{"as_of":"2026-08-16T13:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c107e886619d9c6d7f01b718bf29c0ec376ef3f310a974de18f624dfa058acec","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T17:18:42.960273Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.09169/citation-record","integrity":"/paper/2412.09169/integrity","json":"/paper/2412.09169/citation-record.json","paper":"/paper/2412.09169"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-11T17:18:42.736330Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.736330Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:ff5333ac9479ce61c72f57973efc765e979552b9c65d8e8d20ccbf2749a699a7","observation_id":"6abf3ce1-0fc1-4585-9e66-cade3f1ed61b","resolution":{"observed_at":"2026-08-11T17:18:42.736330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:18:42.741880Z","title":"Emerg- ing properties in self-supervised vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.741880Z"},"links":{"citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:56f2676c4afac13b81ee33b2c9d031ed10c7bec8a11c979076325ec613ba1bef","observation_id":"05091123-4b78-4585-805b-61c7167667a1","resolution":{"observed_at":"2026-08-11T17:18:42.741880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:18:43.658544Z","title":"Muse: Text- to-image generation via masked generative transformers.Pro- ceedings of the 40th International Conference on Machine Learning, 202, 2023","venue":null,"work_id":"98d7b314-c322-4d44-83b0-c8157e299265","year":2023},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.746950Z"},"links":{"citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:60a25c5a6740e14e3c88ebb59bda8746ee681ba2e141fdd35d5c1454db7edf93","observation_id":"f55e3cce-729b-4734-a5aa-c94d0d73a681","resolution":{"observed_at":"2026-08-11T17:18:43.662764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-11T17:18:42.751715Z","title":"An image is worth 16x16 words: Trans- formers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.751715Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:ea8c49ea8f7cb5ca2519edbddbe136dcd824b14021e9f15185ce435f6ee38c72","observation_id":"c39e965c-c7e6-467d-82a6-427ecabe59d6","resolution":{"observed_at":"2026-08-11T17:18:42.751715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01618","last_updated":"2022-08-02T17:50:36Z","snapshot_observed_at":"2026-08-02T23:40:32.342515Z","submitted_at":"2022-08-02T17:50:36Z","title":"An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01618","snapshot_observed_at":"2026-08-11T17:18:42.756144Z","title":"An image is worth one word: Personalizing text-to- image generation using textual inversion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.756144Z"},"links":{"cited_paper":"/paper/2208.01618","citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:c50b069452eec0e3e8f6bae933631d831e51fa54a9b428bbc14897427ff341eb","observation_id":"dd103b17-723e-4290-a97a-a3dab91d6054","resolution":{"observed_at":"2026-08-11T17:18:42.756144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.01241","last_updated":"2018-03-06T06:15:46Z","snapshot_observed_at":"2026-08-14T19:49:02.864746Z","submitted_at":"2018-02-05T02:42:40Z","title":"Semantic projection: recovering human knowledge of multiple, distinct object features from word embeddings","version":2},"cited_work":{"arxiv_id":"1802.01241","doi":null,"metadata_source":"pith","pith_arxiv_id":"1802.01241","snapshot_observed_at":"2026-08-11T17:18:43.314088Z","title":"Semantic projection: recovering human knowledge of multiple, distinct object features from word embeddings","venue":"cs.CL","work_id":"147f8125-a6ae-4c37-8d29-03f59d89e4b8","year":2018},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.761501Z"},"links":{"cited_paper":"/paper/1802.01241","citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:a776b54f780d8e8ad73571c74db5808912b4f1ccae2afad77aff200b63476303","observation_id":"3e2065f8-880a-4439-b594-0c319622c675","resolution":{"observed_at":"2026-08-11T17:18:43.319204Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:18:43.645317Z","title":"Diffusion with offset noise","venue":null,"work_id":"3961acdf-1a87-4d31-be6a-fb118e253736","year":2023},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.766715Z"},"links":{"citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:118e3e44043cbb5482b0759ef61c70e5d5a462be2f9ebfbd4d1807a93f7fa31b","observation_id":"2210236e-35e6-4444-b19c-cc8f9f8c091c","resolution":{"observed_at":"2026-08-11T17:18:43.649800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:18:43.631344Z","title":"Svdiff: Compact parame- ter space for diffusion fine-tuning","venue":null,"work_id":"ee7b995c-440e-4ef5-9764-ff4b1ffa7870","year":2023},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.771653Z"},"links":{"citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:c638f88816d967089a39515a134a79ec17eb2fbbc6ec891e66453fac3cfe0e7d","observation_id":"9dfc8f43-1fdc-4076-b008-308d32662fc9","resolution":{"observed_at":"2026-08-11T17:18:43.636005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-08-11T17:18:42.775570Z","title":"Prompt-to-prompt im- age editing with cross attention control","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.775570Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:98d2369daae9d7c246eaa56c09d93adb0c2571629424fc91cb29afec4382c1dd","observation_id":"63c368b0-50b7-493a-9960-4bb07f209e24","resolution":{"observed_at":"2026-08-11T17:18:42.775570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:18:43.617076Z","title":"Style aligned image generation via shared at- tention","venue":null,"work_id":"cce390fc-7a34-422b-8741-762d11d802f9","year":null},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.779634Z"},"links":{"citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:cc4368be8e1aa702d6d1f00586a0ba6df6766c6b9be00d40fd9fd9fc020600b5","observation_id":"49e03aab-9ede-4888-8791-208be8bba359","resolution":{"observed_at":"2026-08-11T17:18:43.622142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-08-14T06:37:15.299690Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-11T17:18:42.783630Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.783630Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:415952c9351f367a65b9358204b8478280918cca119a17e880bb58853d9bcc40","observation_id":"72e7401d-0db1-4cc9-9367-ee023af79602","resolution":{"observed_at":"2026-08-11T17:18:42.783630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:18:43.602580Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":"f98efa64-b7f5-466c-ad4b-95447c97ab45","year":2020},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.788059Z"},"links":{"citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:a41e1c74df441557a4ef0b8465caec167d04c79eeecd83a8373957ae0e91b13b","observation_id":"51f3ba18-c26f-4e0a-b0a9-2bfcb89acbf0","resolution":{"observed_at":"2026-08-11T17:18:43.607645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:18:42.791842Z","title":"Parameter-efficient transfer learning for nlp","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.791842Z"},"links":{"citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:cd46d4e14210c16333d6ed77d3fa5f391188d24092d982047ea20df684aac7b2","observation_id":"1cb55a0e-eaf0-4361-bf05-e74ea142e237","resolution":{"observed_at":"2026-08-11T17:18:42.791842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-11T17:18:42.795390Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.795390Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:1ff98bd03d3e38896e32a7deb1c5f3dbbc749ba07a099873ee208b551b3db8dd","observation_id":"8d681222-4bd6-46c6-8701-b4d1093c7ad2","resolution":{"observed_at":"2026-08-11T17:18:42.795390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12974","last_updated":"2024-02-21T14:04:30Z","snapshot_observed_at":"2026-08-13T04:14:33.642585Z","submitted_at":"2024-02-20T12:51:17Z","title":"Visual Style Prompting with Swapping Self-Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12974","snapshot_observed_at":"2026-08-11T17:18:42.799488Z","title":"Visual style prompting with swapping self- attention","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.799488Z"},"links":{"cited_paper":"/paper/2402.12974","citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:425ca9f851e1ca0bc681ae8ed93bce69ae7b59dd3757fb1469ccd150eff9154a","observation_id":"4f866657-1142-4578-acc2-8e8496cf47c0","resolution":{"observed_at":"2026-08-11T17:18:42.799488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:18:42.804179Z","title":"Pick-a-pic: An open dataset of user preferences for text-to-image generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.804179Z"},"links":{"citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:78ae33abc078d2d3786d1a8518fb74a0ff7224c6badbba0c5c8ee1ca964ce4b1","observation_id":"777d0831-162a-49f8-9146-c6f3a1c151cb","resolution":{"observed_at":"2026-08-11T17:18:42.804179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:18:43.571940Z","title":"The singular value decompo- sition: Its computation and some applications","venue":null,"work_id":"6207a1a5-05e1-4a5a-afd5-5419fb1f1625","year":1980},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.808747Z"},"links":{"citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:44b0eaaa7ea0b636436910b02fa342a8ad2eb68669d7a8688c84829aa265b2c1","observation_id":"bf6c9dc0-fec1-489c-95e2-59d9e3f4674e","resolution":{"observed_at":"2026-08-11T17:18:43.576424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:18:43.558373Z","title":"Multi-concept customization of text- to-image diffusion","venue":null,"work_id":"14d40001-3800-47c6-9392-1e4833f2d721","year":1931},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.812864Z"},"links":{"citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:5563e1811461b2f1fbafdaa78626afd3380cdc3b0b971a453346a74c31a7e24b","observation_id":"d2dd89bc-c3dd-4254-b222-37e289ec3394","resolution":{"observed_at":"2026-08-11T17:18:43.562821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12004","last_updated":"2024-12-12T05:02:42Z","snapshot_observed_at":"2026-08-13T13:26:51.378301Z","submitted_at":"2024-02-19T09:52:41Z","title":"Direct Consistency Optimization for Robust Customization of Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12004","snapshot_observed_at":"2026-08-11T17:18:42.817196Z","title":"Direct consistency optimization for compositional text- to-image personalization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.817196Z"},"links":{"cited_paper":"/paper/2402.12004","citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:dd26be38a514b5e17ce0e0e3b43eb9b1738affd4a127d26cb4cacfd5a2ecbe0a","observation_id":"8b1c45a7-4a7f-4eb8-b6c2-dff7110c0b72","resolution":{"observed_at":"2026-08-11T17:18:42.817196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08691","last_updated":"2021-09-02T17:34:41Z","snapshot_observed_at":"2026-08-06T15:24:34.790850Z","submitted_at":"2021-04-18T03:19:26Z","title":"The Power of Scale for Parameter-Efficient Prompt Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08691","snapshot_observed_at":"2026-08-11T17:18:42.821680Z","title":"The power of scale for parameter-efficient prompt tuning.arXiv preprint arXiv:2104.08691, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.821680Z"},"links":{"cited_paper":"/paper/2104.08691","citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:2c2e43a3273a7b076726ded0e874095515006663d36e9e939583499eee5fc656","observation_id":"7e8f2be3-ff63-4f17-8430-4ef8ba0dae76","resolution":{"observed_at":"2026-08-11T17:18:42.821680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05375","last_updated":"2024-02-08T03:15:06Z","snapshot_observed_at":"2026-08-13T04:23:45.243057Z","submitted_at":"2024-02-08T03:15:06Z","title":"Get What You Want, Not What You Don't: Image Content Suppression for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05375","snapshot_observed_at":"2026-08-11T17:18:42.826025Z","title":"Get what you want, not what you don’t: Image content suppression for text- to-image diffusion models.arXiv preprint arXiv:2402.05375,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.826025Z"},"links":{"cited_paper":"/paper/2402.05375","citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:c304b4d3602f32e5c2904ceaa4c80b4466c31ca134da634d56e65862be1d6115","observation_id":"00959386-1a3f-4f0d-b0d1-3e0f06d1463e","resolution":{"observed_at":"2026-08-11T17:18:42.826025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.07602","last_updated":"2022-03-20T15:13:08Z","snapshot_observed_at":"2026-08-14T08:27:33.738990Z","submitted_at":"2021-10-14T17:58:47Z","title":"P-Tuning v2: Prompt Tuning Can Be Comparable to Fine-tuning Universally Across Scales and Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.07602","snapshot_observed_at":"2026-08-11T17:18:42.830811Z","title":"P-tuning v2: Prompt tuning can be comparable to fine-tuning universally across scales and tasks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.830811Z"},"links":{"cited_paper":"/paper/2110.07602","citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:c46866c7ef0ffa225e847ccbc2a2d2bd212421fcac495a4e83905acb697baeaa","observation_id":"c05a419f-5f39-483f-9232-156f1ada8828","resolution":{"observed_at":"2026-08-11T17:18:42.830811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:18:42.835623Z","title":"Gpt understands, too","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.835623Z"},"links":{"citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:32b5d74887fe0155f5d4674bba958faba09fa99e0f9d36c4cfcf41ca60988a0b","observation_id":"4fff388b-3814-4a2f-9fd3-303361462914","resolution":{"observed_at":"2026-08-11T17:18:42.835623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:18:43.536081Z","title":"Locating and editing factual associations in gpt","venue":null,"work_id":"30ca25d6-53f7-4c51-9413-23bf04ca0bc3","year":2022},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.839716Z"},"links":{"citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:be37632eef3f79804cc415723694938711d5a81e1837177d17c704cdf62a113b","observation_id":"d55225e2-64ca-498f-9808-568dc03e7afc","resolution":{"observed_at":"2026-08-11T17:18:43.540908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16807","last_updated":"2024-12-10T14:52:10Z","snapshot_observed_at":"2026-08-14T11:31:43.329403Z","submitted_at":"2023-05-26T10:41:08Z","title":"Negative-prompt Inversion: Fast Image Inversion for Editing with Text-guided Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16807","snapshot_observed_at":"2026-08-11T17:18:42.844374Z","title":"Negative-prompt inversion: Fast image inversion for editing with text-guided diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.844374Z"},"links":{"cited_paper":"/paper/2305.16807","citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:f5dc5e56ce6bb2815f15a631039a23d8497c22b0e0aa69c55e3328588af51c51","observation_id":"74bdf3c0-7d46-4625-8175-69924779c337","resolution":{"observed_at":"2026-08-11T17:18:42.844374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:18:43.523444Z","title":"Null-text inversion for editing real im- ages using guided diffusion models","venue":null,"work_id":"58eb3617-7658-46a9-b9e0-cda4d1441f82","year":2023},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.849165Z"},"links":{"citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:2339d3dcb2dc58a0181846bd4aaf35e41531b4d50e8f3cc593e059da99bb14a0","observation_id":"e1c54c64-d54c-4141-a1a4-a31dd0a10bdf","resolution":{"observed_at":"2026-08-11T17:18:43.527476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-11T10:12:11.384939Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-11T17:18:42.853497Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.853497Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:a2f8820f55d85ebd010908d629ed165d3db07853751d26af51740efdd957a762","observation_id":"02a3ed75-00bf-44b5-ab22-d1ce648a7913","resolution":{"observed_at":"2026-08-11T17:18:42.853497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.11565","last_updated":"2024-05-06T16:29:15Z","snapshot_observed_at":"2026-08-13T00:28:01.808023Z","submitted_at":"2024-04-17T17:08:05Z","title":"MoA: Mixture-of-Attention for Subject-Context Disentanglement in Personalized Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.11565","snapshot_observed_at":"2026-08-11T17:18:42.857795Z","title":"Moa: Mixture-of-attention for subject-context 9 disentanglement in personalized image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.857795Z"},"links":{"cited_paper":"/paper/2404.11565","citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:6cf3178692077228b1f00e1add4070e31424571a1a543930bb447722f926284e","observation_id":"c4578e8d-d70f-450d-8483-200b4edb2aef","resolution":{"observed_at":"2026-08-11T17:18:42.857795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01808","last_updated":"2024-01-03T16:10:07Z","snapshot_observed_at":"2026-08-13T04:49:30.634300Z","submitted_at":"2024-01-03T16:10:07Z","title":"aMUSEd: An Open MUSE Reproduction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01808","snapshot_observed_at":"2026-08-11T17:18:42.862315Z","title":"amused: An open muse reproduction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.862315Z"},"links":{"cited_paper":"/paper/2401.01808","citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:cee82441a79362aa0e619505e8cff14734c4994545234a036da8517534874cde","observation_id":"676a9f49-a4ff-4d54-a988-f38ce2ee79a0","resolution":{"observed_at":"2026-08-11T17:18:42.862315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-08-14T22:54:08.184266Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-11T17:18:42.866617Z","title":"Sdxl: Improving latent diffusion models for high- resolution image synthesis.arXiv preprint arXiv:2307.01952,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.866617Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:e2544d7f35439b1511d15b458ff969a1d0f132768f8a2a675a2ea84957d7b5bd","observation_id":"fdc1c4d8-e749-43d0-8166-55a4d1f49aa0","resolution":{"observed_at":"2026-08-11T17:18:42.866617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:18:43.510731Z","title":"Feature projection for im- proved text classification","venue":null,"work_id":"b397f66f-4c8d-4115-aa07-9d412eab739b","year":2020},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.871900Z"},"links":{"citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:89d49dbcbef3df8ee5271e2cfa7cdfc98d3da9f953d5a6e58cf3374dea5be240","observation_id":"d3d0f6f0-d675-49d2-ab6f-2bc5167874cf","resolution":{"observed_at":"2026-08-11T17:18:43.514590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:18:42.875697Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.875697Z"},"links":{"citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:92ee3f29e899878ccc6e1f624f30be0627da8799b1f617576e8662a942abbee0","observation_id":"0b38a6b1-12ff-4cf4-88c5-cb113e756f2e","resolution":{"observed_at":"2026-08-11T17:18:42.875697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:18:43.488610Z","title":"Direct prefer- ence optimization: Your language model is secretly a reward model","venue":null,"work_id":"759824e2-5047-4251-959d-a60fe264e671","year":2024},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.879365Z"},"links":{"citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:6aa4003885f9343dcca317e1e5ad541b7df5fa06b231371dee36b772549bcd64","observation_id":"f5689a00-1975-40be-b09a-3d64e1f806d0","resolution":{"observed_at":"2026-08-11T17:18:43.492994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:18:43.475148Z","title":"Zero-shot text-to-image generation","venue":null,"work_id":"16175eac-f0b7-4ca9-b31b-ab3d3fbc46c9","year":2021},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.883037Z"},"links":{"citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:ce8c994994fdceb27ad9e580d2c2912ac2329077995a4a92c02a59a01ff5f17c","observation_id":"1d892600-5cab-4830-a8be-3dbe3726e769","resolution":{"observed_at":"2026-08-11T17:18:43.479611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:18:42.886957Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.886957Z"},"links":{"citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:b10a26cb5e241a8efd12736f426329be4a15949e3fcb6a007da5368e024bf740","observation_id":"a6cb3673-0a9a-43cf-8bb2-ecc58e470d1d","resolution":{"observed_at":"2026-08-11T17:18:42.886957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:18:42.891065Z","title":"U- net: Convolutional networks for biomedical image segmen- tation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.891065Z"},"links":{"citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:c3279df0e242f5693841296df046daa9d7bf19be21000c4282ab0b5602c09664","observation_id":"66e33ff0-8ee6-4f80-8795-7ccde0e921e5","resolution":{"observed_at":"2026-08-11T17:18:42.891065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:18:42.895647Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven gen- eration","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.895647Z"},"links":{"citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:095bc588a6d3c938ce7d7b8fc75655395fd800605fd16797616f663c03c207a3","observation_id":"de6fd442-b8ea-455f-91e2-a160ca798d38","resolution":{"observed_at":"2026-08-11T17:18:42.895647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:18:43.435171Z","title":"Photorealistic text-to-image diffusion models with deep lan- guage understanding","venue":null,"work_id":"3d6f11ff-26bc-4af3-8401-3b8efc9bab99","year":2022},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.900298Z"},"links":{"citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:be0811ea6e81e27400f89f1cc58424b70c4205bb6f81ea3b618c9f03089efdc4","observation_id":"e572aa89-8684-4c05-b7f8-b4adffcb920b","resolution":{"observed_at":"2026-08-11T17:18:43.440114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:18:43.421362Z","title":"Zur theorie der linearen und nichtlinearen in- tegralgleichungen","venue":null,"work_id":"6ab1a185-f73e-4a5e-9a4d-ff26800add0e","year":null},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.905441Z"},"links":{"citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:39541f8e795cc298cb252f1458d80719c1775dc578ac46bf993f26820fd3d0dc","observation_id":"4f8af555-6a95-4022-92f4-e9ed39ebeba1","resolution":{"observed_at":"2026-08-11T17:18:43.425796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:18:43.407395Z","title":"Ziplora: Any subject in any style by effectively merging loras","venue":null,"work_id":"a2e87887-28ff-45a2-b17d-4e134b4606bf","year":null},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.909614Z"},"links":{"citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:9c2e3231a24b6d5dabd93a128bb3278fb154efc45a39e68f71f023d5088cf43f","observation_id":"0750f039-16f0-4555-b4ea-fbc9c4d2584b","resolution":{"observed_at":"2026-08-11T17:18:43.412066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:18:43.393899Z","title":"Ziplora-pytorch","venue":null,"work_id":"499183ac-4a7e-4bb1-bedb-99271b7d07fe","year":2023},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.913820Z"},"links":{"citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:32317f3c4b914ac359a41178758e608bbad648bf509cc415ccb7968c000a819e","observation_id":"b8fdf0a2-be5f-44e5-baae-3df02cd10ac9","resolution":{"observed_at":"2026-08-11T17:18:43.398157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00983","last_updated":"2023-06-01T17:59:51Z","snapshot_observed_at":"2026-08-13T11:26:59.145106Z","submitted_at":"2023-06-01T17:59:51Z","title":"StyleDrop: Text-to-Image Generation in Any Style","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00983","snapshot_observed_at":"2026-08-11T17:18:42.917951Z","title":"Styledrop: Text-to-image genera- tion in any style","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.917951Z"},"links":{"cited_paper":"/paper/2306.00983","citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:829d8d3857a438cbb6b7fdc5fe272ae63cd7c305ccc80898f286277f42937803","observation_id":"718beb27-dfed-4846-a386-29fc6264763a","resolution":{"observed_at":"2026-08-11T17:18:42.917951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01292","last_updated":"2024-04-01T17:58:30Z","snapshot_observed_at":"2026-08-14T16:35:20.677319Z","submitted_at":"2024-04-01T17:58:30Z","title":"Measuring Style Similarity in Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01292","snapshot_observed_at":"2026-08-11T17:18:42.922747Z","title":"Measuring style similarity in diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.922747Z"},"links":{"cited_paper":"/paper/2404.01292","citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:200ecaaed3147636f6907fb4eb861a2f93b946d8592335810b40fe138d691b2e","observation_id":"7969f504-7463-4116-882a-6f7a5f3ceeab","resolution":{"observed_at":"2026-08-11T17:18:42.922747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-11T17:18:42.927229Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.927229Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:bc49d3bcd95b3168f43cf93eb93e388ff170289d5ef56ba945ed5beb083fb69f","observation_id":"dae98b86-35cd-4732-9eb8-1997f5aed2df","resolution":{"observed_at":"2026-08-11T17:18:42.927229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:18:42.931515Z","title":"Key-locked rank one editing for text-to-image personaliza- tion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.931515Z"},"links":{"citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:36bcf1c7b901ea830df6e3265b77bfced264633061a2ea4be291f64a7164b99e","observation_id":"59c0369f-6034-4c70-ad78-6993721ffc7d","resolution":{"observed_at":"2026-08-11T17:18:42.931515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09341","last_updated":"2023-09-25T08:19:23Z","snapshot_observed_at":"2026-08-14T02:46:25.655503Z","submitted_at":"2023-06-15T17:59:31Z","title":"Human Preference Score v2: A Solid Benchmark for Evaluating Human Preferences of Text-to-Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09341","snapshot_observed_at":"2026-08-11T17:18:42.935498Z","title":"Human preference score v2: A solid benchmark for evaluating human preferences of text-to-image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.935498Z"},"links":{"cited_paper":"/paper/2306.09341","citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:bcbbe484e98ef74664fe818c538882c9f427e721121baf23a40cea9eab11f88f","observation_id":"9a7f870d-33c9-48d5-bd0b-4518e9775c45","resolution":{"observed_at":"2026-08-11T17:18:42.935498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10431","last_updated":"2023-05-21T17:26:40Z","snapshot_observed_at":"2026-08-13T11:40:03.276753Z","submitted_at":"2023-05-17T17:59:55Z","title":"FastComposer: Tuning-Free Multi-Subject Image Generation with Localized Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10431","snapshot_observed_at":"2026-08-11T17:18:42.939817Z","title":"Fastcomposer: Tuning-free multi- subject image generation with localized attention","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.939817Z"},"links":{"cited_paper":"/paper/2305.10431","citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:2f0160933b3b270448f129126c2468c76f4ad65602c8461d668ba48557ceae94","observation_id":"da8f07e6-340f-41e9-bd3a-caec96071194","resolution":{"observed_at":"2026-08-11T17:18:42.939817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19456","last_updated":"2024-03-31T13:26:11Z","snapshot_observed_at":"2026-08-14T15:58:45.061949Z","submitted_at":"2024-03-28T14:27:36Z","title":"Break-for-Make: Modular Low-Rank Adaptations for Composable Content-Style Customization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19456","snapshot_observed_at":"2026-08-11T17:18:42.944369Z","title":"Break-for-make: Modular low-rank adaptations for composable content-style customization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.944369Z"},"links":{"cited_paper":"/paper/2403.19456","citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:03359616ec9cf78e38ebd9f4c2d4ff4c971da47e9375426c892c299344b52747","observation_id":"07efa52e-cdb8-43d5-b20a-d8e52f008886","resolution":{"observed_at":"2026-08-11T17:18:42.944369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-11T17:18:42.948743Z","title":"Ip- adapter: Text compatible image prompt adapter for text-to- image diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.948743Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:cc4280fbf8e4f2c464fe8950d173502ada4e189ef0a5342c769eb72ed9ee05e8","observation_id":"5468fdb8-a940-44f4-a6d3-3302d7243a0e","resolution":{"observed_at":"2026-08-11T17:18:42.948743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14007","last_updated":"2024-04-22T09:16:25Z","snapshot_observed_at":"2026-08-14T04:46:25.368906Z","submitted_at":"2024-04-22T09:16:25Z","title":"Infusion: Preventing Customized Text-to-Image Diffusion from Overfitting","version":1},"cited_work":{"arxiv_id":"2404.14007","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.14007","snapshot_observed_at":"2026-08-11T17:18:43.010871Z","title":"Infusion: Preventing Customized Text-to-Image Diffusion from Overfitting","venue":"cs.CV","work_id":"4f07c769-5ef6-416b-9912-24eb64c61cf2","year":2024},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.952636Z"},"links":{"cited_paper":"/paper/2404.14007","citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:a7fc1472559ad4bd4547b9e84ac2a796dedcc84ecddc4a49ae0db71d6d66a8e5","observation_id":"70a9245d-d3b5-4ca8-aba0-be95365187da","resolution":{"observed_at":"2026-08-11T17:18:43.017662Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:18:43.371260Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":"f31ed870-f6a4-49ee-923a-e7b3f51b8f23","year":2023},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.956578Z"},"links":{"citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:ab51d5cc6bbece5dedc5e71c80ddbbd41a5be53967cfed3109d495826306a9d1","observation_id":"8af422e9-968d-43a0-ae02-91bf4f9dfb37","resolution":{"observed_at":"2026-08-11T17:18:43.375303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19967","last_updated":"2024-09-30T05:36:24Z","snapshot_observed_at":"2026-08-16T13:14:16.700372Z","submitted_at":"2024-09-30T05:36:24Z","title":"Magnet: We Never Know How Text-to-Image Diffusion Models Work, Until We Learn How Vision-Language Models Function","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19967","snapshot_observed_at":"2026-08-11T17:18:42.960273Z","title":"in origami style","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T17:18:42.960273Z"},"links":{"cited_paper":"/paper/2409.19967","citing_paper":"/paper/2412.09169"},"observation_digest":"sha256:3a974efddadd7f9b7cc5e6ff81986c51294b8edbc1137e34aa9f5f19f2cae422","observation_id":"a656a0b0-e6e6-4f57-abce-c1c705dc8443","resolution":{"observed_at":"2026-08-11T17:18:42.960273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.09169","last_updated":"2024-12-12T10:59:44Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T20:17:35.625675Z","submitted_at":"2024-12-12T10:59:44Z","title":"DECOR:Decomposition and Projection of Text Embeddings for Text-to-Image Customization"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":33,"verified_exact":2,"verified_fuzzy":17},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 0 inbound Pith citation observations for arXiv:2412.09169."}