{"as_of":"2026-08-22T12:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:96aa8fc67f2df145228681e7185ab87b246a518888d59fe35f6a8585cb40032d","coverage":[{"denominator":15,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T12:13:43.931325Z","state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.14496/citation-record","integrity":"/paper/2412.14496/integrity","json":"/paper/2412.14496/citation-record.json","paper":"/paper/2412.14496"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-11T12:13:43.856512Z","title":"Ip-adapter: Text compatible image prompt adapter for text-to-image diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14496","last_updated":"2025-04-12T15:23:37Z","snapshot_observed_at":"2026-08-20T00:37:32.259826Z","submitted_at":"2024-12-19T03:42:58Z","title":"WikiStyle+: A Multimodal Approach to Content-Style Representation Disentanglement for Artistic Image Stylization","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T12:13:43.856512Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2412.14496"},"observation_digest":"sha256:52764b3d162ae2bd2a2328771c64d7b0d7f9bbd5875c62e3f766d4b850050a4f","observation_id":"ad370e98-7735-440f-a75e-308821a12b13","resolution":{"observed_at":"2026-08-11T12:13:43.856512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00983","last_updated":"2023-06-01T17:59:51Z","snapshot_observed_at":"2026-08-19T11:34:19.126799Z","submitted_at":"2023-06-01T17:59:51Z","title":"StyleDrop: Text-to-Image Generation in Any Style","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00983","snapshot_observed_at":"2026-08-11T12:13:43.881910Z","title":"Styledrop: Text-to-image generation in any style","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14496","last_updated":"2025-04-12T15:23:37Z","snapshot_observed_at":"2026-08-20T00:37:32.259826Z","submitted_at":"2024-12-19T03:42:58Z","title":"WikiStyle+: A Multimodal Approach to Content-Style Representation Disentanglement for Artistic Image Stylization","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T12:13:43.881910Z"},"links":{"cited_paper":"/paper/2306.00983","citing_paper":"/paper/2412.14496"},"observation_digest":"sha256:902aa080d424550b13886094136fd862529e289a4b0a4ddfb8632157ab57854a","observation_id":"22c5fa3e-ef03-4fbf-ace9-62a9f92df95d","resolution":{"observed_at":"2026-08-11T12:13:43.881910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01618","last_updated":"2022-08-02T17:50:36Z","snapshot_observed_at":"2026-08-20T10:39:03.872570Z","submitted_at":"2022-08-02T17:50:36Z","title":"An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01618","snapshot_observed_at":"2026-08-11T12:13:43.888448Z","title":"An image is worth one word: Personalizing text-to-image generation using textual inversion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14496","last_updated":"2025-04-12T15:23:37Z","snapshot_observed_at":"2026-08-20T00:37:32.259826Z","submitted_at":"2024-12-19T03:42:58Z","title":"WikiStyle+: A Multimodal Approach to Content-Style Representation Disentanglement for Artistic Image Stylization","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T12:13:43.888448Z"},"links":{"cited_paper":"/paper/2208.01618","citing_paper":"/paper/2412.14496"},"observation_digest":"sha256:fd3fe57648b0c623b1ba6b05235719bec0dc031ed5caebb277cb97e74efa7154","observation_id":"ac26a64c-35d8-4a10-80f2-79c2618adaa1","resolution":{"observed_at":"2026-08-11T12:13:43.888448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.09778","last_updated":"2023-02-22T02:14:55Z","snapshot_observed_at":"2026-08-22T02:33:31.033919Z","submitted_at":"2023-02-20T05:48:41Z","title":"Composer: Creative and Controllable Image Synthesis with Composable Conditions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.09778","snapshot_observed_at":"2026-08-11T12:13:43.894311Z","title":"Composer: Creative and controllable image synthesis with composable conditions","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14496","last_updated":"2025-04-12T15:23:37Z","snapshot_observed_at":"2026-08-20T00:37:32.259826Z","submitted_at":"2024-12-19T03:42:58Z","title":"WikiStyle+: A Multimodal Approach to Content-Style Representation Disentanglement for Artistic Image Stylization","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T12:13:43.894311Z"},"links":{"cited_paper":"/paper/2302.09778","citing_paper":"/paper/2412.14496"},"observation_digest":"sha256:e023934b65bea8a36049c85a3a17377545b9eda586222e842ddc4a2daab888ce","observation_id":"80033cf6-ad8c-4a90-91c7-fe814e85ae79","resolution":{"observed_at":"2026-08-11T12:13:43.894311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01770","last_updated":"2024-10-30T17:05:17Z","snapshot_observed_at":"2026-08-19T14:07:18.191023Z","submitted_at":"2023-09-04T19:16:46Z","title":"StyleAdapter: A Unified Stylized Image Generation Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01770","snapshot_observed_at":"2026-08-11T12:13:43.899836Z","title":"Styleadapter: A single-pass lora-free model for stylized image generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14496","last_updated":"2025-04-12T15:23:37Z","snapshot_observed_at":"2026-08-20T00:37:32.259826Z","submitted_at":"2024-12-19T03:42:58Z","title":"WikiStyle+: A Multimodal Approach to Content-Style Representation Disentanglement for Artistic Image Stylization","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T12:13:43.899836Z"},"links":{"cited_paper":"/paper/2309.01770","citing_paper":"/paper/2412.14496"},"observation_digest":"sha256:542ea7581cb217ce96f554393305be6d86d3e854ef84c09c6956792146020f84","observation_id":"f3a5b4d1-fce9-460b-bb8a-7b73dce147a6","resolution":{"observed_at":"2026-08-11T12:13:43.899836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12974","last_updated":"2024-02-21T14:04:30Z","snapshot_observed_at":"2026-08-19T14:07:19.717754Z","submitted_at":"2024-02-20T12:51:17Z","title":"Visual Style Prompting with Swapping Self-Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12974","snapshot_observed_at":"2026-08-11T12:13:43.904988Z","title":"Visual style prompting with swapping self-attention","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14496","last_updated":"2025-04-12T15:23:37Z","snapshot_observed_at":"2026-08-20T00:37:32.259826Z","submitted_at":"2024-12-19T03:42:58Z","title":"WikiStyle+: A Multimodal Approach to Content-Style Representation Disentanglement for Artistic Image Stylization","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T12:13:43.904988Z"},"links":{"cited_paper":"/paper/2402.12974","citing_paper":"/paper/2412.14496"},"observation_digest":"sha256:053907d3e0ba30f54d76b583d9d4d5c6d3b0c24b2683dcae9fd37254e19ef4b6","observation_id":"13510a2b-7512-454e-8faf-3f01a5400b68","resolution":{"observed_at":"2026-08-11T12:13:43.904988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02733","last_updated":"2024-04-04T19:42:32Z","snapshot_observed_at":"2026-08-16T14:03:57.454330Z","submitted_at":"2024-04-03T13:34:09Z","title":"InstantStyle: Free Lunch towards Style-Preserving in Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02733","snapshot_observed_at":"2026-08-11T12:13:43.910316Z","title":"Instantstyle: Free lunch towards style-preserving in text-to-image generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14496","last_updated":"2025-04-12T15:23:37Z","snapshot_observed_at":"2026-08-20T00:37:32.259826Z","submitted_at":"2024-12-19T03:42:58Z","title":"WikiStyle+: A Multimodal Approach to Content-Style Representation Disentanglement for Artistic Image Stylization","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T12:13:43.910316Z"},"links":{"cited_paper":"/paper/2404.02733","citing_paper":"/paper/2412.14496"},"observation_digest":"sha256:b3ad2cfa3c1f9f04564d3d50df1e8bd241aecccfd787acef0ea2b72fb317e8f6","observation_id":"8f6f19f8-f5b6-4af1-94ef-e8f272d7df22","resolution":{"observed_at":"2026-08-11T12:13:43.910316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15842","last_updated":"2025-08-27T10:30:27Z","snapshot_observed_at":"2026-08-19T08:33:41.042420Z","submitted_at":"2024-07-22T17:58:05Z","title":"DiffArtist: Towards Structure and Appearance Controllable Image Stylization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15842","snapshot_observed_at":"2026-08-11T12:13:43.926164Z","title":"Artist: Aesthetically controllable text-driven stylization without training","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14496","last_updated":"2025-04-12T15:23:37Z","snapshot_observed_at":"2026-08-20T00:37:32.259826Z","submitted_at":"2024-12-19T03:42:58Z","title":"WikiStyle+: A Multimodal Approach to Content-Style Representation Disentanglement for Artistic Image Stylization","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T12:13:43.926164Z"},"links":{"cited_paper":"/paper/2407.15842","citing_paper":"/paper/2412.14496"},"observation_digest":"sha256:2f03ded70894be2e92add0e6894694345ce9b936d4a068d12f1f8e4a3ed769f0","observation_id":"403ec5fd-2dc2-4ef1-be98-a266c2961763","resolution":{"observed_at":"2026-08-11T12:13:43.926164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.12092","last_updated":"2021-02-26T23:26:05Z","snapshot_observed_at":"2026-07-06T10:44:09.403787Z","submitted_at":"2021-02-24T06:42:31Z","title":"Zero-Shot Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.12092","snapshot_observed_at":"2026-08-11T12:13:43.931325Z","title":"Namhyuk Ahn, Junsoo Lee, Chunggi Lee, Kunhee Kim, Daesik Kim, Seung-Hun Nam, and Kibeom Hong","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14496","last_updated":"2025-04-12T15:23:37Z","snapshot_observed_at":"2026-08-20T00:37:32.259826Z","submitted_at":"2024-12-19T03:42:58Z","title":"WikiStyle+: A Multimodal Approach to Content-Style Representation Disentanglement for Artistic Image Stylization","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T12:13:43.931325Z"},"links":{"cited_paper":"/paper/2102.12092","citing_paper":"/paper/2412.14496"},"observation_digest":"sha256:249eb79ba96e13bc5ae22dafd4149b8b0e4e3b0c072bea02e52bb645bf5e203d","observation_id":"7721fd55-6403-4212-aa69-c8188b473bcf","resolution":{"observed_at":"2026-08-11T12:13:43.931325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-08-14T06:37:15.299690Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-11T12:13:43.921324Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14496","last_updated":"2025-04-12T15:23:37Z","snapshot_observed_at":"2026-08-20T00:37:32.259826Z","submitted_at":"2024-12-19T03:42:58Z","title":"WikiStyle+: A Multimodal Approach to Content-Style Representation Disentanglement for Artistic Image Stylization","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-11T12:13:43.921324Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2412.14496"},"observation_digest":"sha256:baff922994dfab5c1a3d190aaf8e0fd8cfe37799ea7f553fb903d1b9d7ee3abb","observation_id":"6401c6a1-d458-411d-965a-4bd90cd1c58c","resolution":{"observed_at":"2026-08-11T12:13:43.921324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.00937","last_updated":"2018-05-30T14:58:27Z","snapshot_observed_at":"2026-08-14T20:17:29.355571Z","submitted_at":"2017-11-02T21:14:44Z","title":"Neural Discrete Representation Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.00937","snapshot_observed_at":"2026-08-11T12:13:43.915523Z","title":"I Loshchilov","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14496","last_updated":"2025-04-12T15:23:37Z","snapshot_observed_at":"2026-08-20T00:37:32.259826Z","submitted_at":"2024-12-19T03:42:58Z","title":"WikiStyle+: A Multimodal Approach to Content-Style Representation Disentanglement for Artistic Image Stylization","version":2},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-11T12:13:43.915523Z"},"links":{"cited_paper":"/paper/1711.00937","citing_paper":"/paper/2412.14496"},"observation_digest":"sha256:4eed1efea3707a192dd7a981d761b63f945e026016b15def3ba90a4f47823c1a","observation_id":"cb939296-75fe-4b18-9e18-231aa1953d65","resolution":{"observed_at":"2026-08-11T12:13:43.915523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-11T12:13:43.869558Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.14496","last_updated":"2025-04-12T15:23:37Z","snapshot_observed_at":"2026-08-20T00:37:32.259826Z","submitted_at":"2024-12-19T03:42:58Z","title":"WikiStyle+: A Multimodal Approach to Content-Style Representation Disentanglement for Artistic Image Stylization","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-11T12:13:43.869558Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2412.14496"},"observation_digest":"sha256:21e05255989281d8beab7994e48a857dbd9ca8b5d3682ba1fa34bc0295eb4ab2","observation_id":"a8e4ac87-5e41-4319-b3e3-44fb89be4ae8","resolution":{"observed_at":"2026-08-11T12:13:43.869558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-08-15T12:50:58.405488Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-11T12:13:43.849877Z","title":"Hierarchical text-conditional image generation with clip latents","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14496","last_updated":"2025-04-12T15:23:37Z","snapshot_observed_at":"2026-08-20T00:37:32.259826Z","submitted_at":"2024-12-19T03:42:58Z","title":"WikiStyle+: A Multimodal Approach to Content-Style Representation Disentanglement for Artistic Image Stylization","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-11T12:13:43.849877Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2412.14496"},"observation_digest":"sha256:3388363c8a1cd5e67d0db78cec2bfe4b00570b52f7f4b8b973e414bb36ce3863","observation_id":"2e5da428-d902-4333-8553-3f5dc51df779","resolution":{"observed_at":"2026-08-11T12:13:43.849877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:13:44.296392Z","title":"Multi-concept customization of text-to-image diffusion","venue":null,"work_id":"c13f07c8-e2fe-44ad-8168-04467760f9b8","year":1931},"citing_paper":{"arxiv_id":"2412.14496","last_updated":"2025-04-12T15:23:37Z","snapshot_observed_at":"2026-08-20T00:37:32.259826Z","submitted_at":"2024-12-19T03:42:58Z","title":"WikiStyle+: A Multimodal Approach to Content-Style Representation Disentanglement for Artistic Image Stylization","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-11T12:13:43.875092Z"},"links":{"citing_paper":"/paper/2412.14496"},"observation_digest":"sha256:0f8f33aff3cae161a28401f099f96f6e5dda0f6db7126a50d8a671c1cda6f910","observation_id":"ff3809b3-acc5-4317-a1a5-2a731be50445","resolution":{"observed_at":"2026-08-11T12:13:44.303674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.16766","last_updated":"2024-09-04T10:42:41Z","snapshot_observed_at":"2026-08-16T13:22:49.816942Z","submitted_at":"2024-08-29T17:59:30Z","title":"CSGO: Content-Style Composition in Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.16766","snapshot_observed_at":"2026-08-11T12:13:43.863557Z","title":"Artadapter: Text-to-image style transfer using multi-level style encoder and explicit adaptation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.14496","last_updated":"2025-04-12T15:23:37Z","snapshot_observed_at":"2026-08-20T00:37:32.259826Z","submitted_at":"2024-12-19T03:42:58Z","title":"WikiStyle+: A Multimodal Approach to Content-Style Representation Disentanglement for Artistic Image Stylization","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-11T12:13:43.863557Z"},"links":{"cited_paper":"/paper/2408.16766","citing_paper":"/paper/2412.14496"},"observation_digest":"sha256:1721be59e9ee40804de72be1f9ed59366176d3184f8cdd3360c6bdc95557a400","observation_id":"9a2eac14-aa96-4d22-9514-37d88ecd3d67","resolution":{"observed_at":"2026-08-11T12:13:43.863557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.14496","last_updated":"2025-04-12T15:23:37Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-20T00:37:32.259826Z","submitted_at":"2024-12-19T03:42:58Z","title":"WikiStyle+: A Multimodal Approach to Content-Style Representation Disentanglement for Artistic Image Stylization"},"reference_resolution":{"displayed":15,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":15},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 0 inbound Pith citation observations for arXiv:2412.14496."}