{"as_of":"2026-08-15T23:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dc182640ca67a0aeb11a1401dc53bc8b9ea18322783688b59d9773ca1345c4a8","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:18:27.747207Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-21T16:57:09.843691Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-21T17:00:24.083090Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"cited_work":{"arxiv_id":"2506.05843","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.05843","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fontadapter: Instant font adaptation in visual text generation","venue":null,"work_id":"df0fd119-0c32-4769-8607-bc47e86ba4ce","year":2025},"citing_paper":{"arxiv_id":"2601.01593","last_updated":"2026-05-18T03:12:58Z","snapshot_observed_at":"2026-08-15T13:25:20.502702Z","submitted_at":"2026-01-04T16:46:13Z","title":"Beyond Patches: Global-aware Autoregressive Model for Multimodal Few-Shot Font Generation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-21T16:57:09.843691Z"},"links":{"cited_paper":"/paper/2506.05843","citing_paper":"/paper/2601.01593"},"observation_digest":"sha256:5876caeb3c49ed83d001259d073864eb97f1dc44af312632492e1dbe3c1dcabd","observation_id":"5d1ce551-f27e-4e6a-ac7b-7e75999575ba","resolution":{"observed_at":"2026-05-21T17:00:24.085772Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.05843/citation-record","integrity":"/paper/2506.05843/integrity","json":"/paper/2506.05843/citation-record.json","paper":"/paper/2506.05843"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:22.895037Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:22.895037Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:d843371a3a9f23df14995509ca8aacf0a66a58fe055fc1982a36231d6e51c068","observation_id":"cf407b36-e325-436d-8e31-ce3d5e7043e0","resolution":{"observed_at":"2026-08-07T10:18:22.895037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:22.946829Z","title":"Flamingo: a visual language model for few-shot learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:22.946829Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:52bbf8dff87b91b73459e9bc3af6c2f635248e78e00e810c4ffa9fe993108701","observation_id":"7ba84408-ff23-444f-8ebe-53431e72e9fb","resolution":{"observed_at":"2026-08-07T10:18:22.946829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-07T10:18:23.032839Z","title":"Qwen-vl: A versatile vision-language model for understanding, localization, text reading, and beyond","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:23.032839Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:7fd6f1d3d73652f9bbb7172d727b703bbe708cf69bf0b87ddaddfa5085484247","observation_id":"b222d6b9-78a7-4048-a0fa-a302411a826a","resolution":{"observed_at":"2026-08-07T10:18:23.032839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:23.097134Z","title":"Improving image generation with better captions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:23.097134Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:2c46b697b2ad55b684280b579f2c6dda90fc7034c392759ebf6ecf02e2170e81","observation_id":"566d6ef1-08e4-4374-a79c-67d735089bc3","resolution":{"observed_at":"2026-08-07T10:18:23.097134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:32.834521Z","title":null,"venue":null,"work_id":"b0af06a3-d7df-4baf-b904-56e15be480c4","year":2024},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:23.152284Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:6e4b0ac87798edeb1232aa29b093ea8b947fcfa6f339086554ef0ccc73a02677","observation_id":"f8591035-8c74-4c96-a3ca-2a4fcec2003c","resolution":{"observed_at":"2026-08-07T10:18:32.967139Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:32.507306Z","title":"Anydoor: Zero-shot object-level image customization","venue":null,"work_id":"6020bed2-80d4-4c4b-baf9-d1a97e91796f","year":2024},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:23.269668Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:9e315028a5b6a6c7032f51c4e6e8d840b42863db5db238f2f8619ba1d053814a","observation_id":"fe72c5d3-c70f-464c-8927-6b2cec1cbe22","resolution":{"observed_at":"2026-08-07T10:18:32.647406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05139","last_updated":"2024-07-29T09:15:33Z","snapshot_observed_at":"2026-08-13T01:07:48.543251Z","submitted_at":"2024-03-08T08:12:18Z","title":"Improving Diffusion Models for Authentic Virtual Try-on in the Wild","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05139","snapshot_observed_at":"2026-08-07T10:18:23.326129Z","title":"Improving diffusion models for virtual try-on","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:23.326129Z"},"links":{"cited_paper":"/paper/2403.05139","citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:a1a26aa483c5f77ed725b758fa4482550e10728ce6fdf8c3550031652c6b0ec9","observation_id":"2b357bff-da75-4e72-b332-0e986f6b3be0","resolution":{"observed_at":"2026-08-07T10:18:23.326129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:32.264092Z","title":"Deepfloyd if","venue":null,"work_id":"82fafbd6-b341-4172-8bd8-e3b6cd108f41","year":2023},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:23.405012Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:73b785e06a8c66d7c29a1fe8dcb8cde8614be8a71cdce10e45b8cf619d45ecb8","observation_id":"65a3cd1a-ab3e-4368-8072-2f889f28768b","resolution":{"observed_at":"2026-08-07T10:18:32.349099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:23.523394Z","title":"Scaling rectified flow transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:23.523394Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:093076e3a9dd90fc3a5bdfe9be31c3876f940e75f4dab92301c4372e7fa63d77","observation_id":"4b4d9077-2e1b-487c-aa87-cbf80bbe14a8","resolution":{"observed_at":"2026-08-07T10:18:23.523394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:31.979516Z","title":"Neural transformation fields for arbitrary-styled font generation","venue":null,"work_id":"690e91e8-a346-4be3-96be-c05c937d257e","year":2023},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:23.629289Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:caa60d89f490a6324c1771ecc344d1064c1ed2129c79ded5a7e62b3c2176cc71","observation_id":"3afc96ee-9d9c-48c5-8d9d-bd7b985cc59f","resolution":{"observed_at":"2026-08-07T10:18:32.117832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:31.761854Z","title":"Generate like experts: Multi-stage font generation by incorporating font transfer process into diffusion models","venue":null,"work_id":"c43aef58-5a07-4fad-97f7-6677f2458157","year":2024},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:23.757232Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:486f047390d3999f4b2628a4138fb436a35fb02892baf7d09c8df8abbb2f917e","observation_id":"39087e48-1123-48fb-a956-7ea0f7d3159d","resolution":{"observed_at":"2026-08-07T10:18:31.864092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03620","last_updated":"2024-04-04T17:43:06Z","snapshot_observed_at":"2026-08-13T00:37:32.342972Z","submitted_at":"2024-04-04T17:43:06Z","title":"LCM-Lookahead for Encoder-based Text-to-Image Personalization","version":1},"cited_work":{"arxiv_id":"2404.03620","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.03620","snapshot_observed_at":"2026-08-07T10:18:28.078422Z","title":"LCM-Lookahead for Encoder-based Text-to-Image Personalization","venue":"cs.CV","work_id":"0b9437c3-f9d4-4385-9632-0ba3c9cefb8d","year":2024},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:23.877606Z"},"links":{"cited_paper":"/paper/2404.03620","citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:2c14a49ffa8a6c54359106ce35fbc4cc4a6858d2e283024f736d844c43006e10","observation_id":"0cf21ab7-7185-4582-95cd-e850854db39b","resolution":{"observed_at":"2026-08-07T10:18:28.224899Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:31.468945Z","title":"Diff-font: Diffusion model for robust one-shot font generation","venue":null,"work_id":"4424be6f-a450-47eb-b835-3bbba5250ed3","year":2024},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:23.922688Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:448f3e53bd9b5b5ed9e6ce5c2616a1ba832749227cd7364c76193fc77ceda26e","observation_id":"167e1e46-e68b-4c35-bbbc-214e3b95734f","resolution":{"observed_at":"2026-08-07T10:18:31.602955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:31.221643Z","title":"Disenvisioner: Disentangled and enriched visual prompt for customized image generation","venue":null,"work_id":"080bc40e-3dfe-4cb4-9dd8-503cf2fba5fe","year":2024},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:23.973799Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:70e51b41de7d941a3bb427991cc53c1c773587baac5f2b83e7842b73c8b33772","observation_id":"afa786c7-3df6-41d8-a168-d1659182af3b","resolution":{"observed_at":"2026-08-07T10:18:31.357441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13346","last_updated":"2024-09-20T09:21:49Z","snapshot_observed_at":"2026-08-12T22:41:10.585877Z","submitted_at":"2024-09-20T09:21:49Z","title":"Imagine yourself: Tuning-Free Personalized Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13346","snapshot_observed_at":"2026-08-07T10:18:24.053178Z","title":"Imagine yourself: Tuning-free personalized image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:24.053178Z"},"links":{"cited_paper":"/paper/2409.13346","citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:27d77ae7f55e57f6d5390b93426b346dcb1fa7d979a323ef20ad19a5601af23b","observation_id":"be7b4418-3181-44fe-a68d-4de1e6a5efbf","resolution":{"observed_at":"2026-08-07T10:18:24.053178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-07T10:18:24.168081Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:24.168081Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:ac98206178a0a3228a289effe94b62cc5b84aa3fc1dc2154cbe33080e0529e4e","observation_id":"9bb37b66-919b-4d69-9772-8ffb81c976ec","resolution":{"observed_at":"2026-08-07T10:18:24.168081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05568","last_updated":"2023-04-12T02:08:34Z","snapshot_observed_at":"2026-08-15T16:16:14.871415Z","submitted_at":"2023-04-12T02:08:34Z","title":"Improving Diffusion Models for Scene Text Editing with Dual Encoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05568","snapshot_observed_at":"2026-08-07T10:18:24.266308Z","title":"Improving diffusion models for scene text editing with dual encoders","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:24.266308Z"},"links":{"cited_paper":"/paper/2304.05568","citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:78db9a7d84208dded881e0d4dc9606e39d7fa24e5b44bd94de0614bfbfe432f8","observation_id":"cdc8acb7-219c-44d4-b6c8-7f7c196d05d0","resolution":{"observed_at":"2026-08-07T10:18:24.266308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.03001","last_updated":"2022-06-14T12:00:10Z","snapshot_observed_at":"2026-08-13T15:29:03.126754Z","submitted_at":"2022-06-07T04:33:50Z","title":"PP-OCRv3: More Attempts for the Improvement of Ultra Lightweight OCR System","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.03001","snapshot_observed_at":"2026-08-07T10:18:24.400336Z","title":"Pp-ocrv3: More attempts for the improvement of ultra lightweight ocr system","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:24.400336Z"},"links":{"cited_paper":"/paper/2206.03001","citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:c789848b746c0e745b5c017222c0a32c1404d4be673ce7929088a2fcf270c042","observation_id":"f9092ba9-33e4-46f3-a576-7a8304861b78","resolution":{"observed_at":"2026-08-07T10:18:24.400336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:24.517921Z","title":"Blip-diffusion: Pre-trained subject representation for controllable text-to-image generation and editing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:24.517921Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:46999fee4620d26bda89e31a645ecd7fff4d7f84f897d24ee40bbe5f1805f04c","observation_id":"3e7185a3-8f7f-4260-b7cc-9015edb323af","resolution":{"observed_at":"2026-08-07T10:18:24.517921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.03003","last_updated":"2022-09-07T08:59:55Z","snapshot_observed_at":"2026-07-06T13:49:40.974495Z","submitted_at":"2022-09-07T08:59:55Z","title":"Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.03003","snapshot_observed_at":"2026-08-07T10:18:24.638822Z","title":"Flow straight and fast: Learning to generate and transfer data with rectified flow","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:24.638822Z"},"links":{"cited_paper":"/paper/2209.03003","citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:d0643ac150940b05698edf611f18da8f15bf8e92e8c657a3d43ae64b64f6b8b3","observation_id":"5f964f43-7fe7-42aa-8076-b1d6fae8a33e","resolution":{"observed_at":"2026-08-07T10:18:24.638822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10208","last_updated":"2024-07-12T16:26:40Z","snapshot_observed_at":"2026-08-15T21:20:07.894529Z","submitted_at":"2024-06-14T17:44:09Z","title":"Glyph-ByT5-v2: A Strong Aesthetic Baseline for Accurate Multilingual Visual Text Rendering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10208","snapshot_observed_at":"2026-08-07T10:18:24.793669Z","title":"Glyph-byt5-v2: a strong aesthetic baseline for accurate multilingual visual text rendering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:24.793669Z"},"links":{"cited_paper":"/paper/2406.10208","citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:10e8c6d9c209a53881f77d7a050797983e7c8590c542269fd832cb528b74b0b0","observation_id":"bdf97b66-2c0e-47c4-a980-e48bc7fdf0b0","resolution":{"observed_at":"2026-08-07T10:18:24.793669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:30.947133Z","title":"Glyph-byt5: A customized text encoder for accurate visual text rendering","venue":null,"work_id":"d59bd140-aa9a-45a8-9a0d-7e4c41ac02f0","year":2025},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:24.900979Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:f7d773d6aeb6b0985eca6cafd22945b276228a4cf05a177497c4150f5786054d","observation_id":"d61bb771-a85f-414e-99ea-5141ba949ba6","resolution":{"observed_at":"2026-08-07T10:18:31.053286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.01073","last_updated":"2022-01-05T00:07:35Z","snapshot_observed_at":"2026-08-14T03:40:56.071989Z","submitted_at":"2021-08-02T17:59:47Z","title":"SDEdit: Guided Image Synthesis and Editing with Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.01073","snapshot_observed_at":"2026-08-07T10:18:24.999496Z","title":"Sdedit: Guided image synthesis and editing with stochastic differential equations","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:24.999496Z"},"links":{"cited_paper":"/paper/2108.01073","citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:566f8fae8f62843995d7de6de200b32c2421cd258bffe93063f5e025c370184c","observation_id":"9c034c2a-9a01-4d91-b47a-f10ca562d8e2","resolution":{"observed_at":"2026-08-07T10:18:24.999496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:30.720368Z","title":"Dall-e 3: Text-to-image generation model","venue":null,"work_id":"00501e41-8e1a-4d99-8881-e842cfce9f3d","year":2023},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:25.099590Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:abb587ef0fc084f8ca5749428130aec2c747acc9a559d2d7006203a29d316749","observation_id":"652e8b1d-fa50-401b-b033-a23badd5592e","resolution":{"observed_at":"2026-08-07T10:18:30.817747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:30.471814Z","title":"Gpt-4o system card","venue":null,"work_id":"86426aad-4b05-4819-a43d-1263fba84f06","year":2024},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:25.195624Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:25e33e42595ab13347ad5133910e8df6753a6e71452b9453ad5f9c848df5d7fb","observation_id":"0ce709bb-724c-4621-913d-3470cae8f4bb","resolution":{"observed_at":"2026-08-07T10:18:30.600364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:30.193478Z","title":"Few shot font generation via transferring similarity guided global style and quantization local style","venue":null,"work_id":"7421b79e-042e-4b82-a7d0-7318f91ad63b","year":2023},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:25.332020Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:fa1a4e0b73b260323e7bfedddaa33768edb6009d39f1f00dc4a8f74c53ea47bc","observation_id":"39a672e2-6492-45ff-982b-af2ca167cb73","resolution":{"observed_at":"2026-08-07T10:18:30.273828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:25.427823Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:25.427823Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:7a115bdcf9abe48d98a4111b196eedafb334221ffd379731254308652afe542e","observation_id":"18df5ed4-64c2-498b-8182-77abaa28a9fd","resolution":{"observed_at":"2026-08-07T10:18:25.427823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:25.578209Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:25.578209Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:2057922b7326a1b14d104b09b48b7a6073c7137aa624eab355788da68d608955","observation_id":"6758f2d9-115f-4efd-8098-bef23d06f033","resolution":{"observed_at":"2026-08-07T10:18:25.578209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03209","last_updated":"2024-08-27T12:39:18Z","snapshot_observed_at":"2026-08-14T19:49:17.811717Z","submitted_at":"2024-08-06T14:08:22Z","title":"IPAdapter-Instruct: Resolving Ambiguity in Image-based Conditioning using Instruct Prompts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03209","snapshot_observed_at":"2026-08-07T10:18:25.705669Z","title":"Ipadapter-instruct: Resolving ambiguity in image-based conditioning using instruct prompts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:25.705669Z"},"links":{"cited_paper":"/paper/2408.03209","citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:b9592bd6ef9c8f8ea520787aea4582a98ae56fe2891b4b73cedbae58ec1a900c","observation_id":"0aff2bb7-0a4f-445f-a793-460bfc19a5fa","resolution":{"observed_at":"2026-08-07T10:18:25.705669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:25.794557Z","title":"Photorealistic text-to-image diffusion models with deep language understanding","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:25.794557Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:789f7561014af5bcfb4a314694d135a4ce282572aee4bd4cdb209784c2b21a51","observation_id":"87efda85-7446-459c-9d51-021671a96d36","resolution":{"observed_at":"2026-08-07T10:18:25.794557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:29.927997Z","title":"Instantbooth: Personalized text-to-image generation without test-time finetuning","venue":null,"work_id":"a264e528-3b07-4d33-9103-762b2a252390","year":2024},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:25.899763Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:a6988254bf7939691ba1e803864891893e23672111c28d225b4ff517f0622ae3","observation_id":"7209e051-5d65-4769-aa13-a4c9659d173b","resolution":{"observed_at":"2026-08-07T10:18:30.035495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:29.620049Z","title":"Few-shot font generation by learning fine-grained local styles","venue":null,"work_id":"ab72d3ba-b523-4414-8507-009b36a39793","year":2022},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:26.038407Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:711540b587ee1845f79906b2efed2fa8b7fdb6e35184f8291c5919dacaaa8f2b","observation_id":"ed49de19-eecf-4c9c-a921-819518d1596a","resolution":{"observed_at":"2026-08-07T10:18:29.735342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03054","last_updated":"2024-02-21T07:12:45Z","snapshot_observed_at":"2026-08-15T06:33:54.297763Z","submitted_at":"2023-11-06T12:10:43Z","title":"AnyText: Multilingual Visual Text Generation And Editing","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03054","snapshot_observed_at":"2026-08-07T10:18:26.191889Z","title":"Anytext: Multilingual visual text generation and editing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:26.191889Z"},"links":{"cited_paper":"/paper/2311.03054","citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:70c3b6b4807e078a77f5b361916045bcf3ed08aced8b321191a6a0288857bbe0","observation_id":"a837eed1-0fb6-4c2f-b855-be44c226f8dc","resolution":{"observed_at":"2026-08-07T10:18:26.191889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:26.349124Z","title":"Neural discrete representation learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:26.349124Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:8e429374cc6af046681ddc5e37d5b55abf32f7e8ef92e61c40e89f9fb47bc531","observation_id":"ea3cec40-97f6-4b28-bc8c-97119d012be0","resolution":{"observed_at":"2026-08-07T10:18:26.349124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:29.357631Z","title":"Cf-font: Content fusion for few-shot font generation","venue":null,"work_id":"43610b9a-8e4a-454b-920e-a57b125833ee","year":2023},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:26.504600Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:dcac34a1eab583d673bbfed279074185d7d39d2928e55cb0651485dc1b43d59a","observation_id":"770ba9ea-f120-4b72-a0da-c1da346055cd","resolution":{"observed_at":"2026-08-07T10:18:29.479530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:29.125929Z","title":"Deep high-resolution representation learning for visual recognition","venue":null,"work_id":"14711bb8-7316-46d0-b042-eb68c7eda2d8","year":2020},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:26.667658Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:8a32c4e1fb5eb3ce8687365bf2380faa1f1b5a4e5a057538c05c9afe75f6919d","observation_id":"80d77185-b9ef-4922-a16e-b48387e8c188","resolution":{"observed_at":"2026-08-07T10:18:29.187183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07209","last_updated":"2025-03-04T06:21:26Z","snapshot_observed_at":"2026-08-15T02:15:11.970170Z","submitted_at":"2024-06-11T12:32:53Z","title":"MS-Diffusion: Multi-subject Zero-shot Image Personalization with Layout Guidance","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07209","snapshot_observed_at":"2026-08-07T10:18:26.877834Z","title":"Ms-diffusion: Multi-subject zero-shot image personalization with layout guidance","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:26.877834Z"},"links":{"cited_paper":"/paper/2406.07209","citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:5ce27dc2924eda30802f380b9426d0fc919c7b668db95560246006043c322fa0","observation_id":"1a75200a-4fdf-459b-8c8a-150a57d29d68","resolution":{"observed_at":"2026-08-07T10:18:26.877834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:27.060424Z","title":"Elite: Encoding visual concepts into textual embeddings for customized text-to-image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:27.060424Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:0ee7e37677fe2c38914d20f7dcd784828fabe405027acc94f903550431174bb5","observation_id":"f927e690-6ef0-4df4-baa3-7c5fc85c3263","resolution":{"observed_at":"2026-08-07T10:18:27.060424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:29.038820Z","title":"Rethinking text segmentation: A novel dataset and a text-specific refinement approach","venue":null,"work_id":"8c0e9e5c-0f32-4199-bbc2-3ce3c2685747","year":2021},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:27.220463Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:61fa039c180c8acd0b0642f24d82673474889a8f65d022f3f79f7c02539f7c06","observation_id":"ed7753f2-d47b-4f84-8f4a-7ec6a8a73f0e","resolution":{"observed_at":"2026-08-07T10:18:29.095401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:28.837671Z","title":"Glyphcontrol: glyph conditional control for visual text generation","venue":null,"work_id":"f964fa4c-5eb0-45f8-8817-25802a8477b9","year":2023},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:27.345507Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:fcb8a09a400b74ae962b616b2ee86c5e57d9d49b439941b49ce05c91c2bea37f","observation_id":"4c40841e-21a2-4d8b-9793-3914569b5177","resolution":{"observed_at":"2026-08-07T10:18:28.932148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:28.609663Z","title":"Fontdiffuser: One-shot font generation via denoising diffusion with multi-scale content aggregation and style contrastive learning","venue":null,"work_id":"860e9f7d-1b6d-4464-a667-49b0eddc3dbf","year":2024},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:27.469173Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:d7aeb1346761f5b69ec0f41acf5897d221aeccc6e2bc8fef888d9e0e0b76d588","observation_id":"ce6e8cc2-2a0c-49f3-b762-df259010da78","resolution":{"observed_at":"2026-08-07T10:18:28.716248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-07T10:18:27.551786Z","title":"Ip-adapter: Text compatible image prompt adapter for text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:27.551786Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:d39c6499a8b91235ea86d1c43d1c94bbe9a7054f1a152c24bb3602c443be4a4b","observation_id":"f686ff9e-8e4b-4241-9fa0-baec51abb5e1","resolution":{"observed_at":"2026-08-07T10:18:27.551786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:28.386684Z","title":"Jedi: Joint-image diffusion models for finetuning-free personalized text-to-image generation","venue":null,"work_id":"22ff2755-91e9-4684-9114-22e6a97292f4","year":2024},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:27.656276Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:81a0dce35add1addf8e3fea387fc60949db1c82c18e5ac366992bbe47e7b3075","observation_id":"6a932fb3-9d08-4aa4-b89c-dbc98b1f2b21","resolution":{"observed_at":"2026-08-07T10:18:28.477318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:27.747207Z","title":"Sigmoid loss for language image pre-training","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T10:18:27.747207Z"},"links":{"citing_paper":"/paper/2506.05843"},"observation_digest":"sha256:e6cba8a6be30f4f2200b6ef641b71d6064c23ab15f3c2ab122ec87b95e46f1df","observation_id":"e6764746-f08b-4c21-b0c8-8274990ffaed","resolution":{"observed_at":"2026-08-07T10:18:27.747207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.05843","last_updated":"2025-06-06T08:00:49Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T06:38:56.907294Z","submitted_at":"2025-06-06T08:00:49Z","title":"FontAdapter: Instant Font Adaptation in Visual Text Generation"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":1,"verified_fuzzy":18},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 1 inbound Pith citation observation for arXiv:2506.05843."}