{"as_of":"2026-08-15T10:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:953c6174cb23426427110ea1000adec9773e3a88f7be9ec640d33ffdf3412648","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T11:32:13.750347Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-25T06:38:44.675844Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-25T06:40:25.524752Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":"2411.18159","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.18159","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Type-r: Au- tomatically retouching typos for text-to-image generation","venue":null,"work_id":"c8fa79ba-486b-44b5-8d4c-ed869d738ab9","year":2024},"citing_paper":{"arxiv_id":"2604.10077","last_updated":"2026-05-21T10:14:03Z","snapshot_observed_at":"2026-08-13T03:49:52.401144Z","submitted_at":"2026-04-11T07:50:20Z","title":"DocRevive: A Unified Pipeline for Document Text Restoration","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-10T17:00:33.060573Z"},"links":{"cited_paper":"/paper/2411.18159","citing_paper":"/paper/2604.10077"},"observation_digest":"sha256:59ff4f6609e2d085ec37d1930d96fef38f9d82ab5a1f030634b3103e9db96292","observation_id":"ce0aeb3a-249e-4ad7-a7c3-0d4c87ef23ab","resolution":{"observed_at":"2026-05-11T07:45:57.345337Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":"2411.18159","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.18159","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Type-r: Au- tomatically retouching typos for text-to-image generation","venue":null,"work_id":"c8fa79ba-486b-44b5-8d4c-ed869d738ab9","year":2024},"citing_paper":{"arxiv_id":"2604.10077","last_updated":"2026-05-21T10:14:03Z","snapshot_observed_at":"2026-08-13T03:49:52.401144Z","submitted_at":"2026-04-11T07:50:20Z","title":"DocRevive: A Unified Pipeline for Document Text Restoration","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-25T06:38:44.675844Z"},"links":{"cited_paper":"/paper/2411.18159","citing_paper":"/paper/2604.10077"},"observation_digest":"sha256:a2e852ae6d246aff2589c4e3e0cbc8d0bd3d4f81d6b95b45fcbecb006c1d4660","observation_id":"61573e81-7189-4f4a-b6a8-8bab3e698a8f","resolution":{"observed_at":"2026-05-25T06:40:25.527387Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.18159/citation-record","integrity":"/paper/2411.18159/integrity","json":"/paper/2411.18159/citation-record.json","paper":"/paper/2411.18159"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.520598Z","title":"https://openai.com/dall-e-3","venue":null,"work_id":"f37ea1c6-4c01-4260-b3d0-1a7af5e65fb1","year":2024},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.511737Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:f8dfbba3955ff34dd24fa2aa29e7848ea0afc1f656b446d8e7c76a29ccde7674","observation_id":"ce31ed45-44e8-4e44-b9ac-b4300eeaa238","resolution":{"observed_at":"2026-08-12T11:32:14.524598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.509078Z","title":"https://github.com/deep-floyd/ IF","venue":null,"work_id":"22cc81e1-ba51-4077-b2df-18a9c6957fcb","year":2024},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.517165Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:d366b978e43e28ca75d5c0f11584cc9f9195ea265a4b32ce6ec3c56d83cc7376","observation_id":"c242ad24-850d-4d8e-9022-73a48ac9f80e","resolution":{"observed_at":"2026-08-12T11:32:14.512964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.497707Z","title":"https://blackforestlabs.ai/ announcing - black - forest - labs/","venue":null,"work_id":"c7a513f1-ab17-455e-bbe8-f4cfdcbcfb24","year":2024},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.522456Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:ebfc694278934a9de3e9b0fa98b467505ca58d3d1895ca20e80de86c0947fe7d","observation_id":"1a0a2173-f7a5-4530-a342-7ed57732f2a9","resolution":{"observed_at":"2026-08-12T11:32:14.501601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.486256Z","title":"https://openai.com/index/gpt- 4o- system-card/","venue":null,"work_id":"f60c9480-2234-40b6-98ab-17a8d1483825","year":2024},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.527777Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:d03a57497bfafc3dd6a0b8a54afb9e26addc7d3b7f5822975c3310be292c51bc","observation_id":"64e74740-f83e-4278-80d6-8247a8ed6945","resolution":{"observed_at":"2026-08-12T11:32:14.490059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.475325Z","title":"https : / / github","venue":null,"work_id":"eec80d19-6e25-4480-8068-8ce51a9f65ef","year":null},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.532245Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:b86eaf01e50194bfd38fe823ddec52c6a8b3a75fa17a6377dc5b33ec2445d6a0","observation_id":"38439b7d-f398-412c-83bf-60a423c6f53b","resolution":{"observed_at":"2026-08-12T11:32:14.479240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.464839Z","title":"https://huggingface.co/ stabilityai/stable- diffusion- 3.5- large","venue":null,"work_id":"367e7e32-7c6f-46db-bc95-7bb7e4ece279","year":2024},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.537358Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:48189ed11f3ba1662bfd79b770c18e0544431549b23523dcb4dacb0b09629ea7","observation_id":"16dbd9b1-6daa-467d-bbd0-1ed7439f5196","resolution":{"observed_at":"2026-08-12T11:32:14.468586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.453445Z","title":"What is wrong with scene text recognition model comparisons? dataset and model analysis","venue":null,"work_id":"4a39f261-1847-4753-a6ae-fe1c3a994ef0","year":2019},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.542698Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:d9c9dce320402f1bf4b3ce648fb2e2056ee07871001d2b957a70fa86775f96e9","observation_id":"05ba19b9-67d9-4529-950e-10f6c086c190","resolution":{"observed_at":"2026-08-12T11:32:14.457721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.441098Z","title":"Character region awareness for text de- tection","venue":null,"work_id":"b37679dc-a548-4665-9239-541d1b3de9af","year":2019},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.547227Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:9e6d4c9805fc13f73a0fe8b8556a166a1a812ec02a2b0254aa8d616225bb7d5b","observation_id":"a066b610-fafa-48b1-99ab-34677bc0afc1","resolution":{"observed_at":"2026-08-12T11:32:14.445300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.429266Z","title":"Textdiffuser: Diffusion models as text painters","venue":null,"work_id":"5942c497-90a9-47b5-91f9-1d72da8d6258","year":2023},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.551335Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:167dfcc193ba502a61f6956696652955772bb6f8d32c845316966f4d2f79aced","observation_id":"776a16db-ac97-409c-9ac6-bd2d8431d287","resolution":{"observed_at":"2026-08-12T11:32:14.433768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.416525Z","title":"Textdiffuser-2: Unleashing the power of language models for text rendering","venue":null,"work_id":"30171823-0f6d-4562-a107-6d5edf6a811c","year":2024},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.555324Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:30bceeb5b924395f9783f322d7b70733afe6670a817ca0ec468616398abee960","observation_id":"94e63118-9337-463c-ba77-9da7171bf96e","resolution":{"observed_at":"2026-08-12T11:32:14.420890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.405298Z","title":"Scaling recti- fied flow transformers for high-resolution image synthesis","venue":null,"work_id":"c5daf9f9-0825-41c2-91f1-960e64d39456","year":2024},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.559448Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:ad7260b267b94e5bc68e66cb3c3a1501566071132c0d09fc2f22aa692f3fa1ae","observation_id":"915ec564-4600-4da3-89f9-e73eba73a59a","resolution":{"observed_at":"2026-08-12T11:32:14.409141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.393544Z","title":"Layoutgpt: Compositional visual plan- ning and generation with large language models","venue":null,"work_id":"901facd2-9780-4fb1-8ef9-c0a97ed75477","year":null},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.563584Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:9f4d52e57b7b5b426214fe22e4d7663902b4e2bd72ba75b542f0e3363db9a9af","observation_id":"1f36f9a5-cdf5-4e12-a85a-26725b68678b","resolution":{"observed_at":"2026-08-12T11:32:14.397651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.08500","last_updated":"2018-01-12T14:05:44Z","snapshot_observed_at":"2026-08-14T20:51:33.836666Z","submitted_at":"2017-06-26T17:45:23Z","title":"GANs Trained by a Two Time-Scale Update Rule Converge to a Local Nash Equilibrium","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.08500","snapshot_observed_at":"2026-08-12T11:32:13.568748Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilib- rium","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.568748Z"},"links":{"cited_paper":"/paper/1706.08500","citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:d8033cb0bf0ad47647eb8b6a01396afedf37066099bd295d48bcac936997dfdd","observation_id":"b1b0d25f-8f57-46c5-a5b1-fd1a03bce027","resolution":{"observed_at":"2026-08-12T11:32:13.568748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05568","last_updated":"2023-04-12T02:08:34Z","snapshot_observed_at":"2026-08-13T12:04:37.677539Z","submitted_at":"2023-04-12T02:08:34Z","title":"Improving Diffusion Models for Scene Text Editing with Dual Encoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05568","snapshot_observed_at":"2026-08-12T11:32:13.573241Z","title":"Improving diffusion models for scene text editing with dual encoders","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.573241Z"},"links":{"cited_paper":"/paper/2304.05568","citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:a4afd1607d9e7a6f72dd904a8c25da388905d08498cba5a3efedb70329c7126e","observation_id":"1d31c6c8-5bce-4e4e-97df-91fbb727f481","resolution":{"observed_at":"2026-08-12T11:32:13.573241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16974","last_updated":"2024-03-18T21:43:20Z","snapshot_observed_at":"2026-08-13T05:15:12.217982Z","submitted_at":"2023-11-28T17:22:17Z","title":"COLE: A Hierarchical Generation Framework for Multi-Layered and Editable Graphic Design","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16974","snapshot_observed_at":"2026-08-12T11:32:13.577599Z","title":"Cole: A hierarchical generation frame- work for graphic design","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.577599Z"},"links":{"cited_paper":"/paper/2311.16974","citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:23ee178655026aadadeca52cd585a974477bff833a3dc735d3760059653eeb51","observation_id":"14dbb61c-8be3-414a-bcdf-c33f4d48ccd0","resolution":{"observed_at":"2026-08-12T11:32:13.577599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16422","last_updated":"2024-10-28T22:11:08Z","snapshot_observed_at":"2026-08-13T22:55:51.589359Z","submitted_at":"2024-03-25T04:54:49Z","title":"Refining Text-to-Image Generation: Towards Accurate Training-Free Glyph-Enhanced Image Generation","version":2},"cited_work":{"arxiv_id":"2403.16422","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.16422","snapshot_observed_at":"2026-08-12T11:32:14.004023Z","title":"Refining Text-to-Image Generation: Towards Accurate Training-Free Glyph-Enhanced Image Generation","venue":"cs.CV","work_id":"ed3dd899-2c6d-4dba-88d1-aacb8e97e237","year":2024},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.582193Z"},"links":{"cited_paper":"/paper/2403.16422","citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:a3c5220407f549f605fc2144410c6c48cb509bcc965917ef16a7bd28013c8011","observation_id":"284bf039-7b38-43c7-ba68-d35d8681119e","resolution":{"observed_at":"2026-08-12T11:32:14.008600Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.382427Z","title":"The surprisingly straight- forward scene text removal method with gated attention and region of interest generation: A comprehensive prominent model analysis","venue":null,"work_id":"a6a774b6-65ca-4243-9d07-b630c5ff07f9","year":2022},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.587545Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:28a2128994daf856d8a744499f31b731969baf745404098fec082ed03c2874e4","observation_id":"f16cd242-b519-4316-9dfe-f8c17274869a","resolution":{"observed_at":"2026-08-12T11:32:14.386487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17524","last_updated":"2025-03-28T03:27:40Z","snapshot_observed_at":"2026-08-12T22:37:15.502426Z","submitted_at":"2024-09-26T04:23:17Z","title":"JoyType: A Robust Design for Multilingual Visual Text Creation","version":2},"cited_work":{"arxiv_id":"2409.17524","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.17524","snapshot_observed_at":"2026-08-12T11:32:13.986117Z","title":"JoyType: A Robust Design for Multilingual Visual Text Creation","venue":"cs.CV","work_id":"a867e953-1606-47e2-af86-1b4aa67d3024","year":2024},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.591903Z"},"links":{"cited_paper":"/paper/2409.17524","citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:e4b3932b01da822aa24ff32d9c4163f8cfdb6ced7aa42ab8b459705a1d4d3e9e","observation_id":"933d606c-75b9-4f2f-b4ad-a83c4bdab407","resolution":{"observed_at":"2026-08-12T11:32:13.990550Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.371280Z","title":"Trocr: Transformer-based optical character recognition with pre-trained models","venue":null,"work_id":"f1463b8f-2445-4ce5-9003-7116eccaafac","year":2023},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.597618Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:79b97c8914570d8942466f54f72c04304826e0012185c5540e3dfc573e056c6d","observation_id":"25231841-a43a-4f9a-9811-7aa72238d639","resolution":{"observed_at":"2026-08-12T11:32:14.375246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04439","last_updated":"2024-10-06T10:25:39Z","snapshot_observed_at":"2026-08-12T22:29:50.653210Z","submitted_at":"2024-10-06T10:25:39Z","title":"Empowering Backbone Models for Visual Text Generation with Input Granularity Control and Glyph-Aware Training","version":1},"cited_work":{"arxiv_id":"2410.04439","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.04439","snapshot_observed_at":"2026-08-12T11:32:13.967748Z","title":"Empowering Backbone Models for Visual Text Generation with Input Granularity Control and Glyph-Aware Training","venue":"cs.CV","work_id":"4130e1ef-0d7b-40fa-9ab4-40eed01e78ac","year":2024},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.602048Z"},"links":{"cited_paper":"/paper/2410.04439","citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:7643e9915a060a554e19ecf85ef848b69bf2a55181ef6dcbb650dd26e9a0ee13","observation_id":"56e3014f-71ce-4add-85b7-3dfe59724455","resolution":{"observed_at":"2026-08-12T11:32:13.972610Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.359919Z","title":"First creating backgrounds then rendering texts: A new paradigm for visual text blending","venue":null,"work_id":"4a2ee430-129c-41da-960c-7de3cd7f761d","year":2024},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.606829Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:fbf17b6f2d7bb8f381b887383ba151eaf0954e09b2d4f83c34a623a7553cce31","observation_id":"5810f74c-22c1-47ad-9154-1e4c99ba5883","resolution":{"observed_at":"2026-08-12T11:32:14.364001Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.348382Z","title":"Mask TextSpotter v3: Segmentation proposal net- work for robust scene text spotting","venue":null,"work_id":"ff705f0d-76a4-48f2-9887-aefa3b593837","year":2020},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.610886Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:b54e1e0845281e9618697349a0dde60e5adcad9f148903a285f2e569925c4447","observation_id":"86179833-8aa9-4c91-978d-9a9e599d27ea","resolution":{"observed_at":"2026-08-12T11:32:14.352324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.336483Z","title":"Layoutprompter: Awaken the design ability of large language models","venue":null,"work_id":"dc2ec0bf-90d3-4f40-9eef-f1329eae800d","year":null},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.614964Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:bc5e5b0bbe08563bb97b21fd35a335a16db4ce727cca10323bcd1459b4b6da9d","observation_id":"3c5c9fc8-9f2d-49f2-948e-4171fd1f7955","resolution":{"observed_at":"2026-08-12T11:32:14.340558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.324755Z","title":"Parrot captions teach clip to spot text","venue":null,"work_id":"a5056659-1940-4162-bc8d-502078a9bbe3","year":2024},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.619549Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:be7d7f4569835c945bc2304862fc9bc14ac6b591651d81457ccde3594279bff6","observation_id":"2ca19e3c-abbf-4b76-ad8f-226a27d113c3","resolution":{"observed_at":"2026-08-12T11:32:14.328874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.311865Z","title":"Character-aware models improve visual text rendering","venue":null,"work_id":"83b40a5f-54ee-4311-b3a3-1897fd897238","year":2023},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.623466Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:6237291c473c42cbfcca45e6383499d38cfa1330d371b5185bbc4f03b341e754","observation_id":"0b9dd83a-0221-46c7-aa07-6377ea08b239","resolution":{"observed_at":"2026-08-12T11:32:14.316054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.299683Z","title":"Glyph-byt5: A customized text encoder for accurate visual text rendering","venue":null,"work_id":"ae6491d9-2d62-4ebd-8bd7-77695889146b","year":2024},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.627475Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:7b53ddc2713d19c4a5740eff1546e830f24de28487a601d0412ab56e74bf50ca","observation_id":"497379fc-2c60-4f2d-8696-c4bde5ddb531","resolution":{"observed_at":"2026-08-12T11:32:14.303620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10208","last_updated":"2024-07-12T16:26:40Z","snapshot_observed_at":"2026-08-14T20:26:39.818562Z","submitted_at":"2024-06-14T17:44:09Z","title":"Glyph-ByT5-v2: A Strong Aesthetic Baseline for Accurate Multilingual Visual Text Rendering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10208","snapshot_observed_at":"2026-08-12T11:32:13.631347Z","title":"Glyph-byt5-v2: A strong aesthetic base- line for accurate multilingual visual text rendering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.631347Z"},"links":{"cited_paper":"/paper/2406.10208","citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:8e6beea8c40982553f39abf8ce14d1f8908d35c5bc9b0a04de48877a72c40872","observation_id":"c4773c99-dd29-4f69-9bbe-be18fa2ec2f7","resolution":{"observed_at":"2026-08-12T11:32:13.631347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17870","last_updated":"2023-05-23T04:07:00Z","snapshot_observed_at":"2026-08-13T12:12:43.873574Z","submitted_at":"2023-03-31T08:06:33Z","title":"GlyphDraw: Seamlessly Rendering Text with Intricate Spatial Structures in Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17870","snapshot_observed_at":"2026-08-12T11:32:13.636040Z","title":"Glyphdraw: Seamlessly ren- dering text with intricate spatial structures in text-to-image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.636040Z"},"links":{"cited_paper":"/paper/2303.17870","citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:67cabf4610beba544925a5db78047f8ebe43150310f30f2209cea69193dd8304","observation_id":"9e55af1f-5eaa-4ffb-95aa-1aeeee61b9b0","resolution":{"observed_at":"2026-08-12T11:32:13.636040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.287400Z","title":"Ty- pographic text generation with off-the-shelf diffusion model","venue":null,"work_id":"19257720-7a70-424a-a304-74e3473a20fc","year":2024},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.640256Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:ec962408f30b10484ddb28e7631d2c4f152535014867ee9ac58837488c51ba97","observation_id":"56662c13-e6f6-4094-96d5-a5c034e7a51c","resolution":{"observed_at":"2026-08-12T11:32:14.291780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.276164Z","title":"Sdxl: Improving latent diffusion models for high-resolution image synthesis","venue":null,"work_id":"37012bd6-c483-46c0-b422-d82fb587feb5","year":2023},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.644459Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:ac739c38035ca957915bb77650c8a48e30d742a8676de4e4213c1ed5ebb5228c","observation_id":"ff1f513c-b13e-42cf-9ab9-029d0df0dbd6","resolution":{"observed_at":"2026-08-12T11:32:14.280053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.264418Z","title":"Exploring stroke-level modifi- cations for scene text editing","venue":null,"work_id":"f7dc900b-827d-4a3d-be9e-c21cc3ed0d32","year":2023},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.648429Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:5e776b17c47dd83f9f8c43d6869381a8196ba16850865e0d35be457edab32396","observation_id":"206e4783-5e6d-4834-b4b8-2d866607e0c8","resolution":{"observed_at":"2026-08-12T11:32:14.268447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:13.652504Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.652504Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:ba76147359682b5a35a0fb29ca060ede8b0be53eb4079ff19200b1a7fce9dd38","observation_id":"5ada50da-978a-4f83-b539-2cb93bed68fe","resolution":{"observed_at":"2026-08-12T11:32:13.652504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.244500Z","title":"An empirical study of scaling law for ocr","venue":null,"work_id":"2aac5584-02af-4168-9aea-b506d042cfd3","year":null},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.657720Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:5fd9cdcc12de5ddb69d065174440df9274e1515a1e788638b604c0a4e783b5ea","observation_id":"cd7ac0d0-162d-4a79-a197-d4028667c459","resolution":{"observed_at":"2026-08-12T11:32:14.248755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:13.662275Z","title":"High-resolution image syn- thesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.662275Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:dd7548bb9300f3a6cc2a7390de66701ccbfff7076433e756a8beeafdea0f2435","observation_id":"fa152761-c948-4f3f-97b7-2e66c77007ef","resolution":{"observed_at":"2026-08-12T11:32:13.662275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.225013Z","title":"STEFANN: scene text editor using font adap- tive neural network","venue":null,"work_id":"4a98b3a0-8b11-4c85-8f25-720a0fcac500","year":2020},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.666391Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:48fc97a4a354f558d537a0317504978051cda57996c3b36e7056acc776a00a8e","observation_id":"8a591fe0-9322-4217-9c67-35665b102d3c","resolution":{"observed_at":"2026-08-12T11:32:14.228858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:13.671301Z","title":"Photorealistic text-to-image diffusion models with deep language understanding","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.671301Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:ac827d57e5ec88bf398c8bc7ff14b221801d5716a76cf12d42d18b237b38063b","observation_id":"c71501ed-06de-4ba1-9403-ed216a67a308","resolution":{"observed_at":"2026-08-12T11:32:13.671301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.206266Z","title":"Resolution-robust large mask inpainting with fourier convolutions","venue":null,"work_id":"22b4ff8c-840d-43b6-90d2-0f8c8b23f45e","year":2022},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.675254Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:b5c5a2dd6a9626ed872b6d335ff5fe2f9fbb1b0ab4cd3eeab338ee152a2e4534","observation_id":"f7d1ae55-4052-4ef6-a96f-ae4223a70222","resolution":{"observed_at":"2026-08-12T11:32:14.210044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-12T11:32:13.679352Z","title":"Llama 2: Open foundation and fine-tuned chat models.arXiv preprint arXiv:2307.09288, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.679352Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:dd7b2a7ab8a7b7bb86119b4dedfdce43f1616733ad07dd607a1459e5507e6fb7","observation_id":"484066a5-0b9e-42ed-85cf-d7f53c27926e","resolution":{"observed_at":"2026-08-12T11:32:13.679352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.194974Z","title":"Anytext: Multilingual visual text gener- ation and editing","venue":null,"work_id":"454c63b4-29ea-4bb2-9633-48572442688e","year":2023},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.683492Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:be71fb428020f8619e08af46c3dd64ddafa43be1b86c7cf35b4d914c9dd77eec","observation_id":"0737cc84-8286-45f0-99c9-db7cfe005cb5","resolution":{"observed_at":"2026-08-12T11:32:14.199157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2410.09879","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:13.904077Z","title":"Textmaster: Universal control- lable text edit","venue":null,"work_id":"a2868237-98d4-4e4e-9bfd-b3b348bb6309","year":2024},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.687411Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:132259cdaf949334b1d5af3f7dadda498f3890a3ffe6e65849d66530223c4053","observation_id":"424f01cd-c2e4-4891-b1eb-39d7e1a4aef7","resolution":{"observed_at":"2026-08-12T11:32:13.910911Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14701","last_updated":"2025-03-24T06:13:16Z","snapshot_observed_at":"2026-08-14T06:39:34.899101Z","submitted_at":"2024-05-23T15:35:48Z","title":"DreamText: High Fidelity Scene Text Synthesis","version":5},"cited_work":{"arxiv_id":"2405.14701","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.14701","snapshot_observed_at":"2026-08-12T11:32:13.810692Z","title":"DreamText: High Fidelity Scene Text Synthesis","venue":"cs.CV","work_id":"9baadf3d-6380-4d93-812a-7977125ab1f7","year":2024},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.692178Z"},"links":{"cited_paper":"/paper/2405.14701","citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:dcb852d35392a617fab1584555b4b0118937ce0a0f3426ad41acc795193f2de2","observation_id":"b2f85204-bcfe-4134-865e-8219eeb2a3c8","resolution":{"observed_at":"2026-08-12T11:32:13.817438Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.11382","last_updated":"2023-02-21T12:42:44Z","snapshot_observed_at":"2026-07-06T14:54:37.559648Z","submitted_at":"2023-02-21T12:42:44Z","title":"A Prompt Pattern Catalog to Enhance Prompt Engineering with ChatGPT","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.11382","snapshot_observed_at":"2026-08-12T11:32:13.696719Z","title":"A prompt pattern catalog to enhance prompt engineering with chatgpt","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.696719Z"},"links":{"cited_paper":"/paper/2302.11382","citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:c7698187a1df81ab6feb89aefc1e5dc765652042084fb246cea74790ef5d8646","observation_id":"72e5b94f-4b5a-4559-b2fa-f4b81b92affa","resolution":{"observed_at":"2026-08-12T11:32:13.696719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.183361Z","title":"Editing text in the wild","venue":null,"work_id":"faccb57b-a185-4a11-ae0c-dae5121c33ce","year":2018},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.700770Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:d79f0f4dd0db8af244d390147a316ec3fe6ed3f1de7cc4eda3c8013c6c50b4e8","observation_id":"d8a21a62-9553-4cd1-96ae-48a1114c571c","resolution":{"observed_at":"2026-08-12T11:32:14.186943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.171295Z","title":"Self-correcting llm-controlled diffusion models","venue":null,"work_id":"d81d5ece-3880-4fae-8943-d0066b331f0d","year":2024},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.704922Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:468ba053a0b3003bd83fd2f700683f9de4d32b9cdf604710182a9c0e0c24ec02","observation_id":"fa20b042-38d6-439b-8eaa-a2f8137c4658","resolution":{"observed_at":"2026-08-12T11:32:14.175318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.159925Z","title":"Mastering text-to-image dif- fusion: Recaptioning, planning, and generating with multi- modal llms","venue":null,"work_id":"8b042e4e-3746-46cb-bcd5-91c765ec1497","year":2024},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.708940Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:dd8552eec19cf47b7cb533703ecdabe634a8be7ef78c2b85ef4d292c2734724a","observation_id":"add668d0-cf1d-4dd8-9e0b-3208d1951cae","resolution":{"observed_at":"2026-08-12T11:32:14.164084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.148717Z","title":"Swaptext: Image based texts transfer in scenes","venue":null,"work_id":"d8a212c9-4f0a-4033-a350-b7ac3e8267f4","year":null},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.712904Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:d2d2ce50f5a2c91fdf6130af03e6378d9bfb469752a2ddd4f9806e506a5812d9","observation_id":"d3c4305e-a651-41c9-85aa-f6dc88b57f21","resolution":{"observed_at":"2026-08-12T11:32:14.152509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.136917Z","title":"Glyphcontrol: Glyph conditional control for visual text generation","venue":null,"work_id":"4f6f1298-7458-40b6-a461-edf29a7a704c","year":null},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.716930Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:76267e7655db890fef3eff09a90cce9b702be279907159c9f996ed0e05855466","observation_id":"59c289f2-7aab-4bd0-a394-7201498c2049","resolution":{"observed_at":"2026-08-12T11:32:14.140958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.124605Z","title":"DeepSolo: Let transformer decoder with explicit points solo for text spot- ting","venue":null,"work_id":"b8b5ad41-d81b-4f87-9465-0d73b6d9d243","year":2023},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.720993Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:fe2c2258982f21b3efa6b93f8c22b044f965eb3e44cadb946674cdf168c560e1","observation_id":"3643adf9-b20f-43e6-9d2a-5bf01a795803","resolution":{"observed_at":"2026-08-12T11:32:14.128720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.17904","last_updated":"2024-11-08T10:45:12Z","snapshot_observed_at":"2026-08-13T04:30:14.137588Z","submitted_at":"2024-01-31T15:10:29Z","title":"Hi-SAM: Marrying Segment Anything Model for Hierarchical Text Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.17904","snapshot_observed_at":"2026-08-12T11:32:13.724939Z","title":"Hi-sam: Marrying segment anything model for hierarchical text segmentation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.724939Z"},"links":{"cited_paper":"/paper/2401.17904","citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:d94d0e296cad4da17cf7c511168ec01563cdb66c07bc00790166d4bc6f48fc95","observation_id":"e05876af-e036-43e7-873e-8a9a9f87a168","resolution":{"observed_at":"2026-08-12T11:32:13.724939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.112623Z","title":"TextCtrl: Diffusion-based scene text editing with prior guidance control","venue":null,"work_id":"a66c824a-7bb3-427d-aa0f-4ec015e49afb","year":2024},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.729164Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:275fea6ab5a04e2ea8ea85afbd9781965a04e94e31a855226341dd2f1555ee31","observation_id":"f923a6c9-b1e0-4e36-965d-b17e2efc2ba8","resolution":{"observed_at":"2026-08-12T11:32:14.116922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.100006Z","title":"Brush your text: Synthesize any scene text on im- ages via diffusion model","venue":null,"work_id":"826183d8-13f4-4dcf-9e70-f2fcc8d88d6e","year":2024},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.733409Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:3f5e8f76289d3f4a3884f73a736cceac5685b418328cfa431a9e7f81e0db9dd9","observation_id":"9061a9d7-2238-4653-8cad-2a02c3263eb8","resolution":{"observed_at":"2026-08-12T11:32:14.104113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.087387Z","title":"Layout-agnostic scene text image synthesis with diffusion models","venue":null,"work_id":"7cfdfc86-6c04-44bb-8f37-81aee3fea873","year":2024},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.738054Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:d731ef811b198296fc11dac2efca238ac52c292473c09bd81f77c67c01d551fd","observation_id":"58fb542c-f787-441f-be00-3f7af9cc38d1","resolution":{"observed_at":"2026-08-12T11:32:14.091426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.074788Z","title":"Udifftext: A unified frame- work for high-quality text synthesis in arbitrary images via character-aware diffusion models","venue":null,"work_id":"502ebad7-a6f1-44ed-a7ce-776b36d6583d","year":2024},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.742148Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:40b55547c397ef433d5af9cd8b6ef02f5896c584e7ed0bbf734006c733779c29","observation_id":"0e11a67c-18ed-4d50-94b0-c6740b0a686f","resolution":{"observed_at":"2026-08-12T11:32:14.079484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.062380Z","title":"Harmonizing visual text comprehension and gen- eration","venue":null,"work_id":"5c85cf87-8899-4fd9-96b3-373757e86366","year":2024},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.746381Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:9c841e8600cbd39ec8fd5e2965f0af3e360155220945d7806b8a7d522c75086e","observation_id":"90a5c295-a975-4408-9a69-7496d9240f34","resolution":{"observed_at":"2026-08-12T11:32:14.066680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:32:14.049042Z","title":"Visual text generation in the wild","venue":null,"work_id":"df6ec9a2-d54e-4a76-a2c2-8b5ce9a63452","year":2024},"citing_paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T11:32:13.750347Z"},"links":{"citing_paper":"/paper/2411.18159"},"observation_digest":"sha256:27a1c63b7043a5026b172bfaf26d64f26a1cd07b1035456a5e522a6a9edeff62","observation_id":"e1b5cc59-69da-4108-ad1f-e1839c5c25fb","resolution":{"observed_at":"2026-08-12T11:32:14.053378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.18159","last_updated":"2025-04-30T10:24:23Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T07:59:26.210081Z","submitted_at":"2024-11-27T09:11:45Z","title":"Type-R: Automatically Retouching Typos for Text-to-Image Generation"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":5,"verified_fuzzy":39},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 2 inbound Pith citation observations for arXiv:2411.18159."}