{"as_of":"2026-08-09T21:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:44d233d1103009df4477a0893151010a7a45c5ea092ec5266214bd2cc9bb88b7","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:07:44.228190Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-07T06:38:04.459129Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T10:16:28.883932Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"cited_work":{"arxiv_id":"2507.00992","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00992","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Uniglyph: Unified segmentation-conditioned diffusion for precise visual text synthesis.ArXiv, abs/2507.00992, 2025f.https://api.semanticscholar.org/CorpusID:280069916","venue":null,"work_id":"aec809fe-7254-45ce-8770-8e756d9d8de6","year":null},"citing_paper":{"arxiv_id":"2604.28185","last_updated":"2026-04-30T17:59:02Z","snapshot_observed_at":"2026-07-06T23:13:29.310140Z","submitted_at":"2026-04-30T17:59:02Z","title":"Visual Generation in the New Era: An Evolution from Atomic Mapping to Agentic World Modeling","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-07T06:38:04.459129Z"},"links":{"cited_paper":"/paper/2507.00992","citing_paper":"/paper/2604.28185"},"observation_digest":"sha256:53f7b5b98e727008d4f4490925888726f7520c53490d76e1be5b02b4c3771a0a","observation_id":"6b2b842f-6b4f-4a34-9a2b-3a89513fc44d","resolution":{"observed_at":"2026-05-12T10:16:28.886236Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.00992/citation-record","integrity":"/paper/2507.00992/integrity","json":"/paper/2507.00992/citation-record.json","paper":"/paper/2507.00992"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:45.510431Z","title":null,"venue":null,"work_id":"b9700cb3-2448-4ce0-ab86-492e624eedc0","year":2024},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:43.874831Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:bb0b717f7be454f008b5ca620a968f0d299fbc7edc8c58474675835b48a0ebc7","observation_id":"28ec29b1-c70a-43cf-ba84-567cdb546803","resolution":{"observed_at":"2026-08-06T21:07:45.517671Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16465","last_updated":"2023-11-28T04:02:40Z","snapshot_observed_at":"2026-07-06T16:53:35.776613Z","submitted_at":"2023-11-28T04:02:40Z","title":"TextDiffuser-2: Unleashing the Power of Language Models for Text Rendering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16465","snapshot_observed_at":"2026-08-06T21:07:43.882932Z","title":"Textdiffuser-2: Unleashing the power of language models for text rendering","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:43.882932Z"},"links":{"cited_paper":"/paper/2311.16465","citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:61772cda434f6d67013a3ebbef1c10bec34fa92430626f27a16ea8f6edd42f22","observation_id":"9257fe4e-4b10-4ca9-a301-6a6ce1b7d706","resolution":{"observed_at":"2026-08-06T21:07:43.882932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10855","last_updated":"2023-10-30T06:33:01Z","snapshot_observed_at":"2026-07-06T15:29:08.848146Z","submitted_at":"2023-05-18T10:16:19Z","title":"TextDiffuser: Diffusion Models as Text Painters","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10855","snapshot_observed_at":"2026-08-06T21:07:43.890731Z","title":"Textdiffuser: Diffusion models as text painters","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:43.890731Z"},"links":{"cited_paper":"/paper/2305.10855","citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:62c23370d9a6dc0e08dd8d6117629e23e92ac8124c5d7d1007769fca4b9001a6","observation_id":"7c0a2b13-de15-4e71-8cfe-7a29ad32aae7","resolution":{"observed_at":"2026-08-06T21:07:43.890731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:45.483717Z","title":"Control3d: Towards controllable text-to-3d generation,","venue":null,"work_id":"346bb570-6a5e-4a09-849f-40959649c20c","year":null},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:43.896484Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:0697a39269b0280804c0c8f1aa922a3f243529cb27389da5e87199817844b60d","observation_id":"9a37a80c-e056-447c-9b0c-5066d3d3d3c5","resolution":{"observed_at":"2026-08-06T21:07:45.490375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08099","last_updated":"2025-06-11T05:50:16Z","snapshot_observed_at":"2026-08-07T19:38:25.514759Z","submitted_at":"2025-03-11T07:01:35Z","title":"Whoever Started the Interference Should End It: Guiding Data-Free Model Merging via Task Vectors","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.08099","snapshot_observed_at":"2026-08-06T21:07:43.901697Z","title":"Whoever started the interference should end it: Guiding data-free model merging via task vectors","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:43.901697Z"},"links":{"cited_paper":"/paper/2503.08099","citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:8ed87dce3f5dfc91b254aa041795677c728172da0b63f3cb72161a8a3cd2dc19","observation_id":"32394b3f-a65e-4967-b6c0-236223cdc334","resolution":{"observed_at":"2026-08-06T21:07:43.901697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08341","last_updated":"2024-12-11T12:31:30Z","snapshot_observed_at":"2026-08-08T23:14:09.624424Z","submitted_at":"2024-12-11T12:31:30Z","title":"ALoRE: Efficient Visual Adaptation via Aggregating Low Rank Experts","version":1},"cited_work":{"arxiv_id":"2412.08341","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.08341","snapshot_observed_at":"2026-08-06T21:07:44.721535Z","title":"ALoRE: Efficient Visual Adaptation via Aggregating Low Rank Experts","venue":"cs.CV","work_id":"c6f85d67-8ec0-4bfa-bf9c-6683c64b1a64","year":2024},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:43.908675Z"},"links":{"cited_paper":"/paper/2412.08341","citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:d7063ddaa5afde77bc97c96a84a304f84727267d91acd5d511c024c19a702f8d","observation_id":"519f8f0f-4074-489d-83ea-7cf3c4ee0af7","resolution":{"observed_at":"2026-08-06T21:07:44.729047Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:45.463664Z","title":"Scaling rec- tified flow transformers for high-resolution image synthesis","venue":null,"work_id":"55124bc2-7e02-4a16-9735-630c427bfa61","year":2024},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:43.915762Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:1f4beb924774d42a1826a1655f3812b1449922754a6fa064ca5290657d7de516","observation_id":"c0ba18f1-51ae-4fce-8bc3-1945170f98a7","resolution":{"observed_at":"2026-08-06T21:07:45.469315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:45.445705Z","title":"Layoutgpt: Compositional visual plan- ning and generation with large language models, 2023","venue":null,"work_id":"d91b4018-381d-4c2d-976b-537ab25edbb0","year":2023},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:43.921851Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:ddb777ec627889828f47da054b6f855688294fa9b33011b08203dbb909e4e48e","observation_id":"c01146fd-6b7c-4f0f-8053-4ef61ae18e9c","resolution":{"observed_at":"2026-08-06T21:07:45.451813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.06767","last_updated":"2022-09-29T03:37:02Z","snapshot_observed_at":"2026-07-06T12:37:32.486119Z","submitted_at":"2022-02-14T14:37:15Z","title":"Wukong: A 100 Million Large-scale Chinese Cross-modal Pre-training Benchmark","version":4},"cited_work":{"arxiv_id":"2202.06767","doi":null,"metadata_source":"pith","pith_arxiv_id":"2202.06767","snapshot_observed_at":"2026-08-06T21:07:44.688641Z","title":"Wukong: A 100 Million Large-scale Chinese Cross-modal Pre-training Benchmark","venue":"cs.CV","work_id":"1e2bb39b-00f7-4342-a0a1-9a14eca28b91","year":2022},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:43.927668Z"},"links":{"cited_paper":"/paper/2202.06767","citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:a7f88da5a20b042cb6d45bb97a35fe18dc70779290b8afe121bdbb0ca425017f","observation_id":"b2e9c88f-b1d2-4b29-8ee5-2372cbb9e861","resolution":{"observed_at":"2026-08-06T21:07:44.697290Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:45.426436Z","title":"En- hancing logits distillation with plug&play kendall’s τ rank- ing loss, 2025","venue":null,"work_id":"db3c5719-921c-4cb3-b93b-56a92c77cbbe","year":2025},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:43.934626Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:22926e36e2e321e8ae6535dae9614b5ce294b4b855d9ce73ccd7739f4e253d9e","observation_id":"74d48cac-46bf-4cb1-ad40-38e5519f9540","resolution":{"observed_at":"2026-08-06T21:07:45.433127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:45.409219Z","title":"Animate anyone: Consistent and controllable image-to-video synthesis for character animation","venue":null,"work_id":"12ac11f1-641b-4f63-9906-b14df6142a90","year":null},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:43.941560Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:5981f7e5436955b807247461513f3c7f3f67ddfcfd49084c3f76179258a43663","observation_id":"e79461d0-b430-49fa-aadf-1610f1d3fe7c","resolution":{"observed_at":"2026-08-06T21:07:45.414838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.09778","last_updated":"2023-02-22T02:14:55Z","snapshot_observed_at":"2026-08-06T12:21:57.779550Z","submitted_at":"2023-02-20T05:48:41Z","title":"Composer: Creative and Controllable Image Synthesis with Composable Conditions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.09778","snapshot_observed_at":"2026-08-06T21:07:43.947462Z","title":"Composer: Creative and controllable im- age synthesis with composable conditions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:43.947462Z"},"links":{"cited_paper":"/paper/2302.09778","citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:a15106c31ffe4fe3024d4d65a9fa07e8ce24db5c050805eb9bf79d68550e3e4c","observation_id":"b8724014-6f75-43f2-a924-902a369832bc","resolution":{"observed_at":"2026-08-06T21:07:43.947462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:43.954466Z","title":"Improving diffusion models for scene text editing with dual encoders,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:43.954466Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:16e104762681f2069c2a19c6b9f8460d1022970f15e1154f850d6a98f6f58301","observation_id":"c98c904c-6bbe-4a3a-9884-f37cc9562b90","resolution":{"observed_at":"2026-08-06T21:07:43.954466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:45.373164Z","title":"Kingma and Max Welling","venue":null,"work_id":"2f33df01-81e3-45a9-8e30-0e87388081e5","year":2014},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:43.963391Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:e8cef72282a82e2b33cfadca8c752ee19b482b4ee8f94ccca9977bb1f29b1a0c","observation_id":"a2dd28e5-e48b-42b9-a033-9524c67e998d","resolution":{"observed_at":"2026-08-06T21:07:45.379114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02643","last_updated":"2023-04-05T17:59:46Z","snapshot_observed_at":"2026-08-08T05:14:59.435033Z","submitted_at":"2023-04-05T17:59:46Z","title":"Segment Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02643","snapshot_observed_at":"2026-08-06T21:07:43.970072Z","title":"Berg, Wan-Yen Lo, Piotr Doll ´ar, and Ross Girshick","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:43.970072Z"},"links":{"cited_paper":"/paper/2304.02643","citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:2f561fc6bd5f3734330fe6c1cff824042e2e371d9cb30d120d9b2305cf231bec","observation_id":"29d80fbc-68d5-41e4-97e4-16b8dd01efcc","resolution":{"observed_at":"2026-08-06T21:07:43.970072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:45.352927Z","title":null,"venue":null,"work_id":"9cf42648-73d9-4702-b3a2-954405a1c8f9","year":2024},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:43.976312Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:75dbee1c54dddc0de9f2bb5a7bf27054f92e5e1620c63e81678ac4add1d05ac1","observation_id":"474cd821-cf88-4c2f-b146-013174b5bfa2","resolution":{"observed_at":"2026-08-06T21:07:45.358244Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:45.334409Z","title":"Layoutprompter: Awaken the design ability of large language models, 2023","venue":null,"work_id":"419e0675-9dcd-463a-923d-4f24d76e8219","year":2023},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:43.982417Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:21f88ce75a8e30288a7587cd39643934921b9c2ff194bbd1dac4954e92dac2d9","observation_id":"b98c08c8-4137-4bc3-8dbb-bf80d5faa927","resolution":{"observed_at":"2026-08-06T21:07:45.341179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:45.311642Z","title":null,"venue":null,"work_id":"e8c2ecbc-2ab3-4a85-835d-41523e0d43fe","year":2023},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:43.989421Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:07bf478db1332874efb969cc82d50c6638c1205732792ebb4a96ce2105939340","observation_id":"2592a445-96df-4523-9056-f0870bf9d149","resolution":{"observed_at":"2026-08-06T21:07:45.317609Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:45.284635Z","title":"Character-aware models improve visual text rendering","venue":null,"work_id":"dae0aa9e-a824-41ac-860f-4121be1e3f22","year":2023},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:43.994867Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:261445803283b881e20c867f59610df0fdc2c26069f4dce8971a7f718ffaaeb7","observation_id":"5658022d-f97b-41f3-ab5b-a3adc092bf00","resolution":{"observed_at":"2026-08-06T21:07:45.292971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09622","last_updated":"2024-07-12T16:39:31Z","snapshot_observed_at":"2026-07-06T17:44:45.924645Z","submitted_at":"2024-03-14T17:55:33Z","title":"Glyph-ByT5: A Customized Text Encoder for Accurate Visual Text Rendering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09622","snapshot_observed_at":"2026-08-06T21:07:44.000625Z","title":"Glyph-byt5: A customized text encoder for accurate visual text rendering.arXiv preprint arXiv:2403.09622, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.000625Z"},"links":{"cited_paper":"/paper/2403.09622","citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:e9eb500dd9c20971cb1705c18dcbf6032977f60b2950dbb76f398f3ff376398d","observation_id":"64e623d4-63af-4fe0-8dd8-6a3b972785fa","resolution":{"observed_at":"2026-08-06T21:07:44.000625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10208","last_updated":"2024-07-12T16:26:40Z","snapshot_observed_at":"2026-08-08T01:13:28.144737Z","submitted_at":"2024-06-14T17:44:09Z","title":"Glyph-ByT5-v2: A Strong Aesthetic Baseline for Accurate Multilingual Visual Text Rendering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10208","snapshot_observed_at":"2026-08-06T21:07:44.007905Z","title":"Glyph-byt5-v2: A strong aesthetic base- line for accurate multilingual visual text rendering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.007905Z"},"links":{"cited_paper":"/paper/2406.10208","citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:7185fe55f8803a10de1e6be4dc92bfb888a862be316fd5cf34124f3545b1c191","observation_id":"830d693d-71df-4dbe-b1a3-d86f52c1bad1","resolution":{"observed_at":"2026-08-06T21:07:44.007905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:44.014070Z","title":"Decoupled weight decay regularization, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.014070Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:96142990abeffd3d7df90661f38c988dd052ccd35de4168b739dfb68ad390dfe","observation_id":"0cdbd8b2-a75e-4af2-8d9c-623fc6db15bf","resolution":{"observed_at":"2026-08-06T21:07:44.014070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:45.255896Z","title":"Glyphdraw2: Automatic generation of complex glyph posters with diffusion models and large language models","venue":null,"work_id":"e1a98f57-d49a-48e0-a12c-98786691b2f7","year":2024},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.018896Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:732b7c27bc7dff50f89138c66b3e660d75dd89f3a04ba69665d4dd156aaef7eb","observation_id":"ac20871a-deaa-4b07-96a9-49217aa8085f","resolution":{"observed_at":"2026-08-06T21:07:45.261746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:45.237417Z","title":"Chargen: High accurate character- level visual text generation model with multimodal encoder,","venue":null,"work_id":"52231152-6143-4cd9-ba38-697d93a1796c","year":null},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.024243Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:bc6b231234252b31d836d63a53267f5a72db9aeb827e5fae4c4a8f83e9352301","observation_id":"72c2d6e6-aea4-4bf1-b95d-13b7768a6f87","resolution":{"observed_at":"2026-08-06T21:07:45.242791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:44.029403Z","title":"Follow-your-emoji: Fine-controllable and expressive freestyle portrait animation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.029403Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:8261751ebb7cac64f0d74c470116980bfcf694b0a25ccfed59dc4cad3e9fd5f7","observation_id":"15d08a01-66e1-4976-938c-a646889ebfcf","resolution":{"observed_at":"2026-08-06T21:07:44.029403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04590","last_updated":"2025-06-05T03:11:48Z","snapshot_observed_at":"2026-08-08T12:28:30.144231Z","submitted_at":"2025-06-05T03:11:48Z","title":"Follow-Your-Creation: Empowering 4D Creation through Video Inpainting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04590","snapshot_observed_at":"2026-08-06T21:07:44.034191Z","title":"Follow-your-creation: Empowering 4d creation through video inpainting","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.034191Z"},"links":{"cited_paper":"/paper/2506.04590","citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:44a37ec7c6b42b3edd969d9a84a5c5264713f19108f90d665ada6dcf5631c6b2","observation_id":"759e8097-c38f-4a1d-8da3-a3cace8e61e3","resolution":{"observed_at":"2026-08-06T21:07:44.034191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:44.039407Z","title":"Follow-your-click: Open-domain regional image animation via motion prompts","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.039407Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:4a96b5fc78278378571d6f296ba1553d1c72e23c47b5a87459e422127193f54b","observation_id":"e1d060c2-1f1f-4935-8c1d-cb2df859a355","resolution":{"observed_at":"2026-08-06T21:07:44.039407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:44.046024Z","title":"Follow-your-motion: Video motion transfer via efficient spatial-temporal decoupled finetuning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.046024Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:ac4bbc2c3c5d864d1244f0b44025e86c37d78b9291d93e02b1fd4275a4cf586c","observation_id":"95cc10a5-dbfe-462d-87aa-ba7b9e243a1a","resolution":{"observed_at":"2026-08-06T21:07:44.046024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.08453","last_updated":"2023-03-20T10:52:26Z","snapshot_observed_at":"2026-07-31T21:11:02.534986Z","submitted_at":"2023-02-16T17:56:08Z","title":"T2I-Adapter: Learning Adapters to Dig out More Controllable Ability for Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.08453","snapshot_observed_at":"2026-08-06T21:07:44.051530Z","title":"T2i-adapter: Learning 9 adapters to dig out more controllable ability for text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.051530Z"},"links":{"cited_paper":"/paper/2302.08453","citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:0ab025c9efd78bf29c6fedc3b13eef4ad432e208bebbfdfb8feb0a06340b24b1","observation_id":"85c6a035-d149-40c5-9571-d5e7e9412d20","resolution":{"observed_at":"2026-08-06T21:07:44.051530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:45.183451Z","title":null,"venue":null,"work_id":"bf6e8519-48b3-4902-8469-b637ed31c2ec","year":2023},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.057057Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:a9df9923d0bc447cd2d697bc47852b2779324dac08b6b71df51d5a1a25e98c2c","observation_id":"f7257145-48d7-4055-99cc-c9c9e2be3c24","resolution":{"observed_at":"2026-08-06T21:07:45.188706Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:45.165278Z","title":"Pp-ocrv4","venue":null,"work_id":"4965373e-1c29-4417-a129-79e1d95265ce","year":2023},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.062676Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:51104708410cb8f72daf8d12e7d4822df3adc45ebd999c338b63b82dc50e5517","observation_id":"eca7f108-8b6a-4260-ab83-dbb222952ac5","resolution":{"observed_at":"2026-08-06T21:07:45.170912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:45.146024Z","title":"Customtext: Customized tex- tual image generation using diffusion models, 2024","venue":null,"work_id":"1bce7fcb-c2a0-4d48-8f20-0ee987056ab7","year":2024},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.068222Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:2b2c9824bcccc97b5dd6e54d251f87f4165556668db28b846f29eb80639f8bc8","observation_id":"5e2dcd64-21a8-4ab4-91c3-32fe4b885b28","resolution":{"observed_at":"2026-08-06T21:07:45.151663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:45.129255Z","title":"Scalable diffusion models with transformers, 2023","venue":null,"work_id":"aa145a55-68c5-4533-816c-68777b48ca7a","year":2023},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.073350Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:586a4041feac5e3f521c6bf9c038658a830dd92a8ad2deefdf3f9885b46ab087","observation_id":"c00299d2-de25-4147-8e5a-b7a6fded0ce6","resolution":{"observed_at":"2026-08-06T21:07:45.134504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.02114","last_updated":"2021-11-03T10:16:39Z","snapshot_observed_at":"2026-08-02T08:12:49.547570Z","submitted_at":"2021-11-03T10:16:39Z","title":"LAION-400M: Open Dataset of CLIP-Filtered 400 Million Image-Text Pairs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.02114","snapshot_observed_at":"2026-08-06T21:07:44.079729Z","title":"LAION- 400M: open dataset of clip-filtered 400 million image-text pairs","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.079729Z"},"links":{"cited_paper":"/paper/2111.02114","citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:6a52d9499c130aac3767934306a98e3f90fd783cf634506600e48e4a3286bf41","observation_id":"f1d565d6-219c-41ed-b286-b83687af698d","resolution":{"observed_at":"2026-08-06T21:07:44.079729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:45.112879Z","title":"Gsrender: Dedupli- cated occupancy prediction via weakly supervised 3d gaus- sian splatting, 2024","venue":null,"work_id":"d5fe0bd0-f690-46d2-b148-ea2bd4256f24","year":2024},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.086243Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:a2eee6de2cd1713c0f14132673fae89bab1f2cb16b20f4562a2f27d62209a638","observation_id":"baf90487-c830-4b09-8db0-cf0c9f4a32be","resolution":{"observed_at":"2026-08-06T21:07:45.117661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:44.092479Z","title":"Llama: Open and efficient foundation lan- guage models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.092479Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:234ed14a28930cd1a4059808435eb5b19e44bad74cd93fab78687e5e98a234ae","observation_id":"3a1ba1c1-0ed4-4f34-a40c-12f8709cf312","resolution":{"observed_at":"2026-08-06T21:07:44.092479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:45.077862Z","title":"Llama 2: Open foundation and fine- tuned chat models, 2023","venue":null,"work_id":"f4f616c4-3e78-45d0-a75e-0b22120b6655","year":2023},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.099000Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:dbc05e701cb05779dead0444df6a0b4fb5dc5c327df9fef5a938ef9d18c18351","observation_id":"e2f123c0-3ec0-4c37-9432-779ed9a3975b","resolution":{"observed_at":"2026-08-06T21:07:45.085294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:45.052187Z","title":"Anytext: Multilingual visual text gener- ation and editing","venue":null,"work_id":"8ff1f242-9099-446f-b3d4-14650c87c021","year":2023},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.109747Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:f88ab5c1736d03017fe64c0e49f1d2c6da4e093e207b5140ab43097014072591","observation_id":"f24461fc-4c95-4b2d-bbe4-d58f9451e0ba","resolution":{"observed_at":"2026-08-06T21:07:45.063489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:44.117265Z","title":"Anytext2: Vi- sual text generation and editing with customizable attributes,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.117265Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:a894005db6b809dab33bc8394162c6e22cf9f447695ab936490fc00282ed6b16","observation_id":"3557ce56-9f8c-4c0f-8c73-8feb98e0b5ea","resolution":{"observed_at":"2026-08-06T21:07:44.117265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:45.019289Z","title":"Rectified diffusion: Straightness is not your need in rectified flow, 2024","venue":null,"work_id":"057e86b0-6d32-4a1a-a6ab-422af54f27a4","year":2024},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.123151Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:b2999220554908b29068385caeb01c5dbc70a04889a6b5d6e7d46be32c7863b7","observation_id":"dafd02e2-9225-47b9-aaea-76fd515de825","resolution":{"observed_at":"2026-08-06T21:07:45.024497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:44.129443Z","title":"Perceive, understand and restore: Real-world image super- resolution with autoregressive multimodal generative mod- els, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.129443Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:cf57a451daebf04f0351a6052a1e9dd060b579c21af89279ed6e8b44f5db0934","observation_id":"f8a01ebb-951d-4d13-b4ea-61ecd62c6ce7","resolution":{"observed_at":"2026-08-06T21:07:44.129443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01230","last_updated":"2025-05-26T13:01:08Z","snapshot_observed_at":"2026-07-06T20:15:45.334609Z","submitted_at":"2025-01-02T12:45:21Z","title":"Modeling Multi-Task Model Merging as Adaptive Projective Gradient Descent","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01230","snapshot_observed_at":"2026-08-06T21:07:44.134485Z","title":"Modeling multi-task model merg- ing as adaptive projective gradient descent","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.134485Z"},"links":{"cited_paper":"/paper/2501.01230","citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:88f5694bd381577a324c3077f64effef94698b0695b44b3d2490f4dd0df87fd3","observation_id":"522060b4-323c-494b-873b-20e3b2127e82","resolution":{"observed_at":"2026-08-06T21:07:44.134485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:44.980401Z","title":"Bts: a bi-lingual benchmark for text segmentation in the wild","venue":null,"work_id":"7b24df59-929e-424b-96b2-93c512501556","year":2022},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.141670Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:eae96aa02b6eb0734a59f052476c2cf7da0ff3a8dab8ed5777e2d9e93969b016","observation_id":"fe25d4dc-4367-4c39-93ab-3b1758a6d06d","resolution":{"observed_at":"2026-08-06T21:07:44.987704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.15915","last_updated":"2024-06-19T03:58:32Z","snapshot_observed_at":"2026-07-06T17:08:00.380938Z","submitted_at":"2023-12-26T07:20:55Z","title":"ChartBench: A Benchmark for Complex Visual Reasoning in Charts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.15915","snapshot_observed_at":"2026-08-06T21:07:44.147943Z","title":"Chartbench: A benchmark for complex visual reasoning in charts","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.147943Z"},"links":{"cited_paper":"/paper/2312.15915","citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:a55df653ef32006098809fb2babf8b2763ac4d570ca677c09e113e09925b7aab","observation_id":"5abc69fc-fd2d-4307-aa5a-84377c948c3f","resolution":{"observed_at":"2026-08-06T21:07:44.147943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:44.958619Z","title":"Chartmoe: Mixture of di- versely aligned expert connector for chart understanding","venue":null,"work_id":"99581c84-f764-44bd-af7e-f9be859e78c6","year":2025},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.155012Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:9f506f6a5aaeee778ca84b916ef72c9c012fe60bf2804f60804d5a6638f41812","observation_id":"0c31202c-0975-4b26-8f88-d1509db64f49","resolution":{"observed_at":"2026-08-06T21:07:44.964337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18259","last_updated":"2023-11-11T20:56:44Z","snapshot_observed_at":"2026-07-06T15:34:51.593721Z","submitted_at":"2023-05-29T17:27:59Z","title":"GlyphControl: Glyph Conditional Control for Visual Text Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18259","snapshot_observed_at":"2026-08-06T21:07:44.162209Z","title":"Glyphcontrol: Glyph condi- tional control for visual text generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.162209Z"},"links":{"cited_paper":"/paper/2305.18259","citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:163061bc02774307e937b45ca5de994f9d668c4501533884a9e0f4f336757af4","observation_id":"32bc8583-9f43-4e1a-8d30-0b3a2ede3a12","resolution":{"observed_at":"2026-08-06T21:07:44.162209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:44.937976Z","title":"Ip- adapter: Text compatible image prompt adapter for text-to- image diffusion models","venue":null,"work_id":"b107bfe2-b7e7-4bb4-a123-589af198ddc9","year":2023},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.168175Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:f9939086943074037fc3a0fb28333136affb371348c7196b6b68f22510e42078","observation_id":"f7fb9823-60f4-421d-af5d-afcb3b9cc4ff","resolution":{"observed_at":"2026-08-06T21:07:44.945489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:44.917587Z","title":"Hi-sam: Marrying segment anything model for hierarchical text segmentation","venue":null,"work_id":"d64341ab-0c6f-432f-a97a-1389a39a3696","year":2024},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.173914Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:948aa6496d239e1c4ed31a97a2f61e8ad3b6d032ad2e89ef59df200834f6793a","observation_id":"e89e5119-c991-4136-b5f7-70b5e9781984","resolution":{"observed_at":"2026-08-06T21:07:44.923547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:44.891219Z","title":"Artist: Improving the generation of text-rich images with disentan- gled diffusion models and large language models, 2024","venue":null,"work_id":"fb0d8e33-53bd-44e7-9c05-5e2789642ee3","year":2024},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.180598Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:88d65e10484a2126a7ec0f9c4c00816283849e6a04431b7477af7db00f64cd0f","observation_id":"aad58259-1dea-467c-a0de-cd284818e564","resolution":{"observed_at":"2026-08-06T21:07:44.898659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05543","last_updated":"2023-11-26T22:26:12Z","snapshot_observed_at":"2026-08-04T15:27:22.366324Z","submitted_at":"2023-02-10T23:12:37Z","title":"Adding Conditional Control to Text-to-Image Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05543","snapshot_observed_at":"2026-08-06T21:07:44.186728Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.186728Z"},"links":{"cited_paper":"/paper/2302.05543","citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:fd29f0dee261236348001dfc5f0db79c518d5386eedef8226c3192affe87848c","observation_id":"c5e97818-cffd-4158-8687-a9bcc2c1bd33","resolution":{"observed_at":"2026-08-06T21:07:44.186728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:44.868801Z","title":"Brush your text: Synthesize any scene text on im- ages via diffusion model, 2023","venue":null,"work_id":"ffd1b062-1c76-49f7-acca-3c4385ca8fc6","year":2023},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.191824Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:79a1657b76867b641589ce6ec24db4ffe3b164fa37eebc06da53bc01d60b9979","observation_id":"15123d1d-dc64-4163-9353-9272287b781d","resolution":{"observed_at":"2026-08-06T21:07:44.875641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:44.208944Z","title":"Metaxas, and Praveen Krishnan","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.208944Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:61451520ebda5067423f76ffb3d677b3fda2f37f4e6375e0d5fcdbdfbef88fb9","observation_id":"e013010e-7b22-478a-9dac-5799932759f4","resolution":{"observed_at":"2026-08-06T21:07:44.208944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:44.215339Z","title":"Udifftext: A unified frame- work for high-quality text synthesis in arbitrary images via character-aware diffusion models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.215339Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:e1caaafd75fc9cbe352d03b70062c61274a502e5054ebb1b95ac5c4201ed10d2","observation_id":"4d545e60-7feb-462e-aaf1-9755832c7f90","resolution":{"observed_at":"2026-08-06T21:07:44.215339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:44.820830Z","title":"A task is worth one word: Learning with task prompts for high-quality versatile image inpainting, 2023","venue":null,"work_id":"0da9e0ed-3ee0-4925-b036-554ecb793dfe","year":2023},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.221809Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:00db17e05152ecb1b51645cdba51cf67a97e7183ae8f0b50faa6d2a026262e5e","observation_id":"b423d296-bef3-413e-9c68-ed34d5f7fceb","resolution":{"observed_at":"2026-08-06T21:07:44.826533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:07:44.802674Z","title":"Colorflow: Retrieval- augmented image sequence colorization, 2024","venue":null,"work_id":"06a686ff-df83-4a29-a327-d56923e8e890","year":2024},"citing_paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T21:07:44.228190Z"},"links":{"citing_paper":"/paper/2507.00992"},"observation_digest":"sha256:ae32832fa5255bb5fd4ba16b8b9dd77eec81b74146098f2fcb18974f579e1638","observation_id":"9b7ba74b-e7fb-4925-a627-e4edbaa3c848","resolution":{"observed_at":"2026-08-06T21:07:44.808665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.00992","last_updated":"2025-07-02T04:08:46Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T13:03:24.791483Z","submitted_at":"2025-07-01T17:42:19Z","title":"UniGlyph: Unified Segmentation-Conditioned Diffusion for Precise Visual Text Synthesis"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":2,"verified_fuzzy":25},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 1 inbound Pith citation observation for arXiv:2507.00992."}