{"as_of":"2026-08-09T00:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:469b54decd8652024b3ea8a0e6d1aef257aa87f4c0391759428643effeafeed4","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T15:24:49.983611Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2512.17151/citation-record","integrity":"/paper/2512.17151/integrity","json":"/paper/2512.17151/citation-record.json","paper":"/paper/2512.17151"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:42.787589Z","title":"Ames, Xiangru Xu, Jessy W","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:42.787589Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:9ccf29a5fd0d167cf3d9b29227022e989fce36d96c484024813e7c4dcd433871","observation_id":"131deede-5ad4-4b78-86fa-85d4d683f9c6","resolution":{"observed_at":"2026-08-03T15:24:42.787589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:42.845339Z","title":"Blended diffusion for text-driven editing of natural images","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:42.845339Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:8e655ea1a2ed7e805dd1e597633623aa5ac03f3e04e58c9a02bf36426c816419","observation_id":"cdf072ed-86de-4181-b1c2-31c8b9ce3bb2","resolution":{"observed_at":"2026-08-03T15:24:42.845339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:42.952872Z","title":"In- structpix2pix: Learning to follow image editing instructions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:42.952872Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:4878e8014a1eca0651d6d3c7348a7d0cbcc0b8612b92111454975e341324a3ce","observation_id":"73998e9e-3c6f-40ab-aac6-b310a9b5456b","resolution":{"observed_at":"2026-08-03T15:24:42.952872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:43.029581Z","title":"Masactrl: Tuning-free mu- tual self-attention control for consistent image synthesis and editing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:43.029581Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:c48fbd5d16b080cc2697ef4a4dbc09d6a2ef2cac4795a395d7682885c8159759","observation_id":"f6959836-2bd3-40de-813a-a8e208a1c74d","resolution":{"observed_at":"2026-08-03T15:24:43.029581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:43.149785Z","title":"Attend-and-excite: Attention-based se- mantic guidance for text-to-image diffusion models.ACM transactions on Graphics (TOG), 42(4):1–10, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:43.149785Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:e48df97dc33f48911cc7566b79065f0b8af37beb3a6b3fbaf3ff5383e1fca277","observation_id":"fe08e747-cc24-46bd-997a-61a285192ac2","resolution":{"observed_at":"2026-08-03T15:24:43.149785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:43.262491Z","title":"Posta: A go-to framework for customized artistic poster gen- eration","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:43.262491Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:7e2a2fb30f2200551b5dd8548c55aa91cbf030daf5d8311c3061049caafbfef5","observation_id":"c3d88c4b-2aad-48d4-a78b-37b5b2de9ef3","resolution":{"observed_at":"2026-08-03T15:24:43.262491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:43.340077Z","title":"Textdiffuser: Diffusion models as text painters.Advances in Neural Information Processing Sys- tems, 36:9353–9387, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:43.340077Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:daa2557ff47fd7be5b73dfad9065626e9644db56628a7b4eeecaad562d63b455","observation_id":"7a9f5aab-d860-40c1-b883-1aebb0dac432","resolution":{"observed_at":"2026-08-03T15:24:43.340077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:43.422304Z","title":"Textdiffuser-2: Unleashing the power of language models for text rendering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:43.422304Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:af77860c4cda4a271529f8b36a93aa056dd090deab74a160c9d631f5100ad7b5","observation_id":"f90e2a39-27f0-4eb6-8126-5e5700d29d2c","resolution":{"observed_at":"2026-08-03T15:24:43.422304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:43.582392Z","title":"Training-free layout control with cross-attention guidance","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:43.582392Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:6a73afb092c4fd7ebd8382e0a93379f5202968a1aac4f343b7c968c5baba1840","observation_id":"70e53204-fdc6-4c47-9cac-a53281040b30","resolution":{"observed_at":"2026-08-03T15:24:43.582392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11427","last_updated":"2022-10-20T17:16:37Z","snapshot_observed_at":"2026-08-01T15:07:11.635426Z","submitted_at":"2022-10-20T17:16:37Z","title":"DiffEdit: Diffusion-based semantic image editing with mask guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.11427","snapshot_observed_at":"2026-08-03T15:24:43.681131Z","title":"Diffedit: Diffusion-based seman- tic image editing with mask guidance.arXiv preprint arXiv:2210.11427, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:43.681131Z"},"links":{"cited_paper":"/paper/2210.11427","citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:0b70390ec74387225e9f5ff1b8d9294b1bf348aaeec72949fd5f5126588fa9fc","observation_id":"c9225ee8-d207-4128-b868-c941bcffa928","resolution":{"observed_at":"2026-08-03T15:24:43.681131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03166","last_updated":"2021-07-07T11:49:14Z","snapshot_observed_at":"2026-08-07T05:59:02.438663Z","submitted_at":"2021-07-07T11:49:14Z","title":"FBC-GAN: Diverse and Flexible Image Synthesis via Foreground-Background Composition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03166","snapshot_observed_at":"2026-08-03T15:24:43.825588Z","title":"Fbc-gan: Diverse and flexible image synthesis via foreground-background composition.arXiv preprint arXiv:2107.03166, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:43.825588Z"},"links":{"cited_paper":"/paper/2107.03166","citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:e7498e988eac8b1546a89cea4bddeb37f87f093df785875ad149800deba6376f","observation_id":"d7381d9c-d298-446c-84a0-ed953299c896","resolution":{"observed_at":"2026-08-03T15:24:43.825588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04460","last_updated":"2024-12-05T18:59:18Z","snapshot_observed_at":"2026-08-06T18:59:38.223405Z","submitted_at":"2024-12-05T18:59:18Z","title":"LayerFusion: Harmonized Multi-Layer Text-to-Image Generation with Generative Priors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04460","snapshot_observed_at":"2026-08-03T15:24:43.938435Z","title":"Layerfusion: Harmo- nized multi-layer text-to-image generation with generative priors.arXiv preprint arXiv:2412.04460, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:43.938435Z"},"links":{"cited_paper":"/paper/2412.04460","citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:73298522ac1f431888b00cc0b9e18e2fcac3b220b8c7884c35b760ac68e2be9b","observation_id":"a4316021-2923-4946-b558-d4d0ee13d619","resolution":{"observed_at":"2026-08-03T15:24:43.938435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14683","last_updated":"2025-07-27T11:45:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-20T17:59:30Z","title":"Emerging Properties in Unified Multimodal Pretraining","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14683","snapshot_observed_at":"2026-08-03T15:24:44.046072Z","title":"Emerging properties in unified multimodal pretraining.arXiv preprint arXiv:2505.14683, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:44.046072Z"},"links":{"cited_paper":"/paper/2505.14683","citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:d1f556014e0b5dcb653294cc6acdcb6ac29ddc27d36f742335ddc64431fc588a","observation_id":"c46352bc-d703-4f39-8d30-9010852dbc9c","resolution":{"observed_at":"2026-08-03T15:24:44.046072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:44.188172Z","title":"Salient object-aware background genera- tion using text-guided diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:44.188172Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:be8c511376c2bdd9422e499bbfd6bccfeb2cb4ae7612fd81a94ef1e46dac1cdd","observation_id":"a744a7b2-0ef3-4b3c-a24e-e7086ffa7b3b","resolution":{"observed_at":"2026-08-03T15:24:44.188172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:44.306393Z","title":"A barrier function method for the optimization of trajectory functionals with constraints","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:44.306393Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:763334067497da7d4d026e31230e185cf27cc40ae14ce74eabe91e27a33723f8","observation_id":"50a20055-8832-41f4-a306-48a854f8eae7","resolution":{"observed_at":"2026-08-03T15:24:44.306393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-08-03T15:24:44.312226Z","title":"Prompt-to-prompt im- age editing with cross attention control.arXiv preprint arXiv:2208.01626, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:44.312226Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:f9c71b5890682e9f215d14eb2daab6a36dafba640c183861b20f36e3dd51fbc3","observation_id":"067cb5cb-8930-4b5d-9689-af15f02caf94","resolution":{"observed_at":"2026-08-03T15:24:44.312226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05135","last_updated":"2024-03-08T08:08:10Z","snapshot_observed_at":"2026-08-04T23:51:18.339338Z","submitted_at":"2024-03-08T08:08:10Z","title":"ELLA: Equip Diffusion Models with LLM for Enhanced Semantic Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05135","snapshot_observed_at":"2026-08-03T15:24:44.338397Z","title":"Ella: Equip diffusion models with llm for enhanced semantic alignment.arXiv preprint arXiv:2403.05135, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:44.338397Z"},"links":{"cited_paper":"/paper/2403.05135","citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:b27cc59c274be7f853c6d6705107efb27000576b7da47ac90f49a035c3a9ed69","observation_id":"5069d3de-37d7-4c7a-a3f3-b4d7b896070a","resolution":{"observed_at":"2026-08-03T15:24:44.338397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:44.426736Z","title":"Layerdiff: Exploring text-guided multi-layered composable image synthesis via layer-collaborative diffu- sion model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:44.426736Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:4ba74a0acf1b9d510f939737c16b71407437e9c334c3300bea0de773abb0b7aa","observation_id":"9f5a110c-ec25-42f1-838d-2826168a5b34","resolution":{"observed_at":"2026-08-03T15:24:44.426736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:44.699689Z","title":"Diffusion model-based image editing: A survey.IEEE Transactions on Pattern Analysis and Machine Intelligence, 47(6):4409–4437, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:44.699689Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:064d83800a770475c1549a19f75d67f4ed2ada6ba0cd5d5d65f656d7d7a0f63e","observation_id":"b5daab9b-44f6-4fd7-80e0-20f59a63360c","resolution":{"observed_at":"2026-08-03T15:24:44.699689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:44.833461Z","title":"Opencole: Towards reproducible automatic graphic design generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:44.833461Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:6ed2ba18e531ea66db67075ac5c9fef2f2861e53feed2a29b5109bed8db25538","observation_id":"fe5ea067-0a62-4895-87d8-77c5cca46b33","resolution":{"observed_at":"2026-08-03T15:24:44.833461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:44.937499Z","title":"Brushnet: A plug-and-play image inpainting model with decomposed dual-branch diffusion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:44.937499Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:70f9ed22b35d3830eeaeb5b70e0553d4c2e74f3651b687dd0bbad2921169c92e","observation_id":"d51e02b7-1da3-4934-8953-3b1c2968e480","resolution":{"observed_at":"2026-08-03T15:24:44.937499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:45.088443Z","title":"Multiple gan inversion for exemplar-based image-to-image translation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:45.088443Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:1b48437d66514bc5b42fc67de480d649ce62af81c2357db65d9660df4dde2e21","observation_id":"4b60eea5-8e17-4a10-92dc-6aa795f3c1c7","resolution":{"observed_at":"2026-08-03T15:24:45.088443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16819","last_updated":"2026-05-19T15:22:52Z","snapshot_observed_at":"2026-08-01T07:12:14.758494Z","submitted_at":"2025-05-22T15:54:42Z","title":"Character-Centered Dialogue Generation from Scene-Level Prompts","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16819","snapshot_observed_at":"2026-08-03T15:24:45.295351Z","title":"Action2dialogue: Generating character-centric narratives from scene-level prompts.arXiv preprint arXiv:2505.16819, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:45.295351Z"},"links":{"cited_paper":"/paper/2505.16819","citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:9346e46c9ccd32627887df902214bf32f4c66268a24b965a4c2f8f6e44f6af19","observation_id":"8fc33ea0-2946-47ab-8c23-e2955c88ec14","resolution":{"observed_at":"2026-08-03T15:24:45.295351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:45.457749Z","title":"Automatic determination of text readability over textured backgrounds for augmented reality systems","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:45.457749Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:dfdfc6e61adeafc5050797fd26cf7451a5807752437b5bb7ed5cb1ad3deca0c5","observation_id":"3f862fac-06ee-4f1b-8989-a371f1377766","resolution":{"observed_at":"2026-08-03T15:24:45.457749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:45.620025Z","title":"Relation-aware diffusion model for controllable poster layout generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:45.620025Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:2680c26aa5a34a6bf73b6adf060b632bfffa8d7f6957a7be7d831c14285f792f","observation_id":"35cecc87-e44f-4c06-b9ab-090dcb87b493","resolution":{"observed_at":"2026-08-03T15:24:45.620025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:45.772310Z","title":"Layerdiffusion: Layered controlled image editing with dif- fusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:45.772310Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:1274a2111a3a9b5d464a5cc678c88e48cd666770284bc93cb3029d81a00d14c7","observation_id":"5cc7ea7b-fbc0-4309-9f88-ee4b00d9a419","resolution":{"observed_at":"2026-08-03T15:24:45.772310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:45.893166Z","title":"Gligen: Open-set grounded text-to-image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:45.893166Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:f63dfd9d5b809d819d6dedfc1432b46bac3ebd7c115bb2ccabcb3434e5342b99","observation_id":"da7cb8a7-56f8-45c6-b8e5-c19597551d71","resolution":{"observed_at":"2026-08-03T15:24:45.893166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08822","last_updated":"2024-09-03T07:42:44Z","snapshot_observed_at":"2026-08-05T13:30:57.339252Z","submitted_at":"2023-12-14T11:11:50Z","title":"Planning and Rendering: Towards Product Poster Generation with Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08822","snapshot_observed_at":"2026-08-03T15:24:46.040629Z","title":"Planning and rendering: Towards prod- uct poster generation with diffusion models.arXiv preprint arXiv:2312.08822, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:46.040629Z"},"links":{"cited_paper":"/paper/2312.08822","citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:d0a858b542f825162cf0faff406df66edea2345b8658b3783306c2e0eb7ff9fa","observation_id":"56330e0a-39bb-4243-a496-017f1a5f18b4","resolution":{"observed_at":"2026-08-03T15:24:46.040629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:46.185236Z","title":"Repaint: Inpainting using denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:46.185236Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:c367306415a4064b8cb08436ad3b50375c07c7c919c2986f01e0be185ddbe351","observation_id":"a3b5509d-c132-4562-aac4-c0fee1140a05","resolution":{"observed_at":"2026-08-03T15:24:46.185236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:46.415149Z","title":"Layoutllm: Layout instruction tuning with large language models for document understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:46.415149Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:12a129c4b1246c6d010d53e5ec7ee4e7ab83e91e86257023b9067129e9854df7","observation_id":"87342198-2089-41dd-b807-6814a939f035","resolution":{"observed_at":"2026-08-03T15:24:46.415149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:46.639212Z","title":"Hico: Hierarchical controllable diffu- sion model for layout-to-image generation.Advances in Neu- ral Information Processing Systems, 37:128886–128910,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:46.639212Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:35cb1c85bf25a78015208fd829fbaa5da910a8f42beb505e027c581bc327eaf2","observation_id":"a9bd597b-8b42-4a52-b962-e6c713375585","resolution":{"observed_at":"2026-08-03T15:24:46.639212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:46.867225Z","title":"Sawna: Space-aware text to image generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:46.867225Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:7dadb9950db0f9043e32927b9c59240874df2c0481425152ecd3d7980b89c2f6","observation_id":"747d2cd4-449d-46f5-9cb7-95416d7ad018","resolution":{"observed_at":"2026-08-03T15:24:46.867225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:47.008397Z","title":"Gpt-4o: Openai’s most advanced generative text and vision model.https://openai.com/index/ hello-gpt-4o/, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:47.008397Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:9df501b6746364fd22c4ac4c889b9d87f604b6305dc35f46c02f3c3c5fdddd90","observation_id":"54dc6382-e3cd-4704-9abb-1244bb49d95c","resolution":{"observed_at":"2026-08-03T15:24:47.008397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:47.241872Z","title":"Introducing gpt-5.https://openai.com/ index/introducing-gpt-5/, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:47.241872Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:b813b06bf1b0ce9b51d6b773eda9d7686a0a41aa360d7d32d520367a59077957","observation_id":"cf19e76d-5f84-4fa5-be1f-5227b830d7f1","resolution":{"observed_at":"2026-08-03T15:24:47.241872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:47.395463Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:47.395463Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:92a2a0da1b304a704cdf49d7fdf7398d30675156c1350b693c8dbd18ededa4e8","observation_id":"2226e346-02f3-45de-8b54-3b6bc96c9911","resolution":{"observed_at":"2026-08-03T15:24:47.395463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:47.570614Z","title":"Contrast mea- sures for predicting text readability","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:47.570614Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:ffc105ec3802d133a3afe5222c095c01fa295a125f62c7044e03891de406ca6d","observation_id":"730e10e8-d833-4c78-9108-f841c2309a93","resolution":{"observed_at":"2026-08-03T15:24:47.570614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:47.735639Z","title":"Discriminability measures for predicting readability of text on textured backgrounds.Optics express, 6(4):81–91, 2000","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:47.735639Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:1bbf4c4d4a9ebdddb2233fe71337428e986b30e4c4d2a5d91b410c23fec9a3e3","observation_id":"9faef261-e560-4738-8664-2d51d8ce4224","resolution":{"observed_at":"2026-08-03T15:24:47.735639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16157","last_updated":"2024-01-29T13:42:01Z","snapshot_observed_at":"2026-07-06T17:21:51.054477Z","submitted_at":"2024-01-29T13:42:01Z","title":"Spatial-Aware Latent Initialization for Controllable Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16157","snapshot_observed_at":"2026-08-03T15:24:47.931336Z","title":"Spatial-aware latent initialization for controllable image gen- eration.arXiv preprint arXiv:2401.16157, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:47.931336Z"},"links":{"cited_paper":"/paper/2401.16157","citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:5117d168893f9e67b8b466abb2990c29d7010934568d7bedaedd810b3dab847d","observation_id":"27e9a6dc-5f86-4ab2-b0e3-28df43bad43b","resolution":{"observed_at":"2026-08-03T15:24:47.931336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:48.159850Z","title":"Web content accessi- bility guidelines 2.1","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:48.159850Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:2e8f981f745413fadc24b522628ec7937116a81010c20c2a1056684b8e79442a","observation_id":"6cc56ff9-011e-4b29-af39-004aab0b44ad","resolution":{"observed_at":"2026-08-03T15:24:48.159850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15090","last_updated":"2023-06-13T17:38:20Z","snapshot_observed_at":"2026-07-06T13:57:58.305779Z","submitted_at":"2022-09-29T20:49:25Z","title":"Enforcing Hard Constraints with Soft Barriers: Safe Reinforcement Learning in Unknown Stochastic Environments","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15090","snapshot_observed_at":"2026-08-03T15:24:48.599709Z","title":"Enforcing hard constraints with soft barriers: Safe reinforcement learning in unknown stochastic environments.ArXiv, abs/2209.15090, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:48.599709Z"},"links":{"cited_paper":"/paper/2209.15090","citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:1635eed71ca4916d02066e6d51767d8a5dc8d316f958cc235ab32b0d565ce68d","observation_id":"3df208ff-baa3-4e65-80e2-4b8267414622","resolution":{"observed_at":"2026-08-03T15:24:48.599709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:48.736865Z","title":"Designdiffusion: High- quality text-to-design image generation with diffusion mod- els","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:48.736865Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:ba2eb8678b83ed5ce8c375c9d6e8c4d46f99eb674b447219022fac06d39abf6f","observation_id":"0e1433d6-7eff-48a1-97c1-25a068908b76","resolution":{"observed_at":"2026-08-03T15:24:48.736865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:48.882840Z","title":"Desigen: A pipeline for controllable design template generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:48.882840Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:1af7cfefbc7bacf97f5cadc9ff0fd5b3cf4782ebd75c1f758c2e6260b92c9693","observation_id":"7f1a64b0-6a4c-4e2b-bf11-148913857ef9","resolution":{"observed_at":"2026-08-03T15:24:48.882840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:49.027281Z","title":"Boxdiff: Text-to-image synthesis with training-free box-constrained diffusion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:49.027281Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:f723c17572d7c585aacd0e7c69a8bbe0008b10cb2d96876b4f9548a3c467a261","observation_id":"3059c9c9-180f-4bd4-a5f8-88177fef2cdb","resolution":{"observed_at":"2026-08-03T15:24:49.027281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:49.196838Z","title":"Mastering text-to-image diffu- sion: Recaptioning, planning, and generating with multi- modal llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:49.196838Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:2c74c00e0865c7df4abb3dc32d9546908ea7687bff8da23fc9f303ac7395ca0b","observation_id":"51226779-b2d8-44c5-9914-8f78c08ca7ca","resolution":{"observed_at":"2026-08-03T15:24:49.196838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17113","last_updated":"2024-06-23T03:47:27Z","snapshot_observed_at":"2026-08-07T05:26:05.587260Z","submitted_at":"2024-02-27T01:19:53Z","title":"Transparent Image Layer Diffusion using Latent Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17113","snapshot_observed_at":"2026-08-03T15:24:49.440605Z","title":"Transparent image layer diffusion using latent transparency.arXiv preprint arXiv:2402.17113, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:49.440605Z"},"links":{"cited_paper":"/paper/2402.17113","citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:81795449887045c4ed15fb949a22fc48cde82ff72f0de9a75fdf7ee77a754726","observation_id":"e6d91a74-f4fc-447d-a1ae-f0816d90cda4","resolution":{"observed_at":"2026-08-03T15:24:49.440605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10890","last_updated":"2025-06-12T16:54:39Z","snapshot_observed_at":"2026-08-08T11:46:00.759937Z","submitted_at":"2025-06-12T16:54:39Z","title":"CreatiPoster: Towards Editable and Controllable Multi-Layer Graphic Design Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10890","snapshot_observed_at":"2026-08-03T15:24:49.697863Z","title":"Creatiposter: Towards editable and control- lable multi-layer graphic design generation.arXiv preprint arXiv:2506.10890, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:49.697863Z"},"links":{"cited_paper":"/paper/2506.10890","citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:03c0e25e32692a1529130264307a407bb5ad1415ef565123252bae628f2d44b0","observation_id":"844b82df-f07b-4b27-9111-199762691dac","resolution":{"observed_at":"2026-08-03T15:24:49.697863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:49.815339Z","title":"Layoutdiffusion: Controllable diffu- sion model for layout-to-image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:49.815339Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:7be0767f92cd29633d8163d3a368251f948bb08e618c3a32dd945709d9899c66","observation_id":"2b2d97bf-5296-4bc1-9901-7fd406cad4cc","resolution":{"observed_at":"2026-08-03T15:24:49.815339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:49.900562Z","title":"Human computer interaction: Legibility and contrast","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:49.900562Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:3c890a4e4c11a4d8c26b86ef280a24da6507384a52f79c95bc6119874a795ed2","observation_id":"f13e40bb-108a-460f-a848-b94a00b26993","resolution":{"observed_at":"2026-08-03T15:24:49.900562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:49.983611Z","title":"Add a cream background with snowflakes","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:49.983611Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:f63002deed6737a924c42e2e7f21283d65a53b542e85762e1ef36562008250dc","observation_id":"8a30063c-c0fc-4c2b-b79b-74b2b5755f65","resolution":{"observed_at":"2026-08-03T15:24:49.983611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:24:48.338646Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-03T15:24:48.338646Z"},"links":{"citing_paper":"/paper/2512.17151"},"observation_digest":"sha256:819293d5ed082aa92e7353184dbd771acee9d55d06aa0a642c3ec2c5b587ef5c","observation_id":"fd523e79-7c7d-4143-8bd3-1ef2e7053855","resolution":{"observed_at":"2026-08-03T15:24:48.338646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2512.17151","last_updated":"2026-06-27T04:37:17Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T12:04:36.072147Z","submitted_at":"2025-12-19T01:10:24Z","title":"Text-Conditioned Background Generation for Editable Multi-Layer Documents"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":50,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 0 inbound Pith citation observations for arXiv:2512.17151."}