{"as_of":"2026-08-21T21:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f60c7a253a3be55cd1fd05ad7ef5deff508f33cb6c1a5b4e6189ce107253a09a","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:34:49.638653Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T19:17:19.634242Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04347","snapshot_observed_at":"2026-07-11T19:17:19.634242Z","title":"arXiv preprint arXiv:2505.04347 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04423","last_updated":"2026-07-07T07:27:22Z","snapshot_observed_at":"2026-08-04T06:57:07.480777Z","submitted_at":"2026-07-05T17:33:59Z","title":"Transferability Between Understanding and Generation in Unified Multimodal Models","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-11T19:17:19.634242Z"},"links":{"cited_paper":"/paper/2505.04347","citing_paper":"/paper/2607.04423"},"observation_digest":"sha256:494902d63c17b2c5266d3c85ee44ec7dd1b30af845caffe9b426060415d16b68","observation_id":"4a0bf9cf-6974-4ea1-97d6-cf4406cf7544","resolution":{"observed_at":"2026-07-11T19:17:19.634242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.04347/citation-record","integrity":"/paper/2505.04347/integrity","json":"/paper/2505.04347/citation-record.json","paper":"/paper/2505.04347"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-08-14T22:54:08.184266Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-15T23:34:49.456894Z","title":"Sdxl: Improving latent diffusion models for high-resolution image synthesis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.456894Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:f92612e0ddbd1bee09e59093ca24156646e109c80b6e425b9701ee0b761c7127","observation_id":"4145f01c-9bbc-4820-9dfd-360182efb716","resolution":{"observed_at":"2026-08-15T23:34:49.456894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:50.194779Z","title":"Midjourney,","venue":null,"work_id":"88e24992-6007-4e92-85d1-1998ed9b9147","year":2022},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.463562Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:df89b8e97cce0af8989a8fc0490319698c541fe698f584230bd6d53b7c8e5b09","observation_id":"e05bc6a4-b9ec-4f7c-b7d4-dceaf9e64b83","resolution":{"observed_at":"2026-08-15T23:34:50.199187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:50.181021Z","title":"Dall-e: Creating images from text,","venue":null,"work_id":"4b96e63c-c141-4f97-9e59-d1e71fd5bdec","year":2021},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.468377Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:34672c1d5dceb5ad7cdf78c1668074a56c534021b8186c9ed77dfc1efe6fa180","observation_id":"e8c2edc8-54c6-4271-be29-5b5ba9d15bfb","resolution":{"observed_at":"2026-08-15T23:34:50.185116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:50.166437Z","title":null,"venue":null,"work_id":"f36a2850-9764-41b7-8a12-d40fd581a2d2","year":2023},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.472689Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:0e49ce041d7a9a54ad41e23ac33896f86e1035b8bdb95149d65d677b06b9ab85","observation_id":"c27bf65b-3b18-4f27-b68c-4ff56a74b6d3","resolution":{"observed_at":"2026-08-15T23:34:50.171380Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:50.152565Z","title":"Photorealistic text-to-image diffusion models with deep language understanding,","venue":null,"work_id":"41e430b4-6c8a-445e-b2ae-d57de03ed2c1","year":2022},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.477036Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:0859fb3283f660cb328a5812641b1d79c035729dd417e93d16c899824cfb5140","observation_id":"7725f788-46c3-4ba5-9b80-88dd401393ff","resolution":{"observed_at":"2026-08-15T23:34:50.158200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:50.138010Z","title":"Ranni: Taming text-to-image diffusion for accurate instruction following,","venue":null,"work_id":"cafa77c8-73a9-46c2-a3e4-5b58cc6fdccd","year":2024},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.481759Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:97589385e14d9714b78607dbdca8cc781fa576b9af49bf66b882e5f67620065c","observation_id":"6fd5c28a-0b34-40b4-9bc9-89d5c7340dce","resolution":{"observed_at":"2026-08-15T23:34:50.143031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:50.124906Z","title":"Scenecomposer: Any-level semantic image synthesis,","venue":null,"work_id":"f731db80-6d22-4ecf-bf4f-87ebee89ab78","year":2023},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.486351Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:fa9b598227497137940b00c49a62ae44947ae12411405e013c0583a3529c4da1","observation_id":"ffc1831e-f0e3-4e35-bf10-641ee1f422ea","resolution":{"observed_at":"2026-08-15T23:34:50.129583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:49.490509Z","title":"Dense text-to-image generation with attention modulation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.490509Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:0c694b02741fb13d087b90414d2345cc17058e5c38365c566cc62b396099db33","observation_id":"c9fb6e4a-0dd7-48ea-957b-e240f2988ad8","resolution":{"observed_at":"2026-08-15T23:34:49.490509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:50.099444Z","title":"Boxdiff: Text-to-image synthesis with training-free box-constrained diffusion,","venue":null,"work_id":"a496c9e8-cffe-45cc-a44a-e53ec2324a80","year":2023},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.495759Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:0ed27f7a27c947184db4f0f2bfb20056d521d3a6bdabc6c16212b7450ca1e6ec","observation_id":"e570dea4-82a6-4cd4-b7f8-379fc5064c97","resolution":{"observed_at":"2026-08-15T23:34:50.103877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:50.084882Z","title":"Layoutllm-t2i: Eliciting layout guidance from llm for text-to-image generation,","venue":null,"work_id":"cbdbb58a-dae2-4541-8d29-41c3ded0575e","year":2023},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.501632Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:3a0646aadde346ec48ca2427c3fa2f96745cc256af86b2e533f5cb70603afcf5","observation_id":"08dabad3-ee7e-469c-9c0d-286bc80078e7","resolution":{"observed_at":"2026-08-15T23:34:50.090030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03290","last_updated":"2024-02-05T18:49:17Z","snapshot_observed_at":"2026-08-20T12:02:18.908954Z","submitted_at":"2024-02-05T18:49:17Z","title":"InstanceDiffusion: Instance-level Control for Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03290","snapshot_observed_at":"2026-08-15T23:34:49.506636Z","title":"Instancediffusion: Instance-level control for image generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.506636Z"},"links":{"cited_paper":"/paper/2402.03290","citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:d87890e74dc04f425734139c995738dadde060c0f58d2124d455ce52b847e0e3","observation_id":"84e9e039-4a30-41d0-a4b8-60eb03f2ac1c","resolution":{"observed_at":"2026-08-15T23:34:49.506636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:50.072237Z","title":"Adding conditional control to text-to-image diffusion models,","venue":null,"work_id":"15496cfd-170f-445f-807b-6dd65d6d2692","year":2023},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.510898Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:a62d4e5e9b20aaf4c7b3b8208d6f98e069e0b1481651c42748549abd04270902","observation_id":"18303534-186e-4068-a9e0-47fbdb27801f","resolution":{"observed_at":"2026-08-15T23:34:50.076127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02236","last_updated":"2023-06-04T02:33:12Z","snapshot_observed_at":"2026-08-20T18:52:11.288941Z","submitted_at":"2023-06-04T02:33:12Z","title":"Detector Guidance for Multi-Object Text-to-Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02236","snapshot_observed_at":"2026-08-15T23:34:49.514493Z","title":"Detector guidance for multi-object text-to-image generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.514493Z"},"links":{"cited_paper":"/paper/2306.02236","citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:f1e3921ea628ab0c9d20641efe71297fd24fdfd3846b60f740c776ee49aad7fe","observation_id":"8d6e6530-cfee-4ef3-a0fa-4a03b2d84996","resolution":{"observed_at":"2026-08-15T23:34:49.514493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:50.059436Z","title":"Adver- sarial supervision makes layout-to-image diffusion models thrive,","venue":null,"work_id":"5a0d96f2-422e-4d4d-968c-adc15f59ac14","year":2024},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.519704Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:d7b15486ca428a08b5753cc7b9cdea44abd85ddf1ab5fe93e40dbf8f69df7bbf","observation_id":"93c59ef0-0131-412c-8038-b93fbc616166","resolution":{"observed_at":"2026-08-15T23:34:50.063918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:50.047111Z","title":"Grounded sam: Assembling open-world models for diverse visual tasks,","venue":null,"work_id":"d7df97a7-9418-4fdc-ab09-1be312124c62","year":2024},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.524371Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:4080c603093bd3c92f5e59a1d640a5abea1a6b7cc5c909469702b7a7067097c0","observation_id":"6723baa8-a5df-4781-9d06-ab62a4ad985b","resolution":{"observed_at":"2026-08-15T23:34:50.051675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:49.528196Z","title":"Denoising diffusion prob- abilistic models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.528196Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:92b83922cb43de929953d9e1db9bd93ab216956a8934a1b3b85809125414eaec","observation_id":"916f5dd8-df16-49e9-b172-051130abaec6","resolution":{"observed_at":"2026-08-15T23:34:49.528196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:49.534871Z","title":"High-resolution image synthesis with latent diffu- sion models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.534871Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:982cc7a890326c6d48502d0949e498c81eab4ea76b3e7dfab3e52ad5c1ba0d3e","observation_id":"0ba393e3-15c2-4216-a76d-26752235c282","resolution":{"observed_at":"2026-08-15T23:34:49.534871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.02938","last_updated":"2021-09-15T04:03:34Z","snapshot_observed_at":"2026-08-20T11:19:23.396940Z","submitted_at":"2021-08-06T04:43:13Z","title":"ILVR: Conditioning Method for Denoising Diffusion Probabilistic Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.02938","snapshot_observed_at":"2026-08-15T23:34:49.542272Z","title":"Ilvr: Conditioning method for denoising diffusion probabilistic models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.542272Z"},"links":{"cited_paper":"/paper/2108.02938","citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:ec100fe1159e91c68d0c78da47cf93a96e530edce2eea13b490b6840380f1a96","observation_id":"1a22c75f-156b-4746-9f7b-f05e03f0b2eb","resolution":{"observed_at":"2026-08-15T23:34:49.542272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:49.547587Z","title":"Diffusion models beat gans on image synthesis,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.547587Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:e26c8f8de9af85870f8d45b103eea387ccecaa55dc999fb31a89ee559742239d","observation_id":"fede20ef-04fe-45cf-a1a1-2111c017be9f","resolution":{"observed_at":"2026-08-15T23:34:49.547587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.01073","last_updated":"2022-01-05T00:07:35Z","snapshot_observed_at":"2026-08-20T14:05:04.144690Z","submitted_at":"2021-08-02T17:59:47Z","title":"SDEdit: Guided Image Synthesis and Editing with Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.01073","snapshot_observed_at":"2026-08-15T23:34:49.552444Z","title":"Sdedit: Image synthesis and editing with stochastic differential equations,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.552444Z"},"links":{"cited_paper":"/paper/2108.01073","citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:e8c6c23283006acf9304b366d98235ae739490f4534550f524c653c4a237ce8b","observation_id":"2d8022e9-ad05-4a36-8bbd-dbe244ae0228","resolution":{"observed_at":"2026-08-15T23:34:49.552444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:49.556576Z","title":"Deep unsupervised learning using nonequilibrium thermody- namics,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.556576Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:01ff1534d4156056cac831c639a9427c6c32c73d26714cd77ef6b7ddcd9ceb44","observation_id":"21ed3ec9-0a56-40e4-ac07-8b7315a23179","resolution":{"observed_at":"2026-08-15T23:34:49.556576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:50.002246Z","title":"Modelscope text-to-video technical report,","venue":null,"work_id":"455b5680-75af-4f1f-93f3-4e0203bef7b7","year":2023},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.561178Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:55f283a211da4a3dec74409db8e1e3a6fdf005cca5d5e761b3e0f18c0c927c1b","observation_id":"e7665c01-b9be-41a5-84ad-6c74b0077265","resolution":{"observed_at":"2026-08-15T23:34:50.006383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:49.989858Z","title":"Magictime: Time-lapse video generation models as metamorphic simulators,","venue":null,"work_id":"323f3329-4123-47ba-a867-4e142097dc6c","year":2024},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.566223Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:2b492c1abdafc2a32ded682ae6b9ea5a442dcb816997c97dd4540051b0aed03e","observation_id":"54a089f0-818a-4020-b419-12d0c6d46456","resolution":{"observed_at":"2026-08-15T23:34:49.993881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:49.977488Z","title":"Champ: Controllable and consistent human image animation with 3d parametric guidance,","venue":null,"work_id":"0e0d5ef6-ea68-4d70-b531-99a0f3652e56","year":2024},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.570538Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:8f386c59be695b4a9ec05d0556bad56cd3b659734c2701d07f54f3fa052b96ac","observation_id":"a68c36cf-fdce-4825-926d-e267396a2faf","resolution":{"observed_at":"2026-08-15T23:34:49.981914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:49.964564Z","title":"Renderdiffusion: Image diffusion for 3d reconstruction, inpainting and generation,","venue":null,"work_id":"7889075a-3eef-4545-96e8-e90798ac3de4","year":2023},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.579029Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:600f06e2d53f7cff4b9fcc631d69a20720c65cc5f22af0f90e742008463a717b","observation_id":"10a15bf3-4321-4554-b0a8-30db7947d738","resolution":{"observed_at":"2026-08-15T23:34:49.969200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.17843","last_updated":"2023-07-23T21:27:30Z","snapshot_observed_at":"2026-08-20T12:03:29.864144Z","submitted_at":"2023-06-30T17:59:08Z","title":"Magic123: One Image to High-Quality 3D Object Generation Using Both 2D and 3D Diffusion Priors","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.17843","snapshot_observed_at":"2026-08-15T23:34:49.584217Z","title":"Magic123: One image to high-quality 3d object generation using both 2d and 3d diffusion priors,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.584217Z"},"links":{"cited_paper":"/paper/2306.17843","citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:9a52c3588cf1cdbcef02d9ca066112a447dd39b1b4d9a86c09f3b2a1b56332fe","observation_id":"54971bf6-857a-4dab-9d6e-47187e1d5896","resolution":{"observed_at":"2026-08-15T23:34:49.584217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:49.948961Z","title":"Generative adversarial text to image synthesis,","venue":null,"work_id":"7b6a9d70-b988-4e39-ac6e-f70c96717843","year":2016},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.589320Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:3c121b1e2148bcf6cddcdcb00351082b8bcc8374ddf236196227325f01358d76","observation_id":"59e6cd46-290b-4d87-aa74-f1fa42c239a8","resolution":{"observed_at":"2026-08-15T23:34:49.953963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:49.933690Z","title":"Learning what and where to draw,","venue":null,"work_id":"82cd2b7e-3f41-4e65-848d-a72789310b59","year":2016},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.594418Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:698862ed5eb94b9abd373f77d326f764e9c7cb3dedd7f1db3bcfa8bb9a9fa264","observation_id":"6794cd72-9dc2-4422-ab7e-0ae492f07ca7","resolution":{"observed_at":"2026-08-15T23:34:49.938990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:49.918532Z","title":"More control for free! image synthesis with semantic diffusion guidance,","venue":null,"work_id":"9d63d0d6-c2df-438d-a634-f5ab24d1e308","year":2023},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.598726Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:47b403b4351f628fc0b5b7a352047c504095b53f1266b4b7aeff1f0b0e4a6bcd","observation_id":"99fcc02b-c39d-48b8-bb5a-9d7d51a4c3f3","resolution":{"observed_at":"2026-08-15T23:34:49.922934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-08-14T06:37:15.299690Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-15T23:34:49.603495Z","title":"Classifier-free diffusion guidance,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.603495Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:2c8134d662433e4807e3130c92903b840af323eef6ee93d27f2950ab61b10540","observation_id":"f9bde8c2-961e-4a71-97e5-4785454e9a4c","resolution":{"observed_at":"2026-08-15T23:34:49.603495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:49.903827Z","title":"Universal guidance for diffusion models,","venue":null,"work_id":"a1c44511-835c-476f-84b7-5e24643e8ccf","year":2023},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.607733Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:4f9f8a378826051367f23487da99970df76ea3602630441b4d295a76772befbe","observation_id":"066dd14a-411d-4662-a245-81dc84285ff7","resolution":{"observed_at":"2026-08-15T23:34:49.908918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:49.889102Z","title":"Inversion-based style transfer with diffusion models,","venue":null,"work_id":"9fe0754a-b664-44dc-8f79-329b0717a4f8","year":2023},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.611759Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:3152f76c8dc909b72b4c282905c4a5e4d0cd3eb1e77bc2da5cecfdbf10ef191a","observation_id":"002b2295-fb98-4f8d-9bad-3ab304d1a9c2","resolution":{"observed_at":"2026-08-15T23:34:49.894032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-08-17T00:44:11.103098Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-08-15T23:34:49.615908Z","title":"Prompt-to-prompt image editing with cross attention control,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.615908Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:01d929db80bdba6533c6385bb3d83864a63776e634565578e207e749c3a2eac6","observation_id":"a257889d-918d-4509-9b11-e4da488fc5bb","resolution":{"observed_at":"2026-08-15T23:34:49.615908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10210","last_updated":"2024-06-14T17:46:08Z","snapshot_observed_at":"2026-08-16T13:42:52.013374Z","submitted_at":"2024-06-14T17:46:08Z","title":"Make It Count: Text-to-Image Generation with an Accurate Number of Objects","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10210","snapshot_observed_at":"2026-08-15T23:34:49.620099Z","title":"Make it count: Text-to-image generation with an accurate number of objects,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.620099Z"},"links":{"cited_paper":"/paper/2406.10210","citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:6ad3a9f25f1ff6139228d0fb3a99b65dcf2d2362cd9c1dd80940512be66c9eb2","observation_id":"9a849933-5def-4fc9-af78-cbfbc2848ac4","resolution":{"observed_at":"2026-08-15T23:34:49.620099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04692","last_updated":"2024-03-17T16:59:25Z","snapshot_observed_at":"2026-08-20T12:02:18.410348Z","submitted_at":"2024-03-07T17:41:37Z","title":"PixArt-\\Sigma: Weak-to-Strong Training of Diffusion Transformer for 4K Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04692","snapshot_observed_at":"2026-08-15T23:34:49.624612Z","title":"Pixart- \\sigma: Weak-to-strong training of diffusion transformer for 4k text-to- image generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.624612Z"},"links":{"cited_paper":"/paper/2403.04692","citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:fa41f8e2a817340f261430b88bc17462c89d2d4d0edabc9af2b0fce8f5235a26","observation_id":"9fc1efae-4205-463d-ba9c-26e96039385c","resolution":{"observed_at":"2026-08-15T23:34:49.624612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:49.629619Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.629619Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:cb343d07a7ad9b96816543cad69a24a3755a9666b5f30bbeffe31a0ae0af0e2e","observation_id":"5174fd18-1543-4b42-bb95-181394f0a034","resolution":{"observed_at":"2026-08-15T23:34:49.629619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:49.866601Z","title":"clip-vit-large-patch14,","venue":null,"work_id":"46537bc6-021a-469c-8025-ab11dcd5e0b8","year":2021},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.633873Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:2e6f27da433e0ae2ac3f82fe46dfbd9eced2c0f497637e00a0667571f720d635","observation_id":"356c2531-29c8-42ee-82c3-ce24238e2de4","resolution":{"observed_at":"2026-08-15T23:34:49.872079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:49.845986Z","title":"Imagereward: Learning and evaluating human preferences for text-to-image generation,","venue":null,"work_id":"69122051-8dc2-4392-8783-9c1f9be910f1","year":2023},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.638653Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:ec15c7e2bab154122c2bf80d9c21a0627b4dd6657b19f89fa69d3ceb96a181d6","observation_id":"7e9d78b6-d045-4fbf-bd9c-2d5aae6f7a65","resolution":{"observed_at":"2026-08-15T23:34:49.854133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-20T11:20:00.631093Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":0,"verified_fuzzy":21},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 1 inbound Pith citation observation for arXiv:2505.04347."}