{"as_of":"2026-08-10T19:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b0f2ee1e608a1a4c272e378455ce5db340a6869434d80241261effb34dbec728","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-12T02:09:14.783011Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.03488/citation-record","integrity":"/paper/2607.03488/integrity","json":"/paper/2607.03488/citation-record.json","paper":"/paper/2607.03488"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:09:14.783011Z","title":"Seethrough3d: Occlusion aware 3d control in text-to-image generation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03488","last_updated":"2026-07-03T16:56:01Z","snapshot_observed_at":"2026-08-05T02:12:11.192783Z","submitted_at":"2026-07-03T16:56:01Z","title":"Learning to Generate Multiple Objects from Dense and Occluded Layouts","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-12T02:09:14.783011Z"},"links":{"citing_paper":"/paper/2607.03488"},"observation_digest":"sha256:3c981fce8204a6d6dd88e3c9afcc349ef2a9af0e3c333fa1b81b3cbf6dce6b24","observation_id":"ad8d662a-ab82-4948-86cb-b979f6a9e1a8","resolution":{"observed_at":"2026-07-12T02:09:14.783011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:09:14.783011Z","title":"Improving image generation with better captions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03488","last_updated":"2026-07-03T16:56:01Z","snapshot_observed_at":"2026-08-05T02:12:11.192783Z","submitted_at":"2026-07-03T16:56:01Z","title":"Learning to Generate Multiple Objects from Dense and Occluded Layouts","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-12T02:09:14.783011Z"},"links":{"citing_paper":"/paper/2607.03488"},"observation_digest":"sha256:b3cc43c241800deada0376175b6f609185f4932e4518fdbcf439ece7fd9c03a9","observation_id":"9c1b1e73-3785-4846-af01-11dbe46dfd98","resolution":{"observed_at":"2026-07-12T02:09:14.783011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:09:14.783011Z","title":"Make it count: Text-to-image generation with an accurate number of objects","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03488","last_updated":"2026-07-03T16:56:01Z","snapshot_observed_at":"2026-08-05T02:12:11.192783Z","submitted_at":"2026-07-03T16:56:01Z","title":"Learning to Generate Multiple Objects from Dense and Occluded Layouts","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-12T02:09:14.783011Z"},"links":{"citing_paper":"/paper/2607.03488"},"observation_digest":"sha256:d510a97ea33f8c18312325ca9344a7b44290b57380c821c6c1201fd35dba12ee","observation_id":"609b6dc2-fa71-458b-8de3-600d9bae1806","resolution":{"observed_at":"2026-07-12T02:09:14.783011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.22699","last_updated":"2026-07-06T06:19:03Z","snapshot_observed_at":"2026-08-03T19:47:26.577384Z","submitted_at":"2025-11-27T18:52:07Z","title":"Z-Image: An Efficient Image Generation Foundation Model with Single-Stream Diffusion Transformer","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.22699","snapshot_observed_at":"2026-07-12T02:09:14.783011Z","title":"Z-image: An efficient image generation foundation model with single-stream diffusion transformer.arXiv preprint arXiv:2511.22699, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03488","last_updated":"2026-07-03T16:56:01Z","snapshot_observed_at":"2026-08-05T02:12:11.192783Z","submitted_at":"2026-07-03T16:56:01Z","title":"Learning to Generate Multiple Objects from Dense and Occluded Layouts","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-12T02:09:14.783011Z"},"links":{"cited_paper":"/paper/2511.22699","citing_paper":"/paper/2607.03488"},"observation_digest":"sha256:332e8adb9d80acee48b36e93eb0dfa6e57527d8ba0e623fb973e660cd681759f","observation_id":"546bdf69-a1d4-43c7-90cf-8492b2781205","resolution":{"observed_at":"2026-07-12T02:09:14.783011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16719","last_updated":"2026-03-28T16:54:56Z","snapshot_observed_at":"2026-08-07T05:59:39.049027Z","submitted_at":"2025-11-20T18:59:56Z","title":"SAM 3: Segment Anything with Concepts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.16719","snapshot_observed_at":"2026-07-12T02:09:14.783011Z","title":"Sam 3: Segment anything with concepts.arXiv preprint arXiv:2511.16719, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03488","last_updated":"2026-07-03T16:56:01Z","snapshot_observed_at":"2026-08-05T02:12:11.192783Z","submitted_at":"2026-07-03T16:56:01Z","title":"Learning to Generate Multiple Objects from Dense and Occluded Layouts","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-12T02:09:14.783011Z"},"links":{"cited_paper":"/paper/2511.16719","citing_paper":"/paper/2607.03488"},"observation_digest":"sha256:a195e2015366c21eec04292a7e6e67b863023f727d09c08b698da53bf2c9c828","observation_id":"b3a504ab-495b-4838-a2ed-dbe46c2affe8","resolution":{"observed_at":"2026-07-12T02:09:14.783011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:09:14.783011Z","title":"Attend-and-excite: Attention-based semantic guidance for text-to-image diffusion models.ACM Trans","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03488","last_updated":"2026-07-03T16:56:01Z","snapshot_observed_at":"2026-08-05T02:12:11.192783Z","submitted_at":"2026-07-03T16:56:01Z","title":"Learning to Generate Multiple Objects from Dense and Occluded Layouts","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-12T02:09:14.783011Z"},"links":{"citing_paper":"/paper/2607.03488"},"observation_digest":"sha256:06acf8e7b0fe774b96138f3d850c41b5c97412cc8163fe8f80423fdc889e5eef","observation_id":"1ad75d48-e6cb-4eeb-a44f-01b76f5a3e8a","resolution":{"observed_at":"2026-07-12T02:09:14.783011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:09:14.783011Z","title":"Training-free layout control with cross-attention guidance","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03488","last_updated":"2026-07-03T16:56:01Z","snapshot_observed_at":"2026-08-05T02:12:11.192783Z","submitted_at":"2026-07-03T16:56:01Z","title":"Learning to Generate Multiple Objects from Dense and Occluded Layouts","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-12T02:09:14.783011Z"},"links":{"citing_paper":"/paper/2607.03488"},"observation_digest":"sha256:dce576fea3efd54274893ea929a3332a97ac0fda1c7f92aea815e58c52c5b3e8","observation_id":"2b72de42-dbe0-4d19-afca-bbe551e4b2cf","resolution":{"observed_at":"2026-07-12T02:09:14.783011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17126","last_updated":"2023-11-28T14:51:13Z","snapshot_observed_at":"2026-07-06T16:54:02.725142Z","submitted_at":"2023-11-28T14:51:13Z","title":"Reason out Your Layout: Evoking the Layout Master from Large Language Models for Text-to-Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17126","snapshot_observed_at":"2026-07-12T02:09:14.783011Z","title":"Reason out your layout: Evoking the layout master from large language models for text-to-image synthesis.arXiv preprint arXiv:2311.17126, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03488","last_updated":"2026-07-03T16:56:01Z","snapshot_observed_at":"2026-08-05T02:12:11.192783Z","submitted_at":"2026-07-03T16:56:01Z","title":"Learning to Generate Multiple Objects from Dense and Occluded Layouts","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-12T02:09:14.783011Z"},"links":{"cited_paper":"/paper/2311.17126","citing_paper":"/paper/2607.03488"},"observation_digest":"sha256:e6f119910ae8821be45c86dd5bd1f97b7c3498a7028420988447c40ebfce03bf","observation_id":"bac52182-86d1-4124-a3d4-19a7fbdc2304","resolution":{"observed_at":"2026-07-12T02:09:14.783011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-07-12T02:09:14.783011Z","title":"Prompt-to-prompt image editing with cross attention control.arXiv preprint arXiv:2208.01626, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.03488","last_updated":"2026-07-03T16:56:01Z","snapshot_observed_at":"2026-08-05T02:12:11.192783Z","submitted_at":"2026-07-03T16:56:01Z","title":"Learning to Generate Multiple Objects from Dense and Occluded Layouts","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-12T02:09:14.783011Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2607.03488"},"observation_digest":"sha256:d353d139530c3a99fe5f3080862afe5163fac0e92ce9985b3c7a158729b39ea9","observation_id":"1e2c5967-567b-4291-b48c-eb80a79963db","resolution":{"observed_at":"2026-07-12T02:09:14.783011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:09:14.783011Z","title":"T2i-compbench: A compre- hensive benchmark for open-world compositional text-to-image generation.Advances in Neural Information Processing Systems, 36:78723–78747, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03488","last_updated":"2026-07-03T16:56:01Z","snapshot_observed_at":"2026-08-05T02:12:11.192783Z","submitted_at":"2026-07-03T16:56:01Z","title":"Learning to Generate Multiple Objects from Dense and Occluded Layouts","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-12T02:09:14.783011Z"},"links":{"citing_paper":"/paper/2607.03488"},"observation_digest":"sha256:6be054b0a3b1b067f06fd4749fb16b8e58eeff31b0912b86d889b6442e0943d6","observation_id":"2891cf76-d7f7-49dc-b61c-588227f78569","resolution":{"observed_at":"2026-07-12T02:09:14.783011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:09:14.783011Z","title":"Counting guidance for high fidelity text-to-image synthesis","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03488","last_updated":"2026-07-03T16:56:01Z","snapshot_observed_at":"2026-08-05T02:12:11.192783Z","submitted_at":"2026-07-03T16:56:01Z","title":"Learning to Generate Multiple Objects from Dense and Occluded Layouts","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-12T02:09:14.783011Z"},"links":{"citing_paper":"/paper/2607.03488"},"observation_digest":"sha256:7d6f970de7dc3f79dc6f4cd5fdafe95599536b14549a356b620a09cbf0e817df","observation_id":"f30a5ed3-2d5d-44e2-96ad-173f6abda7f6","resolution":{"observed_at":"2026-07-12T02:09:14.783011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.17567","last_updated":"2025-03-05T11:52:00Z","snapshot_observed_at":"2026-07-06T15:48:44.267376Z","submitted_at":"2023-06-30T11:40:35Z","title":"Counting Guidance for High Fidelity Text-to-Image Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.17567","snapshot_observed_at":"2026-07-12T02:09:14.783011Z","title":"Counting guidance for high fidelity text-to-image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03488","last_updated":"2026-07-03T16:56:01Z","snapshot_observed_at":"2026-08-05T02:12:11.192783Z","submitted_at":"2026-07-03T16:56:01Z","title":"Learning to Generate Multiple Objects from Dense and Occluded Layouts","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-12T02:09:14.783011Z"},"links":{"cited_paper":"/paper/2306.17567","citing_paper":"/paper/2607.03488"},"observation_digest":"sha256:58345d610679deaa0a497d45580648cc9159bb16f2f1995bc4bca0e3642ee6a7","observation_id":"ee752f6c-2d7f-4828-8124-88fb8d5e856d","resolution":{"observed_at":"2026-07-12T02:09:14.783011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:09:14.783011Z","title":"Omg: Occlusion-friendly personalized multi-concept generation in diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03488","last_updated":"2026-07-03T16:56:01Z","snapshot_observed_at":"2026-08-05T02:12:11.192783Z","submitted_at":"2026-07-03T16:56:01Z","title":"Learning to Generate Multiple Objects from Dense and Occluded Layouts","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-12T02:09:14.783011Z"},"links":{"citing_paper":"/paper/2607.03488"},"observation_digest":"sha256:7d32703ec6f5a70494db09621f3e49f06ddca1ed7bea332c2831aeb6ca78bbe0","observation_id":"8e3aea05-25e2-4707-bea1-0525d029be58","resolution":{"observed_at":"2026-07-12T02:09:14.783011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:09:14.783011Z","title":"Visual genome: Connecting language and vision using crowdsourced dense image annotations.International Journal of Computer Vision, 123(1):32–73, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.03488","last_updated":"2026-07-03T16:56:01Z","snapshot_observed_at":"2026-08-05T02:12:11.192783Z","submitted_at":"2026-07-03T16:56:01Z","title":"Learning to Generate Multiple Objects from Dense and Occluded Layouts","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-12T02:09:14.783011Z"},"links":{"citing_paper":"/paper/2607.03488"},"observation_digest":"sha256:fa07c6196395f8af1d2a5e7e4254bb9c488345e7ba7f1df02cc799aa9c7a0e8e","observation_id":"5d43416f-8a12-4c91-aac8-8a17abad44e5","resolution":{"observed_at":"2026-07-12T02:09:14.783011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:09:14.783011Z","title":"Flux.https://github.com/black-forest-labs/flux, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03488","last_updated":"2026-07-03T16:56:01Z","snapshot_observed_at":"2026-08-05T02:12:11.192783Z","submitted_at":"2026-07-03T16:56:01Z","title":"Learning to Generate Multiple Objects from Dense and Occluded Layouts","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-12T02:09:14.783011Z"},"links":{"citing_paper":"/paper/2607.03488"},"observation_digest":"sha256:4e2d43f285bca0e191dc95a828bee290680467a3433e6ccdab1fdaba6c7499be","observation_id":"f73cb970-9b98-4996-ae31-80138e8bc470","resolution":{"observed_at":"2026-07-12T02:09:14.783011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:09:14.783011Z","title":"Armand, Divyansh Srivastava, Xiaojun Shan, Zeyuan Chen, Jianwen Xie, and Zhuowen Tu","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03488","last_updated":"2026-07-03T16:56:01Z","snapshot_observed_at":"2026-08-05T02:12:11.192783Z","submitted_at":"2026-07-03T16:56:01Z","title":"Learning to Generate Multiple Objects from Dense and Occluded Layouts","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-12T02:09:14.783011Z"},"links":{"citing_paper":"/paper/2607.03488"},"observation_digest":"sha256:fd77889d3ce661a2fa88bf94b282982d8641c1de68614a5e8677ad4158faccd1","observation_id":"69c3e2cb-3e67-411e-aeca-6af2e6782f90","resolution":{"observed_at":"2026-07-12T02:09:14.783011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:09:14.783011Z","title":"GLIGEN: Open-set grounded text-to-image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03488","last_updated":"2026-07-03T16:56:01Z","snapshot_observed_at":"2026-08-05T02:12:11.192783Z","submitted_at":"2026-07-03T16:56:01Z","title":"Learning to Generate Multiple Objects from Dense and Occluded Layouts","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-12T02:09:14.783011Z"},"links":{"citing_paper":"/paper/2607.03488"},"observation_digest":"sha256:ba34daf1401d1b317c7aae4e5983b3d0485f79517abe0cbb1132e3a628c5ea4e","observation_id":"1c02271e-0704-453b-9280-97ed2c0d62d9","resolution":{"observed_at":"2026-07-12T02:09:14.783011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:09:14.783011Z","title":"Microsoft COCO: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.03488","last_updated":"2026-07-03T16:56:01Z","snapshot_observed_at":"2026-08-05T02:12:11.192783Z","submitted_at":"2026-07-03T16:56:01Z","title":"Learning to Generate Multiple Objects from Dense and Occluded Layouts","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-12T02:09:14.783011Z"},"links":{"citing_paper":"/paper/2607.03488"},"observation_digest":"sha256:87d72da6ac8fabea117f19b40c9adeeeabdd67f7411d1d368c90ba2fd92dadae","observation_id":"0a561043-dbf4-4c0e-82b9-b709d647e2b8","resolution":{"observed_at":"2026-07-12T02:09:14.783011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:09:14.783011Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03488","last_updated":"2026-07-03T16:56:01Z","snapshot_observed_at":"2026-08-05T02:12:11.192783Z","submitted_at":"2026-07-03T16:56:01Z","title":"Learning to Generate Multiple Objects from Dense and Occluded Layouts","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-12T02:09:14.783011Z"},"links":{"citing_paper":"/paper/2607.03488"},"observation_digest":"sha256:0e6fc561c7bcddcb91bc392b57a071f36eb6b58d4c0c343fbc14c9cc9edd4814","observation_id":"1c496f91-fb53-45fa-a68c-32640b822c81","resolution":{"observed_at":"2026-07-12T02:09:14.783011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:09:14.783011Z","title":"T2i-adapter: Learning adapters to dig out more controllable ability for text-to-image diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03488","last_updated":"2026-07-03T16:56:01Z","snapshot_observed_at":"2026-08-05T02:12:11.192783Z","submitted_at":"2026-07-03T16:56:01Z","title":"Learning to Generate Multiple Objects from Dense and Occluded Layouts","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-12T02:09:14.783011Z"},"links":{"citing_paper":"/paper/2607.03488"},"observation_digest":"sha256:cc3a9f89bc21238e6b54080a7c1694f06c10550ca24368f109b56ca2320c5ba9","observation_id":"fb917b53-28ad-42c0-95a9-177487774d36","resolution":{"observed_at":"2026-07-12T02:09:14.783011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:09:14.783011Z","title":"Grounded text-to-image synthesis with attention refocusing.2024 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pages 7932–7942, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03488","last_updated":"2026-07-03T16:56:01Z","snapshot_observed_at":"2026-08-05T02:12:11.192783Z","submitted_at":"2026-07-03T16:56:01Z","title":"Learning to Generate Multiple Objects from Dense and Occluded Layouts","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-12T02:09:14.783011Z"},"links":{"citing_paper":"/paper/2607.03488"},"observation_digest":"sha256:7c1e93944a9d072db1f121f2237b5bcefe522b4e8913f5f2bda5f29fc06de419","observation_id":"68610aff-99af-4919-99a0-790253431a02","resolution":{"observed_at":"2026-07-12T02:09:14.783011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:09:14.783011Z","title":"SDXL: Improving latent diffusion models for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03488","last_updated":"2026-07-03T16:56:01Z","snapshot_observed_at":"2026-08-05T02:12:11.192783Z","submitted_at":"2026-07-03T16:56:01Z","title":"Learning to Generate Multiple Objects from Dense and Occluded Layouts","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-12T02:09:14.783011Z"},"links":{"citing_paper":"/paper/2607.03488"},"observation_digest":"sha256:b24920e4fb26f9b981ae308a19c3a87861ad9672755d721ba2077f64630c5eb6","observation_id":"c8be5934-5eb3-420a-b95c-8687020a0404","resolution":{"observed_at":"2026-07-12T02:09:14.783011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:09:14.783011Z","title":"In- stancediffusion: Instance-level control for image generation.2024 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pages 6232–6242, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03488","last_updated":"2026-07-03T16:56:01Z","snapshot_observed_at":"2026-08-05T02:12:11.192783Z","submitted_at":"2026-07-03T16:56:01Z","title":"Learning to Generate Multiple Objects from Dense and Occluded Layouts","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-12T02:09:14.783011Z"},"links":{"citing_paper":"/paper/2607.03488"},"observation_digest":"sha256:bcad51ddfd38124021274a8d021e9fc982f050db7c820ddf04169c7fb72254d3","observation_id":"c910f002-b4a6-4931-8618-4922b9f6f2fe","resolution":{"observed_at":"2026-07-12T02:09:14.783011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:09:14.783011Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03488","last_updated":"2026-07-03T16:56:01Z","snapshot_observed_at":"2026-08-05T02:12:11.192783Z","submitted_at":"2026-07-03T16:56:01Z","title":"Learning to Generate Multiple Objects from Dense and Occluded Layouts","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-12T02:09:14.783011Z"},"links":{"citing_paper":"/paper/2607.03488"},"observation_digest":"sha256:190dd913f8e7c1845cf61f8064e456e565f150fd25f3fd9fc4ba8f1d87e84378","observation_id":"f0f2bd11-c132-492b-b0ab-4665d3e5c6ea","resolution":{"observed_at":"2026-07-12T02:09:14.783011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:09:14.783011Z","title":"Lay- outdiffusion: Controllable diffusion model for layout-to-image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03488","last_updated":"2026-07-03T16:56:01Z","snapshot_observed_at":"2026-08-05T02:12:11.192783Z","submitted_at":"2026-07-03T16:56:01Z","title":"Learning to Generate Multiple Objects from Dense and Occluded Layouts","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-12T02:09:14.783011Z"},"links":{"citing_paper":"/paper/2607.03488"},"observation_digest":"sha256:92cc189d30f3fcc1b6b7174e1617e1f8157186f1bc8ae41bed2f537fdb077405","observation_id":"c449535a-7ada-459c-a6f9-eae17f653397","resolution":{"observed_at":"2026-07-12T02:09:14.783011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:09:14.783011Z","title":"Migc: Multi-instance generation controller for text-to-image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03488","last_updated":"2026-07-03T16:56:01Z","snapshot_observed_at":"2026-08-05T02:12:11.192783Z","submitted_at":"2026-07-03T16:56:01Z","title":"Learning to Generate Multiple Objects from Dense and Occluded Layouts","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-12T02:09:14.783011Z"},"links":{"citing_paper":"/paper/2607.03488"},"observation_digest":"sha256:fbd6ac35105d8224ba3e320a055dfef87d3d8d40ab50cfef2b5fcaaab8d9c01f","observation_id":"80495e0e-ac8d-4d1a-adfe-6b280c9b5856","resolution":{"observed_at":"2026-07-12T02:09:14.783011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:09:14.783011Z","title":"3DIS: Depth-driven decoupled image synthesis for universal multi-instance generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03488","last_updated":"2026-07-03T16:56:01Z","snapshot_observed_at":"2026-08-05T02:12:11.192783Z","submitted_at":"2026-07-03T16:56:01Z","title":"Learning to Generate Multiple Objects from Dense and Occluded Layouts","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-12T02:09:14.783011Z"},"links":{"citing_paper":"/paper/2607.03488"},"observation_digest":"sha256:cae9349ec85a1ee3508a7a6040cf0173716fb303e7a26819cc15b3d580c3d433","observation_id":"2be1af61-4229-48f0-a74c-0e077f803af8","resolution":{"observed_at":"2026-07-12T02:09:14.783011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.03488","last_updated":"2026-07-03T16:56:01Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-05T02:12:11.192783Z","submitted_at":"2026-07-03T16:56:01Z","title":"Learning to Generate Multiple Objects from Dense and Occluded Layouts"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 0 inbound Pith citation observations for arXiv:2607.03488."}