{"as_of":"2026-08-10T23:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3db290182cd24d23547014ed534ae0dd3b9cf03c098ec4ae9f107d652c431b30","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T13:38:44.707837Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T13:38:44.707837Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-03T04:47:38.315879Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"cited_work":{"arxiv_id":"2606.10892","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.10892","snapshot_observed_at":"2026-07-03T04:47:38.315879Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","venue":"cs.CV","work_id":"32a2f165-43de-4ebe-8d9d-5d1ffb875312","year":2026},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"cited_paper":"/paper/2606.10892","citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:ae8594d7ff4303c961158a13ad35a6ea554aa6dd82d99ca2d9e9548178256571","observation_id":"0185a2ac-0c67-4453-8a44-ab2efd08ef6c","resolution":{"observed_at":"2026-07-03T04:47:38.317169Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2606.10892/citation-record","integrity":"/paper/2606.10892/integrity","json":"/paper/2606.10892/citation-record.json","paper":"/paper/2606.10892"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"cited_work":{"arxiv_id":"2606.10892","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.10892","snapshot_observed_at":"2026-07-03T04:47:38.315879Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","venue":"cs.CV","work_id":"32a2f165-43de-4ebe-8d9d-5d1ffb875312","year":2026},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"cited_paper":"/paper/2606.10892","citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:ae8594d7ff4303c961158a13ad35a6ea554aa6dd82d99ca2d9e9548178256571","observation_id":"0185a2ac-0c67-4453-8a44-ab2efd08ef6c","resolution":{"observed_at":"2026-07-03T04:47:38.317169Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"x should be artifact-free and conform to y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:2a046a536510e5ed6241107aed754f9594891ee581319e02fdb8806bcf3d8187","observation_id":"60758d02-373b-4755-9b75-11b1d77be557","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:e7a36c44f0ac5089cc432d34432589afeab905a3d30ab8f881a4545cb3c18e6c","observation_id":"7cf32bea-f358-4322-9f01-57ec39495e53","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:677a02bbe5457c65b9ab83a4098377c62db295268c374091091a1c4aad52629d","observation_id":"345aae86-c0a6-4ff6-8556-80125a2aa2ed","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"Blended latent diffusion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:cbbc9c0d9663cb27cf20421011147de44761168c91e0972455efe5c68e3c956f","observation_id":"18faf429-43b2-4410-a886-5a8073271cbf","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"Blended diffusion for text-driven editing of natural im- ages,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:8129fbc2aaf2d47db581618f0c6c888c255f08a168aadc9180c1eef16754db49","observation_id":"a72479b5-8986-4552-bf69-ead4ce9ce181","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"High-resolution image synthesis with latent dif- fusion models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:5f34acd64620a461b9863ec628128793f23d90b423c78bf422f5599d97b7556f","observation_id":"92a56736-21de-4ad4-b15e-66eb983df8b1","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"A task is worth one word: Learning with task prompts for high-quality versatile image inpainting,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:4ce5a867981cbccbaf9c3ae3af1beb591c00b4e8c2c659534ba7fb14f4fdd2b4","observation_id":"cd1da71a-b9b4-4f04-9bcd-60708f49d0ec","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"Transparent im- age layer diffusion using latent transparency,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:435c1ecaba7417e5ae1b6190f6b92523db9d68ff7c56852fb3df624702d3c094","observation_id":"872aedf7-eec2-44b8-a5dc-4b39139ef3a4","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"BrushNet: A plug-and-play image inpainting model with decom- posed dual-branch diffusion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:5a53a9fcb092c4897421e9f62cdc32975ab32243fa905ee2138f800b4677bcdf","observation_id":"c862692a-64ab-4513-b9c3-12195d3be57e","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:7abf15098ee3ea3e1f7aa8b989c1fd6737144e00b4a6c8abb6f1eed5e02555b5","observation_id":"57397949-0712-43b6-b3d9-2f465ffa3ff7","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"GLIDE: towards photorealistic image generation and editing with text-guided diffusion mod- els,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:02ae359df1cec1304fa622495b15fbf8180b80061762d68017476c3793b423f6","observation_id":"0a3b2135-f773-497d-ba19-6b210fa621b4","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"Zero-shot text-to-image generation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:6115149113b169deb280d47852f03fb010d9635f5795b15cc2725b20a54057bd","observation_id":"6bc7b700-8e0e-442a-b6d3-cb1565edc40e","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"PixArt-α: Fast training of diffusion transformer for photorealistic text-to-image synthesis,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:24aa9dacb8c218fb7f4ff689eb9e214afa9fcae3812c8417738954c74cdecbdd","observation_id":"44739a5d-8375-42da-85ba-99319d418008","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"Null- text inversion for editing real images using guided dif- fusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:150016edaaf392681efdc89150f10f4c8fb91a375a5494625cc898b6aeb27a57","observation_id":"1f60000f-47cc-4599-acb4-4afb50287e28","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"ProxEdit: improving tuning-free real image editing with proximal guidance,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:b8fb3b89f8ce27fe78171a648d4a098f91e8e0751339032521cf49dcc1402be9","observation_id":"744edf53-072f-4fc0-8929-8f010efad6cf","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"Adding conditional control to text-to-image diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:7df656de764ab92260721668c76bf0f8961606839e0e168e27325a67d78a74a9","observation_id":"5c04a25e-0acc-4dde-b45f-07158e9abdd1","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"Imagen Editor and EditBench: advancing and evaluat- ing text-guided image inpainting,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:61b3abf88a57179715e63a4855c1b19edccd295b4363d8102b7c05664789eef7","observation_id":"1216dc7a-d6e9-4e03-9004-7633c13da358","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"Attend- and-excite: Attention-based semantic guidance for text- to-image diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:62742f8bbc4e6b0b9a4d7626b72214b6c388e744a62cb13d8f25717c1f4352a6","observation_id":"2339ff2d-07ca-4854-ae21-1b97426f4a6e","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"Prompt-to-prompt image editing with cross-attention control,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:5196c0559b0941b4c362bc24b3935d01333ae1af23a4eb627570f75ce8531275","observation_id":"78df26b9-158f-4b4f-bb1e-217a216c5473","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"Learning transferable visual models from natural lan- guage supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:8a03036e1e67f3c09dd51c58f611b08d134ecb62685fd28d1b50b178e44a3857","observation_id":"e5f9352d-6359-4728-8ac1-031312e4c97e","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"Plug-and-play diffusion features for text-driven image- to-image translation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:3d4dfc6a83b5a13afdcf6f9d349a4417593965079ed83dc308b9db5565f7253b","observation_id":"26750e58-3284-4e81-aa9c-b28168771bf9","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"An im- age is worth one word: Personalizing text-to-image gen- eration using textual inversion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:70f6a9bfcf7f78b429a8d80b6fcdf091755fb5d880fd45184c0f58293331353d","observation_id":"2bce5a5e-492c-44bb-abe0-57c5d9ecc702","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"Subject- Diffusion: open domain personalized text-to-image gen- eration without test-time fine-tuning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:0b85d455281eabdc1bcb668ed47dda2ddf08e51c45d850ca64ae431a177dd27c","observation_id":"92c4a788-dc97-439b-9754-68097784814f","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"BLIP- Diffusion: pre-trained subject representation for control- lable text-to-image generation and editing,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:51f356708028440b916ba2c7da55a73add880e16fc198b2594a191b67924c2f1","observation_id":"496547ed-c058-448e-a816-755e68ff575f","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14142","last_updated":"2022-11-17T16:20:21Z","snapshot_observed_at":"2026-08-10T21:35:22.068222Z","submitted_at":"2022-10-25T16:42:03Z","title":"From colouring-in to pointillism: revisiting semantic segmentation supervision","version":2},"cited_work":{"arxiv_id":"2210.14142","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.14142","snapshot_observed_at":"2026-07-03T04:47:38.318471Z","title":"From colouring-in to pointillism: revisiting semantic segmen- tation supervision,","venue":null,"work_id":"7d4c5144-0daf-4cac-8f86-d371057d4b8f","year":2022},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"cited_paper":"/paper/2210.14142","citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:645c1c5e0b51dee889259d41c353f35ca5ffe0226ae1f53ecf5a5f18762cfdfc","observation_id":"bcafd246-db44-4bfb-9bf9-e48066e6dd36","resolution":{"observed_at":"2026-07-03T04:47:38.319934Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"Decoupled weight decay regularization,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:b365c25b01efd3167917bbe8530c8a5d1abd897f133786f52ca4d1c18a0f24b2","observation_id":"d30c39b7-5bf5-479a-8328-947fede000c7","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"De- noising diffusion implicit models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:a5b8030f07f302101fc3ac2b084b5152c617ff3c8ca87568db794b4fcb7dc86a","observation_id":"ffb59a2e-5fab-43e6-93b5-310059f27eaf","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"Segment anything,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:f79a05d74d571ac3156db6e11e2c3940e3b2596d6683aa899b0a3c10d66fe1af","observation_id":"7a342623-166d-493e-8dfe-fe1623f960bc","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"Grounding DINO: marrying DINO with grounded pre- training for open-set object detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:7f1f42b4b36c8496a2a7267bb0136e4f31783b0fe8fbef50ab6c431f4a9c1bc2","observation_id":"b5504037-e7b5-4780-86bb-1ed8aabb6e2c","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"ImageRe- ward: learning and evaluating human preferences for text-to-image generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:238d345d42d9d5f658899c7380f9598d632d34ab56144a5798be6dcc61d76f9a","observation_id":"d5e645bc-6bb3-462e-8d56-0670641d1bf8","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T13:38:44.707837Z","title":"LAION-5B: an open large-scale dataset for training next generation image-text models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-27T13:38:44.707837Z"},"links":{"citing_paper":"/paper/2606.10892"},"observation_digest":"sha256:f1396337ffa56b9be5bc99b30816b06b9373935d0a7af74a842703d12b56b3b8","observation_id":"d914fec5-f3a7-42e4-a37e-17a47acb3fed","resolution":{"observed_at":"2026-06-27T13:38:44.707837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.10892","last_updated":"2026-06-09T14:04:51Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T21:37:06.867326Z","submitted_at":"2026-06-09T14:04:51Z","title":"Improving Text-Instance Alignment Of Foreground Conditioned Out-Painting Via Customized Concept Embedding"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 1 inbound Pith citation observation for arXiv:2606.10892."}