Pith. sign in

Paper Citation Record · LEDGER

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation

As of 15 August 2026, this Paper Citation Record lists 61 of 61 outbound references and 1 inbound Pith citation observation for arXiv:2501.03490.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2501.03490 v1

Coverage vector

measured 61 of 61 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-10T21:56:07.941714Z

measured 62 of 62 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-15T06:32:42.880941+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-10T15:20:03.542467Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: pith, observed 2026-08-10T15:20:04.115181Z

Reference resolution

61 of 61 outbound references displayed

  • verified exact1
  • verified fuzzy32
  • unresolved28
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 7de209d1-609b-4dea-8356-51dfb5a66030 · outbound

This paper cites Multi- concept customization of text-to-image diffusion,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Multi- concept customization of text-to-image diffusion,

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.633575Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.633575Z digest=sha256:e2458b286c79d516bcbce8b4c190adc5379c8df2493edb3e9f404be2c7d6d8c2

Observation 17f929f1-9a58-4e8c-919c-54d824721f9b · outbound

This paper cites Dreambooth: Fine tuning text-to-image diffusion models for subject- driven generation,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Dreambooth: Fine tuning text-to-image diffusion models for subject- driven generation,

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.639905Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.639905Z digest=sha256:da3fa8c55a7eff74366a6520b658e8291994e858182bc3de2ba0e35d9c7d7d2a

Observation 4387ae30-3531-4969-b106-557b6c313235 · outbound

This paper cites Paint by example: Exemplar-based image editing with diffusion models,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Paint by example: Exemplar-based image editing with diffusion models,

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.834475Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.647037Z digest=sha256:914803731f481a9fddb17cb3f9ea5c7c99438556fe28d42da3ca6f79b0e0bcbf

Observation c24f6e30-f154-4fa9-815c-80f08f3ac860 · outbound

This paper cites An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.653001Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.653001Z digest=sha256:90cbfb2fe4287f7cf269cb1a7178b7047466e5b75e54a94cd7bc3a2963a6aa19

Observation b19cc6d9-f0fa-47b9-9a9b-8e490ee4cdcc · outbound

This paper cites Blip-diffusion: Pre-trained subject representa- tion for controllable text-to-image generation and editing,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Blip-diffusion: Pre-trained subject representa- tion for controllable text-to-image generation and editing,

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.818245Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.659724Z digest=sha256:18d0d05c51c2ee296b9f59946ed5dbb60117c95750538e48fd67b5d55c986658

Observation 02e3a208-db6f-49db-b564-890f63a8da68 · outbound

This paper cites AnyDoor: Zero-shot Object-level Image Customization.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation AnyDoor: Zero-shot Object-level Image Customization

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.670882Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.670882Z digest=sha256:1443da2f4ceaa8e5182672499da2be850ffc308348147e65982b9cea84fd88b3

Observation 507af8f7-d69f-4830-a34f-99ca62ea1037 · outbound

This paper cites Compositional gan: Learning image-conditional binary composition,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Compositional gan: Learning image-conditional binary composition,

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.802754Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.676004Z digest=sha256:0acbaaec262815013c8a6cf10586eb9c23ce60aab331925509dd6898ae563146

Observation 31f2056f-333a-4559-b1d9-94febbf47efc · outbound

This paper cites Painterly image har- monization using diffusion model,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Painterly image har- monization using diffusion model,

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.787864Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.681275Z digest=sha256:888a8f4c4721afb78af555989eb4edb2e6c07f7338c7f34da83f82a7f43e8503

Observation e9c2d73b-59dc-447a-bd3a-e9a942e89f9f · outbound

This paper cites Learning object placement via dual-path graph completion,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Learning object placement via dual-path graph completion,

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.772525Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.686719Z digest=sha256:f9cf70fc755039d2f51e11d066f924ba962c768637f7d82d0946a4601e97a669

Observation a716b768-b8b4-497f-b3b1-b66efba431bf · outbound

This paper cites Bridging composite and real: towards end-to-end deep image matting,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Bridging composite and real: towards end-to-end deep image matting,

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.691768Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.691768Z digest=sha256:fc2c9f537d213b39cb87e52bb955454e1ae237ef5e8c380d631f48af7469fdf9

Observation 14e339c8-fa07-4b9d-95c9-130deb36e274 · outbound

This paper cites Countering Language Drift via Visual Grounding.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Countering Language Drift via Visual Grounding

Reference 12

Resolution
verified exact
local_arxiv, observed 2026-08-10T21:56:08.130646Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.696770Z digest=sha256:5c8188e2aa24b4468fc85d7b63962f80d4a7cc9f99bc2408fdca553ac4653bac

Observation 6bbe005a-19ee-4fa3-b5cf-41c9e2f9ebca · outbound

This paper cites Countering language drift with seeded iterated learning,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Countering language drift with seeded iterated learning,

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.747215Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.703288Z digest=sha256:375698098a475738c6ae81529e5b778c0c7e2f29d7de5a9b378221550f089501

Observation 6b7ac6d6-1010-4df4-8417-42e1691559c8 · outbound

This paper cites Adding conditional control to text-to-image diffusion models,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Adding conditional control to text-to-image diffusion models,

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.708296Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.708296Z digest=sha256:656dff921687530345c14347ab4963cb89343a93fa88c5343f8a0eb08e997656

Observation 49a87905-e020-45a4-95c1-eaaaeabf27af · outbound

This paper cites High- resolution image synthesis with latent diffusion models,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation High- resolution image synthesis with latent diffusion models,

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.713063Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.713063Z digest=sha256:ccdb3efb1d7f1640f9273fb2b8191416d3adbdd9d88bb4f8a604d9e7e501cfc9

Observation 524e131e-d475-4a08-9941-c64bb2cb9132 · outbound

This paper cites Mat: Mask- aware transformer for large hole image inpainting,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Mat: Mask- aware transformer for large hole image inpainting,

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.711245Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.717859Z digest=sha256:9e7ae6831867475fcac8f7f41cda8c629e0a74bef78c629237be2ad9743fb9bb

Observation 6a5755f2-b5bb-480f-9df7-0db61c97e652 · outbound

This paper cites Repaint: Inpainting using denoising diffusion probabilistic models,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Repaint: Inpainting using denoising diffusion probabilistic models,

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.722923Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.722923Z digest=sha256:e52d8970ec6bca67947a6a29c8e79cbfb044d1b8dcaf25d9cdf6b01a44d64a38

Observation 23e6db53-1882-4dd0-8c6b-0ad0e9bc7514 · outbound

This paper cites Imagen editor and editbench: Advancing and evaluating text-guided image inpainting,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Imagen editor and editbench: Advancing and evaluating text-guided image inpainting,

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.685209Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.728756Z digest=sha256:f100b6a96c7f6d43d7c878a3b34073c2903c943e1bea6a3bc0c091bd2e82c7d0

Observation fb86e0dd-974f-4589-b552-715c91a6dc6b · outbound

This paper cites Layoutdm: Transformer-based diffusion model for layout generation,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Layoutdm: Transformer-based diffusion model for layout generation,

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.668750Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.733907Z digest=sha256:4a57a33e8b2857d6e857f4db915ddd81ed2d148c1b573d4b0d34961c7fdbbef7

Observation 471c75c9-50e5-4e5d-b815-fddb435862b1 · outbound

This paper cites Learning transferable visual models from natural language supervision,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Learning transferable visual models from natural language supervision,

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.738683Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.738683Z digest=sha256:79e81a2d627fb405029a0283c8ff548b419496b920c6c8674cff4f7a777d2696

Observation d74b7532-9572-4ece-b580-a854ffbf74b2 · outbound

This paper cites Gligen: Open-set grounded text-to-image generation,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Gligen: Open-set grounded text-to-image generation,

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.641753Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.743823Z digest=sha256:202cc1f51f27985b4dba69d38e1d5233b0ac8a09b70800b51fc897e0a27199c1

Observation c8449c7b-b116-465d-aff1-a46eb26e1587 · outbound

This paper cites Microsoft coco: Common objects in context,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Microsoft coco: Common objects in context,

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.748652Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.748652Z digest=sha256:d4fa931d1a441047f5078923821a02d3dda8ef862d6fd1320885d2503d9c718c

Observation 905618ed-fd07-4b0f-9c79-11b8bae24e9b · outbound

This paper cites Denoising diffusion probabilistic mod- els,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Denoising diffusion probabilistic mod- els,

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.615458Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.753403Z digest=sha256:31a70e65386fe7a0b94d4cd96d1833307a82eb7d35076de823d23473df561d08

Observation 6a8f896d-01df-451a-9e26-ab41a15bb839 · outbound

This paper cites Deep unsupervised learning using nonequilibrium thermodynamics,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Deep unsupervised learning using nonequilibrium thermodynamics,

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.758124Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.758124Z digest=sha256:36d67b2e5f9da4afaaecf22bf31ab688adf4aaa7e0b3c29a1bf271c33166c22e

Observation a737daf2-7c0a-48f6-80c9-01f69e097b18 · outbound

This paper cites Score-Based Generative Modeling through Stochastic Differential Equations.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Score-Based Generative Modeling through Stochastic Differential Equations

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.762979Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.762979Z digest=sha256:9b25f33d33a37e2633d33e5fa9cbf9f755b64a567785267a1e81ae76abbc7f3e

Observation 20281740-7012-456b-8864-f5d92f1b7f75 · outbound

This paper cites Improved denoising diffusion probabilis- tic models,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Improved denoising diffusion probabilis- tic models,

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.767836Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.767836Z digest=sha256:bae45f75348d99db90be708cb43646279cb95d83f6501e6a8f4d084cf54c50c1

Observation 672f60f6-c064-46de-87e7-581021e4b8c0 · outbound

This paper cites Diffusion models beat gans on image synthesis,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Diffusion models beat gans on image synthesis,

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.772378Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.772378Z digest=sha256:9dc70f1765860a8a9bc56678792b9b28b27f6a102fd266faa18970329b555f00

Observation f6e23de4-71ab-4a87-906f-b47e5a5a0789 · outbound

This paper cites Fastdiff: A fast conditional diffusion model for high-quality speech synthesis,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Fastdiff: A fast conditional diffusion model for high-quality speech synthesis,

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.570135Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.777676Z digest=sha256:6ffa9b92c721684747afdabcedb876306ba13fd04abd95d6f3eb7ff05155e1f0

Observation db43b03c-ce0f-4eca-be57-513feed80894 · outbound

This paper cites DisenBooth: Identity-Preserving Disentangled Tuning for Subject-Driven Text-to-Image Generation.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation DisenBooth: Identity-Preserving Disentangled Tuning for Subject-Driven Text-to-Image Generation

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.783337Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.783337Z digest=sha256:3a6a3c00a5cfda6b6ff64cb34bd29505e7862dc4a7dc783c8d24195b8eeb2d0e

Observation 41ca1734-141f-45b7-b44b-5363ace9288b · outbound

This paper cites InstantBooth: Personalized Text-to-Image Generation without Test-Time Finetuning.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation InstantBooth: Personalized Text-to-Image Generation without Test-Time Finetuning

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.788000Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.788000Z digest=sha256:3f0f6a63cce0601d32b99488dc9695cc2be3cac4894d295e24b604a53d16c308

Observation eb7becec-6434-4168-85d5-f61ee20bd04b · outbound

This paper cites ELITE: Encoding Visual Concepts into Textual Embeddings for Customized Text-to-Image Generation.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation ELITE: Encoding Visual Concepts into Textual Embeddings for Customized Text-to-Image Generation

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.792817Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.792817Z digest=sha256:227921367127d65711d5b5ff447ccac2d536f4ba4f021168621931e36d47c779

Observation 5a540e45-d1b3-413c-9718-35f3a44da445 · outbound

This paper cites Cones: Concept Neurons in Diffusion Models for Customized Generation.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Cones: Concept Neurons in Diffusion Models for Customized Generation

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.797790Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.797790Z digest=sha256:336b47f6ba63c7c275df19972d46935868ea9d1b6c1a04a04be36b36d3dfb59f

Observation a51f0e7c-536f-4ed4-a3a7-7291ad6b6244 · outbound

This paper cites P+: Extended Textual Conditioning in Text-to-Image Generation.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation P+: Extended Textual Conditioning in Text-to-Image Generation

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.802479Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.802479Z digest=sha256:d0993acbae527774c4e41ed1fcc59929ec1ca76e4217eda3ff5ddd12c87e11eb

Observation 1833d590-8ba1-46f7-92d1-83b871da6358 · outbound

This paper cites Subject-driven text-to-image generation via apprenticeship learning,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Subject-driven text-to-image generation via apprenticeship learning,

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.554918Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.807275Z digest=sha256:830ff01f42644b48746d512ace3c428d39fc97d1ee34999015dbbb0cc2063b69

Observation 71147ebd-8197-4cb5-9d3e-b100c5583cb2 · outbound

This paper cites A neural space- time representation for text-to-image personalization,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation A neural space- time representation for text-to-image personalization,

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.538573Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.811927Z digest=sha256:c0d3ecd1b7b6db0274ccce22398f3e61fe15a1678a0c0907c817a2ddf482ae08

Observation 1e34b9bd-3109-4a0d-b227-425b753ac173 · outbound

This paper cites T2i- adapter: Learning adapters to dig out more controllable ability for text- to-image diffusion models,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation T2i- adapter: Learning adapters to dig out more controllable ability for text- to-image diffusion models,

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.522570Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.816846Z digest=sha256:d359e202c65735b7f28f9b064556297199db183278a8a0df386e20a3e2a6d7e0

Observation dc75e2ed-f764-4084-ab1b-c571dc250eb8 · outbound

This paper cites Uni-controlnet: All-in-one control to text-to-image diffusion models,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Uni-controlnet: All-in-one control to text-to-image diffusion models,

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.506195Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.821350Z digest=sha256:90c844b349ec0a8067d6c4b2e03eb5716433d1c7559be13509dc6adbfe992960

Observation d3029fa8-af2b-4838-8d09-dba17ef4600b · outbound

This paper cites Layoutvae: Stochastic scene layout generation from a label set,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Layoutvae: Stochastic scene layout generation from a label set,

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.491179Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.826603Z digest=sha256:7b2c0f5fa13c1c188dd8233e018da1cce3cc5d5e42e2639a8aa0f945356be0eb

Observation b636b276-a809-49de-976f-2b4c7705f923 · outbound

This paper cites LayoutGAN: Generating Graphic Layouts with Wireframe Discriminators.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation LayoutGAN: Generating Graphic Layouts with Wireframe Discriminators

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.831159Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.831159Z digest=sha256:e86d78f1f623ca3256ca5862f4e7cdb8af7bead0f1fe9ea69eb8f0bdcdf9f20f

Observation 620910f7-8767-4737-b0f4-79365c0e6527 · outbound

This paper cites Attribute- conditioned layout gan for automatic graphic design,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Attribute- conditioned layout gan for automatic graphic design,

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.473776Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.836278Z digest=sha256:a54a8527df30907931e9fbc2cbaa03dd936daa0e542ce6d673564aa38e0a30db

Observation d03f73e1-2851-4f39-b61c-994f95d1b94d · outbound

This paper cites Variational transformer networks for layout generation,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Variational transformer networks for layout generation,

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.456686Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.840938Z digest=sha256:965a60c8324ff4116f5cd02d9920732eb313ec142ab0f13a864250de22cceb1b

Observation 6a4d4e75-637d-4994-ab81-dd329740c68a · outbound

This paper cites Layouttransformer: Layout generation and completion with self-attention,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Layouttransformer: Layout generation and completion with self-attention,

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.440962Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.845606Z digest=sha256:f605a62006733d8a44debd4c6090a6e0448a19489b9b7b6f3cbca10da8c114e7

Observation 165e288f-8e9b-4b86-a062-cb046cb86663 · outbound

This paper cites Layout-bridging text-to-image synthesis,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Layout-bridging text-to-image synthesis,

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.424957Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.850454Z digest=sha256:c5139a6126e56a7bb91024ba007cfe77bdf7bf976e976eadbfa2b283f19a0212

Observation d7401883-f39f-4c1e-8a5e-96734e564948 · outbound

This paper cites Background layout generation and object knowledge transfer for text-to-image generation,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Background layout generation and object knowledge transfer for text-to-image generation,

Reference 44

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.409209Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.855108Z digest=sha256:e59cc2d18ceb6bf3755a3dfe2e38731a55e094fcb870b0058d19274c3d775f9f

Observation 9931f9fa-61af-4d87-9f9f-0c0eb979fc16 · outbound

This paper cites Layoutllm-t2i: Eliciting layout guidance from llm for text-to-image generation,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Layoutllm-t2i: Eliciting layout guidance from llm for text-to-image generation,

Reference 45

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.392739Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.859843Z digest=sha256:3d6003120cc7203dd0b5c91a9a32dfccacc6a20361674ddab78be46459e3f1ef

Observation 7b6340ee-ecbf-40c5-b81c-4478cc4287a4 · outbound

This paper cites LLM-grounded Diffusion: Enhancing Prompt Understanding of Text-to-Image Diffusion Models with Large Language Models.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation LLM-grounded Diffusion: Enhancing Prompt Understanding of Text-to-Image Diffusion Models with Large Language Models

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.864387Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.864387Z digest=sha256:20d4895d5a609c965f6b0113e706f1bae0fb02030ad2e9caede99a3d4866a5e2

Observation 7d003791-b3c1-4253-8fc9-da2fe2edb2c4 · outbound

This paper cites Attention is all you need,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Attention is all you need,

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.869369Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.869369Z digest=sha256:38be0e3a4c8ceb12dab018ba0418a2119e55e16ecdaee60357b0ac63ec917bf0

Observation d207fd25-3c02-4a19-9887-ae07a066bc18 · outbound

This paper cites Nerf: Representing scenes as neural radiance fields for view synthesis,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Nerf: Representing scenes as neural radiance fields for view synthesis,

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.874882Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.874882Z digest=sha256:f13a982329ccf4d2df923f0afa42505cc9d694b3a181e2f96cfe7c65f4389eb1

Observation 4d82856c-e9c8-40d2-966f-a40923bc4b75 · outbound

This paper cites An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.879344Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.879344Z digest=sha256:8a5a5729bee2f9ea27e9653658436e35bab1d1074ab49bb0fff2fa6b425449f6

Observation 8dbcf914-8753-4682-a2b0-ce60a0760c9c · outbound

This paper cites On the spectral bias of neural networks,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation On the spectral bias of neural networks,

Reference 50

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.355260Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.884222Z digest=sha256:15032a81926dd7a155c835ffecb7f85276b6a8085e60c44d4a190872e8912a51

Observation 9bdfc08e-75d4-4bc9-a085-296e04b46105 · outbound

This paper cites Gans trained by a two time-scale update rule converge to a local nash equilibrium,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Gans trained by a two time-scale update rule converge to a local nash equilibrium,

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.888735Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.888735Z digest=sha256:a4bbe47e9533e80f78e355560142520c3b5e9d478a4b38318e419953c4e39f7f

Observation b87feada-dda5-4334-897c-874fa388a333 · outbound

This paper cites Clipscore: A reference-free evaluation metric for image captioning,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Clipscore: A reference-free evaluation metric for image captioning,

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.893247Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.893247Z digest=sha256:9e7e7f04f3dd2a5724c215df3673136633cd5a265541e30b1a05ce65469a84c1

Observation 7f0254a8-e094-4942-9f6a-be9de7508741 · outbound

This paper cites Image synthesis from layout with locality-aware mask adaption,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Image synthesis from layout with locality-aware mask adaption,

Reference 53

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.319659Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.897901Z digest=sha256:329a6967e51c3c249161ee6e6acc0d77616191fb417ff4ab16b7395ca86bf1c0

Observation 9882da85-2b29-4e33-9a35-433e3a9e9514 · outbound

This paper cites Constrained graphic layout generation via latent optimization,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Constrained graphic layout generation via latent optimization,

Reference 54

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.303614Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.902493Z digest=sha256:9c3303c7d9290cb8cf6eda443db32ef692f6c6777990c5c4e1bcbc7a0fcf1cca

Observation 78a56dc3-82e0-4f81-8ad1-d06fe206d62b · outbound

This paper cites Pytorch: An imperative style, high-performance deep learning library,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Pytorch: An imperative style, high-performance deep learning library,

Reference 55

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.907166Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.907166Z digest=sha256:254e907e22206c7ca446859f39eafc7e11befb7b8cddf4de2417bb167bbc8a4d

Observation 95fd7851-cac3-46ab-bf80-72079237903b · outbound

This paper cites Adam: A Method for Stochastic Optimization.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Adam: A Method for Stochastic Optimization

Reference 56

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.911944Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.911944Z digest=sha256:0bc1a5fce58108941a98cdea847b26a1d34177f640af88f46abf11f645a16b08

Observation 42f614d4-7af6-476e-9d88-e9015524d7e0 · outbound

This paper cites Dataset diffusion: Diffusion-based synthetic data generation for pixel-level semantic seg- mentation,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Dataset diffusion: Diffusion-based synthetic data generation for pixel-level semantic seg- mentation,

Reference 57

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.275701Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.917040Z digest=sha256:fc53ee596a55c8b1c73814e5e71147492f2ee6c65b66f92cd2f31843f5cae73b

Observation 448d14bc-e049-4efd-a55e-890bde848c11 · outbound

This paper cites Image synthesis from reconfigurable layout and style,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Image synthesis from reconfigurable layout and style,

Reference 58

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.258206Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.922661Z digest=sha256:a3c212e39d014f294c7f55d771d1419a3889b428d1e089bb9943fa900fc89003

Observation 676c68f8-2e66-44e4-81ae-687cb1b368f7 · outbound

This paper cites Learning layout and style reconfigurable gans for controllable image synthesis,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Learning layout and style reconfigurable gans for controllable image synthesis,

Reference 59

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.241887Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.927361Z digest=sha256:bae1e8897614e31e1a4cc5387ea091adc5d336263fe8eb386e57550ae16b1beb

Observation 7c4f1469-648c-4298-9120-8c4cf455e1d9 · outbound

This paper cites Object- centric image generation from layouts,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Object- centric image generation from layouts,

Reference 60

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.226246Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.932105Z digest=sha256:0f4a7e93d01f32676ec07ee132c592e7cb852bf38e1b3ab8cdcecfdce72b40f3

Observation f93553b9-a59e-4f37-b703-6609b187936a · outbound

This paper cites Layoutdiffusion: Controllable diffusion model for layout-to-image generation,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Layoutdiffusion: Controllable diffusion model for layout-to-image generation,

Reference 61

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.210383Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.936977Z digest=sha256:554d97951a55ddbd80251b014c32197fc43b5bfcaa8fd9edc0dccdf9287391d6

Observation 1e0a897d-406a-4e01-956f-840b489f5178 · outbound

This paper cites Drag your gan: Interactive point-based manipulation on the generative image manifold,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Drag your gan: Interactive point-based manipulation on the generative image manifold,

Reference 62

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.195108Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T21:56:07.941714Z digest=sha256:a5efe650eedc143c99dec656d29bd03f2352acf9d0019cda008941dedb5999c8

Pith citing papers

Observation a5415215-b39f-43aa-938a-8eaf33183f90 · inbound

T-Stars-Poster: A Framework for Product-Centric Advertising Image Design cites this paper.

T-Stars-Poster: A Framework for Product-Centric Advertising Image Design SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation

Reference 4

Resolution
verified exact
local_arxiv, observed 2026-08-10T15:20:04.119093Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-10T15:20:03.542467Z digest=sha256:60d824c1bec67474d701f8d43b6e12a7af9f8d31fbb98f46e8febeec51f1e3aa