Pith. sign in

Paper Citation Record · LEDGER

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation

As of 16 August 2026, this Paper Citation Record lists 61 of 61 outbound references and 1 inbound Pith citation observation for arXiv:2501.03490.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2501.03490 v1

Coverage vector

measured 61 of 61 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-10T21:56:07.941714Z

measured 62 of 62 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-16T06:30:59.297886+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-10T15:20:03.542467Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: pith, observed 2026-08-10T15:20:04.115181Z

Reference resolution

61 of 61 outbound references displayed

  • verified exact1
  • verified fuzzy32
  • unresolved28
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 7de209d1-609b-4dea-8356-51dfb5a66030 · outbound

This paper cites Multi- concept customization of text-to-image diffusion,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Multi- concept customization of text-to-image diffusion,

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.633575Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.633575Z digest=sha256:69b4ad8f0d90db9865f401cf69e88d1c86cdf1bb7459371ab39ad55f2c594866

Observation 17f929f1-9a58-4e8c-919c-54d824721f9b · outbound

This paper cites Dreambooth: Fine tuning text-to-image diffusion models for subject- driven generation,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Dreambooth: Fine tuning text-to-image diffusion models for subject- driven generation,

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.639905Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.639905Z digest=sha256:9762d00f34ba7bacfae598683027f0e772ed8d18b261e97471cc2b319d602515

Observation 4387ae30-3531-4969-b106-557b6c313235 · outbound

This paper cites Paint by example: Exemplar-based image editing with diffusion models,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Paint by example: Exemplar-based image editing with diffusion models,

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.834475Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.647037Z digest=sha256:7b28e6f9d6edd64b9c5c729fad8fe8db1b7a32ac3b1bd94204a9365626c12e02

Observation c24f6e30-f154-4fa9-815c-80f08f3ac860 · outbound

This paper cites An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.653001Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.653001Z digest=sha256:efa4f638a5b94990760776937867afd2a21fc4fe1216215e72cb3891e9c2c294

Observation b19cc6d9-f0fa-47b9-9a9b-8e490ee4cdcc · outbound

This paper cites Blip-diffusion: Pre-trained subject representa- tion for controllable text-to-image generation and editing,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Blip-diffusion: Pre-trained subject representa- tion for controllable text-to-image generation and editing,

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.818245Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.659724Z digest=sha256:a768c661498299f84a76f770b0a428e0fef3ec2b247d64c6eb263968b68069bb

Observation 02e3a208-db6f-49db-b564-890f63a8da68 · outbound

This paper cites AnyDoor: Zero-shot Object-level Image Customization.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation AnyDoor: Zero-shot Object-level Image Customization

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.670882Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.670882Z digest=sha256:a297dde104cba1e7707e1fdc23689d41f765bb1868643047348c4859115e0c08

Observation 507af8f7-d69f-4830-a34f-99ca62ea1037 · outbound

This paper cites Compositional gan: Learning image-conditional binary composition,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Compositional gan: Learning image-conditional binary composition,

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.802754Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.676004Z digest=sha256:0e9c0c5176c66e6fff04f851e4867e74621eac2637b402987813005f1b641c32

Observation 31f2056f-333a-4559-b1d9-94febbf47efc · outbound

This paper cites Painterly image har- monization using diffusion model,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Painterly image har- monization using diffusion model,

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.787864Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.681275Z digest=sha256:36443db6fe32a3f6fcf7d36d6868717c49f6005763ccae5d8f4c958382116490

Observation e9c2d73b-59dc-447a-bd3a-e9a942e89f9f · outbound

This paper cites Learning object placement via dual-path graph completion,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Learning object placement via dual-path graph completion,

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.772525Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.686719Z digest=sha256:43d513e06b83b4df9e686e87f7e076de4c8d6ae9a74b1c700a6f8861958e5efd

Observation a716b768-b8b4-497f-b3b1-b66efba431bf · outbound

This paper cites Bridging composite and real: towards end-to-end deep image matting,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Bridging composite and real: towards end-to-end deep image matting,

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.691768Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.691768Z digest=sha256:ed15d5c0f92dc491cfccbb060c7670cac229cf628abc26430e60d2ad78b25cd1

Observation 14e339c8-fa07-4b9d-95c9-130deb36e274 · outbound

This paper cites Countering Language Drift via Visual Grounding.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Countering Language Drift via Visual Grounding

Reference 12

Resolution
verified exact
local_arxiv, observed 2026-08-10T21:56:08.130646Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.696770Z digest=sha256:80d7ea932e6e1400a2d41e611c3d1d2754e942a0a6481e68bb9f38c15cf9a1b9

Observation 6bbe005a-19ee-4fa3-b5cf-41c9e2f9ebca · outbound

This paper cites Countering language drift with seeded iterated learning,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Countering language drift with seeded iterated learning,

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.747215Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.703288Z digest=sha256:344ca2421a97ed3ca96f0cb672d5fc7399b83e4d57629c283cfb12bb9611116b

Observation 6b7ac6d6-1010-4df4-8417-42e1691559c8 · outbound

This paper cites Adding conditional control to text-to-image diffusion models,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Adding conditional control to text-to-image diffusion models,

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.708296Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.708296Z digest=sha256:ce8949fecc31a15097a1b7734410cb22e8a1e2ee4a5da81893d5665a74078d4e

Observation 49a87905-e020-45a4-95c1-eaaaeabf27af · outbound

This paper cites High- resolution image synthesis with latent diffusion models,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation High- resolution image synthesis with latent diffusion models,

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.713063Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.713063Z digest=sha256:4db961013b00ef5126886efecf29dd658ce830f942eb390953cb387bb72cf9e8

Observation 524e131e-d475-4a08-9941-c64bb2cb9132 · outbound

This paper cites Mat: Mask- aware transformer for large hole image inpainting,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Mat: Mask- aware transformer for large hole image inpainting,

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.711245Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.717859Z digest=sha256:c58e3a44357bd08fe7d3b7af021bc7a9b5828a67821be22753e76249d7a1164a

Observation 6a5755f2-b5bb-480f-9df7-0db61c97e652 · outbound

This paper cites Repaint: Inpainting using denoising diffusion probabilistic models,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Repaint: Inpainting using denoising diffusion probabilistic models,

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.722923Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.722923Z digest=sha256:16c521489142ec5ac7ceb6ad42a6d4c948dcddf776bd460897b42345d324b09d

Observation 23e6db53-1882-4dd0-8c6b-0ad0e9bc7514 · outbound

This paper cites Imagen editor and editbench: Advancing and evaluating text-guided image inpainting,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Imagen editor and editbench: Advancing and evaluating text-guided image inpainting,

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.685209Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.728756Z digest=sha256:55104e356c4d7e249664a02835f0d14e1e0f491382599f6b0123aaab4926bb5f

Observation fb86e0dd-974f-4589-b552-715c91a6dc6b · outbound

This paper cites Layoutdm: Transformer-based diffusion model for layout generation,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Layoutdm: Transformer-based diffusion model for layout generation,

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.668750Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.733907Z digest=sha256:670a5081e292ef8fade3670723979abadb11043b4352a71ce98cc7c734b6bc29

Observation 471c75c9-50e5-4e5d-b815-fddb435862b1 · outbound

This paper cites Learning transferable visual models from natural language supervision,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Learning transferable visual models from natural language supervision,

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.738683Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.738683Z digest=sha256:b4907a680d1437c42a14c29128c7435ae4888d9e6ead993c97c97b7cf991d488

Observation d74b7532-9572-4ece-b580-a854ffbf74b2 · outbound

This paper cites Gligen: Open-set grounded text-to-image generation,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Gligen: Open-set grounded text-to-image generation,

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.641753Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.743823Z digest=sha256:bb30394a7fd0d46f121646ba55b23448fa98bd918b1662f78f984d8c1f856939

Observation c8449c7b-b116-465d-aff1-a46eb26e1587 · outbound

This paper cites Microsoft coco: Common objects in context,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Microsoft coco: Common objects in context,

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.748652Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.748652Z digest=sha256:f70ae586dc3bda3a2c17d724943dd7cb7399b542d9b17405064f9edbb2a74e00

Observation 905618ed-fd07-4b0f-9c79-11b8bae24e9b · outbound

This paper cites Denoising diffusion probabilistic mod- els,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Denoising diffusion probabilistic mod- els,

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.615458Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.753403Z digest=sha256:22c620f5b2ae1a9c028ae6a0b9404aba0122e537a709b683adc297e5ff5f25d2

Observation 6a8f896d-01df-451a-9e26-ab41a15bb839 · outbound

This paper cites Deep unsupervised learning using nonequilibrium thermodynamics,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Deep unsupervised learning using nonequilibrium thermodynamics,

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.758124Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.758124Z digest=sha256:9f7603b72684909658694ab344d1e1e4bb07f5599fb9b1a78e4eef2478aaad47

Observation a737daf2-7c0a-48f6-80c9-01f69e097b18 · outbound

This paper cites Score-Based Generative Modeling through Stochastic Differential Equations.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Score-Based Generative Modeling through Stochastic Differential Equations

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.762979Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.762979Z digest=sha256:88d3f26f8227a2e8912ccfc2d2a823cefaea40f9b196fcbe295e6a10f1fb2cdb

Observation 20281740-7012-456b-8864-f5d92f1b7f75 · outbound

This paper cites Improved denoising diffusion probabilis- tic models,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Improved denoising diffusion probabilis- tic models,

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.767836Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.767836Z digest=sha256:47eece22c498682a0f557e8e55c8af38fbabe5068c4c3a7fe8df919fbb4f4e79

Observation 672f60f6-c064-46de-87e7-581021e4b8c0 · outbound

This paper cites Diffusion models beat gans on image synthesis,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Diffusion models beat gans on image synthesis,

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.772378Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.772378Z digest=sha256:9c4348aa7ec6e607fb599de948392a984e4f9a635972aaebaaff5815a7ae0bda

Observation f6e23de4-71ab-4a87-906f-b47e5a5a0789 · outbound

This paper cites Fastdiff: A fast conditional diffusion model for high-quality speech synthesis,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Fastdiff: A fast conditional diffusion model for high-quality speech synthesis,

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.570135Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.777676Z digest=sha256:1d62c03e62695d903ef7b6197c4349f05cb0d9889dae9a406c97e61fe3a23905

Observation db43b03c-ce0f-4eca-be57-513feed80894 · outbound

This paper cites DisenBooth: Identity-Preserving Disentangled Tuning for Subject-Driven Text-to-Image Generation.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation DisenBooth: Identity-Preserving Disentangled Tuning for Subject-Driven Text-to-Image Generation

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.783337Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.783337Z digest=sha256:b485e5bc553fe2a6c12ac33e2620524b8ccd1529d61165272785198471ce96e5

Observation 41ca1734-141f-45b7-b44b-5363ace9288b · outbound

This paper cites InstantBooth: Personalized Text-to-Image Generation without Test-Time Finetuning.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation InstantBooth: Personalized Text-to-Image Generation without Test-Time Finetuning

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.788000Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.788000Z digest=sha256:3c4d3f61eaea0e70d00913ecdc532fc15e6f75bf94dda3b7ee11db74a2c3780b

Observation eb7becec-6434-4168-85d5-f61ee20bd04b · outbound

This paper cites ELITE: Encoding Visual Concepts into Textual Embeddings for Customized Text-to-Image Generation.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation ELITE: Encoding Visual Concepts into Textual Embeddings for Customized Text-to-Image Generation

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.792817Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.792817Z digest=sha256:b3101157e0a99b1520a124c319b5c35162086fa235386898f024519131e85f61

Observation 5a540e45-d1b3-413c-9718-35f3a44da445 · outbound

This paper cites Cones: Concept Neurons in Diffusion Models for Customized Generation.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Cones: Concept Neurons in Diffusion Models for Customized Generation

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.797790Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.797790Z digest=sha256:b3462af0a494a482c24e2d5183b68baef7ac77f2f835aae91d7a5a8660dbb343

Observation a51f0e7c-536f-4ed4-a3a7-7291ad6b6244 · outbound

This paper cites P+: Extended Textual Conditioning in Text-to-Image Generation.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation P+: Extended Textual Conditioning in Text-to-Image Generation

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.802479Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.802479Z digest=sha256:a8d930d5b61a1d72dde7cf8ce1ce581e6e6f096f6a7a9c4b0683eb4a98a8255a

Observation 1833d590-8ba1-46f7-92d1-83b871da6358 · outbound

This paper cites Subject-driven text-to-image generation via apprenticeship learning,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Subject-driven text-to-image generation via apprenticeship learning,

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.554918Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.807275Z digest=sha256:1b512eaae7e28f5cfb369fc4c6fde76c10cd5957acc8f1985bac803684e0174d

Observation 71147ebd-8197-4cb5-9d3e-b100c5583cb2 · outbound

This paper cites A neural space- time representation for text-to-image personalization,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation A neural space- time representation for text-to-image personalization,

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.538573Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.811927Z digest=sha256:13f43a8b673aae1f454760573dbb1490575c636f4515dec6d7042b9955021310

Observation 1e34b9bd-3109-4a0d-b227-425b753ac173 · outbound

This paper cites T2i- adapter: Learning adapters to dig out more controllable ability for text- to-image diffusion models,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation T2i- adapter: Learning adapters to dig out more controllable ability for text- to-image diffusion models,

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.522570Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.816846Z digest=sha256:9b9cf9c6c937ae1cf9de6cbeba899c8475d18cb929c11e7f61e79c0bbb41ffe2

Observation dc75e2ed-f764-4084-ab1b-c571dc250eb8 · outbound

This paper cites Uni-controlnet: All-in-one control to text-to-image diffusion models,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Uni-controlnet: All-in-one control to text-to-image diffusion models,

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.506195Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.821350Z digest=sha256:537e470088210a1f15dddf2023dd692cb61151601aeee6b24a31b5e38cd9d2ea

Observation d3029fa8-af2b-4838-8d09-dba17ef4600b · outbound

This paper cites Layoutvae: Stochastic scene layout generation from a label set,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Layoutvae: Stochastic scene layout generation from a label set,

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.491179Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.826603Z digest=sha256:89ac7e538d419df283109b465ed7ba4c24820a1af3fcd8041a1737d5da4f2073

Observation b636b276-a809-49de-976f-2b4c7705f923 · outbound

This paper cites LayoutGAN: Generating Graphic Layouts with Wireframe Discriminators.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation LayoutGAN: Generating Graphic Layouts with Wireframe Discriminators

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.831159Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.831159Z digest=sha256:09562badbccde54da818a4389a4434dd6a50aab5c8b2b783a7c0ac69e308cdb3

Observation 620910f7-8767-4737-b0f4-79365c0e6527 · outbound

This paper cites Attribute- conditioned layout gan for automatic graphic design,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Attribute- conditioned layout gan for automatic graphic design,

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.473776Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.836278Z digest=sha256:1b2352d9be90c43d483d5bf518de6a9dd377d22aee295996c367e678f075167d

Observation d03f73e1-2851-4f39-b61c-994f95d1b94d · outbound

This paper cites Variational transformer networks for layout generation,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Variational transformer networks for layout generation,

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.456686Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.840938Z digest=sha256:671e47e2cf02dc78b2e3b70839f6e70d804e1162a49f69b1cc71dcbd130b7fdd

Observation 6a4d4e75-637d-4994-ab81-dd329740c68a · outbound

This paper cites Layouttransformer: Layout generation and completion with self-attention,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Layouttransformer: Layout generation and completion with self-attention,

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.440962Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.845606Z digest=sha256:ad2972e129f703039e79b190cf5bb7545e6374746b8d787d27de1010eaa90fad

Observation 165e288f-8e9b-4b86-a062-cb046cb86663 · outbound

This paper cites Layout-bridging text-to-image synthesis,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Layout-bridging text-to-image synthesis,

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.424957Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.850454Z digest=sha256:b3a8accb73d66ab24d9be643ef873fed99af6ab0e211c1dc4a4c7195e789b79c

Observation d7401883-f39f-4c1e-8a5e-96734e564948 · outbound

This paper cites Background layout generation and object knowledge transfer for text-to-image generation,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Background layout generation and object knowledge transfer for text-to-image generation,

Reference 44

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.409209Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.855108Z digest=sha256:ae43fe214e4f78946f996076e5e472ea1cc726dc1ce97f182e08baaf595cc258

Observation 9931f9fa-61af-4d87-9f9f-0c0eb979fc16 · outbound

This paper cites Layoutllm-t2i: Eliciting layout guidance from llm for text-to-image generation,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Layoutllm-t2i: Eliciting layout guidance from llm for text-to-image generation,

Reference 45

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.392739Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.859843Z digest=sha256:b7bf06b75a53fa55deb4f9c84152d580bf45d6512ec033a52b453dd769e4c790

Observation 7b6340ee-ecbf-40c5-b81c-4478cc4287a4 · outbound

This paper cites LLM-grounded Diffusion: Enhancing Prompt Understanding of Text-to-Image Diffusion Models with Large Language Models.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation LLM-grounded Diffusion: Enhancing Prompt Understanding of Text-to-Image Diffusion Models with Large Language Models

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.864387Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.864387Z digest=sha256:9d5fcd107dbc6159c28c03cba773747a7d19ed6ffa86bb07415dcfc5be63105c

Observation 7d003791-b3c1-4253-8fc9-da2fe2edb2c4 · outbound

This paper cites Attention is all you need,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Attention is all you need,

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.869369Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.869369Z digest=sha256:171fbd6f411f02abf92275d286c562915da5d7d3e89efd10ca60b0e854bb5f5b

Observation d207fd25-3c02-4a19-9887-ae07a066bc18 · outbound

This paper cites Nerf: Representing scenes as neural radiance fields for view synthesis,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Nerf: Representing scenes as neural radiance fields for view synthesis,

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.874882Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.874882Z digest=sha256:cab7c697810018cab5a85957de0cb98403688df237e479a2592ccfae1eb574bd

Observation 4d82856c-e9c8-40d2-966f-a40923bc4b75 · outbound

This paper cites An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.879344Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.879344Z digest=sha256:545790161d10e79c4fdb84fea97acb13bd960e5d118114bb1071b21acbf6b804

Observation 8dbcf914-8753-4682-a2b0-ce60a0760c9c · outbound

This paper cites On the spectral bias of neural networks,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation On the spectral bias of neural networks,

Reference 50

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.355260Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.884222Z digest=sha256:c665393102e3e7ec5c9636a3710246b314b5fb2edb447502ddd27df69bdd15a5

Observation 9bdfc08e-75d4-4bc9-a085-296e04b46105 · outbound

This paper cites Gans trained by a two time-scale update rule converge to a local nash equilibrium,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Gans trained by a two time-scale update rule converge to a local nash equilibrium,

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.888735Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.888735Z digest=sha256:59bb38435ccf8b036ae0090e25f5a6f033b5b8c2db05b79aa17ece320b81ee5e

Observation b87feada-dda5-4334-897c-874fa388a333 · outbound

This paper cites Clipscore: A reference-free evaluation metric for image captioning,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Clipscore: A reference-free evaluation metric for image captioning,

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.893247Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.893247Z digest=sha256:d51de526617c94082ba52506e975540efbedd98a2fd36b94982c5e3d9df4720d

Observation 7f0254a8-e094-4942-9f6a-be9de7508741 · outbound

This paper cites Image synthesis from layout with locality-aware mask adaption,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Image synthesis from layout with locality-aware mask adaption,

Reference 53

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.319659Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.897901Z digest=sha256:dc78ffebdd35476940305971b94b959729cee3dbb797fa47f8ae8735c63176af

Observation 9882da85-2b29-4e33-9a35-433e3a9e9514 · outbound

This paper cites Constrained graphic layout generation via latent optimization,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Constrained graphic layout generation via latent optimization,

Reference 54

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.303614Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.902493Z digest=sha256:c54fccb3906d53bfe9eb2c6e103a1f114926ff143ad320b7ad7b5e1fdd6a9704

Observation 78a56dc3-82e0-4f81-8ad1-d06fe206d62b · outbound

This paper cites Pytorch: An imperative style, high-performance deep learning library,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Pytorch: An imperative style, high-performance deep learning library,

Reference 55

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.907166Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.907166Z digest=sha256:5ba4f5b5dd834853914daf2af73e4f86685be55af973424b97ac6d6026260e82

Observation 95fd7851-cac3-46ab-bf80-72079237903b · outbound

This paper cites Adam: A Method for Stochastic Optimization.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Adam: A Method for Stochastic Optimization

Reference 56

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:07.911944Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:07.911944Z digest=sha256:0f29a59c1db40d60b3e0fc4f8b61d13660fc41279ef97feba388e9219b09104c

Observation 42f614d4-7af6-476e-9d88-e9015524d7e0 · outbound

This paper cites Dataset diffusion: Diffusion-based synthetic data generation for pixel-level semantic seg- mentation,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Dataset diffusion: Diffusion-based synthetic data generation for pixel-level semantic seg- mentation,

Reference 57

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.275701Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.917040Z digest=sha256:a113cd4da44a7cef8d7f8ef4105c4b38d2ab1e2a56fe6ed7ae0cd702e2a6e529

Observation 448d14bc-e049-4efd-a55e-890bde848c11 · outbound

This paper cites Image synthesis from reconfigurable layout and style,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Image synthesis from reconfigurable layout and style,

Reference 58

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.258206Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.922661Z digest=sha256:4cffe26a777f3007e977aef275e56f18df28ac7b916192e0fd0919ba7cf27731

Observation 676c68f8-2e66-44e4-81ae-687cb1b368f7 · outbound

This paper cites Learning layout and style reconfigurable gans for controllable image synthesis,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Learning layout and style reconfigurable gans for controllable image synthesis,

Reference 59

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.241887Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.927361Z digest=sha256:9e5cd9c742444b698fb24eb44800fb406e5e4377fd245dd92c9899ee5d418cd6

Observation 7c4f1469-648c-4298-9120-8c4cf455e1d9 · outbound

This paper cites Object- centric image generation from layouts,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Object- centric image generation from layouts,

Reference 60

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.226246Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.932105Z digest=sha256:7ff3b242483433b248530c2c6e1ec0706fe157764585905d43c3a5fc23d30c64

Observation f93553b9-a59e-4f37-b703-6609b187936a · outbound

This paper cites Layoutdiffusion: Controllable diffusion model for layout-to-image generation,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Layoutdiffusion: Controllable diffusion model for layout-to-image generation,

Reference 61

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.210383Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.936977Z digest=sha256:7e6291c40893270c35e908161bdfa8781b7980227799f8c464dd359cb70a69d7

Observation 1e0a897d-406a-4e01-956f-840b489f5178 · outbound

This paper cites Drag your gan: Interactive point-based manipulation on the generative image manifold,.

SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation Drag your gan: Interactive point-based manipulation on the generative image manifold,

Reference 62

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T21:56:08.195108Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T21:56:07.941714Z digest=sha256:34b08d83043ccfc82df049594278796acc4b9f2926bb97e6529351a496f9f25a

Pith citing papers

Observation a5415215-b39f-43aa-938a-8eaf33183f90 · inbound

T-Stars-Poster: A Framework for Product-Centric Advertising Image Design cites this paper.

T-Stars-Poster: A Framework for Product-Centric Advertising Image Design SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation

Reference 4

Resolution
verified exact
local_arxiv, observed 2026-08-10T15:20:04.119093Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-08-10T15:20:03.542467Z digest=sha256:388480f8522b9b8e5da5c095419ae7b7c08aa70d9e37105bf48928ab2990faf7