Pith. sign in

Paper Citation Record · LEDGER

Context-Aware Autoregressive Models for Multi-Conditional Image Generation

As of 18 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 2 inbound Pith citation observations for arXiv:2505.12274.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.12274 v1

Coverage vector

measured 45 of 45 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-15T20:41:44.333463Z

measured 47 of 47 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-18T06:34:40.430872+00:00

measured 2 of 2 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-04T16:43:49.597958Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-13T07:37:29.558808Z

Reference resolution

45 of 45 outbound references displayed

  • verified exact0
  • verified fuzzy3
  • unresolved42
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation b72b28ee-d27f-4b59-b652-c08a02eced97 · outbound

This paper cites Denoising Diffusion Implicit Models.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Denoising Diffusion Implicit Models

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.140241Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.140241Z digest=sha256:bc13fa9a1d0c8cd5a04c39134c92bfee1f4c27ffa203cb1d8992ab420e068b45

Observation bb9d62a0-ec5c-4cff-a9da-dec1200e868a · outbound

This paper cites Denoising diffusion probabilistic models.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Denoising diffusion probabilistic models

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.145286Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.145286Z digest=sha256:1bc3713023f73fe19fa74f622a0a8254204f67f394c39e351c5ae0348398fc46

Observation 33e2405b-606e-4cb1-aac2-de1785b56972 · outbound

This paper cites Improved denoising diffusion probabilistic models.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Improved denoising diffusion probabilistic models

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.149679Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.149679Z digest=sha256:1bde89f41efdce22bcfd6637adf4c208a3533167f361509bf2f644616498e473

Observation f685d86d-f203-4fdd-8fc8-84bf1ca0a2f0 · outbound

This paper cites Diffusion models beat gans on image synthesis.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Diffusion models beat gans on image synthesis

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.153925Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.153925Z digest=sha256:c9f410bbd618bdd404a45919e51be3e34ff060e02dd782fb6037411dbc19a85b

Observation bb331460-7bf0-43be-8a3a-44a1d0927c9d · outbound

This paper cites High- resolution image synthesis with latent diffusion models.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation High- resolution image synthesis with latent diffusion models

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.158511Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.158511Z digest=sha256:b031fe73cc9594d7933446e227cdb6ec0d79cb39e349e8ebcb84f8082945a511

Observation baa16279-307d-47ee-b8ed-523ca45f46bb · outbound

This paper cites an unresolved cited work.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Unresolved cited work

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.162762Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.162762Z digest=sha256:5f6e80357a867994655fe97d9c0710aa65b23b3583f717ebc45461001d9e0d28

Observation 156407d8-9e67-47bb-ab47-f960667c6379 · outbound

This paper cites Adding conditional control to text-to-image diffusion models.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Adding conditional control to text-to-image diffusion models

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.167468Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.167468Z digest=sha256:dcee6c7069f320f276973f14eb336b321d944d13fb06760401b256a3675eec6e

Observation 5996f9e7-d615-4e11-98a3-32dca0f32c30 · outbound

This paper cites IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.172128Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.172128Z digest=sha256:4e1128bfc001940bf9afd0aa85c9a04efa3c8feb4a3412f2938675c5d445ba46

Observation 3ce2e962-59ca-4e43-90ff-16527d8e76e4 · outbound

This paper cites T2i-adapter: Learning adapters to dig out more controllable ability for text-to-image diffusion models.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation T2i-adapter: Learning adapters to dig out more controllable ability for text-to-image diffusion models

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.176633Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.176633Z digest=sha256:6971d00f7f77c49d2341b89cb59babc1154598e90b6efbacc5de4e79449d83f3

Observation fb6d3e11-1ed5-4bba-bb81-47aea42d4937 · outbound

This paper cites Attention is all you need.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Attention is all you need

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.180755Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.180755Z digest=sha256:f6194c581f52ef000086326b8a2f8e33174034ce8dc0a86423b06de4b0a1a0f4

Observation 0821285c-ba89-4654-baab-2b341add60be · outbound

This paper cites Language models are few-shot learners.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Language models are few-shot learners

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.184861Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.184861Z digest=sha256:5411d9cf11fdd40dabcdda390b7a1b182b6b525ebd45d11de54fa26666d113c1

Observation ad9b4fb7-d4f5-4ea4-9750-e988de3e3c70 · outbound

This paper cites EditAR: Unified Conditional Generation with Autoregressive Models.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation EditAR: Unified Conditional Generation with Autoregressive Models

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.189077Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.189077Z digest=sha256:3b5b704b56f1c6c1394067a81ef366196396709548bff7341d66c1016261b1d4

Observation f90a00d5-9c01-4f68-bfe3-d25d032e43f7 · outbound

This paper cites Controllable generation with text-to-image diffusion models: A survey.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Controllable generation with text-to-image diffusion models: A survey

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.193688Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.193688Z digest=sha256:2fa50167f50b29835aeb0e059e88a8d6c95e329b32bb9fbc0c51a024860f22b7

Observation e92f3527-7725-43bb-bf06-d168a9f634ac · outbound

This paper cites Roformer: Enhanced transformer with rotary position embedding.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Roformer: Enhanced transformer with rotary position embedding

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.197889Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.197889Z digest=sha256:22ec261a46d661de4bb8d136aae4a4904869a15fabd60fcbbdbf4d95e8f263eb

Observation 70e140b5-0e1b-4239-bb14-5d96fa847898 · outbound

This paper cites Generating diverse high-fidelity images with vq-vae-2.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Generating diverse high-fidelity images with vq-vae-2

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.202079Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.202079Z digest=sha256:e9b6fd2482cf4ebf238a60c9aa5956d124a36bf547e1b9a21d4aac94c2cdd05c

Observation de25290d-2691-4d0f-bfba-32629cc05dc1 · outbound

This paper cites Taming transformers for high-resolution image synthesis.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Taming transformers for high-resolution image synthesis

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.206302Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.206302Z digest=sha256:8b76a10c5ffec591dfd6c2379037ccaa3f19417fa85828f3572bbad71d03515a

Observation 69bdb8b2-bc96-4de2-be4d-90258f272d3f · outbound

This paper cites Scaling Autoregressive Models for Content-Rich Text-to-Image Generation.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Scaling Autoregressive Models for Content-Rich Text-to-Image Generation

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.210819Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.210819Z digest=sha256:4bddde0d6aa169256c6fae324a6ce01f00984fefd9f51f3dcf020732a1ca6284

Observation be9279aa-166d-4761-bf55-cdd2798d3837 · outbound

This paper cites Zero-shot text-to-image generation.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Zero-shot text-to-image generation

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:41:44.950893Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-15T20:41:44.215575Z digest=sha256:3a981a75695c2e70b97989c86f2b921c701a3e38688ec4c54e2631d4aef24fe1

Observation a0cf1651-5935-4d74-8fc4-dc795b4f309b · outbound

This paper cites Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.220396Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.220396Z digest=sha256:24e39295617961266fa8a8eefa6b4dc93c02ed5f26859731d2754317fc76b6b1

Observation c9a44ebc-a6ad-453a-9f86-163cea55f097 · outbound

This paper cites Autoregressive Image Generation without Vector Quantization.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Autoregressive Image Generation without Vector Quantization

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.224837Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.224837Z digest=sha256:8b89acaf8d91d2ff83db95814e3ec360f80a70af96f05fd294f928801c7c2293

Observation b4df1f46-ef28-4521-aac4-c23afc41165a · outbound

This paper cites Visual Autoregressive Modeling: Scalable Image Generation via Next-Scale Prediction.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Visual Autoregressive Modeling: Scalable Image Generation via Next-Scale Prediction

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.229696Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.229696Z digest=sha256:46796c4aa10e62038f797910371bedf12d4662861f589e36673f8472255c2399

Observation 600e19ec-a827-445f-a4f7-27b2a57186eb · outbound

This paper cites Frequency autoregressive image generation with continuous tokens.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Frequency autoregressive image generation with continuous tokens

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.233965Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.233965Z digest=sha256:f0d304c7d982d2dc96bdd529f4586d2cf9f3733efc0569512624708902626fe2

Observation c1da0a42-c1bc-45c9-b559-33b6fa260dff · outbound

This paper cites SimpleAR: Pushing the Frontier of Autoregressive Visual Generation through Pretraining, SFT, and RL.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation SimpleAR: Pushing the Frontier of Autoregressive Visual Generation through Pretraining, SFT, and RL

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.238033Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.238033Z digest=sha256:2268c4ae8dae4bd85b2f00ed3ca33da379cd92b96567a6beda52ef053d486ab7

Observation 2002b53b-3a6e-4a44-b2ff-a787471e1582 · outbound

This paper cites Neural discrete representation learning.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Neural discrete representation learning

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.242506Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.242506Z digest=sha256:964c7b4f1327db157b317a6938c0f8c23fa6b3113e20d0b368f1861492483190

Observation 149553c9-4592-453a-9ed0-62664eb578ed · outbound

This paper cites LLaMA: Open and Efficient Foundation Language Models.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation LLaMA: Open and Efficient Foundation Language Models

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.246734Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.246734Z digest=sha256:3fb9bf9c499590565e361c1e5f4ca3a702da5dad38f61d5293616f9bd7fcc526

Observation e10d45d5-dbe1-401e-a4ce-1c4d95e90ac6 · outbound

This paper cites Llama 2: Open Foundation and Fine-Tuned Chat Models.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Llama 2: Open Foundation and Fine-Tuned Chat Models

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.250824Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.250824Z digest=sha256:735f6810516f0d864877dab0b3f9b32643b30b6b96badff82d7a1fd52e2a125d

Observation 140281db-9745-4e6d-a1bd-fcb950964b0c · outbound

This paper cites InstantID: Zero-shot Identity-Preserving Generation in Seconds.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation InstantID: Zero-shot Identity-Preserving Generation in Seconds

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.255142Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.255142Z digest=sha256:1346c1fe6bc9ce24c1c6625a5bc1fa33b9c35878536458874052548e51207c25

Observation 04eb1b5f-e978-4aad-b908-2612a7b1d894 · outbound

This paper cites UniControl: A Unified Diffusion Model for Controllable Visual Generation In the Wild.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation UniControl: A Unified Diffusion Model for Controllable Visual Generation In the Wild

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.259527Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.259527Z digest=sha256:4817369c572ba533d34c6555a385bfefc01e43ba15694bf5c408dfbedcae42d6

Observation c85d1db0-2950-417c-9d49-88b6d5af04a7 · outbound

This paper cites Uni-controlnet: All-in-one control to text-to-image diffusion models.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Uni-controlnet: All-in-one control to text-to-image diffusion models

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.264411Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.264411Z digest=sha256:0d137f4195d2e1362f9601974099aaf3223f02c630a08af5e61dd37013a3dc8d

Observation 9b34388c-b1d8-436d-9d61-405d071e7e95 · outbound

This paper cites Cocktail: Mixing multi-modality control for text-conditional image generation.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Cocktail: Mixing multi-modality control for text-conditional image generation

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:41:44.918450Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-15T20:41:44.268410Z digest=sha256:8ce105b471d0e13ab03fa9bf84e5f6934bfdde901261f0f921ef66281918ebdc

Observation 88ab3198-98a9-44f9-9e05-dcf30b0f1737 · outbound

This paper cites UniCombine: Unified Multi-Conditional Combination with Diffusion Transformer.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation UniCombine: Unified Multi-Conditional Combination with Diffusion Transformer

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.272420Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.272420Z digest=sha256:1b5e069342bd084949d0a55984c4c837a6e32801ba37badadd34773027356cc4

Observation bd65a0a1-b730-48d1-bb8d-c5646f38c5dc · outbound

This paper cites PixelPonder: Dynamic Patch Adaptation for Enhanced Multi-Conditional Text-to-Image Generation.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation PixelPonder: Dynamic Patch Adaptation for Enhanced Multi-Conditional Text-to-Image Generation

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.276787Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.276787Z digest=sha256:c7168d1932403e95261857f81809a9164f885331bdb5dfe9a307ff013d60b3d7

Observation 57013891-88c4-4c26-972e-f92f67edffd1 · outbound

This paper cites ControlAR: Controllable Image Generation with Autoregressive Models.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation ControlAR: Controllable Image Generation with Autoregressive Models

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.281298Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.281298Z digest=sha256:7b621f673d1e17c6677989cedb3164d9398161bcbc402b5090ba79be0a7bfae2

Observation bb1ee8e1-3d91-4b00-b86b-ec60c1380080 · outbound

This paper cites Janus: Decoupling Visual Encoding for Unified Multimodal Understanding and Generation.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Janus: Decoupling Visual Encoding for Unified Multimodal Understanding and Generation

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.285925Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.285925Z digest=sha256:aeb034b07b3f76d443e991fb916c34d6d22f631992e1f94078839fc5a1648ec5

Observation aadbe2ac-659f-48cb-9f0f-9d346eea314a · outbound

This paper cites VILA-U: a Unified Foundation Model Integrating Visual Understanding and Generation.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation VILA-U: a Unified Foundation Model Integrating Visual Understanding and Generation

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.290233Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.290233Z digest=sha256:dc195b1177147a1f66cf052602c07d2009595351d11d873923cac6a67c4438d5

Observation 3e1a804f-8a82-4936-8c0f-600e760d5d98 · outbound

This paper cites Liquid: Language Models are Scalable and Unified Multi-modal Generators.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Liquid: Language Models are Scalable and Unified Multi-modal Generators

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.294438Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.294438Z digest=sha256:ffbe08abc43a31eb9f99b5794d3c900f3bfb42ba2cb91ab7b53c1f913cd8b542

Observation b5b546d0-676f-40f1-a6aa-4b79c49ab343 · outbound

This paper cites Chameleon: Mixed-Modal Early-Fusion Foundation Models.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Chameleon: Mixed-Modal Early-Fusion Foundation Models

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.299066Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.299066Z digest=sha256:ad9bc9611fcbaa14fa1b35b5972a60bc74a3b2c0e6303f2677696b4bd0ef124d

Observation a8083cf6-0782-4e88-98cf-1ce27595576c · outbound

This paper cites Emu3: Next-Token Prediction is All You Need.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Emu3: Next-Token Prediction is All You Need

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.303093Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.303093Z digest=sha256:282ca392bffacc4fc46f2544adcc63e538af9263f9c734d0154eb8e1537a68df

Observation befd92c9-b5f8-4bbf-8483-57ef935985d4 · outbound

This paper cites Transfusion: Predict the Next Token and Diffuse Images with One Multi-Modal Model.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Transfusion: Predict the Next Token and Diffuse Images with One Multi-Modal Model

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.307195Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.307195Z digest=sha256:e8d6811add9888c3ed1adc92fccb49d498f6cd7104e9f34be12bbf27092f2fa7

Observation 9b9ac289-2f1c-478a-a6c5-a4797a24ffe0 · outbound

This paper cites Show-o: One Single Transformer to Unify Multimodal Understanding and Generation.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Show-o: One Single Transformer to Unify Multimodal Understanding and Generation

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.311365Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.311365Z digest=sha256:c74f9c47105c6b46d5b0970d72dac6cfacf60c93be7251d80dcc529c362a06bd

Observation eff20e51-407a-41fa-b394-a8551b0cf29e · outbound

This paper cites Vision as LoRA.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Vision as LoRA

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.316499Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.316499Z digest=sha256:8191e43037e601926ca98a823f07e8602e540869fa9803b87733ef6edf5d3978

Observation db49728d-d160-4e99-b914-a36dc8c5ba49 · outbound

This paper cites Gans trained by a two time-scale update rule converge to a local nash equilibrium.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Gans trained by a two time-scale update rule converge to a local nash equilibrium

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.320762Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.320762Z digest=sha256:bfafe06068025c1d6b9f6a3d271922c3214560e86078ef7c1bdad2a9380d1b35

Observation 173ed8ee-ddfb-4d5b-8253-2ccdd449013d · outbound

This paper cites Musiq: Multi-scale image quality transformer.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Musiq: Multi-scale image quality transformer

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.324925Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.324925Z digest=sha256:ae045beaac65b9bafd91c5fb315a2758aa9e74e123246cc0c6e991c2dfcae01d

Observation 436078d9-53e2-4a0a-9603-d3f728769147 · outbound

This paper cites Image quality assessment: from error visibility to structural similarity.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Image quality assessment: from error visibility to structural similarity

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-15T20:41:44.329116Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:41:44.329116Z digest=sha256:d4b4166906f79af6b29fa95e3ec281bdfc565a33878f09dbf53e28640210fd65

Observation 2388aff6-a27b-435f-b4d1-452bf9d60b08 · outbound

This paper cites Learning transferable visual models from natural language supervision.

Context-Aware Autoregressive Models for Multi-Conditional Image Generation Learning transferable visual models from natural language supervision

Reference 45

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T20:41:44.874477Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-15T20:41:44.333463Z digest=sha256:8f15471e7c9fbebb64aca81ede2ca8178c25f0f9a6b04fd7fea969efebd23118

Pith citing papers

Observation 271753ac-7640-4a93-a96a-038fc82083d6 · inbound

Layout-Conditioned Autoregressive Text-to-Image Generation via Structured Masking cites this paper.

Layout-Conditioned Autoregressive Text-to-Image Generation via Structured Masking Context-Aware Autoregressive Models for Multi-Conditional Image Generation

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-04T16:43:49.597958Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-04T16:43:49.597958Z digest=sha256:7a1cbf5e2defdf41984ae1ff55fd0a2a2ffdaf3f080c1c022196b39336d0feb2

Observation badc69f1-39d1-4426-ada2-3893880d96f2 · inbound

Design Your Ad: Personalized Advertising Image and Text Generation with Unified Autoregressive Models cites this paper.

Design Your Ad: Personalized Advertising Image and Text Generation with Unified Autoregressive Models Context-Aware Autoregressive Models for Multi-Conditional Image Generation

Reference 15

Resolution
verified exact
arxiv_id, observed 2026-05-13T07:37:29.562067Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-05-13T07:34:41.000570Z digest=sha256:386fef77903936761c5e01c019415bf5b01c0367eb241a3c8b1fcfa85b51db09