Pith. sign in

Paper Citation Record · LEDGER

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation

As of 21 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 3 inbound Pith citation observations for arXiv:2505.23493.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.23493 v1

Coverage vector

measured 50 of 50 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T12:48:56.713041Z

measured 53 of 53 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-20T06:33:59.587034+00:00

measured 3 of 3 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-06-30T06:48:22.594002Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-06-30T06:54:20.749687Z

Reference resolution

50 of 50 outbound references displayed

  • verified exact6
  • verified fuzzy0
  • unresolved44
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation d15d36c5-e011-4bda-8d2a-cfd185456321 · outbound

This paper cites an unresolved cited work.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Unresolved cited work

Reference 1

Resolution
unresolved
raw_fallback, observed 2026-08-07T12:49:00.159374Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-07T12:48:49.746943Z digest=sha256:19cf4f0afdd98592e03e1596462363c0556abc7e2dbf73d9dd4028b5566604aa

Observation 010d06db-4492-4aa0-adc9-773aab591966 · outbound

This paper cites Janus-Pro: Unified Multimodal Understanding and Generation with Data and Model Scaling.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Janus-Pro: Unified Multimodal Understanding and Generation with Data and Model Scaling

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:49.843304Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:49.843304Z digest=sha256:5813033dcbe9e334672fbac0ff4afbe4e63b267d6914794f7c85fd572b3fdfe1

Observation fef839bb-e848-40d5-a172-edfede8c32f1 · outbound

This paper cites CausalBench: A Large-scale Benchmark for Network Inference from Single-cell Perturbation Data.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation CausalBench: A Large-scale Benchmark for Network Inference from Single-cell Perturbation Data

Reference 3

Resolution
verified exact
local_arxiv, observed 2026-08-07T12:48:58.625556Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-07T12:48:50.005107Z digest=sha256:5bc47ef887516f9bcbfeef4278ab05e2344e9a5af90919dd82e5dc4a489939fd

Observation 7302757c-64c6-463a-891b-5be4aba836af · outbound

This paper cites Davidsonian Scene Graph: Improving Reliability in Fine-grained Evaluation for Text-to-Image Generation.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Davidsonian Scene Graph: Improving Reliability in Fine-grained Evaluation for Text-to-Image Generation

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:50.146992Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:50.146992Z digest=sha256:6dc00f6056d09266c34a8f46d0ee08cde6a40db432e2747ad2556084ed3ab8bb

Observation bc722c93-31a9-456c-80b2-35d3d5367dfd · outbound

This paper cites Ties Matter: Meta-Evaluating Modern Metrics with Pairwise Accuracy and Tie Calibration.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Ties Matter: Meta-Evaluating Modern Metrics with Pairwise Accuracy and Tie Calibration

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:50.308918Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:50.308918Z digest=sha256:783ca9e1631c37a945c06e3ce93429d63aa7b7ae37695787c2bccfdff29dbcbd

Observation 86f70d88-4b49-4d1f-b0ac-de7c90dfb821 · outbound

This paper cites an unresolved cited work.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Unresolved cited work

Reference 6

Resolution
unresolved
raw_fallback, observed 2026-08-07T12:48:59.888400Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-07T12:48:50.460119Z digest=sha256:82cb231909d6e3eefc1f9c36b9e1e5610461a63c498dc9c5b7e8dc870be9fe66

Observation a7e5a7b6-088a-45e7-a1b8-ac1e9abb352a · outbound

This paper cites Scaling Rectified Flow Transformers for High-Resolution Image Synthesis.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Scaling Rectified Flow Transformers for High-Resolution Image Synthesis

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:50.601657Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:50.601657Z digest=sha256:35dd27a6f83b568bd2fca3f9887c07051db28339d84272d0b16e6c8940e3fde1

Observation 2a1e1bb1-ba1a-4820-90c6-e681d26cbd59 · outbound

This paper cites Commonsense-T2I Challenge: Can Text-to-Image Generation Models Understand Commonsense?.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Commonsense-T2I Challenge: Can Text-to-Image Generation Models Understand Commonsense?

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:50.711956Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:50.711956Z digest=sha256:5675458dea4a9b847f205cf94fdf4bbfa911a2e50b398c0a5aa40b5fd96c1521

Observation 369b99fb-2f79-4006-ae23-413dac14c3a7 · outbound

This paper cites Lumina-T2X: Transforming Text into Any Modality, Resolution, and Duration via Flow-based Large Diffusion Transformers.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Lumina-T2X: Transforming Text into Any Modality, Resolution, and Duration via Flow-based Large Diffusion Transformers

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:50.794369Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:50.794369Z digest=sha256:2d7834edc05663424a8f1e54d1081bdd1f3ab14bc06c19ce979cf637d6a83117

Observation 52f2d23d-c8a4-459b-a650-5772f282b9d7 · outbound

This paper cites an unresolved cited work.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Unresolved cited work

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:50.918448Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:50.918448Z digest=sha256:ffa72a622267b5566361016e7a90e720a534d46ca4aaa5b531e964ab6d0bf1fb

Observation c30ed327-5349-46e7-b27a-bb7d9de92dad · outbound

This paper cites Can We Generate Images with CoT? Let's Verify and Reinforce Image Generation Step by Step.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Can We Generate Images with CoT? Let's Verify and Reinforce Image Generation Step by Step

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:51.044539Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:51.044539Z digest=sha256:d7bbfb0b059bc2e3a60416ffe2cb64b4234804f1677ce5906a974af4138d6d1f

Observation cca02173-e221-4070-b608-b43bb1183361 · outbound

This paper cites CLIPScore: A Reference-free Evaluation Metric for Image Captioning.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation CLIPScore: A Reference-free Evaluation Metric for Image Captioning

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:51.198464Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:51.198464Z digest=sha256:8cbb7597b56cf152f41df86be2b6a9714ae144501234fe4024ab0d5883ae0416

Observation 45a045a7-98f8-420f-98c9-3d0e66a55142 · outbound

This paper cites ELLA: Equip Diffusion Models with LLM for Enhanced Semantic Alignment.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation ELLA: Equip Diffusion Models with LLM for Enhanced Semantic Alignment

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:51.465446Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:51.465446Z digest=sha256:509b54e3954b30631ba34b8ab06cc14a07235383fe4f2bdafefa5f0cf1b8b4f1

Observation 2231ea07-0147-4d7b-8f59-c4722310452a · outbound

This paper cites GPT-4o System Card.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation GPT-4o System Card

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:51.628628Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:51.628628Z digest=sha256:680370412106630c01c497b0168b37553f2710dfd2d29289fd60d79b72ad27b8

Observation f62b6d8b-f62f-43d4-a2e3-82943ec1678e · outbound

This paper cites Kendall's Tau for Functional Data Analysis.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Kendall's Tau for Functional Data Analysis

Reference 15

Resolution
verified exact
local_arxiv, observed 2026-08-07T12:48:58.308666Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-07T12:48:51.794555Z digest=sha256:2e0c709b450e9099423902b0f159c6f6c190d3b7b1567cf66852ab4b6d9bfb92

Observation 804ffdb4-d090-4c42-9dc0-ddf05b948e29 · outbound

This paper cites T2I-R1: Reinforcing Image Generation with Collaborative Semantic-level and Token-level CoT.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation T2I-R1: Reinforcing Image Generation with Collaborative Semantic-level and Token-level CoT

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:51.964061Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:51.964061Z digest=sha256:771e98fe97a539d5f647eef41db0bcc323e19f338f40cd7f9beb2676cbbac3ee

Observation db0e28d8-1cfa-40fa-a469-aa79a0625070 · outbound

This paper cites an unresolved cited work.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Unresolved cited work

Reference 17

Resolution
unresolved
raw_fallback, observed 2026-08-07T12:48:59.602562Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-07T12:48:52.147488Z digest=sha256:d1f1b44fadbd42bc63679d83de16b11b81ebd84932f77a10610255e393bef290

Observation ad65a177-2452-4707-8dac-e53ac9c1a002 · outbound

This paper cites VIEScore: Towards Explainable Metrics for Conditional Image Synthesis Evaluation.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation VIEScore: Towards Explainable Metrics for Conditional Image Synthesis Evaluation

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:52.532034Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:52.532034Z digest=sha256:8af6720ab950c0bb501e479dfcfeeae0645fabe8db254e0274dd92c01d2cce1c

Observation b14e1c6f-fc45-420c-b189-7e1c833fb11e · outbound

This paper cites an unresolved cited work.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Unresolved cited work

Reference 20

Resolution
unresolved
raw_fallback, observed 2026-08-07T12:48:59.339026Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-07T12:48:52.666804Z digest=sha256:c28b46b25e3275624cf93450e95f0cc3264e32f0b10a07f5daee9f4b1eb8f94f

Observation 43c04451-4193-4182-b1fc-579930d9d841 · outbound

This paper cites IMAGINE-E: Image Generation Intelligence Evaluation of State-of-the-art Text-to-Image Models.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation IMAGINE-E: Image Generation Intelligence Evaluation of State-of-the-art Text-to-Image Models

Reference 21

Resolution
verified exact
local_arxiv, observed 2026-08-07T12:48:57.976466Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-07T12:48:52.817656Z digest=sha256:aa0df219e4158bab1014456899bd7f77ddd3a07f49eae53d6839800138366fb7

Observation 836d8399-db45-4cb3-84f0-0bbc4b029464 · outbound

This paper cites GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:52.975148Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:52.975148Z digest=sha256:e44513b7fca7e21da14b0fbda960b6bd72d296461841e51620a8d6da0f14f5d1

Observation 723ce008-02c0-4df6-8f68-b18827866cb5 · outbound

This paper cites ImageGen-CoT: Enhancing Text-to-Image In-context Learning with Chain-of-Thought Reasoning.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation ImageGen-CoT: Enhancing Text-to-Image In-context Learning with Chain-of-Thought Reasoning

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:53.157072Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:53.157072Z digest=sha256:41bc92a2d0cd91b975f7bd4a2d4186d1e83b64b30f34aa78bf15bf2edd080b4a

Observation 33189b65-b17b-43ee-a9e5-0152e6f44c30 · outbound

This paper cites MagicMix: Semantic Mixing with Diffusion Models.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation MagicMix: Semantic Mixing with Diffusion Models

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:53.295857Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:53.295857Z digest=sha256:62ed2c76366096d056e6f8409c73431d416ffa8b7f0586b578a3c1d067e0cf8c

Observation 5b8a8ef9-cba3-48d6-b038-4acffd83eaa5 · outbound

This paper cites an unresolved cited work.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Unresolved cited work

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:53.425939Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:53.425939Z digest=sha256:a4e51549a71a501c45b2c686d2c66655de53f4bee266c48df27d68be58350ced

Observation b30cb2e3-9dc7-4397-ad67-4a745b572ff1 · outbound

This paper cites LogiQA: A Challenge Dataset for Machine Reading Comprehension with Logical Reasoning.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation LogiQA: A Challenge Dataset for Machine Reading Comprehension with Logical Reasoning

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:53.577654Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:53.577654Z digest=sha256:578c39f2f9345f7f668551d25e80421b421ee723c063f5b764ce9b196259d586

Observation e55c5242-413a-43ce-b7fa-cf86eb48aed6 · outbound

This paper cites an unresolved cited work.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Unresolved cited work

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:53.747961Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:53.747961Z digest=sha256:38dbc6365fa4ff7bb3e0d65a6c612b180b53681da8c28bf0659a8b13e8cb2bbb

Observation adda8c30-b5c0-439a-a532-f3d0e4ca0885 · outbound

This paper cites an unresolved cited work.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Unresolved cited work

Reference 28

Resolution
unresolved
raw_fallback, observed 2026-08-07T12:48:59.129969Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-07T12:48:53.921825Z digest=sha256:63e4f246e45a9fca1cab029934f92e47af5b87762b9b0dbae237220855088b08

Observation 05868bab-5a3c-4920-9e7d-12d77b8175ba · outbound

This paper cites Learning Visual Generative Priors without Text.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Learning Visual Generative Priors without Text

Reference 29

Resolution
verified exact
local_arxiv, observed 2026-08-07T12:48:57.707197Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-07T12:48:54.032525Z digest=sha256:cfc0afe6d292fddf10bd350e4f755bf632c317aa02d13a7bd9fc2d64af4802b2

Observation da3143c8-41f6-45b9-bec3-a3a40a0ef15f · outbound

This paper cites an unresolved cited work.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Unresolved cited work

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:54.106454Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:54.106454Z digest=sha256:43227bae4c9e3a1ada3b1d37d2a8effce4f3bc205f2ba99e5e478b4708b00b37

Observation 40408198-a49f-43fc-85d5-d6426c2ed649 · outbound

This paper cites WISE: A World Knowledge-Informed Semantic Evaluation for Text-to-Image Generation.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation WISE: A World Knowledge-Informed Semantic Evaluation for Text-to-Image Generation

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:54.317434Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:54.317434Z digest=sha256:63222623c303e04fc28f478c4356141599b78844e0c201c31df29d813baeb0ef

Observation cf20f87c-f19c-496c-a84b-2ac9f43a21e6 · outbound

This paper cites Lumina-Image 2.0: A Unified and Efficient Image Generative Framework.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Lumina-Image 2.0: A Unified and Efficient Image Generative Framework

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:54.580086Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:54.580086Z digest=sha256:c850a85e94d5d7e78169e4ac925a65cd26e40540705fa871082f84b58011a7d6

Observation 17673e44-7f71-446b-bef4-7adb5565277b · outbound

This paper cites an unresolved cited work.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Unresolved cited work

Reference 34

Resolution
unresolved
raw_fallback, observed 2026-08-07T12:48:58.969246Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-07T12:48:54.692540Z digest=sha256:936e01f204eec54bc54178aed86953b6334ae0cfb26e8da575591c571f39be6a

Observation 37859dc6-6fc7-41fa-a920-6b90ec0d4b14 · outbound

This paper cites Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:54.855706Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:54.855706Z digest=sha256:0fd6eae3cd0b744055bc55bc21d548d16ab07d6c515af4d0784a443f130383ce

Observation c2c0e2d7-3117-4f63-9400-0e3e1d0fe880 · outbound

This paper cites Generative Multimodal Models are In-Context Learners.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Generative Multimodal Models are In-Context Learners

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:55.005689Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:55.005689Z digest=sha256:9777871b5b7b8cbf0fff635e7fd378a278a79d1bf81bb6f29bdc373c25498d2a

Observation 15fe29a9-c656-48bc-91ee-f800647ce3f3 · outbound

This paper cites Emu: Generative Pretraining in Multimodality.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Emu: Generative Pretraining in Multimodality

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:55.111828Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:55.111828Z digest=sha256:bcdbdd5c03c15c1e1463192427fb145aaa8daf8b6f511a16b882fab14e32034c

Observation 03b63b66-149e-47b7-98ee-befe15c591cd · outbound

This paper cites an unresolved cited work.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Unresolved cited work

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:55.192746Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:55.192746Z digest=sha256:8c3a01b1957ac4851009c064fe281d80b7b97975defbfb1f12dbb16f0f25f040

Observation e33e3d93-ec1e-49a8-9ef6-5bc9596101ba · outbound

This paper cites MetaMorph: Multimodal Understanding and Generation via Instruction Tuning.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation MetaMorph: Multimodal Understanding and Generation via Instruction Tuning

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:55.384624Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:55.384624Z digest=sha256:fb1d65fcd91573483901828c3503178f6dfb16d9b19efcf0b73889b18282bb02

Observation fdb135d6-f843-4d5f-ae9b-5688fdadfc0c · outbound

This paper cites an unresolved cited work.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Unresolved cited work

Reference 40

Resolution
unresolved
raw_fallback, observed 2026-08-07T12:48:58.803715Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-07T12:48:55.514454Z digest=sha256:e78993fa4bc872a2fc7421f9be17f773c2380619b4a627aa0ef42baa98518257

Observation d961166e-2c35-4e17-a820-a5fe76732e65 · outbound

This paper cites Emu3: Next-Token Prediction is All You Need.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Emu3: Next-Token Prediction is All You Need

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:55.567187Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:55.567187Z digest=sha256:ebd00a6ec8a4a648204184fdcfd34b2d43ac55b60177bb8ecbf5940e2de5c3e4

Observation 9a7f49e9-8af9-4f8d-afc6-7bba26078876 · outbound

This paper cites ConceptMix: A Compositional Image Generation Benchmark with Controllable Difficulty.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation ConceptMix: A Compositional Image Generation Benchmark with Controllable Difficulty

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:55.570907Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:55.570907Z digest=sha256:8bb326506eb3029d93a8b1a7d20cf9c28e67296eab93f62830209eedad8a226a

Observation 2bee3ea4-59db-4fb9-9590-684383f90c07 · outbound

This paper cites OmniGen: Unified Image Generation.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation OmniGen: Unified Image Generation

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:55.618522Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:55.618522Z digest=sha256:9ea559da07964da6e1ad485db9d5dbee50bcb85427c2f14011a0344a5082ae26

Observation 2898c4ff-0a6a-4f53-acae-e0166b00442a · outbound

This paper cites SANA 1.5: Efficient Scaling of Training-Time and Inference-Time Compute in Linear Diffusion Transformer.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation SANA 1.5: Efficient Scaling of Training-Time and Inference-Time Compute in Linear Diffusion Transformer

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:55.829535Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:55.829535Z digest=sha256:63d4c67d10b721aa71e5d804358957b84d910acbf8f11ed5d6c5101bc6dad851

Observation 2bd8c5a0-ceba-4d35-8cd3-c01cec3ba9e4 · outbound

This paper cites Show-o: One Single Transformer to Unify Multimodal Understanding and Generation.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Show-o: One Single Transformer to Unify Multimodal Understanding and Generation

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:55.954212Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:55.954212Z digest=sha256:a3206a190b0b764da1629e2ba32a6efcb0774c57e10ee9c772ef0b890d3954ed

Observation c40b6fc4-a2da-4dcb-8750-19d86b2d9706 · outbound

This paper cites Improving Diffusion-Based Image Synthesis with Context Prediction.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Improving Diffusion-Based Image Synthesis with Context Prediction

Reference 47

Resolution
verified exact
local_arxiv, observed 2026-08-07T12:48:57.320478Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-07T12:48:56.036754Z digest=sha256:ca63a25268c43f00b9d06c134b62d0a107f3755b83acb6b84d740c7f77bbf40c

Observation 9f2adca5-024e-4b9b-bbc3-bf397071ab34 · outbound

This paper cites VAR-CLIP: Text-to-Image Generator with Visual Auto-Regressive Modeling.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation VAR-CLIP: Text-to-Image Generator with Visual Auto-Regressive Modeling

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:56.108385Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:56.108385Z digest=sha256:72273ca1f3cbf13f85e4b7655c9a767248775b95a1bbe0fc4f88e58bcfc16b2f

Observation 7d178482-6428-4976-96ef-9290457b12da · outbound

This paper cites Envisioning Beyond the Pixels: Benchmarking Reasoning-Informed Visual Editing.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Envisioning Beyond the Pixels: Benchmarking Reasoning-Informed Visual Editing

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:56.234527Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:56.234527Z digest=sha256:d5fad688f6cff8f7263bd42d4bf755028418448a168ee5b4103a3393e6514257

Observation eee34671-3498-47ed-bd10-555b3b04761a · outbound

This paper cites Transfusion: Predict the Next Token and Diffuse Images with One Multi-Modal Model.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Transfusion: Predict the Next Token and Diffuse Images with One Multi-Modal Model

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:56.360167Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:56.360167Z digest=sha256:e62f05409a2fb934a9342d917f647130f1646ce726e96beb53a30666affcc575

Observation c8d31cea-5951-4100-ab35-8c0f3b4a3ad4 · outbound

This paper cites Evaluating Semantic Variation in Text-to-Image Synthesis: A Causal Perspective.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Evaluating Semantic Variation in Text-to-Image Synthesis: A Causal Perspective

Reference 51

Resolution
verified exact
local_arxiv, observed 2026-08-07T12:48:57.030869Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-07T12:48:56.454870Z digest=sha256:122a9a52bd1836b0c93f107e7fe10a65b8189a66d01ee01ef63654e97a63969d

Observation b556ee5a-ae57-4893-8b1e-1f03754f9921 · outbound

This paper cites URL: " 'urlintro :=.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation URL: " 'urlintro :=

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:56.601294Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:56.601294Z digest=sha256:953b734b19410045a6b1b96b68a1d1c086b11eab55aef0840977434bc42229f6

Observation c5e8baea-0cc1-4bb7-b1a2-1d462c9be9bf · outbound

This paper cites write newline.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation write newline

Reference 53

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:56.713041Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:56.713041Z digest=sha256:5888803fca82259ad8641e75a299a65bd58359ca14c90a2f15946e728c7818da

Pith citing papers

Observation 46fadfc8-672a-4492-bd62-df72663c45b5 · inbound

FireScope: Wildfire Risk Raster Prediction with a Chain-of-Thought Oracle cites this paper.

FireScope: Wildfire Risk Raster Prediction with a Chain-of-Thought Oracle R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation

Reference 11

Resolution
verified exact
arxiv_id, observed 2026-05-17T20:50:15.265088Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-05-17T20:45:15.034196Z digest=sha256:f67ededcfe023ac6d2d7c5e172dc0434509794a43fcbb80141da0fb68b3dcd87

Observation 59c12a06-209e-4f77-b97a-d26040fdf814 · inbound

FireScope: Wildfire Risk Raster Prediction with a Chain-of-Thought Oracle cites this paper.

FireScope: Wildfire Risk Raster Prediction with a Chain-of-Thought Oracle R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation

Reference 11

Resolution
verified exact
arxiv_id, observed 2026-05-25T07:20:28.749989Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-05-25T07:17:26.381232Z digest=sha256:0bdab1426494a7714d0c80fe567a8e618870b0d390f933ef3e11c2ebc3b7b150

Observation 4d3fa62b-0fe2-424e-893c-4a4515adfa78 · inbound

SciIR: A Large-scale Training Dataset and Benchmark for Scientific Image Reasoning Generation cites this paper.

SciIR: A Large-scale Training Dataset and Benchmark for Scientific Image Reasoning Generation R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation

Reference 5

Resolution
metadata mismatch
arxiv_id, observed 2026-06-30T06:54:20.751242Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-06-30T06:48:22.594002Z digest=sha256:546a839922804935a39b7bc3a37766c550a264f6125d2cd76eb281cc266a15f0