Pith. sign in

Paper Citation Record · LEDGER

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation

As of 7 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 3 inbound Pith citation observations for arXiv:2505.23493.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.23493 v1

Coverage vector

measured 50 of 50 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T12:48:56.713041Z

measured 53 of 53 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-07T06:34:17.273281+00:00

measured 3 of 3 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-06-30T06:48:22.594002Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-06-30T06:54:20.749687Z

Reference resolution

50 of 50 outbound references displayed

  • verified exact6
  • verified fuzzy0
  • unresolved44
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation d15d36c5-e011-4bda-8d2a-cfd185456321 · outbound

This paper cites an unresolved cited work.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Unresolved cited work

Reference 1

Resolution
unresolved
raw_fallback, observed 2026-08-07T12:49:00.159374Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T12:48:49.746943Z digest=sha256:0e62976218a616185356f7201e9c3d4b6379813875669dea20b05ed47fe17b84

Observation 010d06db-4492-4aa0-adc9-773aab591966 · outbound

This paper cites Janus-Pro: Unified Multimodal Understanding and Generation with Data and Model Scaling.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Janus-Pro: Unified Multimodal Understanding and Generation with Data and Model Scaling

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:49.843304Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:49.843304Z digest=sha256:35e3337aaf32663c82b40f7680914dd31a5ea9713ee72aa4b9f2fbbf37ec059a

Observation fef839bb-e848-40d5-a172-edfede8c32f1 · outbound

This paper cites CausalBench: A Large-scale Benchmark for Network Inference from Single-cell Perturbation Data.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation CausalBench: A Large-scale Benchmark for Network Inference from Single-cell Perturbation Data

Reference 3

Resolution
verified exact
local_arxiv, observed 2026-08-07T12:48:58.625556Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T12:48:50.005107Z digest=sha256:05f21998cbe06bfe3c768b64584f575613c73c5ccfdd8c972892627f47db1e58

Observation 7302757c-64c6-463a-891b-5be4aba836af · outbound

This paper cites Davidsonian Scene Graph: Improving Reliability in Fine-grained Evaluation for Text-to-Image Generation.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Davidsonian Scene Graph: Improving Reliability in Fine-grained Evaluation for Text-to-Image Generation

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:50.146992Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:50.146992Z digest=sha256:5c45b2970c19a1269a76a29eb80bd1fb1529c06100067ceae0ff1bd2afae3f4e

Observation bc722c93-31a9-456c-80b2-35d3d5367dfd · outbound

This paper cites Ties Matter: Meta-Evaluating Modern Metrics with Pairwise Accuracy and Tie Calibration.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Ties Matter: Meta-Evaluating Modern Metrics with Pairwise Accuracy and Tie Calibration

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:50.308918Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:50.308918Z digest=sha256:4acebc61cf689be6f3e5f44357957777173999318aa4cd809b3eb37177fb67c9

Observation 86f70d88-4b49-4d1f-b0ac-de7c90dfb821 · outbound

This paper cites an unresolved cited work.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Unresolved cited work

Reference 6

Resolution
unresolved
raw_fallback, observed 2026-08-07T12:48:59.888400Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T12:48:50.460119Z digest=sha256:787a5a4c5a6be440b4173b3cbd23e193a05cbd0d808c277121a90fe2102da807

Observation a7e5a7b6-088a-45e7-a1b8-ac1e9abb352a · outbound

This paper cites Scaling Rectified Flow Transformers for High-Resolution Image Synthesis.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Scaling Rectified Flow Transformers for High-Resolution Image Synthesis

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:50.601657Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:50.601657Z digest=sha256:21c58e2a37d45bf17bd68721f02dd74ba295de640a3cdce583390accad558f06

Observation 2a1e1bb1-ba1a-4820-90c6-e681d26cbd59 · outbound

This paper cites Commonsense-T2I Challenge: Can Text-to-Image Generation Models Understand Commonsense?.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Commonsense-T2I Challenge: Can Text-to-Image Generation Models Understand Commonsense?

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:50.711956Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:50.711956Z digest=sha256:de09f7c278ba52e0e390830fa452d740e7e8c6e4a7dbf1997fcd073959fbdd1d

Observation 369b99fb-2f79-4006-ae23-413dac14c3a7 · outbound

This paper cites Lumina-T2X: Transforming Text into Any Modality, Resolution, and Duration via Flow-based Large Diffusion Transformers.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Lumina-T2X: Transforming Text into Any Modality, Resolution, and Duration via Flow-based Large Diffusion Transformers

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:50.794369Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:50.794369Z digest=sha256:f146aa9cc436a7ea1822bf66b2cb9076fd4b02950d05d2f941536d970ceb8d3a

Observation 52f2d23d-c8a4-459b-a650-5772f282b9d7 · outbound

This paper cites an unresolved cited work.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Unresolved cited work

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:50.918448Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:50.918448Z digest=sha256:d65f88059968ed537b3d84542b14197af5c9b6991cd4832c022d3698bdfb67e5

Observation c30ed327-5349-46e7-b27a-bb7d9de92dad · outbound

This paper cites Can We Generate Images with CoT? Let's Verify and Reinforce Image Generation Step by Step.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Can We Generate Images with CoT? Let's Verify and Reinforce Image Generation Step by Step

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:51.044539Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:51.044539Z digest=sha256:5a45a16ad4bf3731e33d648a480f55b6488324e1a255da2fe8d73154fcb8e82a

Observation cca02173-e221-4070-b608-b43bb1183361 · outbound

This paper cites CLIPScore: A Reference-free Evaluation Metric for Image Captioning.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation CLIPScore: A Reference-free Evaluation Metric for Image Captioning

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:51.198464Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:51.198464Z digest=sha256:70bf8821840b3bd06dee72129cedd4bdcb77e527786730608cbef189a84e029d

Observation 45a045a7-98f8-420f-98c9-3d0e66a55142 · outbound

This paper cites ELLA: Equip Diffusion Models with LLM for Enhanced Semantic Alignment.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation ELLA: Equip Diffusion Models with LLM for Enhanced Semantic Alignment

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:51.465446Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:51.465446Z digest=sha256:b7c864a934581584c59e4007f1ed3f8f24ea3c77f88a66657446a6942ce3fd01

Observation 2231ea07-0147-4d7b-8f59-c4722310452a · outbound

This paper cites GPT-4o System Card.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation GPT-4o System Card

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:51.628628Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:51.628628Z digest=sha256:87c7006bc260c55b73c4ba68755f1a4bc7b75b94f3be9fada0df60ddc9370674

Observation f62b6d8b-f62f-43d4-a2e3-82943ec1678e · outbound

This paper cites Kendall's Tau for Functional Data Analysis.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Kendall's Tau for Functional Data Analysis

Reference 15

Resolution
verified exact
local_arxiv, observed 2026-08-07T12:48:58.308666Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T12:48:51.794555Z digest=sha256:adc98150ae1add79bb5a7e958cd61aaf619e09ad87bd49e795b17ab3e2f583e7

Observation 804ffdb4-d090-4c42-9dc0-ddf05b948e29 · outbound

This paper cites T2I-R1: Reinforcing Image Generation with Collaborative Semantic-level and Token-level CoT.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation T2I-R1: Reinforcing Image Generation with Collaborative Semantic-level and Token-level CoT

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:51.964061Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:51.964061Z digest=sha256:a01da2aa189ec692c03ace3b509a85db3b9accc45802893f22cd554ef30cabca

Observation db0e28d8-1cfa-40fa-a469-aa79a0625070 · outbound

This paper cites an unresolved cited work.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Unresolved cited work

Reference 17

Resolution
unresolved
raw_fallback, observed 2026-08-07T12:48:59.602562Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T12:48:52.147488Z digest=sha256:3d6c82820347075d136b01a4453e8262107a065caffcdbaa143094edd5b7a27c

Observation ad65a177-2452-4707-8dac-e53ac9c1a002 · outbound

This paper cites VIEScore: Towards Explainable Metrics for Conditional Image Synthesis Evaluation.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation VIEScore: Towards Explainable Metrics for Conditional Image Synthesis Evaluation

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:52.532034Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:52.532034Z digest=sha256:a1a2edc9d52dcb5ae2d7da3cbb4ccea4ab8b18547b3681f14c6636a2751cd7d4

Observation b14e1c6f-fc45-420c-b189-7e1c833fb11e · outbound

This paper cites an unresolved cited work.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Unresolved cited work

Reference 20

Resolution
unresolved
raw_fallback, observed 2026-08-07T12:48:59.339026Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T12:48:52.666804Z digest=sha256:c3898b68f10929855549c02d22a3a977dd5a80aa6bcc25ecf6390d07a8709184

Observation 43c04451-4193-4182-b1fc-579930d9d841 · outbound

This paper cites IMAGINE-E: Image Generation Intelligence Evaluation of State-of-the-art Text-to-Image Models.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation IMAGINE-E: Image Generation Intelligence Evaluation of State-of-the-art Text-to-Image Models

Reference 21

Resolution
verified exact
local_arxiv, observed 2026-08-07T12:48:57.976466Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T12:48:52.817656Z digest=sha256:5762dccdc08420b8db9d22c7346889bac7ad6e2f86eb259261607596a90334b0

Observation 836d8399-db45-4cb3-84f0-0bbc4b029464 · outbound

This paper cites GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:52.975148Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:52.975148Z digest=sha256:df0da24a5c8f40b68799e034f67b04bfaf7f81bb85bd76ce417843eb10142905

Observation 723ce008-02c0-4df6-8f68-b18827866cb5 · outbound

This paper cites ImageGen-CoT: Enhancing Text-to-Image In-context Learning with Chain-of-Thought Reasoning.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation ImageGen-CoT: Enhancing Text-to-Image In-context Learning with Chain-of-Thought Reasoning

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:53.157072Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:53.157072Z digest=sha256:a344be60d59aca2efe20758f62851ed62e0cdc79b4743f96584a6093e5f3de63

Observation 33189b65-b17b-43ee-a9e5-0152e6f44c30 · outbound

This paper cites MagicMix: Semantic Mixing with Diffusion Models.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation MagicMix: Semantic Mixing with Diffusion Models

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:53.295857Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:53.295857Z digest=sha256:5cdbe47c5c51609030c9182a6a02ac6072312de10b5fdb73ff63f2339b026bc9

Observation 5b8a8ef9-cba3-48d6-b038-4acffd83eaa5 · outbound

This paper cites an unresolved cited work.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Unresolved cited work

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:53.425939Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:53.425939Z digest=sha256:801e7243ecf18e98f54175861e4a0453c41025d408249fe0d25dd35aa51c74cb

Observation b30cb2e3-9dc7-4397-ad67-4a745b572ff1 · outbound

This paper cites LogiQA: A Challenge Dataset for Machine Reading Comprehension with Logical Reasoning.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation LogiQA: A Challenge Dataset for Machine Reading Comprehension with Logical Reasoning

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:53.577654Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:53.577654Z digest=sha256:bf37aa7eb58ad4c2eab35d840cf5dbd0222414c28971b7108421f2ec5fe17cd0

Observation e55c5242-413a-43ce-b7fa-cf86eb48aed6 · outbound

This paper cites an unresolved cited work.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Unresolved cited work

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:53.747961Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:53.747961Z digest=sha256:4958a9ceb8c4b8e24f3b7e6559ff908cceabf8084f6fbb88a4463fa32437a2f6

Observation adda8c30-b5c0-439a-a532-f3d0e4ca0885 · outbound

This paper cites an unresolved cited work.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Unresolved cited work

Reference 28

Resolution
unresolved
raw_fallback, observed 2026-08-07T12:48:59.129969Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T12:48:53.921825Z digest=sha256:5dfc9d6066e082da7ec57706e8e369d8af591bf3d8145da23db2348e94439334

Observation 05868bab-5a3c-4920-9e7d-12d77b8175ba · outbound

This paper cites Learning Visual Generative Priors without Text.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Learning Visual Generative Priors without Text

Reference 29

Resolution
verified exact
local_arxiv, observed 2026-08-07T12:48:57.707197Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T12:48:54.032525Z digest=sha256:bf40b2e5d9068b59db79eb47926c418544bfe74add6b4c6208d578e459cb36f9

Observation da3143c8-41f6-45b9-bec3-a3a40a0ef15f · outbound

This paper cites an unresolved cited work.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Unresolved cited work

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:54.106454Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:54.106454Z digest=sha256:bb3445682c9bfb046f7ca86683d9db625bc4f7b26bbccda68716ecae6b3af994

Observation 40408198-a49f-43fc-85d5-d6426c2ed649 · outbound

This paper cites WISE: A World Knowledge-Informed Semantic Evaluation for Text-to-Image Generation.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation WISE: A World Knowledge-Informed Semantic Evaluation for Text-to-Image Generation

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:54.317434Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:54.317434Z digest=sha256:7ff5a3f74a6d4fdaf54a3fdecaab8932e2fe47766d6e153002961549d7d887b5

Observation cf20f87c-f19c-496c-a84b-2ac9f43a21e6 · outbound

This paper cites Lumina-Image 2.0: A Unified and Efficient Image Generative Framework.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Lumina-Image 2.0: A Unified and Efficient Image Generative Framework

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:54.580086Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:54.580086Z digest=sha256:9a44a3be4efdb469819800e72fbb998ebc0610cb61d0b39a27cd25a567fc82b1

Observation 17673e44-7f71-446b-bef4-7adb5565277b · outbound

This paper cites an unresolved cited work.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Unresolved cited work

Reference 34

Resolution
unresolved
raw_fallback, observed 2026-08-07T12:48:58.969246Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T12:48:54.692540Z digest=sha256:b881d0f8a04c1038ba9bc2479c9a6a9f67c5aacbc9cef7247ea76178be3331f3

Observation 37859dc6-6fc7-41fa-a920-6b90ec0d4b14 · outbound

This paper cites Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:54.855706Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:54.855706Z digest=sha256:22580cb8ab4baecbfb0bfade4ee0c98c9f7cd4f849e8e7f7e1bf76cb523dd871

Observation c2c0e2d7-3117-4f63-9400-0e3e1d0fe880 · outbound

This paper cites Generative Multimodal Models are In-Context Learners.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Generative Multimodal Models are In-Context Learners

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:55.005689Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:55.005689Z digest=sha256:d53e0897cba28e1a005ac45e447f2e4d9d833b421ced8b0709c1a880488ef899

Observation 15fe29a9-c656-48bc-91ee-f800647ce3f3 · outbound

This paper cites Emu: Generative Pretraining in Multimodality.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Emu: Generative Pretraining in Multimodality

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:55.111828Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:55.111828Z digest=sha256:6813b8d1478a6dcb01dde30dc4035b217de76db3433a22620db7f54d49a68682

Observation 03b63b66-149e-47b7-98ee-befe15c591cd · outbound

This paper cites an unresolved cited work.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Unresolved cited work

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:55.192746Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:55.192746Z digest=sha256:31e245341c8806815520126eb0794812c6970ecfd3304610e60f5a818f2bc5f8

Observation e33e3d93-ec1e-49a8-9ef6-5bc9596101ba · outbound

This paper cites MetaMorph: Multimodal Understanding and Generation via Instruction Tuning.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation MetaMorph: Multimodal Understanding and Generation via Instruction Tuning

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:55.384624Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:55.384624Z digest=sha256:c1ab31538519888700346a541c728ba70277f93b5f260b7d6bdb9b03a55ddddb

Observation fdb135d6-f843-4d5f-ae9b-5688fdadfc0c · outbound

This paper cites an unresolved cited work.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Unresolved cited work

Reference 40

Resolution
unresolved
raw_fallback, observed 2026-08-07T12:48:58.803715Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T12:48:55.514454Z digest=sha256:a9de23ca3028d3d5a5af72c3750f02c8785dc2d298552107b9fed1a4721c9944

Observation d961166e-2c35-4e17-a820-a5fe76732e65 · outbound

This paper cites Emu3: Next-Token Prediction is All You Need.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Emu3: Next-Token Prediction is All You Need

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:55.567187Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:55.567187Z digest=sha256:d0f78d68dd2b068faf0b90b3143eaa9c48a1d1bfdb9596a26c53d86107f6cd1f

Observation 9a7f49e9-8af9-4f8d-afc6-7bba26078876 · outbound

This paper cites ConceptMix: A Compositional Image Generation Benchmark with Controllable Difficulty.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation ConceptMix: A Compositional Image Generation Benchmark with Controllable Difficulty

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:55.570907Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:55.570907Z digest=sha256:35269c91dd188b6147ac343dfecf474d8899056f4c25d4e55cc2705334f72fb2

Observation 2bee3ea4-59db-4fb9-9590-684383f90c07 · outbound

This paper cites OmniGen: Unified Image Generation.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation OmniGen: Unified Image Generation

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:55.618522Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:55.618522Z digest=sha256:126153347445e26072df6a0b072e90b03eda30cefe93eb6d6c059ca52f4df80a

Observation 2898c4ff-0a6a-4f53-acae-e0166b00442a · outbound

This paper cites SANA 1.5: Efficient Scaling of Training-Time and Inference-Time Compute in Linear Diffusion Transformer.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation SANA 1.5: Efficient Scaling of Training-Time and Inference-Time Compute in Linear Diffusion Transformer

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:55.829535Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:55.829535Z digest=sha256:5cd2088002bfb171742b56507e485921235163484811b43b7b23eb3117a47349

Observation 2bd8c5a0-ceba-4d35-8cd3-c01cec3ba9e4 · outbound

This paper cites Show-o: One Single Transformer to Unify Multimodal Understanding and Generation.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Show-o: One Single Transformer to Unify Multimodal Understanding and Generation

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:55.954212Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:55.954212Z digest=sha256:54d82c292dc1db1729f26baf2e4b5f917403c6fa61926209870c382fa0c11d71

Observation c40b6fc4-a2da-4dcb-8750-19d86b2d9706 · outbound

This paper cites Improving Diffusion-Based Image Synthesis with Context Prediction.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Improving Diffusion-Based Image Synthesis with Context Prediction

Reference 47

Resolution
verified exact
local_arxiv, observed 2026-08-07T12:48:57.320478Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T12:48:56.036754Z digest=sha256:5dc4090f65114a0c23d3623b87597229e7ceab393aca88909cce35187d60c7db

Observation 9f2adca5-024e-4b9b-bbc3-bf397071ab34 · outbound

This paper cites VAR-CLIP: Text-to-Image Generator with Visual Auto-Regressive Modeling.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation VAR-CLIP: Text-to-Image Generator with Visual Auto-Regressive Modeling

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:56.108385Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:56.108385Z digest=sha256:ac2918f5cdf8d1c0ccda088454c32d81c47091af122f0209ab9a61dacf539a9d

Observation 7d178482-6428-4976-96ef-9290457b12da · outbound

This paper cites Envisioning Beyond the Pixels: Benchmarking Reasoning-Informed Visual Editing.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Envisioning Beyond the Pixels: Benchmarking Reasoning-Informed Visual Editing

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:56.234527Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:56.234527Z digest=sha256:0ea096eccac2b0ccd6cf2c23ed094695da1dca744b8857b152c41d9af512e47d

Observation eee34671-3498-47ed-bd10-555b3b04761a · outbound

This paper cites Transfusion: Predict the Next Token and Diffuse Images with One Multi-Modal Model.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Transfusion: Predict the Next Token and Diffuse Images with One Multi-Modal Model

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:56.360167Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:56.360167Z digest=sha256:87ac21dbd9b5b8cefd5f7b8c9d9b5bdd765d8d2aa9bfe0be1ff3d2408bf5a810

Observation c8d31cea-5951-4100-ab35-8c0f3b4a3ad4 · outbound

This paper cites Evaluating Semantic Variation in Text-to-Image Synthesis: A Causal Perspective.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation Evaluating Semantic Variation in Text-to-Image Synthesis: A Causal Perspective

Reference 51

Resolution
verified exact
local_arxiv, observed 2026-08-07T12:48:57.030869Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T12:48:56.454870Z digest=sha256:09796cdbe4c697464e376a7ecbfa7d4e65590ef09ae7fefa2b5166504e192636

Observation b556ee5a-ae57-4893-8b1e-1f03754f9921 · outbound

This paper cites URL: " 'urlintro :=.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation URL: " 'urlintro :=

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:56.601294Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:56.601294Z digest=sha256:98dcbf6332493f958de9b3a063c27b2a0e48569fa2eb9645032ef296de3218d5

Observation c5e8baea-0cc1-4bb7-b1a2-1d462c9be9bf · outbound

This paper cites write newline.

R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation write newline

Reference 53

Resolution
unresolved
no resolver link, observed 2026-08-07T12:48:56.713041Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:48:56.713041Z digest=sha256:f754a31dd91c03e0f7aab7c936aabae445934e11c8ac5cf265d7cccdde1a080f

Pith citing papers

Observation 46fadfc8-672a-4492-bd62-df72663c45b5 · inbound

FireScope: Wildfire Risk Raster Prediction with a Chain-of-Thought Oracle cites this paper.

FireScope: Wildfire Risk Raster Prediction with a Chain-of-Thought Oracle R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation

Reference 11

Resolution
verified exact
arxiv_id, observed 2026-05-17T20:50:15.265088Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-17T20:45:15.034196Z digest=sha256:9c97ecb94b9392adb0058f502617015ce961a9caa47eaa63dc3bbd1044cef0fd

Observation 59c12a06-209e-4f77-b97a-d26040fdf814 · inbound

FireScope: Wildfire Risk Raster Prediction with a Chain-of-Thought Oracle cites this paper.

FireScope: Wildfire Risk Raster Prediction with a Chain-of-Thought Oracle R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation

Reference 11

Resolution
verified exact
arxiv_id, observed 2026-05-25T07:20:28.749989Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-25T07:17:26.381232Z digest=sha256:2fddeb1f0b107e21f3ae237c61f629504cfd712aeff16367e33dd6b397ea0ea3

Observation 4d3fa62b-0fe2-424e-893c-4a4515adfa78 · inbound

SciIR: A Large-scale Training Dataset and Benchmark for Scientific Image Reasoning Generation cites this paper.

SciIR: A Large-scale Training Dataset and Benchmark for Scientific Image Reasoning Generation R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation

Reference 5

Resolution
metadata mismatch
arxiv_id, observed 2026-06-30T06:54:20.751242Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-06-30T06:48:22.594002Z digest=sha256:abfb795c44d3b71b78e7383f912eb1d9110abeff8ec314965b5e6ce2dbc03e71