Pith. sign in

Paper Citation Record · LEDGER

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation

As of 21 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 6 inbound Pith citation observations for arXiv:2505.01490.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.01490 v1

Coverage vector

measured 33 of 33 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-16T04:21:03.959775Z

measured 39 of 39 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-20T06:33:59.587034+00:00

measured 6 of 6 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T00:15:39.056728Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-06-30T21:15:04.740148Z

Reference resolution

33 of 33 outbound references displayed

  • verified exact0
  • verified fuzzy13
  • unresolved20
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 5156b9e0-5340-4c08-ab63-65d34c2b78d8 · outbound

This paper cites Pixart- α, 2023.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation Pixart- α, 2023

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:21:04.535697Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T04:21:03.782845Z digest=sha256:2cd64921575c7da16858cdd686b83fd943673f34e927d44a2904d0af74ffbf95

Observation ea0f5641-663d-494a-b56c-41e1a3c6fb44 · outbound

This paper cites Janus-Pro: Unified Multimodal Understanding and Generation with Data and Model Scaling.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation Janus-Pro: Unified Multimodal Understanding and Generation with Data and Model Scaling

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-16T04:21:03.788762Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T04:21:03.788762Z digest=sha256:d4a854bc82d94359d28d45fb39ce1d85bb7dd8c120982e8964724c104c8c4d15

Observation f52913e4-fd80-4c42-a27a-ef8e42572d02 · outbound

This paper cites Cogview: Mastering text-to-image generation via transformers.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation Cogview: Mastering text-to-image generation via transformers

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-16T04:21:03.794031Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T04:21:03.794031Z digest=sha256:7930b8744deff4d97925d9d5d609cbf88e96f635abe5201b2f8948a415045d9d

Observation a4c78459-63e2-42cc-bb15-a3bc63ec43c9 · outbound

This paper cites Scaling rectified flow trans- formers for high-resolution image synthesis, 2024.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation Scaling rectified flow trans- formers for high-resolution image synthesis, 2024

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-16T04:21:03.799384Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T04:21:03.799384Z digest=sha256:0f0986253d5997b77af72f92415a917abca397119c0c069c383c807c070c1204

Observation 2d10fbf6-fa10-4d28-8599-c33d4693be75 · outbound

This paper cites GoT: Unleashing Reasoning Capability of Multimodal Large Language Model for Visual Generation and Editing.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation GoT: Unleashing Reasoning Capability of Multimodal Large Language Model for Visual Generation and Editing

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-16T04:21:03.804768Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T04:21:03.804768Z digest=sha256:3fca53622156773e4beaadae02450bc5ff1e9d8308268450c0235ef1bc6f30c3

Observation c8b11c57-6ead-4fab-aef7-2da2874d5f5c · outbound

This paper cites Commonsense-T2I Challenge: Can Text-to-Image Generation Models Understand Commonsense?.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation Commonsense-T2I Challenge: Can Text-to-Image Generation Models Understand Commonsense?

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-16T04:21:03.809359Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T04:21:03.809359Z digest=sha256:ef06ca2d968473fd2b849a89cf150669ce272f7312205f32235e236604d358f4

Observation 57f70801-2ce3-4ebe-84f2-68b7d283e0d0 · outbound

This paper cites Geneval: An object-focused framework for evaluating text- to-image alignment.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation Geneval: An object-focused framework for evaluating text- to-image alignment

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:21:04.497421Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T04:21:03.813970Z digest=sha256:d4457c7ba2aa08728aed6ffd8c58cabc5930c8dd49579c3f4a47838aab768462

Observation 6a76b079-4cf6-4721-87ec-1c8f6c85e3e9 · outbound

This paper cites CLIPScore: A Reference-free Evaluation Metric for Image Captioning.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation CLIPScore: A Reference-free Evaluation Metric for Image Captioning

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-16T04:21:03.819558Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T04:21:03.819558Z digest=sha256:3f8a5f61cc3b40a62da1933cf581def13569661517efb23ffb1aa3ac49971069

Observation d9738b05-cf16-404a-9ee9-ddaa7b158600 · outbound

This paper cites Gans trained by a two time-scale update rule converge to a local nash equilib- rium.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation Gans trained by a two time-scale update rule converge to a local nash equilib- rium

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-16T04:21:03.826113Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T04:21:03.826113Z digest=sha256:0722d9aba145144e3dbb71d16bf0108387975af177ce2d300bb3a7dcce8413d9

Observation 802ace42-339b-4073-88af-9ab1d07951e5 · outbound

This paper cites T2i-compbench: A comprehensive bench- mark for open-world compositional text-to-image genera- tion.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation T2i-compbench: A comprehensive bench- mark for open-world compositional text-to-image genera- tion

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-16T04:21:03.831331Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T04:21:03.831331Z digest=sha256:d0d2d9876e9d2f1fd9e5d164f35777c74e4a027318acd5b7ffb8b662c2255b3a

Observation f350fbcf-a92e-4648-93d1-6c498bd3173d · outbound

This paper cites an unresolved cited work.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation Unresolved cited work

Reference 11

Resolution
unresolved
raw_fallback, observed 2026-08-16T04:21:04.458455Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T04:21:03.836641Z digest=sha256:d4e4121638c57881a62ad66563f57563b07139101851cce1226a55cb003c14dd

Observation 5fc7c835-9002-47d1-8190-5fda143f834a · outbound

This paper cites Playground v2.5: Three insights towards enhancing aesthetic quality in text-to-image genera- tion, 2024.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation Playground v2.5: Three insights towards enhancing aesthetic quality in text-to-image genera- tion, 2024

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:21:04.441927Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T04:21:03.841666Z digest=sha256:48b57727717338518e8ff1c270599a0e7db6421eb9d4abb77027b7e0bb286b42

Observation 7da416eb-b37e-42e0-b0bb-43037ee1a701 · outbound

This paper cites Janusflow: Harmonizing autoregression and rectified flow for unified multimodal understanding and generation, 2024.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation Janusflow: Harmonizing autoregression and rectified flow for unified multimodal understanding and generation, 2024

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:21:04.425217Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T04:21:03.846528Z digest=sha256:a01b637d26d65529967c4b1aff39400e58a04cc238800823bc4b681f4f542d21

Observation 7e061e2e-aedf-412c-b790-d4298859e3cc · outbound

This paper cites PhyBench: A Physical Commonsense Benchmark for Evaluating Text-to-Image Models.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation PhyBench: A Physical Commonsense Benchmark for Evaluating Text-to-Image Models

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-16T04:21:03.851716Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T04:21:03.851716Z digest=sha256:4a52a718dee484cc4892dedbc222cd8904870ef2ee22a6fec4c186d5609b70d1

Observation 15f118e9-dc57-4acb-950b-0f5c1813dd2a · outbound

This paper cites WISE: A World Knowledge-Informed Semantic Evaluation for Text-to-Image Generation.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation WISE: A World Knowledge-Informed Semantic Evaluation for Text-to-Image Generation

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-16T04:21:03.857840Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T04:21:03.857840Z digest=sha256:e273ba014c7e6502cf6a798d51a269b084902fbf9509ef99fa087f8992e97f3a

Observation c31a09e9-fe47-40f0-928c-696f7e2fc23c · outbound

This paper cites Sdxl: Improving latent diffusion models for high-resolution image synthesis, 2023.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation Sdxl: Improving latent diffusion models for high-resolution image synthesis, 2023

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:21:04.408771Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T04:21:03.863325Z digest=sha256:6d8f8d3601bebeacc47fd7110ca417515219f71c338a73b6eb11b58e0b9763de

Observation accb891c-8b06-4161-b25a-4efaee954668 · outbound

This paper cites Lumina-mgpt 2.0: Stand-alone autore- gressive image modeling, 2025.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation Lumina-mgpt 2.0: Stand-alone autore- gressive image modeling, 2025

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:21:04.392623Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T04:21:03.868737Z digest=sha256:65294705afcbd6ac8c2652a9d6cfe4c29be5228b9f7e8838b5501a5f10629047

Observation 97038b01-f60d-4170-90d3-51b513edad7d · outbound

This paper cites SimpleAR: Pushing the Frontier of Autoregressive Visual Generation through Pretraining, SFT, and RL.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation SimpleAR: Pushing the Frontier of Autoregressive Visual Generation through Pretraining, SFT, and RL

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-16T04:21:03.874113Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T04:21:03.874113Z digest=sha256:ac60df5a0780dbffdcfff89eca6fbde4b6a4a8500c2d5c001a77f7a261948c86

Observation c049eb9f-99d4-4eff-93ac-82ea9004ce72 · outbound

This paper cites Emu3: Next-Token Prediction is All You Need.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation Emu3: Next-Token Prediction is All You Need

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-16T04:21:03.878868Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T04:21:03.878868Z digest=sha256:1f34567558becf27016ecb628f6641ad458b817f9347e5d70550062877650cae

Observation 7d0abfc7-90a9-45ca-a33b-42b094ec9816 · outbound

This paper cites Janus: Decoupling Visual Encoding for Unified Multimodal Understanding and Generation.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation Janus: Decoupling Visual Encoding for Unified Multimodal Understanding and Generation

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-16T04:21:03.884328Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T04:21:03.884328Z digest=sha256:a83e8d9349a8d7b163b85bc605388083a808d197fca8bd428ab3780b2be4d2fd

Observation bf3f4944-a383-46b2-9ea4-dba77fdea222 · outbound

This paper cites Harmonizing visual representations for unified multimodal understanding and generation, 2025.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation Harmonizing visual representations for unified multimodal understanding and generation, 2025

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:21:04.374317Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T04:21:03.890031Z digest=sha256:178bf624e9a244e8522beabcd6ad3862ec4a8f5290ad450e43ec8878a17bb825

Observation 146b7fb0-8cd4-414b-a764-eae022dd83d1 · outbound

This paper cites VILA-U: a Unified Foundation Model Integrating Visual Understanding and Generation.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation VILA-U: a Unified Foundation Model Integrating Visual Understanding and Generation

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-16T04:21:03.896062Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T04:21:03.896062Z digest=sha256:091cd32faae3b201ae40297738e824e93cdc93a5ddf0ab59bc30bdd4c6d19902

Observation c084c1f2-c906-4646-ae2c-86c35deb42f1 · outbound

This paper cites Show-o: One Single Transformer to Unify Multimodal Understanding and Generation.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation Show-o: One Single Transformer to Unify Multimodal Understanding and Generation

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-16T04:21:03.901676Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T04:21:03.901676Z digest=sha256:e1f3ca20ebd56baf90315e6396fd0027c152ddf47a9a87edca84c4f48c9fc332

Observation 03f0e48d-dc45-4e86-bf35-bfda22f90330 · outbound

This paper cites Imagere- ward: Learning and evaluating human preferences for text- to-image generation.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation Imagere- ward: Learning and evaluating human preferences for text- to-image generation

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:21:04.358110Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T04:21:03.906989Z digest=sha256:af6d4c071d709b7db8caaab56bde72221895026508d11da0f3830a2cae4a4f87

Observation 6ed38b81-92cf-40a4-8823-2a9a188f875d · outbound

This paper cites Bridging SFT and DPO for Diffusion Model Alignment with Self-Sampling Preference Optimization.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation Bridging SFT and DPO for Diffusion Model Alignment with Self-Sampling Preference Optimization

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-16T04:21:03.913750Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T04:21:03.913750Z digest=sha256:c85eb2cc938c3301ea3a287f8a7baf2e8d37082626e0284d5085d8d8e22c7761

Observation cdddc680-6aad-40e1-8c1a-df6a03e07a24 · outbound

This paper cites Average Table 3.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation Average Table 3

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:21:04.341158Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T04:21:03.919647Z digest=sha256:1e477819788208f4b683322c605883f685716fddf5f6cb6380a8a890b1d6b425

Observation 69c4c8ca-ebd9-4e7b-babd-f6497f51a6d1 · outbound

This paper cites The evalution prompt is: Evaluation Procedure.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation The evalution prompt is: Evaluation Procedure

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:21:04.324751Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T04:21:03.926295Z digest=sha256:10fbbb14eaa70e3a5dc026c8e9bd50631bec35dccd33f828f1c937b262616110

Observation e4606e5a-04ab-434f-8008-32e3b006a6d5 · outbound

This paper cites an unresolved cited work.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation Unresolved cited work

Reference 28

Resolution
unresolved
raw_fallback, observed 2026-08-16T04:21:04.306623Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T04:21:03.932758Z digest=sha256:8341f05f6b58904dca2e8c30ee45cafb955ddeb426f52cf95e183593e63c8242

Observation 8dd315fa-eaa9-43e6-9ac3-0ceada21ace3 · outbound

This paper cites an unresolved cited work.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation Unresolved cited work

Reference 29

Resolution
unresolved
raw_fallback, observed 2026-08-16T04:21:04.288661Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T04:21:03.938879Z digest=sha256:e99d6e216b609ff8a667eaff3e8e5fdf014492d7ebf929b12f3f419eb1a298cf

Observation 52639836-0f0b-4978-8ed8-54898fe889b7 · outbound

This paper cites an unresolved cited work.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation Unresolved cited work

Reference 30

Resolution
unresolved
raw_fallback, observed 2026-08-16T04:21:04.270678Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T04:21:03.944158Z digest=sha256:372c5eae51b1d21bbd614cb390f72ffad5b57134a97a0500cdbd93316da21654

Observation b1a52b52-5669-43ba-bdd8-797b3707dde3 · outbound

This paper cites You may only use what is explicitly shown or labeled in the image.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation You may only use what is explicitly shown or labeled in the image

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:21:04.251974Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T04:21:03.949736Z digest=sha256:f10128da60f5c7e4727c4fbd89df1a905a4d1d9061bdae736e0db0b27b10b247

Observation 46dd3d4d-c66e-474b-919f-20caba05d02b · outbound

This paper cites Standard.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation Standard

Reference 32

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:21:04.234813Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T04:21:03.955043Z digest=sha256:aea257735880c39bee1f1d31d1c2dbee161d63c1132f039ceb1e4897dd7e6755

Observation 2800a5c1-b025-4d8a-8201-2aeb172d149b · outbound

This paper cites item": "The honey gatherer wore simple shorts and was topless.

WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation item": "The honey gatherer wore simple shorts and was topless

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:21:04.217029Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T04:21:03.959775Z digest=sha256:0d2d49e38c69a50365d6278d419324d066bd8114763912f30d2b84fcc2c31745

Pith citing papers

Observation a8c39ae7-e055-461f-a386-58e2306950d9 · inbound

T2VWorldBench: A Benchmark for Evaluating World Knowledge in Text-to-Video Generation cites this paper.

T2VWorldBench: A Benchmark for Evaluating World Knowledge in Text-to-Video Generation WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-06T14:43:29.263437Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T14:43:29.263437Z digest=sha256:cbe488e5a8afe00321100092e2a1db30e46c63b42c8bbdc52225cef0ca24170b

Observation 2830227b-9eec-4644-b345-f9c2e2138914 · inbound

DriveCtrl: Conditioned Sim-to-Real Driving Video Generation cites this paper.

DriveCtrl: Conditioned Sim-to-Real Driving Video Generation WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation

Reference 46

Resolution
verified exact
arxiv_id, observed 2026-06-30T21:15:04.744553Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-06-30T21:06:06.548538Z digest=sha256:fd05746859252741c909c3bd96f8ecabf1c0b07928935f3ebae637c41f473a89

Observation d3fada0d-d836-4812-8bef-9284344304af · inbound

Qwen-Image-Bench: From Generation to Creation in Text-to-Image Evaluation cites this paper.

Qwen-Image-Bench: From Generation to Creation in Text-to-Image Evaluation WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation

Reference 16

Resolution
metadata mismatch
arxiv_id, observed 2026-06-29T14:13:30.359078Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-06-29T14:05:25.988619Z digest=sha256:275e20ab50b8e70cc5fe78ba4d1456725695c67f4662376934bba4fd22229493

Observation 8c55bed4-154c-4f7a-9369-f22feae33752 · inbound

Boogu-Image-0.1: Boosting Open Agentic Multimodal Generation via Understanding under a Minimal Budget cites this paper.

Boogu-Image-0.1: Boosting Open Agentic Multimodal Generation via Understanding under a Minimal Budget WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation

Reference 140

Resolution
unresolved
no resolver link, observed 2026-08-02T06:14:05.518722Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T06:14:05.518722Z digest=sha256:73c30541199917f9eadab5a4fa1f6fe68c7ffb1017a8d66871a73e8b1939a10f

Observation 6c8a6a02-67e5-4945-bd6d-e446b58fa215 · inbound

OmniPhys: Knowledge-Graph-Driven Benchmarking and Collective Optimization for Physical Commonsense in Text-to-Image Generation cites this paper.

OmniPhys: Knowledge-Graph-Driven Benchmarking and Collective Optimization for Physical Commonsense in Text-to-Image Generation WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-01T01:54:37.880433Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T01:54:37.880433Z digest=sha256:01cd893cf73543b39e8ba48f5e75b274f61edf49ce8140867c19f10ae2361900

Observation ae267b74-6094-4415-a9d5-4277b5df018e · inbound

ToolArtist: Tool-Using Unified Multimodal Models for Agentic Image Generation cites this paper.

ToolArtist: Tool-Using Unified Multimodal Models for Agentic Image Generation WorldGenBench: A World-Knowledge-Integrated Benchmark for Reasoning-Driven Text-to-Image Generation

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-07T00:15:39.056728Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:15:39.056728Z digest=sha256:4c46a2da95e948c5939af81971e96aed6bcef4aadf067c189215dc87eeed0548