Pith. sign in

Paper Citation Record · LEDGER

T2I-CompBench++: An Enhanced and Comprehensive Benchmark for Compositional Text-to-image Generation

As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 15 inbound Pith citation observations for arXiv:2307.06350.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2307.06350 v3

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 15 of 15 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-06T06:34:29.942622+00:00

measured 15 of 15 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-06T19:18:50.365029Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-02T14:57:03.724733Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 3f602b83-fa9b-418a-b4af-a5f683562da0 · inbound

Scaling Rectified Flow Transformers for High-Resolution Image Synthesis cites this paper.

Scaling Rectified Flow Transformers for High-Resolution Image Synthesis T2I-CompBench++: An Enhanced and Comprehensive Benchmark for Compositional Text-to-image Generation

Reference 142

Resolution
verified exact
arxiv_id, observed 2026-05-12T08:27:53.656561Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=arxiv_source observed=2026-05-12T08:27:53.446686Z digest=sha256:099ff0648932cb0a96dcc519dd7a230467d73b788bf558a87d43f47fcd5aebcb

Observation c825cdfc-b5a3-4949-84de-ee6e671f6738 · inbound

Mixture-of-Transformers: A Sparse and Scalable Architecture for Multi-Modal Foundation Models cites this paper.

Mixture-of-Transformers: A Sparse and Scalable Architecture for Multi-Modal Foundation Models T2I-CompBench++: An Enhanced and Comprehensive Benchmark for Compositional Text-to-image Generation

Reference 15

Resolution
verified exact
arxiv_id, observed 2026-05-18T02:48:45.006556Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-18T02:48:44.900467Z digest=sha256:a02a77621b5cf66dee0f7be21c3b95a73aa6e544491e2cbe6a1dce02b2d20f67

Observation c2a97c68-a4ae-43ad-b5d8-45f9c83ae372 · inbound

TextPixs: Glyph-Conditioned Diffusion with Character-Aware Attention and OCR-Guided Supervision cites this paper.

TextPixs: Glyph-Conditioned Diffusion with Character-Aware Attention and OCR-Guided Supervision T2I-CompBench++: An Enhanced and Comprehensive Benchmark for Compositional Text-to-image Generation

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-06T19:18:50.365029Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T19:18:50.365029Z digest=sha256:8e8b21518a2915f96c6f4185bdf9c8bae4f7fafc230f2d6ff18114868ffb410c

Observation f2d2c8f5-04bc-4a5e-9d42-b0b4da157f9b · inbound

Towards Evaluating Robustness of Prompt Adherence in Text to Image Models cites this paper.

Towards Evaluating Robustness of Prompt Adherence in Text to Image Models T2I-CompBench++: An Enhanced and Comprehensive Benchmark for Compositional Text-to-image Generation

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-06T18:50:42.784210Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T18:50:42.784210Z digest=sha256:acdb5996a472b320c06516782ee3ce4d01823f30cd81e16420d8cde0e79b7fa6

Observation 536242bd-79f5-4edf-b5cc-89f572b67e5e · inbound

Echo-4o: Harnessing the Power of GPT-4o Synthetic Images for Improved Image Generation cites this paper.

Echo-4o: Harnessing the Power of GPT-4o Synthetic Images for Improved Image Generation T2I-CompBench++: An Enhanced and Comprehensive Benchmark for Compositional Text-to-image Generation

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-05T20:44:12.680706Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T20:44:12.680706Z digest=sha256:dbd96eb95bed0c91c048f0267fd20c928c3967b38dc76a8835a3d1d0f0baf9c2

Observation 39496e77-780b-4891-a077-0e698c61f2ef · inbound

LLaSO: A Foundational Framework for Reproducible Research in Large Language and Speech Model cites this paper.

LLaSO: A Foundational Framework for Reproducible Research in Large Language and Speech Model T2I-CompBench++: An Enhanced and Comprehensive Benchmark for Compositional Text-to-image Generation

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-05T17:56:52.482995Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T17:56:52.482995Z digest=sha256:569dd8d5b7f2b9c98195be57aae83d1d3dbf7e9730c1dfd46b3cb329b9a31dc1

Observation 5f74645b-dff7-4ee7-b7a7-8e27c88559e4 · inbound

Sealing The Backdoor: Unlearning Adversarial Text Triggers In Diffusion Models Using Knowledge Distillation cites this paper.

Sealing The Backdoor: Unlearning Adversarial Text Triggers In Diffusion Models Using Knowledge Distillation T2I-CompBench++: An Enhanced and Comprehensive Benchmark for Compositional Text-to-image Generation

Reference 56

Resolution
unresolved
no resolver link, observed 2026-08-05T18:47:45.271784Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T18:47:45.271784Z digest=sha256:e9b8e9c4f5775951ef319f22170fc9cf5022fb623ef6fa678753f892908a4edd

Observation 2656f209-dea0-49ef-b843-3e4e825cc669 · inbound

Beyond Accuracy: Benchmarking Cross-Task Consistency in Unified Multimodal Models cites this paper.

Beyond Accuracy: Benchmarking Cross-Task Consistency in Unified Multimodal Models T2I-CompBench++: An Enhanced and Comprehensive Benchmark for Compositional Text-to-image Generation

Reference 17

Resolution
verified exact
arxiv_id, observed 2026-05-11T21:51:18.468344Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-08T04:08:41.452018Z digest=sha256:3d0b2be8b2311f9ac37616111784c207e918e12d86332c3097e42124b06b7eb2

Observation 1e361967-1b4b-4b51-8f21-44866183bc66 · inbound

Unlocking Complex Visual Generation via Closed-Loop Verified Reasoning cites this paper.

Unlocking Complex Visual Generation via Closed-Loop Verified Reasoning T2I-CompBench++: An Enhanced and Comprehensive Benchmark for Compositional Text-to-image Generation

Reference 18

Resolution
verified exact
arxiv_id, observed 2026-05-19T16:37:39.744583Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-05-19T16:35:43.166697Z digest=sha256:4b02bae5c4c95aa9ed96550d1ea8590ddc8eb178fd02b86e6845956dc6a144ab

Observation 42f0a070-55d3-4d62-8bcf-99dd84e4ebf3 · inbound

The Illusion of High Utility in Safety Alignment of Text-to-Image Diffusion Models cites this paper.

The Illusion of High Utility in Safety Alignment of Text-to-Image Diffusion Models T2I-CompBench++: An Enhanced and Comprehensive Benchmark for Compositional Text-to-image Generation

Reference 12

Resolution
metadata mismatch
arxiv_id, observed 2026-07-02T14:57:03.726486Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.

source=pdf_text observed=2026-07-02T14:56:40.860766Z digest=sha256:f45a561dd8901461de90b43b7307a48233d70aff0cebcefddb84ab758ddb854d

Observation d92e1202-1a7d-4e3f-a27d-2abe02fc04db · inbound

Think, Plan, Paint: Layout-Aware Reasoning for Controllable Image Generation in Unified Models cites this paper.

Think, Plan, Paint: Layout-Aware Reasoning for Controllable Image Generation in Unified Models T2I-CompBench++: An Enhanced and Comprehensive Benchmark for Compositional Text-to-image Generation

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-01T21:07:58.733061Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T21:07:58.733061Z digest=sha256:02f504f6fcbba6b5531140587170a059e279196018966794401c9bf14084520a

Observation 73280caa-25ab-44dd-b35d-df6f459a6509 · inbound

Moving Alphabet: A Controlled Study of Training Data for Text-to-Video Generation cites this paper.

Moving Alphabet: A Controlled Study of Training Data for Text-to-Video Generation T2I-CompBench++: An Enhanced and Comprehensive Benchmark for Compositional Text-to-image Generation

Reference 2022

Resolution
unresolved
no resolver link, observed 2026-08-01T14:24:46.083996Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T14:24:46.083996Z digest=sha256:225bd00d29adb40efe9121d66b76253b88ee10300df39beae4feb3b9f04963d2

Observation b58957d5-4016-4ffb-8860-bffa5b8c3866 · inbound

Poplar: A Scalable Pipeline for Human-Centric Image Dataset Synthesis cites this paper.

Poplar: A Scalable Pipeline for Human-Centric Image Dataset Synthesis T2I-CompBench++: An Enhanced and Comprehensive Benchmark for Compositional Text-to-image Generation

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-05T01:00:04.805025Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T01:00:04.805025Z digest=sha256:1d8d8606a4e484ed70e5a2f1dbe39fa7b947cb6195b7019537c368bcfbb3b8af

Observation 25e91c2f-579f-4e29-8be2-02b1c64c458f · inbound

MultiCompose: Multi-Concept Personalized Composition with Per-Subject Attribute Binding cites this paper.

MultiCompose: Multi-Concept Personalized Composition with Per-Subject Attribute Binding T2I-CompBench++: An Enhanced and Comprehensive Benchmark for Compositional Text-to-image Generation

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-05T14:23:58.328521Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T14:23:58.328521Z digest=sha256:314a966b5529d8e2444ebaa16e0073b4d46a00ec0c1d4865c2f811f5df4ba377

Observation 9663b61d-8c42-451b-b1a5-acbf264ea2d5 · inbound

Simile Understanding in Text-to-Image Models: An Evaluation Framework cites this paper.

Simile Understanding in Text-to-Image Models: An Evaluation Framework T2I-CompBench++: An Enhanced and Comprehensive Benchmark for Compositional Text-to-image Generation

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-06T17:31:34.759041Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T17:31:34.759041Z digest=sha256:d8e3caad20b251d18f36fef525763622091d0a2785c39bf8eec88cdaee1bc91a