Pith. sign in

Paper Citation Record · LEDGER

Training-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis

As of 4 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 26 inbound Pith citation observations for arXiv:2212.05032.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2212.05032 v3

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 26 of 26 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-04T06:34:03.388597+00:00

measured 26 of 26 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-04T18:48:03.650851Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-04T13:49:51.397457Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 12b77970-2e47-4e10-8810-1350c663fd79 · inbound

T2I-Adapter: Learning Adapters to Dig out More Controllable Ability for Text-to-Image Diffusion Models cites this paper.

T2I-Adapter: Learning Adapters to Dig out More Controllable Ability for Text-to-Image Diffusion Models Training-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis

Reference 9

Resolution
metadata mismatch
arxiv_id, observed 2026-05-16T22:47:50.430263Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-16T22:47:50.355642Z digest=sha256:28511a67008c7de6fdb28166ffbfda1716f9b41c20e57376ab4d0978190d7077

Observation 03d7455a-2e79-435a-a75f-e7352e86d6e4 · inbound

Aligning Text-to-Image Models using Human Feedback cites this paper.

Aligning Text-to-Image Models using Human Feedback Training-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis

Reference 4

Resolution
verified exact
arxiv_id, observed 2026-05-14T20:39:15.444332Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-14T20:39:15.388881Z digest=sha256:40a555515af7da118d71219513101799dfea1697526a1897a7fa2289ddf53d8e

Observation f64a06d5-6647-456a-8712-649871df1292 · inbound

SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis cites this paper.

SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis Training-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis

Reference 8

Resolution
metadata mismatch
arxiv_id, observed 2026-05-10T15:22:03.643258Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-10T15:22:03.530707Z digest=sha256:6b05e23b560eebc8fda2d7e5b3f79243b737d150ac78fbaa89b6a2f138547aac

Observation 08251f48-e2f4-4cd0-b116-da77f07a7353 · inbound

ELLA: Equip Diffusion Models with LLM for Enhanced Semantic Alignment cites this paper.

ELLA: Equip Diffusion Models with LLM for Enhanced Semantic Alignment Training-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis

Reference 19

Resolution
verified exact
arxiv_id, observed 2026-05-11T19:43:03.508187Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-11T19:43:03.310237Z digest=sha256:abd463caf4d15172c69f84b57f5d92c1e4d1293111e137fe179ee1885f461d86

Observation 4fcc6343-5cbe-4d4d-a45e-68ea7c3543f2 · inbound

Enhancing Text-to-Image Diffusion Transformer via Split-Text Conditioning cites this paper.

Enhancing Text-to-Image Diffusion Transformer via Split-Text Conditioning Training-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis

Reference 10

Resolution
verified exact
arxiv_id, observed 2026-05-19T13:22:19.224983Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-19T13:19:20.215467Z digest=sha256:5c915815326a2ba635b677d7116d20a9885d4241fd15a21f8713e2cd3ad14dc8

Observation 0f6fadec-312e-44c2-b44d-623bec1bce2f · inbound

FLUX-Reason-6M & PRISM-Bench: A Million-Scale Text-to-Image Reasoning Dataset and Comprehensive Benchmark cites this paper.

FLUX-Reason-6M & PRISM-Bench: A Million-Scale Text-to-Image Reasoning Dataset and Comprehensive Benchmark Training-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-04T18:48:03.650851Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T18:48:03.650851Z digest=sha256:f814a166f9bb33b0a697e316298f8e3cee21e9affa45fac558d97927bc921443

Observation 65d00cb5-e0c5-48f8-8a42-d7790a24b1e8 · inbound

CARINOX: Inference-time Scaling with Category-Aware Reward-based Initial Noise Optimization and Exploration cites this paper.

CARINOX: Inference-time Scaling with Category-Aware Reward-based Initial Noise Optimization and Exploration Training-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis

Reference 6

Resolution
metadata mismatch
arxiv_id, observed 2026-05-18T15:26:33.623984Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-18T15:25:39.116881Z digest=sha256:1617a74012550feedc56830a0f0a103c59db783a8a30c27968de35dc0bd98b09

Observation fccdcaf9-d61a-4c48-9fdb-cd71446bcd66 · inbound

RAPO++: Cross-Stage Prompt Optimization for Text-to-Video Generation via Data Alignment and Test-Time Scaling cites this paper.

RAPO++: Cross-Stage Prompt Optimization for Text-to-Video Generation via Data Alignment and Test-Time Scaling Training-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis

Reference 50

Resolution
metadata mismatch
arxiv_id, observed 2026-05-18T05:15:54.449073Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-18T05:13:42.934115Z digest=sha256:27377eb8d7f2b8fd1a3dccfcec364a9fcd9fe453db0b652dc344f39752d9a67d

Observation 29bd5041-5fe9-428f-8ea7-eef7d831e913 · inbound

Selective Aggregation of Attention Maps Improves Diffusion-Based Visual Interpretation cites this paper.

Selective Aggregation of Attention Maps Improves Diffusion-Based Visual Interpretation Training-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis

Reference 4

Resolution
verified exact
arxiv_id, observed 2026-05-10T23:15:47.688792Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-10T19:16:51.134397Z digest=sha256:31a4e551ccfdf00bcbbd1777169b8afd2e8ac28b2c7ba2e09ddf06cd8c7c6271

Observation ee364f6f-b42c-4b45-a243-30a18657619f · inbound

DCR: Counterfactual Attractor Guidance for Rare Compositional Generation cites this paper.

DCR: Counterfactual Attractor Guidance for Rare Compositional Generation Training-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis

Reference 9

Resolution
verified exact
arxiv_id, observed 2026-05-11T19:01:10.626417Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-08T13:06:56.964670Z digest=sha256:87f91272794f1ec6db10cef410836a26f64e32e8576a0fe39a26bf8fcc23f9f8

Observation 5bb50145-cb64-4d02-a65e-017ff25f18d9 · inbound

LENS: Low-Frequency Eigen Noise Shaping for Efficient Diffusion Sampling cites this paper.

LENS: Low-Frequency Eigen Noise Shaping for Efficient Diffusion Sampling Training-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis

Reference 8

Resolution
verified exact
arxiv_id, observed 2026-05-11T01:45:51.123178Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-11T01:43:15.520788Z digest=sha256:26d10332076d8a75f0434b9ff212ab0ae32097bdef344e4a7c50b9b13972d745

Observation 8cc69159-6958-435c-8f6c-388ec1df9ca1 · inbound

Attention Sinks in Diffusion Transformers: A Causal Analysis cites this paper.

Attention Sinks in Diffusion Transformers: A Causal Analysis Training-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis

Reference 3

Resolution
verified exact
arxiv_id, observed 2026-05-12T06:26:24.090203Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-12T04:18:26.883899Z digest=sha256:0cbdfd1ea59192160bbcd78377591cb447a027835607a161c2d4ed8f5c2ed773

Observation c3f8729d-82b8-4f29-a105-a87cb7167e34 · inbound

Attention Sinks in Diffusion Transformers: A Causal Analysis cites this paper.

Attention Sinks in Diffusion Transformers: A Causal Analysis Training-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis

Reference 3

Resolution
verified exact
arxiv_id, observed 2026-05-13T06:02:23.306839Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-13T05:59:16.233848Z digest=sha256:0914df64704e89ac4782630bed6689bf7a5976bd7b84beae462e174d4568d730

Observation 47b60213-96fa-4d80-ab69-5dfafd005419 · inbound

Attention Sinks in Diffusion Transformers: A Causal Analysis cites this paper.

Attention Sinks in Diffusion Transformers: A Causal Analysis Training-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis

Reference 3

Resolution
verified exact
arxiv_id, observed 2026-07-01T13:45:46.114494Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-06-30T22:47:11.360530Z digest=sha256:c3f269af5853e2aef7b0964e83c66e4c85e8f5c282f48dfdd344b1bdc008133b

Observation d648d496-52c2-45c1-ab5a-33079e3428c2 · inbound

Compositional Video Generation via Inference-Time Guidance cites this paper.

Compositional Video Generation via Inference-Time Guidance Training-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis

Reference 10

Resolution
verified exact
arxiv_id, observed 2026-06-30T21:35:04.306183Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-06-30T21:33:27.227307Z digest=sha256:84409a15e5107a9400b00bbf9fe032ef1fb0c2f97f5ee3628713adaab1fe91ad

Observation 720ae636-c248-4476-93c7-f3337a2457d0 · inbound

CPC-VAR:Continual Personalized and Compositional Generation in Visual Autoregressive Models cites this paper.

CPC-VAR:Continual Personalized and Compositional Generation in Visual Autoregressive Models Training-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis

Reference 9

Resolution
verified exact
arxiv_id, observed 2026-05-20T07:03:06.228228Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-20T07:01:01.427273Z digest=sha256:11242df8a32b8e37b812614cf3c599ceb6f5886615808f947fdb91a55707c54f

Observation 782b6b6a-8fde-47f8-8e3b-18af6c844fca · inbound

StreamEdit: Training-Free Video Editing via Few-Step Streaming Video Generation cites this paper.

StreamEdit: Training-Free Video Editing via Few-Step Streaming Video Generation Training-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis

Reference 19

Resolution
verified exact
arxiv_id, observed 2026-05-21T04:53:57.664463Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-05-21T04:53:55.386923Z digest=sha256:21671c87718ac5bf8d1bc194c887563b653ab9e41c8e670dc2b8ba48993570f9

Observation 304ea553-bb51-4421-b1b6-5591912f833b · inbound

StreamEdit: Training-Free Video Editing via Few-Step Streaming Video Generation cites this paper.

StreamEdit: Training-Free Video Editing via Few-Step Streaming Video Generation Training-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis

Reference 19

Resolution
verified exact
arxiv_id, observed 2026-07-01T07:55:30.883532Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-07-01T07:49:06.391436Z digest=sha256:ccb5d1b1fb92210eb4a8a323586f1e2a15b82c54a18ba2fa23a24bfee384c0b8

Observation b2d2d9a4-d7f0-41bd-9b4d-34c4207bfcc6 · inbound

Composing People Together: Iterative Pose-Image Generation for Multi-Person Interaction Scenes cites this paper.

Composing People Together: Iterative Pose-Image Generation for Multi-Person Interaction Scenes Training-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis

Reference 34

Resolution
verified exact
arxiv_id, observed 2026-05-25T05:10:22.311115Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=arxiv_source observed=2026-05-25T05:07:14.227821Z digest=sha256:6f1c8258ec71f7e29cff5813c5cea7550ed3ab898d1b63cb2078c0ba15f3a06f

Observation 5760107d-dd91-4e26-b3ac-12b0b44a9b92 · inbound

A Systematic Study of Behavioral Cloning for Scientific Data Annotation cites this paper.

A Systematic Study of Behavioral Cloning for Scientific Data Annotation Training-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis

Reference 248

Resolution
verified exact
arxiv_id, observed 2026-06-29T16:23:39.138875Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=arxiv_source observed=2026-06-29T16:23:08.402194Z digest=sha256:18a731afd72fad8eb3454d84c74c668aaece1e0e5a231d68224908ebd745c811

Observation 105303c1-30a3-4a3c-a992-5fe208e33fcb · inbound

STEDiff: Strengthening Text Embedding for Text-to-Image Alignment in Diffusion Model cites this paper.

STEDiff: Strengthening Text Embedding for Text-to-Image Alignment in Diffusion Model Training-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis

Reference 49

Resolution
metadata mismatch
arxiv_id, observed 2026-07-03T04:37:36.511852Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-06-27T13:50:32.005383Z digest=sha256:1d876f7575899b7a99435645e3ec62ec7c9c20a0562644d586e8babbd5db8b73

Observation f69efa5a-cb66-4c16-b4a6-3b3890fddd85 · inbound

DanceOPD: On-Policy Generative Field Distillation cites this paper.

DanceOPD: On-Policy Generative Field Distillation Training-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis

Reference 25

Resolution
metadata mismatch
arxiv_id, observed 2026-07-04T13:49:51.398979Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.

source=pdf_text observed=2026-06-26T04:55:42.018348Z digest=sha256:96c869571e72c34c1e43a4cd1d718b5b39343021f0f6aa067c80be43788df9c1

Observation d94b44ea-a8d8-4d31-b04b-70f4329ba23d · inbound

DanceOPD: On-Policy Generative Field Distillation cites this paper.

DanceOPD: On-Policy Generative Field Distillation Training-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis

Reference 25

Resolution
unresolved
no resolver link, observed 2026-07-12T11:44:54.717393Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-12T11:44:54.717393Z digest=sha256:1a4d0b3e59e73440d13980ed2dc6fce6589d312cf33a0cc383cece95629cc495

Observation afde7bb3-2214-4971-ae5b-b145f454a45c · inbound

Transferability Between Understanding and Generation in Unified Multimodal Models cites this paper.

Transferability Between Understanding and Generation in Unified Multimodal Models Training-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis

Reference 30

Resolution
unresolved
no resolver link, observed 2026-07-11T19:17:19.634242Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-11T19:17:19.634242Z digest=sha256:924053a2d05ffd3ef10e0856b8c1cd3679e854a2b4c6bb555b90ae815aa12af9

Observation 339b0c4a-a215-44da-a5ab-bdcf8ee4323e · inbound

TILT: Improving Compositional Generation in Diffusion Models with a Model-Intrinsic Reward cites this paper.

TILT: Improving Compositional Generation in Diffusion Models with a Model-Intrinsic Reward Training-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-02T13:55:30.481624Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-02T13:55:30.481624Z digest=sha256:374c0b0e860cdaca7736729c3a6a3bc56a9d9942271ebbae5574ee91bd41d810

Observation addfe0cf-821c-4bd2-81bf-bb8f86ce90d6 · inbound

TPD: Temporal Prior Decoupling for Text-to-Video Diffusion Models cites this paper.

TPD: Temporal Prior Decoupling for Text-to-Video Diffusion Models Training-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis

Reference 26

Resolution
unresolved
no resolver link, observed 2026-07-30T23:29:03.384400Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-30T23:29:03.384400Z digest=sha256:0b2d1aeda32f39834cfadea461e32434d3ab5d9cc474f94a85afe72070971652