Pith. sign in

Paper Citation Record · LEDGER

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation

As of 19 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 1 inbound Pith citation observation for arXiv:2507.02713.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2507.02713 v2

Coverage vector

measured 34 of 34 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T20:26:37.951818Z

measured 35 of 35 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-19T06:32:44.657259+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-07-01T06:58:15.910837Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-01T08:55:35.719491Z

Reference resolution

34 of 34 outbound references displayed

  • verified exact2
  • verified fuzzy7
  • unresolved24
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch1

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 18a8a7e8-d58f-436a-829a-374dee2eb931 · outbound

This paper cites Layer Normalization.

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation Layer Normalization

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-06T20:26:37.829974Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T20:26:37.829974Z digest=sha256:8a28f55a9fe6ef4ca1006c409d15412e81d098077489b3d054fe8e2d90ab4387

Observation 0ce664aa-8222-4bee-a01d-41e488039fde · outbound

This paper cites YOLO-World: Real-Time Open-Vocabulary Object Detection.

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation YOLO-World: Real-Time Open-Vocabulary Object Detection

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-06T20:26:37.846808Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T20:26:37.846808Z digest=sha256:7d03992c2ecce850c7096aea6c6ebc643186ffddd464f1bbad58145a7f0053a9

Observation 4a86b7fb-5a21-456b-b4c0-e8a9e72225e8 · outbound

This paper cites Other works (Esser et al., 2024; Chen et al., 2023; OpenAI, 2024a; Gao et al., 2024; Li et al., 2024b; Xie et al., 2023; Nair et al.,.

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation Other works (Esser et al., 2024; Chen et al., 2023; OpenAI, 2024a; Gao et al., 2024; Li et al., 2024b; Xie et al., 2023; Nair et al.,

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T20:26:38.345732Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-06T20:26:37.930053Z digest=sha256:3d21b32db2101e6ace7ae1b6a60cb69716bfe0d577b46c24bc275646a46ba6a0

Observation 4459dfd4-ebc3-4b8e-a686-1c3c4491139d · outbound

This paper cites Orange kittenwith bright blue eyes on rocky ground.

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation Orange kittenwith bright blue eyes on rocky ground

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T20:26:38.285944Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-06T20:26:37.951818Z digest=sha256:21482e5d614a35ce09386f137184072da1193ace5159f735e8735f4529266e92

Observation c21c29c2-f788-422c-9333-00e92ba0796d · outbound

This paper cites Prompt-to-Prompt Image Editing with Cross Attention Control.

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation Prompt-to-Prompt Image Editing with Cross Attention Control

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-06T20:26:37.861949Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T20:26:37.861949Z digest=sha256:624d108d2bc2cf0b5ae4914b3930161731d3ef74e71cccf8df12b092e57c7713

Observation 50d7046c-663c-4008-9ad5-29b874c4478b · outbound

This paper cites RTMPose: Real-Time Multi-Person Pose Estimation based on MMPose.

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation RTMPose: Real-Time Multi-Person Pose Estimation based on MMPose

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-06T20:26:37.868943Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T20:26:37.868943Z digest=sha256:2b88a82332c95b1b273a3518a0a254c6d346bb8b4276fae6c232d0b15d8bef04

Observation 01613cf8-1f4b-4777-9245-2199ba8b590b · outbound

This paper cites Hunyuan-DiT: A Powerful Multi-Resolution Diffusion Transformer with Fine-Grained Chinese Understanding.

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation Hunyuan-DiT: A Powerful Multi-Resolution Diffusion Transformer with Fine-Grained Chinese Understanding

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-06T20:26:37.875779Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T20:26:37.875779Z digest=sha256:53c3ea316d83abcde00d236117b5efcda82f8c8e8b7ef35492434d1c7dd00a26

Observation 7215d8bd-8432-4be5-a886-136d3118ed11 · outbound

This paper cites FiT: Flexible Vision Transformer for Diffusion Model.

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation FiT: Flexible Vision Transformer for Diffusion Model

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-06T20:26:37.882309Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T20:26:37.882309Z digest=sha256:127c2b3ef79a803667d3de53fdc2a0b8de27e7f5ba54831cc4f51ef86c9572d6

Observation 8b242ca2-ef67-4c57-a9a8-d9dda2a33e65 · outbound

This paper cites SiT: Exploring Flow and Diffusion-based Generative Models with Scalable Interpolant Transformers.

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation SiT: Exploring Flow and Diffusion-based Generative Models with Scalable Interpolant Transformers

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-06T20:26:37.885766Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T20:26:37.885766Z digest=sha256:af2c0fff867b662d7736c418f4730c5243a3ca79d4c2f378825f7cb66d3d9230

Observation d997714a-58dc-400b-a68f-f60983debfc6 · outbound

This paper cites Diffscaler: Enhancing the Generative Prowess of Diffusion Transformers.

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation Diffscaler: Enhancing the Generative Prowess of Diffusion Transformers

Reference 17

Resolution
verified exact
local_arxiv, observed 2026-08-06T20:26:38.080385Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-06T20:26:37.889061Z digest=sha256:afa93c77d13ed30d162cbcd8b76616afe16b3e00272b1efeb02b5b5170de979a

Observation e46863c8-3d73-4bb5-90f9-27a220622298 · outbound

This paper cites Hierarchical Text-Conditional Image Generation with CLIP Latents.

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation Hierarchical Text-Conditional Image Generation with CLIP Latents

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-06T20:26:37.893082Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T20:26:37.893082Z digest=sha256:2117799dffffebf1b9d4cdf86fbf531f9b0942724be6682565cb1c3e548f1272

Observation 34055887-880b-46fb-bc8a-0a98c08cd7dc · outbound

This paper cites U-DiTs: Downsample Tokens in U-Shaped Diffusion Transformers.

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation U-DiTs: Downsample Tokens in U-Shaped Diffusion Transformers

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-06T20:26:37.899687Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T20:26:37.899687Z digest=sha256:c31701e1bc5f7248b0a13e960561c92216748dc7d76e19d51f922114996115ab

Observation 4c00fb91-bada-4d3b-8495-fda0d80c9b88 · outbound

This paper cites Plug- and-play diffusion features for text-driven image-to- image translation.

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation Plug- and-play diffusion features for text-driven image-to- image translation

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-06T20:26:37.903085Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T20:26:37.903085Z digest=sha256:fb76e23932f66d4427f4aabfb8332bf34b3a1a6b259e21fc258d4183cdcb84cb

Observation 546da1e9-c8f0-4b9f-8677-79a3345d2600 · outbound

This paper cites CogVLM: Visual Expert for Pretrained Language Models.

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation CogVLM: Visual Expert for Pretrained Language Models

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-06T20:26:37.906594Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T20:26:37.906594Z digest=sha256:bf1e38a74b7d956aa34c8d1b18e84c727cacb546d35c6fef914bbac4b1f3a0b4

Observation a97ff1bb-d775-4d86-b0e4-feeb561fb681 · outbound

This paper cites InstanceDiffusion: Instance-level Control for Image Generation.

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation InstanceDiffusion: Instance-level Control for Image Generation

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-06T20:26:37.910026Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T20:26:37.910026Z digest=sha256:b8d7909127f136a76af64486f3e7656c72d3534fe66e66dd618078f9b83f2d74

Observation 1ef55050-4ddb-493d-af15-66ccca64d5a0 · outbound

This paper cites MagicPose4D: Crafting Articulated Models with Appearance and Motion Control.

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation MagicPose4D: Crafting Articulated Models with Appearance and Motion Control

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-06T20:26:37.913412Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T20:26:37.913412Z digest=sha256:1039cb88fcbd8cac52573651c5b984f9e6db9a6bd0217020eaaff6e841a99e51

Observation 076047ce-e063-4916-ae4b-eb62f3a7ba30 · outbound

This paper cites MIGC: Multi-Instance Generation Controller for Text-to-Image Synthesis.

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation MIGC: Multi-Instance Generation Controller for Text-to-Image Synthesis

Reference 25

Resolution
verified exact
local_arxiv, observed 2026-08-06T20:26:37.990345Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-06T20:26:37.916573Z digest=sha256:2599c654c2cc70b9256dc16c20dbe7241e5f6c20d0a9aff7b498d4de4416e7e4

Observation 6a3e5616-3fab-43f9-84b3-eaaf67b1dc47 · outbound

This paper cites Dataset A.1.

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation Dataset A.1

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T20:26:38.377852Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-06T20:26:37.920187Z digest=sha256:deae93a3eec45bd5c4b11c38a5b5fab970909251ceeaa0d5c5ae7f203bba4cd4

Observation 5744c3c2-3163-4b75-af18-0695f3ca3986 · outbound

This paper cites an unresolved cited work.

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation Unresolved cited work

Reference 27

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:26:38.367393Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-06T20:26:37.923599Z digest=sha256:ea06704290d4dd2a4337f6c721410e5f5abf44663d0733fae5288f860c3e1580

Observation 53db4ca1-4d6f-46f0-8937-f1de40e25cdb · outbound

This paper cites an unresolved cited work.

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation Unresolved cited work

Reference 28

Resolution
unresolved
raw_fallback, observed 2026-08-06T20:26:38.356929Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-06T20:26:37.926726Z digest=sha256:cde7efd5c75156dd213e2200b1d8abd5b571f9ebec26afbd4154aa5cfd538318

Observation a793e732-afa4-499e-b52b-adaf3782c812 · outbound

This paper cites In this work, we use PIXART-α as our backbone, which is a variant of DiT (Peebles & Xie, 2023).

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation In this work, we use PIXART-α as our backbone, which is a variant of DiT (Peebles & Xie, 2023)

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T20:26:38.332672Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-06T20:26:37.933292Z digest=sha256:7163b7157f10c70cd8f08375f8af74dd3ed907c4810da1067bcf1514d156435c

Observation 2d81187c-e584-48ed-bdca-80089b5f3f4c · outbound

This paper cites During the sampling process, the model can transform Gaussian noise of normal distribution to real samples step-by-step.

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation During the sampling process, the model can transform Gaussian noise of normal distribution to real samples step-by-step

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T20:26:38.320860Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-06T20:26:37.937078Z digest=sha256:ec865a005a882a88a7a93a430502680e82584f7c6de68399610a6fd697f61277

Observation 8fb12fa2-5987-4aef-a44b-4a71474f2a56 · outbound

This paper cites Latent Diffusion Model & PIXART-α.

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation Latent Diffusion Model & PIXART-α

Reference 32

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T20:26:38.309040Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-06T20:26:37.941904Z digest=sha256:b9172197edcd8f238183308f6688cfee15c561f8b08ad8330773e0541931ee71

Observation a77f4d82-7611-4f2b-b617-79222886e324 · outbound

This paper cites At the inference stage, we can reconstruct the generated image through the decoder ˆx = D(ˆz).

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation At the inference stage, we can reconstruct the generated image through the decoder ˆx = D(ˆz)

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T20:26:38.297545Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-06T20:26:37.947189Z digest=sha256:f0936bab33edfd9ea87849520415bcb564f608a04f6b4ace0bb13cf2db120f4b

Observation be50e2ba-d19a-4114-aa3d-92c320cc81b9 · outbound

This paper cites Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection.

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection

Reference 2014

Resolution
unresolved
no resolver link, observed 2026-08-06T20:26:37.879007Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T20:26:37.879007Z digest=sha256:fa99f8d457ac7cbaf388e650844c509bd49c3648d7405c6145ffdcd02792d447

Observation b0b1cdd5-10a6-46bd-92b0-d2a793596c66 · outbound

This paper cites SyDog: A Synthetic Dog Dataset for Improved 2D Pose Estimation.

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation SyDog: A Synthetic Dog Dataset for Improved 2D Pose Estimation

Reference 2015

Resolution
unresolved
no resolver link, observed 2026-08-06T20:26:37.896114Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T20:26:37.896114Z digest=sha256:5b5122816eeac13c40a038ab937ac7efa5b2ae5bf3dcf905f095c6da45bcd97c

Observation 66b5de23-ce72-49b8-9087-f6d3de5844cc · outbound

This paper cites Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond.

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond

Reference 2016

Resolution
unresolved
no resolver link, observed 2026-08-06T20:26:37.835389Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T20:26:37.835389Z digest=sha256:624039b8610d58b6d1a42b3e44a6b791465858d20bf0ccbfb587a08c8703d1f2

Observation 1c6e5d5b-eb49-4408-9bf2-6a90c31c6534 · outbound

This paper cites PixArt-\Sigma: Weak-to-Strong Training of Diffusion Transformer for 4K Text-to-Image Generation.

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation PixArt-\Sigma: Weak-to-Strong Training of Diffusion Transformer for 4K Text-to-Image Generation

Reference 2017

Resolution
unresolved
no resolver link, observed 2026-08-06T20:26:37.842944Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T20:26:37.842944Z digest=sha256:3c0b6b88e1dba403b073308f20368a1ceaab986a9081bd05b33291c9bcfd7a45

Observation 1e9c2a99-12d5-4a3d-ba4f-936d9f692126 · outbound

This paper cites DiffiT: Diffusion Vision Transformers for Image Generation.

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation DiffiT: Diffusion Vision Transformers for Image Generation

Reference 2018

Resolution
unresolved
no resolver link, observed 2026-08-06T20:26:37.858456Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T20:26:37.858456Z digest=sha256:20e6d0443bc1036a99486b967e149d6f821b36b4f522d6b2bd00c1193ac38311

Observation 16d69922-5558-45b9-be06-f30d5f5af92e · outbound

This paper cites Animate Anyone: Consistent and Controllable Image-to-Video Synthesis for Character Animation.

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation Animate Anyone: Consistent and Controllable Image-to-Video Synthesis for Character Animation

Reference 2020

Resolution
unresolved
no resolver link, observed 2026-08-06T20:26:37.865492Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T20:26:37.865492Z digest=sha256:1b1693cc6c82471fd4cea5783dcc9adde7fe90b541abfed67afd020c3df762d2

Observation 826e5b75-7a8c-4d47-9523-abc80896f559 · outbound

This paper cites Scaling Rectified Flow Transformers for High-Resolution Image Synthesis.

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation Scaling Rectified Flow Transformers for High-Resolution Image Synthesis

Reference 2021

Resolution
unresolved
no resolver link, observed 2026-08-06T20:26:37.850431Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T20:26:37.850431Z digest=sha256:9d7a267cc4bf52ff89a0063c335a4a976ebc3cc83d19dd828553418f978bc3d2

Observation 507a892c-920f-4d4f-8c5d-79a184db2557 · outbound

This paper cites Lumina-T2X: Transforming Text into Any Modality, Resolution, and Duration via Flow-based Large Diffusion Transformers.

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation Lumina-T2X: Transforming Text into Any Modality, Resolution, and Duration via Flow-based Large Diffusion Transformers

Reference 2022

Resolution
unresolved
no resolver link, observed 2026-08-06T20:26:37.854469Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T20:26:37.854469Z digest=sha256:43ce3c1a473957a457f66270c1938fd4771b15e68573cf914346f7fc769b685e

Observation aff6a9c9-759d-4e83-9fbd-d7349d8a2396 · outbound

This paper cites Demystifying MMD GANs.

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation Demystifying MMD GANs

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-06T20:26:37.839095Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T20:26:37.839095Z digest=sha256:0f453a39d12864835038e28e3ba46088e31af92eda031ac7601ab60ac35036f0

Observation c8e0e912-55f9-409c-8f16-dbe75a0f90cf · outbound

This paper cites CosmicMan: A Text-to-Image Foundation Model for Humans.

UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation CosmicMan: A Text-to-Image Foundation Model for Humans

Reference 2024

Resolution
metadata mismatch
local_arxiv, observed 2026-08-06T20:26:38.150909Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-08-06T20:26:37.872458Z digest=sha256:6366dc5d38b934f07e59d6d6f40b9b0d5dc4cad66d0ef59ed48baf287388b878

Pith citing papers

Observation 19d9ffe3-fda1-4681-b56d-7aa338b5475f · inbound

TerraDiT-$\Omega$: Unified Spatial Control for Satellite Image Synthesis with Any Geospatial Primitive cites this paper.

TerraDiT-$\Omega$: Unified Spatial Control for Satellite Image Synthesis with Any Geospatial Primitive UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation

Reference 16

Resolution
verified exact
arxiv_id, observed 2026-07-01T08:55:35.721118Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-07-01T06:58:15.910837Z digest=sha256:55be2e1fcc4a83c91c2d4b271f0c39bf979e52237a82b09707bf17d7def56b81