Pith. sign in

Paper Citation Record · LEDGER

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers

As of 14 August 2026, this Paper Citation Record lists 100 of 104 outbound references and 0 inbound Pith citation observations for arXiv:2607.28611.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2607.28611 v1

Coverage vector

measured 100 of 104 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-07-31T02:16:08.275374Z

measured 100 of 100 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-14T06:32:32.682623+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

100 of 104 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved100
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation b3f1285a-a8d2-4f8f-a4b9-b9dcc1c0ed75 · outbound

This paper cites Gqa: Training generalizedmulti-querytransformermodelsfrommulti-headcheckpoints.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Gqa: Training generalizedmulti-querytransformermodelsfrommulti-headcheckpoints

Reference 1

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.291402Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.291402Z digest=sha256:2f2a84fc61c1d69343f48309d88cde575f5f2630ce2a7d21ef20cc675689ef4b

Observation 96695258-4f06-4a0b-a373-f9ea6da9bf1f · outbound

This paper cites Physics of language models: Part 4.1, architecture design and the magic of canon layers.Advances in Neural Information Processing Systems, 38:42349–42369, 2026.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Physics of language models: Part 4.1, architecture design and the magic of canon layers.Advances in Neural Information Processing Systems, 38:42349–42369, 2026

Reference 2

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.326089Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.326089Z digest=sha256:a5a64107064cfe5cc4f6d0310040ba39aad6313dd0eab7ba1b11d19699a01ac9

Observation 0d07a87d-a406-4eff-8c04-eb02c23dadc6 · outbound

This paper cites Round and Round We Go! What makes Rotary Positional Encodings useful?.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Round and Round We Go! What makes Rotary Positional Encodings useful?

Reference 3

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.387521Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.387521Z digest=sha256:ee74cc86d06654310f4151dcf3c5abd2579b0ce8c11c0f3bb27a815ed07f0eb5

Observation a737b48e-98d1-426c-8c17-1cd3eae2f01d · outbound

This paper cites FLUX.2: Frontier Visual Intelligence.https://bfl.ai/blog/flux-2, 2025.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers FLUX.2: Frontier Visual Intelligence.https://bfl.ai/blog/flux-2, 2025

Reference 4

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.457244Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.457244Z digest=sha256:07e90f232759d1f8724d097cdef5d7245fee07ec201e4f7f461d8132c953f7be

Observation 68d82e32-8e07-4210-894f-267e0498a709 · outbound

This paper cites Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets

Reference 5

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.541093Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.541093Z digest=sha256:84d42dce2b423e9f16c8d8dfd0f3c19e1d365f4b8e7adc74da7df788143716e6

Observation 29be113c-67ae-43d7-911f-a3b992baf929 · outbound

This paper cites Align your latents: High-resolution video synthesis with latent diffusion models.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Align your latents: High-resolution video synthesis with latent diffusion models

Reference 6

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.613961Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.613961Z digest=sha256:114ebbf4907e94faec2fb38a55e410452c9ed4802a1901361cb1853303086227

Observation 6d331e3b-93dd-4ff1-86b7-504d7c3dd1c5 · outbound

This paper cites Video generation models as world simulators, 2024.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Video generation models as world simulators, 2024

Reference 7

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.660028Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.660028Z digest=sha256:4535365ee382803e4b0a4f2bf988bb576f086363fe1d5b2527b570340fae19b4

Observation 30e953e9-3eaf-4b06-8b0d-d25ac09c1202 · outbound

This paper cites Z-Image: An Efficient Image Generation Foundation Model with Single-Stream Diffusion Transformer.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Z-Image: An Efficient Image Generation Foundation Model with Single-Stream Diffusion Transformer

Reference 8

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.719858Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.719858Z digest=sha256:b5f3929f9b7212f4f722cb26ca904fb291523137466e8f94d69502fbeeef8079

Observation ef575262-d288-4069-b27f-0b5ed773a300 · outbound

This paper cites The Effect of Mini-Batch Noise on the Implicit Bias of Adam.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers The Effect of Mini-Batch Noise on the Implicit Bias of Adam

Reference 9

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.806062Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.806062Z digest=sha256:9a08c915ac87b142d37d20ef812c1d57ec8bb6076dacb15bc1274e3a4d3e35bd

Observation fab3edf1-56a2-4e90-9f61-a2f66ca0cb59 · outbound

This paper cites Aligning visual foundation encoders to tokenizers for diffusion models.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Aligning visual foundation encoders to tokenizers for diffusion models

Reference 10

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.841398Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.841398Z digest=sha256:67055d6d34119b5736d9998631cff1816d496bbcaad097f33d2cececd7a1de92

Observation 36fa5535-064a-4f56-bae4-85e122f790c2 · outbound

This paper cites Diffusion forcing: Next-token prediction meets full-sequence diffusion.Advances in Neural Information Processing Systems, 37:24081–24125, 2024.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Diffusion forcing: Next-token prediction meets full-sequence diffusion.Advances in Neural Information Processing Systems, 37:24081–24125, 2024

Reference 11

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.903452Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.903452Z digest=sha256:bf371ddcba89c8d238f5d2a41b9f1260cf46e048705bd9e7997232d0a3c97b84

Observation c3940baf-8bf9-44d4-a4d8-f8dc42210c58 · outbound

This paper cites Pixart-alpha: Fast training of diffusion transformer for photorealistic text-to-image synthesis.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Pixart-alpha: Fast training of diffusion transformer for photorealistic text-to-image synthesis

Reference 12

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.957963Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.957963Z digest=sha256:479fb72399ac35989c5b60465c6e17f35d6589124fda7bf676689b6f169fb177

Observation 23fc2699-5ddc-4f6c-8ed8-89242d511d5b · outbound

This paper cites Sana-video: Efficient video generation with block linear diffusion transformer.arXiv preprint arXiv:2509.24695, 2025.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Sana-video: Efficient video generation with block linear diffusion transformer.arXiv preprint arXiv:2509.24695, 2025

Reference 13

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.961114Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.961114Z digest=sha256:68852f7a070a0dfc8fe5ad8721369eff3f1609ac58b6bea64b0fe800b241c86d

Observation 953987e6-b508-4a14-8bd5-ddcd18846e6f · outbound

This paper cites Generating Long Sequences with Sparse Transformers.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Generating Long Sequences with Sparse Transformers

Reference 14

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.963748Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.963748Z digest=sha256:7f613dd6d2bf0e3a1b2bc0d280f52cd6a223e6ff49622d82716dac94ba669164

Observation efe1d071-f925-4e60-ae13-7cf14f5bb61f · outbound

This paper cites Conditional positional encodings for vision transformers.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Conditional positional encodings for vision transformers

Reference 15

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.966909Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.966909Z digest=sha256:3bd48fbe340973afa89a178a598a44ba47c2aa0d5e5de92ecae70fe3b2ee75e7

Observation 8674616c-2509-4dbd-903f-49993d1da42a · outbound

This paper cites UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining

Reference 16

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.969747Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.969747Z digest=sha256:e17362fddfebef539c40c06247ebc2108f7194f26de45cafb8d9b31640d0b69f

Observation edcd3dbe-525e-4544-9742-04d20e705ff7 · outbound

This paper cites Deepseekmoe: Towards ultimate expert specialization in mixture-of-experts language models.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Deepseekmoe: Towards ultimate expert specialization in mixture-of-experts language models

Reference 17

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.973704Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.973704Z digest=sha256:6efc8cc3597446bcdbd433733798162d083a4b300d4d42f6821b78309e86ff76

Observation f9116ccc-38c1-471e-9fd3-d8c5c2c9643f · outbound

This paper cites Don’t be lazy: Completep enables compute-efficient deep transformers.Advances in Neural Information Processing Systems, 38:137707–137739, 2026.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Don’t be lazy: Completep enables compute-efficient deep transformers.Advances in Neural Information Processing Systems, 38:137707–137739, 2026

Reference 18

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.976481Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.976481Z digest=sha256:ae55bce6309ad01301b3f4b6d3e79e5338ba785d455f66e031a82a047e5ba500

Observation ac60a4be-a081-44c8-b2a8-03848e0a3802 · outbound

This paper cites Diffusion models beat gans on image synthesis.Advances in neural information processing systems, 34:8780–8794, 2021.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Diffusion models beat gans on image synthesis.Advances in neural information processing systems, 34:8780–8794, 2021

Reference 19

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.979224Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.979224Z digest=sha256:3d8d3ca33953eb434b9882bc936a5b4bdc8a2bbad546f73ddb50f066bde028c8

Observation 99b7920e-3e6b-4a0c-93f4-60cd195bd1c6 · outbound

This paper cites Diffusion is spectral autoregression.https://sander.ai/2024/09/02/spectral-autoregression.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Diffusion is spectral autoregression.https://sander.ai/2024/09/02/spectral-autoregression

Reference 20

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.982181Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.982181Z digest=sha256:bacfd74e73bb462bfb3f96f1afd96fdea56098fa5ff2d9b31f963d7435535f16

Observation 2ed05fa7-6588-4b8f-a38b-f139a7e59178 · outbound

This paper cites Efficient-vDiT: Efficient Video Diffusion Transformers With Attention Tile.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Efficient-vDiT: Efficient Video Diffusion Transformers With Attention Tile

Reference 21

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.984738Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.984738Z digest=sha256:c7946985818664932ce25379c3725f3ea4c91884847b83e30d5af2bc90907035

Observation 28838b84-62cb-4cdc-8185-7ac6cda2c1b3 · outbound

This paper cites Cogview: Mastering text-to-image generation via transformers.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Cogview: Mastering text-to-image generation via transformers

Reference 22

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.987633Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.987633Z digest=sha256:5ce58a9f8af508e6c7f02ba47bbe7e89ea7a0602620772f73d8223f278aa8134

Observation ff79909b-1e87-4091-a68a-c00474cf92a1 · outbound

This paper cites A mathematical framework for transformer circuits.Transformer Circuits Thread, 1(1):12, 2021.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers A mathematical framework for transformer circuits.Transformer Circuits Thread, 1(1):12, 2021

Reference 23

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.990174Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.990174Z digest=sha256:6fb4f8f15ed3ac87fcb36f6af17e2016c0735186030f7222bae56457438ad977

Observation 671d716e-8ae5-4088-a419-c54af8afa06b · outbound

This paper cites Scaling rectified flow transformers for high-resolution image synthesis.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Scaling rectified flow transformers for high-resolution image synthesis

Reference 24

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.992876Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.992876Z digest=sha256:37335ac3ee82bc21ebe297c42a84b059e5c8847703a24a6d0ea9eaaca3e145bf

Observation b81ca4ad-de40-42c4-b0ed-2f7a2faeed45 · outbound

This paper cites Switch transformers: Scaling to trillion parameter models with simple and efficient sparsity.Journal of Machine Learning Research, 23(120):1–39, 2022.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Switch transformers: Scaling to trillion parameter models with simple and efficient sparsity.Journal of Machine Learning Research, 23(120):1–39, 2022

Reference 25

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.996132Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.996132Z digest=sha256:b530a2725dead766ae7b62c2222943b83edfb5cf4867f5c9ff1619725e351ae9

Observation f0ee9087-c842-4324-ba7c-9f8d3087430b · outbound

This paper cites Scaling diffusion transformers to 16 billion parameters, 2024.URL https://arxiv.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Scaling diffusion transformers to 16 billion parameters, 2024.URL https://arxiv

Reference 26

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.998823Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.998823Z digest=sha256:95b7fd64d6e7cf2a4ec27638c155cd03b64a936a4eb0f187d15781eb01ad8154

Observation 446d8ba5-35f7-4ccb-9656-986942f894cd · outbound

This paper cites Why Adam Works Better with $\beta_1 = \beta_2$: The Missing Gradient Scale Invariance Principle.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Why Adam Works Better with $\beta_1 = \beta_2$: The Missing Gradient Scale Invariance Principle

Reference 27

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.001681Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.001681Z digest=sha256:346a8e7d63ae68224159a74aa86b2e20fd8949ba8ac2704db09990048106950a

Observation 0ce817d8-e67d-46df-9eb4-370966ed2a94 · outbound

This paper cites Geneval: Anobject-focusedframeworkforevaluatingtext-to-image alignment.Advances in Neural Information Processing Systems, 36:52132–52152, 2023.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Geneval: Anobject-focusedframeworkforevaluatingtext-to-image alignment.Advances in Neural Information Processing Systems, 36:52132–52152, 2023

Reference 28

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.004957Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.004957Z digest=sha256:70310920d05993803cc2a2b0ec8b434b22f1af9eacc94afd825a802fe5f22085

Observation 671749fa-901a-4d51-ae7b-6987ce5f36a0 · outbound

This paper cites Mamba: Linear-Time Sequence Modeling with Selective State Spaces.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Mamba: Linear-Time Sequence Modeling with Selective State Spaces

Reference 29

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.007646Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.007646Z digest=sha256:ff4240847b75c59a37cf0cb2f430397612e60743ab21d9133f6c7eb5b7eec171

Observation 1b633e07-6b12-4c58-ac5e-566d2fb7de99 · outbound

This paper cites Scaling Laws for Autoregressive Generative Modeling.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Scaling Laws for Autoregressive Generative Modeling

Reference 30

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.010546Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.010546Z digest=sha256:0f6a9220b0a0ebd3e5aa9ef366fb9b3dd66f69c86ff663d541ac43a72e2f1809

Observation 6986aedf-9bec-42d7-ad5b-7ffa62020ef6 · outbound

This paper cites Deep Learning Scaling is Predictable, Empirically.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Deep Learning Scaling is Predictable, Empirically

Reference 31

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.013539Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.013539Z digest=sha256:dd143e7969c02348b7a9045f3197db0aea889be3c3ccd6a292edc943078ed9cb

Observation d7e826fe-f2ee-40ab-a17b-119ab4738c20 · outbound

This paper cites Classifier-Free Diffusion Guidance.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Classifier-Free Diffusion Guidance

Reference 32

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.016487Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.016487Z digest=sha256:9a11b192ff1ff4f2e63c44340eb86b4cce72b6e43d96fec0b5d41005bedc65f9

Observation d368d901-0493-44a1-b018-5a816f0e4934 · outbound

This paper cites Denoising diffusion probabilistic models.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Denoising diffusion probabilistic models

Reference 33

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.019392Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.019392Z digest=sha256:4b580a9d62cc375f822871ac7f22ba0d00187187378cd43f3c3cb1b48c379d91

Observation 58a6f19e-8edf-4053-9290-88b2b7f56191 · outbound

This paper cites Imagen Video: High Definition Video Generation with Diffusion Models.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Imagen Video: High Definition Video Generation with Diffusion Models

Reference 34

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.022280Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.022280Z digest=sha256:844da4cae2215e9ae30f3d02403709f44c8a4b3dc5404a2527f199477a79b59c

Observation 5ed24407-67a4-49d0-aaed-2698296a6679 · outbound

This paper cites Videodiffusionmodels.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Videodiffusionmodels

Reference 35

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.025391Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.025391Z digest=sha256:fd4d978f0cc2b421199b2c1b878b11982c0c38a8da60711945bc23d43b9ef23c

Observation 9f224e44-c918-49f2-8d50-51c96bbc222f · outbound

This paper cites Training Compute-Optimal Large Language Models.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Training Compute-Optimal Large Language Models

Reference 36

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.035084Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.035084Z digest=sha256:7ac7c1091808b8d212cff57e0e13be09a2f1b1ee480a0a1d533c30e1cb915be7

Observation de8a3529-9465-4022-873d-0a7b8af82577 · outbound

This paper cites Pushing the Boundaries of State Space Models for Image and Video Generation.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Pushing the Boundaries of State Space Models for Image and Video Generation

Reference 37

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.038112Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.038112Z digest=sha256:11919011fa5308ba39f5e7731f41945dfa56e43d8cdc9a4a13dcf837390b7bf5

Observation 907bfc44-2e6c-438d-b7cf-8da6a3be8b97 · outbound

This paper cites Relic: Interactive video world model with long-horizon memory.arXiv preprint arXiv:2512.04040, 2025.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Relic: Interactive video world model with long-horizon memory.arXiv preprint arXiv:2512.04040, 2025

Reference 38

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.041706Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.041706Z digest=sha256:5048bc566f1924a28b87abae299a5b4a8b728dbdd1fef6425848cfce164f8eb6

Observation 854dee7c-e799-4fb1-9465-644bbdb961fd · outbound

This paper cites Zigma: A dit-style zigzag mamba diffusion model.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Zigma: A dit-style zigzag mamba diffusion model

Reference 39

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.044262Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.044262Z digest=sha256:387f9f7837f9b4059dedb97b40f280649413f9ec33c530a2db426997b676cd03

Observation 347a662c-4aac-44ba-9bb8-68c2c9a11862 · outbound

This paper cites ELLA: Equip Diffusion Models with LLM for Enhanced Semantic Alignment.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers ELLA: Equip Diffusion Models with LLM for Enhanced Semantic Alignment

Reference 40

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.046825Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.046825Z digest=sha256:d51fd1f237b0649638102957f79837232a7353ed5ce9dfee11f704167ca9745c

Observation d0b02c73-1eb9-4353-861d-530ca9f69023 · outbound

This paper cites Self forcing: Bridging the train-test gap in autoregressive video diffusion.Advances in Neural Information Processing Systems, 38:167283–167308, 2026.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Self forcing: Bridging the train-test gap in autoregressive video diffusion.Advances in Neural Information Processing Systems, 38:167283–167308, 2026

Reference 41

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.050076Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.050076Z digest=sha256:38261d6aa4ef68b64d384296cce5aae842ed695b38bbe6e29a87786a4da1af95

Observation afbafc47-653c-4a81-99c9-8a190606c0a9 · outbound

This paper cites Muon: An optimizer for hidden layers in neural networks, 2024.URL https://kellerjordan.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Muon: An optimizer for hidden layers in neural networks, 2024.URL https://kellerjordan

Reference 42

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.052719Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.052719Z digest=sha256:1b5e562b611b09bf309a5fe0d833d0642f90e2e4d3d4229baaccf35b630e1627

Observation 1a9554c0-a78e-4a22-ac5f-0dab9b9d65ca · outbound

This paper cites EditVerse: Unifying Image and Video Editing and Generation with In-Context Learning.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers EditVerse: Unifying Image and Video Editing and Generation with In-Context Learning

Reference 43

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.055344Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.055344Z digest=sha256:2898904a2722bb510f40046aa03e05322191f610d1d453a215583c3b4ef53640

Observation 43f4c58a-6810-4bfe-adda-4ece00621794 · outbound

This paper cites Scaling Laws for Neural Language Models.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Scaling Laws for Neural Language Models

Reference 44

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.058662Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.058662Z digest=sha256:2982b7f20d38c89c7fe470b09c0c87f2c6f961f48959f60d7e68b5e766efb323

Observation a8164523-4a2b-4b2f-b976-2d7b763f56dc · outbound

This paper cites Transformers are RNNs: Fast autoregressive transformers with linear attention.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Transformers are RNNs: Fast autoregressive transformers with linear attention

Reference 45

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.061609Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.061609Z digest=sha256:7c1a9778924b0ccb22e17c82235bc667c2ffdb67ea6c35ccf8059056cc84c2da

Observation 59fdf7c9-40b3-47c4-8afd-de47f0065aa7 · outbound

This paper cites Theimpactofpositional encoding on length generalization in transformers.Advances in Neural Information Processing Systems, 36:24892–24928, 2023.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Theimpactofpositional encoding on length generalization in transformers.Advances in Neural Information Processing Systems, 36:24892–24928, 2023

Reference 46

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.064097Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.064097Z digest=sha256:c21644136af712fab6bd43f9193c907ba743b80f2d6c974764002615655173a5

Observation 687323ae-9ce3-4040-b70f-896365421064 · outbound

This paper cites GShard: Scaling Giant Models with Conditional Computation and Automatic Sharding.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers GShard: Scaling Giant Models with Conditional Computation and Automatic Sharding

Reference 48

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.069668Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.069668Z digest=sha256:c12aa222bfe5d1c169bf4fe9c499953aeb668e96a251c3307bea89256560c93f

Observation 9cff701e-1901-46ce-971c-f471979af551 · outbound

This paper cites Back to basics: Let denoising generative models denoise.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Back to basics: Let denoising generative models denoise

Reference 49

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.072710Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.072710Z digest=sha256:f4465a4728b99120d2e40591c2ec7a69d47014656b1bf6bd90d299da80e84fc8

Observation 1599da00-1c66-4942-8bfc-6092dc53883f · outbound

This paper cites Scalinglawsfordiffusiontransformers.arXivpreprintarXiv:2410.08184, 2024.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Scalinglawsfordiffusiontransformers.arXivpreprintarXiv:2410.08184, 2024

Reference 50

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.075575Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.075575Z digest=sha256:c51f9e9db2b4570a77a4b6afd82743643b8f0f3009602ef952fdc6e4cd35f44e

Observation 1fe38c64-c4d4-47a9-92b6-d6260e640913 · outbound

This paper cites Flow Matching for Generative Modeling.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Flow Matching for Generative Modeling

Reference 51

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.108176Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.108176Z digest=sha256:167ed811a1b3dec7e05e0bd2145473d05afc4328529abcf0cac686b7ba0f4a2d

Observation 4c800bfc-44b0-41b5-ad7e-75edf89c5063 · outbound

This paper cites DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model

Reference 52

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.114735Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.114735Z digest=sha256:4b152b9bdc9e39a9cb104ba6f7365fdf98af1129f8e748b6a25c9f72636a5418

Observation ab65fb43-f2e6-4737-b465-bf4a20dafbb7 · outbound

This paper cites DeepSeek-V3 Technical Report.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers DeepSeek-V3 Technical Report

Reference 53

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.125037Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.125037Z digest=sha256:8cd281b1e5771b1aedd4f77eaf4aca89c54b823ab3fc39b79dfd706c76ad24f6

Observation 4d9fb7bd-8261-4275-adfe-c6333a4ba733 · outbound

This paper cites DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models

Reference 54

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.128479Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.128479Z digest=sha256:e1dfe4b5664fcdcb90065900d0c952d42059d8b10192ebe061d59c2276abbf18

Observation 92036d02-b64c-4ea5-a004-471275f9a9ca · outbound

This paper cites Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow

Reference 55

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.131544Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.131544Z digest=sha256:8d1a6341163ea125be09c03c96265dfe3a8d02df8d6996694717507526c692c2

Observation 4bae04a0-1abc-43d3-8ca3-84f29ebf7d69 · outbound

This paper cites Vmamba: Visual state space model.Advances in neural information processing systems, 37:103031–103063, 2024.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Vmamba: Visual state space model.Advances in neural information processing systems, 37:103031–103063, 2024

Reference 56

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.134615Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.134615Z digest=sha256:774d3f1eb30f42a649b1ec6c342bd5bb25a1bb5b29d4b8ae5dda1a6c4211407f

Observation 12de7f78-7b2e-4d10-a181-28fc38675a27 · outbound

This paper cites Olmo Hybrid: From Theory to Practice and Back.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Olmo Hybrid: From Theory to Practice and Back

Reference 57

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.137640Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.137640Z digest=sha256:4e827b008f79fb1fce6879d97d3d5a2d7b4e7dbfc7df707cb67309046e369574

Observation 0b914026-664f-43da-91dc-1397d6ac4913 · outbound

This paper cites Completed hyperparameter transfer across modules, width, depth, batch and duration.arXiv preprint arXiv:2512.22382, 2025.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Completed hyperparameter transfer across modules, width, depth, batch and duration.arXiv preprint arXiv:2512.22382, 2025

Reference 58

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.140944Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.140944Z digest=sha256:e6ae6b4f364324c4bceab11961816c16c394717540d8ce3cc5e7c658d9c23c0d

Observation 212799eb-a387-45c3-a07e-2dd1616da5c8 · outbound

This paper cites GLIDE: Towards Photorealistic Image Generation and Editing with Text-Guided Diffusion Models.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers GLIDE: Towards Photorealistic Image Generation and Editing with Text-Guided Diffusion Models

Reference 59

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.143885Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.143885Z digest=sha256:01f1cb7477baf9ceb6568dc63112421227495571e811c8acaa42ee0dc80c3f2f

Observation 0d656b73-33cd-494f-88f9-5966961b6d29 · outbound

This paper cites Improveddenoisingdiffusionprobabilisticmodels.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Improveddenoisingdiffusionprobabilisticmodels

Reference 60

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.147126Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.147126Z digest=sha256:86aa39151c9f4be5bb8b63952b3c5347b096c36fa05885f81599a6e2406f2db8

Observation 8151033e-a9de-42d0-b2bd-8c0c052c7735 · outbound

This paper cites In-context Learning and Induction Heads.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers In-context Learning and Induction Heads

Reference 61

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.149754Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.149754Z digest=sha256:62fc17cc8f656076968d3407a7a3c17f4f9b37a90e54058fae1541b82e3f9f5b

Observation 8a8e47bb-4377-48bb-9e15-e984c14596f8 · outbound

This paper cites In search of adam’s secret sauce.Advances in Neural Information Processing Systems, 38: 63404–63442, 2026.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers In search of adam’s secret sauce.Advances in Neural Information Processing Systems, 38: 63404–63442, 2026

Reference 62

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.152730Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.152730Z digest=sha256:f23868a7ed9d6953353474b336b3627a4caa1521b38d1054ce4bba386af6ea6b

Observation 7c7a5ff3-66bd-4dc0-a055-d7724dd27987 · outbound

This paper cites Scalable diffusion models with transformers.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Scalable diffusion models with transformers

Reference 63

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.155647Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.155647Z digest=sha256:813b96531edd88c8af9dd2eaf1833e7306103ee7ade3768dfa750c39dd943f3d

Observation 42be2ed3-3502-4058-a0a4-6253d0ad9e89 · outbound

This paper cites Smith, and Mike Lewis.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Smith, and Mike Lewis

Reference 64

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.158345Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.158345Z digest=sha256:ae1142dfa949e4b44d8b34e87d6d9a573ec86d5d114c4d7aa1e8f65146192c6d

Observation efdae082-a1d8-4568-982f-8cfc99517b03 · outbound

This paper cites Exploring the limits of transfer learning with a unified text-to-text transformer.Journal of machine learning research, 21 (140):1–67, 2020.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Exploring the limits of transfer learning with a unified text-to-text transformer.Journal of machine learning research, 21 (140):1–67, 2020

Reference 65

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.161196Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.161196Z digest=sha256:d63e5c56731aa9ae5b9e91f1037385c681b1adb159c332b1a7d9fde83202d4ca

Observation f165b87e-08ef-49b9-aa6f-2f217c342229 · outbound

This paper cites Hierarchical Text-Conditional Image Generation with CLIP Latents.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Hierarchical Text-Conditional Image Generation with CLIP Latents

Reference 66

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.163727Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.163727Z digest=sha256:528adca0b88108345eadbce1b3e877393401dd81ae2d94232783664c1b50c71d

Observation 8cd5d4c0-51d7-434e-8f5f-2b421631129c · outbound

This paper cites High-resolution image synthesis with latent diffusion models.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers High-resolution image synthesis with latent diffusion models

Reference 67

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.166787Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.166787Z digest=sha256:84baa1c8a3617dbe26c13f2973b220ca9d839d99b04a27b68875b0e29db900a1

Observation acc1cb7e-8e03-4849-8d53-eeb3e2d3cca8 · outbound

This paper cites Photorealistic text-to-image diffusion models with deep language understanding.Advances in neural information processing systems, 35:36479–36494, 2022.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Photorealistic text-to-image diffusion models with deep language understanding.Advances in neural information processing systems, 35:36479–36494, 2022

Reference 68

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.169494Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.169494Z digest=sha256:03207156c0a64b27419449354cbe7b1a3a2d21a38a06943f63859f6d8534f577

Observation 0493f57c-70eb-42ea-96f8-66c62baa9b60 · outbound

This paper cites Fast Transformer Decoding: One Write-Head is All You Need.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Fast Transformer Decoding: One Write-Head is All You Need

Reference 69

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.172183Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.172183Z digest=sha256:fe39704b599daa081a267fd81cac9f88fbf9b769e2e4cc96b3db46fa9fa4dfcc

Observation f4c7ed8b-d3a9-4ee9-989f-d43470775374 · outbound

This paper cites GLU Variants Improve Transformer.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers GLU Variants Improve Transformer

Reference 70

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.175141Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.175141Z digest=sha256:1892e18bd40ab4114829be1e1afb9c45d7ae00a8476dfb41313a11eee05a9e12

Observation 9ca1d191-b33b-4f77-b079-4ad0d40e6e08 · outbound

This paper cites Make-A-Video: Text-to-Video Generation without Text-Video Data.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Make-A-Video: Text-to-Video Generation without Text-Video Data

Reference 71

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.178098Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.178098Z digest=sha256:32f90999204f6dfc5a7ba80a7f9ab45867aa3001e1c6a21ae7568c7c881367b4

Observation 89d519d2-650e-482b-86ac-a7cfc9d78284 · outbound

This paper cites History-Guided Video Diffusion.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers History-Guided Video Diffusion

Reference 72

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.181000Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.181000Z digest=sha256:ce78ec560d12fb6b7f1f5b2e183cd4880af7091c11dd2a2dc810350e8451441c

Observation 448d3f28-3376-4196-bdc9-3f608c766d96 · outbound

This paper cites Score-Based Generative Modeling through Stochastic Differential Equations.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Score-Based Generative Modeling through Stochastic Differential Equations

Reference 73

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.183994Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.183994Z digest=sha256:bb89a6b4e89b08556938f146164d548cf9b11fc36d3efe8dea7aabc0e7bbf486

Observation 94342501-a152-46bb-90b4-b7f4cc4a6ec6 · outbound

This paper cites Roformer: Enhanced transformer with rotary position embedding.Neurocomputing, 568:127063, 2024.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Roformer: Enhanced transformer with rotary position embedding.Neurocomputing, 568:127063, 2024

Reference 74

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.187004Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.187004Z digest=sha256:9ca82120bbb4f05078358db28e97769894b3b9757dcb64e62a4f41b5e8ad7f00

Observation 0ee61b72-b472-43af-b6ea-35b1efb7a054 · outbound

This paper cites Retentive Network: A Successor to Transformer for Large Language Models.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Retentive Network: A Successor to Transformer for Large Language Models

Reference 75

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.189565Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.189565Z digest=sha256:17567251c32ed5410f6c08b1f6307c56a2c8b53a78e557ac8c0cd839df1de990

Observation e51f221d-5cc8-46df-9a7a-a6308546798d · outbound

This paper cites Dsv: Exploiting dynamic sparsity to accelerate large-scale video dit training.arXiv preprint arXiv:2502.07590, 2025.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Dsv: Exploiting dynamic sparsity to accelerate large-scale video dit training.arXiv preprint arXiv:2502.07590, 2025

Reference 76

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.192329Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.192329Z digest=sha256:6afafed4010cc5f6ee150f730bc879ace37e822b1ded1d180388b5cb2fce8a9b

Observation db331e8e-1600-4fca-90d1-71d58df648a2 · outbound

This paper cites Kimi k3: Open frontier intelligence, 2026.https://arxiv.org/abs/2607.24653.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Kimi k3: Open frontier intelligence, 2026.https://arxiv.org/abs/2607.24653

Reference 77

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.198077Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.198077Z digest=sha256:285362946a348cf8a123000c48485409ad42775b26e52d17aec21b3b7f0c20e8

Observation cee43a81-79fd-4491-bbc7-17946f0ff2af · outbound

This paper cites Kimi Linear: An Expressive, Efficient Attention Architecture.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Kimi Linear: An Expressive, Efficient Attention Architecture

Reference 78

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.200768Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.200768Z digest=sha256:8be4d8308bf6c7c79e218908919bb8702f46a64f7ddac196f29c3e56fcfbdabf

Observation 69380636-d526-4efb-baa6-b7f03c974c2a · outbound

This paper cites Qwen3.5-Omni Technical Report.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Qwen3.5-Omni Technical Report

Reference 79

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.203599Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.203599Z digest=sha256:4eb1f76f38d32b25ef0dd97a56ebc858d297287f783e64c5ad721bafde51b43e

Observation f7183d94-e7ab-4d8d-bdba-4e77f9bd0d92 · outbound

This paper cites Hunyuanvideo 1.5 technical report, 2025.https://arxiv.org/abs/2511.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Hunyuanvideo 1.5 technical report, 2025.https://arxiv.org/abs/2511

Reference 80

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.213747Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.213747Z digest=sha256:438230b7f5d1e64b7ef8185c029de80ee63188d6cef5a5ad825a759acf46150a

Observation 18c04200-4605-452c-ba69-7a8fc7bf8e82 · outbound

This paper cites Gomez, Lukasz Kaiser, and Illia Polosukhin.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Gomez, Lukasz Kaiser, and Illia Polosukhin

Reference 81

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.217148Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.217148Z digest=sha256:1c5b94be983eafd67818270ebcc1997f962a3e6460efa2b236ac8b0347e62f5d

Observation 94a2fd28-715b-4fce-a1cb-909bf7fdcc05 · outbound

This paper cites Wan: Open and Advanced Large-Scale Video Generative Models.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Wan: Open and Advanced Large-Scale Video Generative Models

Reference 82

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.219923Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.219923Z digest=sha256:646f8b0f5b3ae960e2290335a33ef5ac32711ea45f9a753041f2c130571760ec

Observation 5c8f58a3-e9c7-45a3-bd6f-16f0cc273bbd · outbound

This paper cites Lingen: Towards high-resolution minute-length text-to-video generation with linear computational complexity.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Lingen: Towards high-resolution minute-length text-to-video generation with linear computational complexity

Reference 83

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.223627Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.223627Z digest=sha256:5ceed9db0900139cb57eec147d6646b865a9ba763462b09ff1f4a043682b1451

Observation b71a8927-3d4a-4512-9cbf-46e288aecc79 · outbound

This paper cites Auxiliary-Loss-Free Load Balancing Strategy for Mixture-of-Experts.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Auxiliary-Loss-Free Load Balancing Strategy for Mixture-of-Experts

Reference 84

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.227426Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.227426Z digest=sha256:de8fed071b0a718582efc2dc0df3311861edb777ff16af7462f723a7743ad627

Observation 945ca130-8d03-433a-b5ba-12e39e89a6d8 · outbound

This paper cites Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution

Reference 85

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.230561Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.230561Z digest=sha256:86eabb024e938242231590379fe6bf02eb9edc868084bffeb8435d37aa24ad22

Observation 5afe614a-3d6a-4bdf-8a7a-c838d0837cf8 · outbound

This paper cites Scaling laws, carefully.lilianweng.github.io, June 2026.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Scaling laws, carefully.lilianweng.github.io, June 2026

Reference 86

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.233526Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.233526Z digest=sha256:fa6f05e59497d7cf0237edf5d65463ba723ee9f9e587f7cdb27824dd3a91c90a

Observation 18181547-990b-45f6-9678-de8b78d31882 · outbound

This paper cites Qwen-Image Technical Report.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Qwen-Image Technical Report

Reference 87

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.236568Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.236568Z digest=sha256:22e096bf130668038fc3499336ee8221459cc4da0f6271e998bc23aed7f52d50

Observation 7f634608-880a-4d02-b295-6ed5f131e32f · outbound

This paper cites VMoBA: Mixture-of-Block Attention for Video Diffusion Models.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers VMoBA: Mixture-of-Block Attention for Video Diffusion Models

Reference 88

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.239355Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.239355Z digest=sha256:0f1cb3c27565dfa1f139f5efe76ee7984ac167b7e52e0d31fcfd1066ea343b16

Observation 9f33261d-732d-49fe-878b-39018db1bfa9 · outbound

This paper cites Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity

Reference 89

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.242540Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.242540Z digest=sha256:60db8661e13c03b092470ea551a4be0546ca08b83338595fdde6f06b15626e8e

Observation 6d45c22b-788f-44f7-9d0b-50113234b865 · outbound

This paper cites mHC: Manifold-Constrained Hyper-Connections.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers mHC: Manifold-Constrained Hyper-Connections

Reference 90

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.245486Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.245486Z digest=sha256:80cc71a97e54ec5a5057cfc82b1448da1e3dc057c84aad37fcbff2b5ce14378a

Observation 63a96bc9-3167-463c-91a2-d6803eb34016 · outbound

This paper cites Qwen3 Technical Report.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Qwen3 Technical Report

Reference 91

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.248478Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.248478Z digest=sha256:8ba29b37dcf332f0b9c8c34c00d4d768f2e4b80fab6a5fe666dff97b47adef09

Observation 87e6a1ac-b78f-4ea7-964a-0246e98ecbed · outbound

This paper cites Tuning large neural networks via zero-shot hyperparameter transfer.Advances in Neural Information Processing Systems, 34:17084–17097, 2021.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Tuning large neural networks via zero-shot hyperparameter transfer.Advances in Neural Information Processing Systems, 34:17084–17097, 2021

Reference 92

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.251304Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.251304Z digest=sha256:58e865c642eb5b439b835127e7d1f7b701f8d9e172d0a976207d69944f3ffc6e

Observation f9cc9133-94d9-4698-a52f-d1cec4bca3cb · outbound

This paper cites Tensor Programs V: Tuning Large Neural Networks via Zero-Shot Hyperparameter Transfer.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Tensor Programs V: Tuning Large Neural Networks via Zero-Shot Hyperparameter Transfer

Reference 93

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.253839Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.253839Z digest=sha256:bdcf503970f858732b455b4d1a353371c3c78d41fc354cf181330db2efc8496b

Observation 6e73d0fd-b071-4be4-b8bc-1c395b8298f9 · outbound

This paper cites Parallelizing linear transformers with the delta rule over sequence length.Advances in neural information processing systems, 37:115491–115522, 2024.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Parallelizing linear transformers with the delta rule over sequence length.Advances in neural information processing systems, 37:115491–115522, 2024

Reference 94

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.256882Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.256882Z digest=sha256:9c753594b772a10cf97d6069903d9bf948035723747e8310298281296ec745e2

Observation 9828ea82-a305-4572-b5ab-f0574a808a06 · outbound

This paper cites Cogvideox: Text-to-videodiffusionmodelswithanexperttransformer.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Cogvideox: Text-to-videodiffusionmodelswithanexperttransformer

Reference 95

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.259508Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.259508Z digest=sha256:0ae22b7792c41e58c6bb2003d7492fec2ec0f836099acb488fb9e1e514a0259d

Observation 2002f6bb-7974-458f-918f-692d43cc7710 · outbound

This paper cites Pixeldit: Pixel diffusion transformers for image generation.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Pixeldit: Pixel diffusion transformers for image generation

Reference 96

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.262096Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.262096Z digest=sha256:4009f731f1505365b55bc30d16c63546865c8fdf5960f14932e995a97bfdd9c7

Observation 55100718-4c93-403c-94ee-f06d3b4153f6 · outbound

This paper cites Native sparse attention: Hardware-aligned and natively trainable sparse attention.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Native sparse attention: Hardware-aligned and natively trainable sparse attention

Reference 97

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.265084Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.265084Z digest=sha256:41149e9ff0df471e217b0cbd4e45b58ac0fbf9bc8b9dc9f7233d1e691db1c370

Observation d12d853a-dc80-4086-a18f-c623c53a8907 · outbound

This paper cites Bidirectional sparse attention for faster video diffusion training.arXiv preprint arXiv:2509.01085, 2025.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Bidirectional sparse attention for faster video diffusion training.arXiv preprint arXiv:2509.01085, 2025

Reference 98

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.267705Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.267705Z digest=sha256:130d989853a6db971023e910b2f65aecfa2f432196140ebec70fd900daae4a50

Observation fc1da28f-177a-49d9-83a5-abc89bf29834 · outbound

This paper cites KnapFormer: An Online Load Balancer for Efficient Diffusion Transformers Training.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers KnapFormer: An Online Load Balancer for Efficient Diffusion Transformers Training

Reference 99

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.270116Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.270116Z digest=sha256:cd438b35db42823696ce08282990547c48109f0944629ada4855d2ae2e60497b

Observation a50d4019-bb90-4f5f-a6af-cf9dcc048071 · outbound

This paper cites Faster video diffusion with trainable sparse attention.Advances in Neural Information Processing Systems, 38:152509–152534, 2026.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Faster video diffusion with trainable sparse attention.Advances in Neural Information Processing Systems, 38:152509–152534, 2026

Reference 100

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.272881Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.272881Z digest=sha256:a91bb911a43bbedbd178d834400ef014a0b8028526435f0f3d1584c40292fdd7

Observation c1480be5-84c7-4953-8ea8-a5de0a860c4a · outbound

This paper cites PyTorch FSDP: Experiences on Scaling Fully Sharded Data Parallel.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers PyTorch FSDP: Experiences on Scaling Fully Sharded Data Parallel

Reference 101

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.275374Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.275374Z digest=sha256:5d220c757129974085e5b6957c92746789ae62e84acc3070ee63f17245058223

Pith citing papers

No inbound Pith citation observations are available.