Pith. sign in

Paper Citation Record · LEDGER

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers

As of 15 August 2026, this Paper Citation Record lists 100 of 104 outbound references and 0 inbound Pith citation observations for arXiv:2607.28611.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2607.28611 v1

Coverage vector

measured 100 of 104 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-07-31T02:16:08.275374Z

measured 100 of 100 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-14T06:32:32.682623+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

100 of 104 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved100
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation b3f1285a-a8d2-4f8f-a4b9-b9dcc1c0ed75 · outbound

This paper cites Gqa: Training generalizedmulti-querytransformermodelsfrommulti-headcheckpoints.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Gqa: Training generalizedmulti-querytransformermodelsfrommulti-headcheckpoints

Reference 1

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.291402Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.291402Z digest=sha256:cb62f9c63857c9a964d8bf45ccda7f9855b98fe7ca75eb58c2e1fba3700efffe

Observation 96695258-4f06-4a0b-a373-f9ea6da9bf1f · outbound

This paper cites Physics of language models: Part 4.1, architecture design and the magic of canon layers.Advances in Neural Information Processing Systems, 38:42349–42369, 2026.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Physics of language models: Part 4.1, architecture design and the magic of canon layers.Advances in Neural Information Processing Systems, 38:42349–42369, 2026

Reference 2

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.326089Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.326089Z digest=sha256:08e1aadc48bf4fedbe70996b410936615da0dae0cea19aa6d416920a3c84b5f2

Observation 0d07a87d-a406-4eff-8c04-eb02c23dadc6 · outbound

This paper cites Round and Round We Go! What makes Rotary Positional Encodings useful?.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Round and Round We Go! What makes Rotary Positional Encodings useful?

Reference 3

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.387521Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.387521Z digest=sha256:1933616b769e8a9c742f561241d652db80160ba041108768faa34be2c911b0a3

Observation a737b48e-98d1-426c-8c17-1cd3eae2f01d · outbound

This paper cites FLUX.2: Frontier Visual Intelligence.https://bfl.ai/blog/flux-2, 2025.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers FLUX.2: Frontier Visual Intelligence.https://bfl.ai/blog/flux-2, 2025

Reference 4

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.457244Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.457244Z digest=sha256:303d6eec7526066fcaf767cf3aa0723f9fb3127f3e00dee3a226130638374d27

Observation 68d82e32-8e07-4210-894f-267e0498a709 · outbound

This paper cites Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets

Reference 5

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.541093Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.541093Z digest=sha256:3a7ab8a07471d9ce6520b669401f1c584bc18ff78ba472247d47be48f2c68dcb

Observation 29be113c-67ae-43d7-911f-a3b992baf929 · outbound

This paper cites Align your latents: High-resolution video synthesis with latent diffusion models.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Align your latents: High-resolution video synthesis with latent diffusion models

Reference 6

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.613961Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.613961Z digest=sha256:287dfcdf9ac9c6729fadb2f33041c4b0ff6def76a0ddfd19a854df85c1adcb97

Observation 6d331e3b-93dd-4ff1-86b7-504d7c3dd1c5 · outbound

This paper cites Video generation models as world simulators, 2024.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Video generation models as world simulators, 2024

Reference 7

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.660028Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.660028Z digest=sha256:71b736c5133ef3689685ebe9777fc1a3f3ef68ed480edadc71c3f799d1bcb9b7

Observation 30e953e9-3eaf-4b06-8b0d-d25ac09c1202 · outbound

This paper cites Z-Image: An Efficient Image Generation Foundation Model with Single-Stream Diffusion Transformer.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Z-Image: An Efficient Image Generation Foundation Model with Single-Stream Diffusion Transformer

Reference 8

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.719858Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.719858Z digest=sha256:17204fafb4a0c341cc946bb6a53e67112848202f4735e67acf541ea9e759c024

Observation ef575262-d288-4069-b27f-0b5ed773a300 · outbound

This paper cites The Effect of Mini-Batch Noise on the Implicit Bias of Adam.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers The Effect of Mini-Batch Noise on the Implicit Bias of Adam

Reference 9

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.806062Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.806062Z digest=sha256:b5092fa2bc85ff305ccee2e252aed9d6bc7a370a6c2f74e016391bd787f99f83

Observation fab3edf1-56a2-4e90-9f61-a2f66ca0cb59 · outbound

This paper cites Aligning visual foundation encoders to tokenizers for diffusion models.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Aligning visual foundation encoders to tokenizers for diffusion models

Reference 10

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.841398Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.841398Z digest=sha256:dbc383a8f374eb227c78a65124c682f744fc244a4dbf80d82d9917ed8f492b38

Observation 36fa5535-064a-4f56-bae4-85e122f790c2 · outbound

This paper cites Diffusion forcing: Next-token prediction meets full-sequence diffusion.Advances in Neural Information Processing Systems, 37:24081–24125, 2024.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Diffusion forcing: Next-token prediction meets full-sequence diffusion.Advances in Neural Information Processing Systems, 37:24081–24125, 2024

Reference 11

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.903452Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.903452Z digest=sha256:20dbe37aff5023017a13648720463903433de535326e61cc4ae31c5b0e97ef59

Observation c3940baf-8bf9-44d4-a4d8-f8dc42210c58 · outbound

This paper cites Pixart-alpha: Fast training of diffusion transformer for photorealistic text-to-image synthesis.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Pixart-alpha: Fast training of diffusion transformer for photorealistic text-to-image synthesis

Reference 12

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.957963Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.957963Z digest=sha256:5c22c48807a88e29478a9581f8df66dd78aa93b4a2ac78f03f24d9f6900eee78

Observation 23fc2699-5ddc-4f6c-8ed8-89242d511d5b · outbound

This paper cites Sana-video: Efficient video generation with block linear diffusion transformer.arXiv preprint arXiv:2509.24695, 2025.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Sana-video: Efficient video generation with block linear diffusion transformer.arXiv preprint arXiv:2509.24695, 2025

Reference 13

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.961114Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.961114Z digest=sha256:12cc61f1693085cfeaaae6068dbd2feeebcab38be65d7de5ba9ffb5ee32ac081

Observation 953987e6-b508-4a14-8bd5-ddcd18846e6f · outbound

This paper cites Generating Long Sequences with Sparse Transformers.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Generating Long Sequences with Sparse Transformers

Reference 14

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.963748Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.963748Z digest=sha256:85b8d155411d4949dd040cf791da25b91ba26b78a6e91d3e2fa628ab540a9cb1

Observation efe1d071-f925-4e60-ae13-7cf14f5bb61f · outbound

This paper cites Conditional positional encodings for vision transformers.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Conditional positional encodings for vision transformers

Reference 15

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.966909Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.966909Z digest=sha256:860b30c2f3307b46120cc290298560ea3fbce7d392a761cbfd5aa6f6e08be088

Observation 8674616c-2509-4dbd-903f-49993d1da42a · outbound

This paper cites UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining

Reference 16

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.969747Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.969747Z digest=sha256:73a9dba481b1c658c0898bcf4a140dc88f94f9aad1a0b1f622ba997c2d16f60b

Observation edcd3dbe-525e-4544-9742-04d20e705ff7 · outbound

This paper cites Deepseekmoe: Towards ultimate expert specialization in mixture-of-experts language models.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Deepseekmoe: Towards ultimate expert specialization in mixture-of-experts language models

Reference 17

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.973704Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.973704Z digest=sha256:31b3b9907c59911a50e273346fe7862509575a41b3111bc461848a719b6cd588

Observation f9116ccc-38c1-471e-9fd3-d8c5c2c9643f · outbound

This paper cites Don’t be lazy: Completep enables compute-efficient deep transformers.Advances in Neural Information Processing Systems, 38:137707–137739, 2026.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Don’t be lazy: Completep enables compute-efficient deep transformers.Advances in Neural Information Processing Systems, 38:137707–137739, 2026

Reference 18

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.976481Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.976481Z digest=sha256:93d2e5adbee69689bca12b15ec4a4ccd144d85e4456b2be0202fb64be1afa680

Observation ac60a4be-a081-44c8-b2a8-03848e0a3802 · outbound

This paper cites Diffusion models beat gans on image synthesis.Advances in neural information processing systems, 34:8780–8794, 2021.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Diffusion models beat gans on image synthesis.Advances in neural information processing systems, 34:8780–8794, 2021

Reference 19

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.979224Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.979224Z digest=sha256:697179b8ce2285648052159f94520f45a6d449420df5b147385b50b3126dc1ec

Observation 99b7920e-3e6b-4a0c-93f4-60cd195bd1c6 · outbound

This paper cites Diffusion is spectral autoregression.https://sander.ai/2024/09/02/spectral-autoregression.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Diffusion is spectral autoregression.https://sander.ai/2024/09/02/spectral-autoregression

Reference 20

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.982181Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.982181Z digest=sha256:a9f620fb079ab8fb7b25cc850f0e42210e49e13881b6cfa8c9e886ba1120c71a

Observation 2ed05fa7-6588-4b8f-a38b-f139a7e59178 · outbound

This paper cites Efficient-vDiT: Efficient Video Diffusion Transformers With Attention Tile.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Efficient-vDiT: Efficient Video Diffusion Transformers With Attention Tile

Reference 21

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.984738Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.984738Z digest=sha256:5143f8ed89d5132c53253c2b9b88401d969a91656146b058da27f089b990b234

Observation 28838b84-62cb-4cdc-8185-7ac6cda2c1b3 · outbound

This paper cites Cogview: Mastering text-to-image generation via transformers.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Cogview: Mastering text-to-image generation via transformers

Reference 22

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.987633Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.987633Z digest=sha256:d6bdf95ae682ee9e4a58ab08eabca547f6ae578f12002bc9222b228aaae572fc

Observation ff79909b-1e87-4091-a68a-c00474cf92a1 · outbound

This paper cites A mathematical framework for transformer circuits.Transformer Circuits Thread, 1(1):12, 2021.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers A mathematical framework for transformer circuits.Transformer Circuits Thread, 1(1):12, 2021

Reference 23

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.990174Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.990174Z digest=sha256:fec37e4841f9375917627ab85198b2734c48a4956be68344142211d46d2f4c1d

Observation 671d716e-8ae5-4088-a419-c54af8afa06b · outbound

This paper cites Scaling rectified flow transformers for high-resolution image synthesis.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Scaling rectified flow transformers for high-resolution image synthesis

Reference 24

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.992876Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.992876Z digest=sha256:d96cdc8384f098381036116e92c138b33d940bcefac79c94170d4d347c9e7eb2

Observation b81ca4ad-de40-42c4-b0ed-2f7a2faeed45 · outbound

This paper cites Switch transformers: Scaling to trillion parameter models with simple and efficient sparsity.Journal of Machine Learning Research, 23(120):1–39, 2022.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Switch transformers: Scaling to trillion parameter models with simple and efficient sparsity.Journal of Machine Learning Research, 23(120):1–39, 2022

Reference 25

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.996132Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.996132Z digest=sha256:d1769653cf09f63e76161aedd60f5f137a1391c423911120524bf854d63ed6e6

Observation f0ee9087-c842-4324-ba7c-9f8d3087430b · outbound

This paper cites Scaling diffusion transformers to 16 billion parameters, 2024.URL https://arxiv.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Scaling diffusion transformers to 16 billion parameters, 2024.URL https://arxiv

Reference 26

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:07.998823Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:07.998823Z digest=sha256:9eecb5e335e964d181725b980a7a59bffc6202881bfd239dfaaa52d3df1a89b2

Observation 446d8ba5-35f7-4ccb-9656-986942f894cd · outbound

This paper cites Why Adam Works Better with $\beta_1 = \beta_2$: The Missing Gradient Scale Invariance Principle.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Why Adam Works Better with $\beta_1 = \beta_2$: The Missing Gradient Scale Invariance Principle

Reference 27

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.001681Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.001681Z digest=sha256:1d4a960872d86ff34d335d7c2028851ac3859e6492b2464a9de0905e8fd52aa3

Observation 0ce817d8-e67d-46df-9eb4-370966ed2a94 · outbound

This paper cites Geneval: Anobject-focusedframeworkforevaluatingtext-to-image alignment.Advances in Neural Information Processing Systems, 36:52132–52152, 2023.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Geneval: Anobject-focusedframeworkforevaluatingtext-to-image alignment.Advances in Neural Information Processing Systems, 36:52132–52152, 2023

Reference 28

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.004957Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.004957Z digest=sha256:dde87da596521803986097185f2a20004d55f23a9abcd5f56af894490ca5c102

Observation 671749fa-901a-4d51-ae7b-6987ce5f36a0 · outbound

This paper cites Mamba: Linear-Time Sequence Modeling with Selective State Spaces.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Mamba: Linear-Time Sequence Modeling with Selective State Spaces

Reference 29

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.007646Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.007646Z digest=sha256:c93083a3ce433bd9652396ae8b36d5dd80c39323086043b008e529d1e1ee0b9b

Observation 1b633e07-6b12-4c58-ac5e-566d2fb7de99 · outbound

This paper cites Scaling Laws for Autoregressive Generative Modeling.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Scaling Laws for Autoregressive Generative Modeling

Reference 30

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.010546Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.010546Z digest=sha256:179896cc0d0b0a9ebbadd873bdadd77dc64e629cfda263638c66cb164d32afae

Observation 6986aedf-9bec-42d7-ad5b-7ffa62020ef6 · outbound

This paper cites Deep Learning Scaling is Predictable, Empirically.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Deep Learning Scaling is Predictable, Empirically

Reference 31

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.013539Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.013539Z digest=sha256:6c202d791b9cd8407324d700a0d32f667ed2b8dcd7b0b76d4220d002b63bc429

Observation d7e826fe-f2ee-40ab-a17b-119ab4738c20 · outbound

This paper cites Classifier-Free Diffusion Guidance.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Classifier-Free Diffusion Guidance

Reference 32

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.016487Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.016487Z digest=sha256:e3e3e43ade7f1765c0c69b26286a0d266399bc4d0a805db942cdf67f899186bb

Observation d368d901-0493-44a1-b018-5a816f0e4934 · outbound

This paper cites Denoising diffusion probabilistic models.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Denoising diffusion probabilistic models

Reference 33

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.019392Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.019392Z digest=sha256:6ff9a79fbed4ba7cfa56bf880fdb886a243b136992804302df0b74f1ab87beec

Observation 58a6f19e-8edf-4053-9290-88b2b7f56191 · outbound

This paper cites Imagen Video: High Definition Video Generation with Diffusion Models.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Imagen Video: High Definition Video Generation with Diffusion Models

Reference 34

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.022280Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.022280Z digest=sha256:65e2936ac68ef4a6bba04d9589480309ef6fbd94951c3c04e9cab3a14056c908

Observation 5ed24407-67a4-49d0-aaed-2698296a6679 · outbound

This paper cites Videodiffusionmodels.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Videodiffusionmodels

Reference 35

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.025391Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.025391Z digest=sha256:1048b61061366cf07e7eae5bbaa158d51f7069f20bc142a8bd934df9836f627f

Observation 9f224e44-c918-49f2-8d50-51c96bbc222f · outbound

This paper cites Training Compute-Optimal Large Language Models.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Training Compute-Optimal Large Language Models

Reference 36

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.035084Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.035084Z digest=sha256:10898bb3a2419a588f18580ffc0201c0bc516fd810467e77390929ee24e081be

Observation de8a3529-9465-4022-873d-0a7b8af82577 · outbound

This paper cites Pushing the Boundaries of State Space Models for Image and Video Generation.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Pushing the Boundaries of State Space Models for Image and Video Generation

Reference 37

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.038112Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.038112Z digest=sha256:6fc4093f5ed11d76051fbd0d3206b448c14e06c18569c8e0b31b5ba16e2c01ed

Observation 907bfc44-2e6c-438d-b7cf-8da6a3be8b97 · outbound

This paper cites Relic: Interactive video world model with long-horizon memory.arXiv preprint arXiv:2512.04040, 2025.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Relic: Interactive video world model with long-horizon memory.arXiv preprint arXiv:2512.04040, 2025

Reference 38

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.041706Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.041706Z digest=sha256:e4a9a487badb2bd4d4cfa541be2ddc16e8a696caa37f99c5ec08805e2a9cb60b

Observation 854dee7c-e799-4fb1-9465-644bbdb961fd · outbound

This paper cites Zigma: A dit-style zigzag mamba diffusion model.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Zigma: A dit-style zigzag mamba diffusion model

Reference 39

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.044262Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.044262Z digest=sha256:595e8730ababaf02bfad8dab2819639dccef4fe06eb8fc76618b9db9b0e22550

Observation 347a662c-4aac-44ba-9bb8-68c2c9a11862 · outbound

This paper cites ELLA: Equip Diffusion Models with LLM for Enhanced Semantic Alignment.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers ELLA: Equip Diffusion Models with LLM for Enhanced Semantic Alignment

Reference 40

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.046825Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.046825Z digest=sha256:f148af6670f049731431a16f7692e494f3387447c5aafe0de371fc8407adca80

Observation d0b02c73-1eb9-4353-861d-530ca9f69023 · outbound

This paper cites Self forcing: Bridging the train-test gap in autoregressive video diffusion.Advances in Neural Information Processing Systems, 38:167283–167308, 2026.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Self forcing: Bridging the train-test gap in autoregressive video diffusion.Advances in Neural Information Processing Systems, 38:167283–167308, 2026

Reference 41

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.050076Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.050076Z digest=sha256:4d3507f21a691fd014a04b0044f1794ef0f89a946a091bcac9894c7b2f44318f

Observation afbafc47-653c-4a81-99c9-8a190606c0a9 · outbound

This paper cites Muon: An optimizer for hidden layers in neural networks, 2024.URL https://kellerjordan.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Muon: An optimizer for hidden layers in neural networks, 2024.URL https://kellerjordan

Reference 42

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.052719Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.052719Z digest=sha256:cd93f9cabe19b601b77b350578fb22cc13785d23a2c78783d4a6d1fb8c0f5bdf

Observation 1a9554c0-a78e-4a22-ac5f-0dab9b9d65ca · outbound

This paper cites EditVerse: Unifying Image and Video Editing and Generation with In-Context Learning.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers EditVerse: Unifying Image and Video Editing and Generation with In-Context Learning

Reference 43

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.055344Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.055344Z digest=sha256:d38f90d3c9a63938acd4eb0b53c7fbdb2e12c1a0b25cd7aab8116c0a3e1c2fd6

Observation 43f4c58a-6810-4bfe-adda-4ece00621794 · outbound

This paper cites Scaling Laws for Neural Language Models.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Scaling Laws for Neural Language Models

Reference 44

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.058662Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.058662Z digest=sha256:bdf41e193bb804cd437e9c831456e35691f362b398ebe6fd66fd6e1bbe93c5ae

Observation a8164523-4a2b-4b2f-b976-2d7b763f56dc · outbound

This paper cites Transformers are RNNs: Fast autoregressive transformers with linear attention.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Transformers are RNNs: Fast autoregressive transformers with linear attention

Reference 45

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.061609Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.061609Z digest=sha256:f6d775662e8017225abe46c41a17b6eb7f5960ffb51870cc03c182e6688b2de4

Observation 59fdf7c9-40b3-47c4-8afd-de47f0065aa7 · outbound

This paper cites Theimpactofpositional encoding on length generalization in transformers.Advances in Neural Information Processing Systems, 36:24892–24928, 2023.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Theimpactofpositional encoding on length generalization in transformers.Advances in Neural Information Processing Systems, 36:24892–24928, 2023

Reference 46

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.064097Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.064097Z digest=sha256:77bd68fbbde3521f6a499be776b4cb2adca6e6ada94b28cf9adda4b93d226d29

Observation 687323ae-9ce3-4040-b70f-896365421064 · outbound

This paper cites GShard: Scaling Giant Models with Conditional Computation and Automatic Sharding.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers GShard: Scaling Giant Models with Conditional Computation and Automatic Sharding

Reference 48

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.069668Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.069668Z digest=sha256:6d4444aba7676b406776784855c22397424fd73b15c76236bbd7eb6a6fee2f61

Observation 9cff701e-1901-46ce-971c-f471979af551 · outbound

This paper cites Back to basics: Let denoising generative models denoise.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Back to basics: Let denoising generative models denoise

Reference 49

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.072710Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.072710Z digest=sha256:2d4bae4a8ce016a85858b3f8284f31e9ce5e685fe225442dc6e69a29f2f77706

Observation 1599da00-1c66-4942-8bfc-6092dc53883f · outbound

This paper cites Scalinglawsfordiffusiontransformers.arXivpreprintarXiv:2410.08184, 2024.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Scalinglawsfordiffusiontransformers.arXivpreprintarXiv:2410.08184, 2024

Reference 50

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.075575Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.075575Z digest=sha256:fbd696f9496ba0e0d5a48d0eae6916cffc6ea68fb851952c1e3e2a7182452335

Observation 1fe38c64-c4d4-47a9-92b6-d6260e640913 · outbound

This paper cites Flow Matching for Generative Modeling.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Flow Matching for Generative Modeling

Reference 51

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.108176Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.108176Z digest=sha256:ba9972fe61b7167760790d560cc435b7292affcbec3f09b3278dcf0738f11294

Observation 4c800bfc-44b0-41b5-ad7e-75edf89c5063 · outbound

This paper cites DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model

Reference 52

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.114735Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.114735Z digest=sha256:1e9a15a39b9c8fda63f607794296c705118ac3a265b314c83ebfcf438130ec16

Observation ab65fb43-f2e6-4737-b465-bf4a20dafbb7 · outbound

This paper cites DeepSeek-V3 Technical Report.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers DeepSeek-V3 Technical Report

Reference 53

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.125037Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.125037Z digest=sha256:b0aebefa2e27f3694c6734baa622bc9ab5b69ff9ab4889139437d931c647a51a

Observation 4d9fb7bd-8261-4275-adfe-c6333a4ba733 · outbound

This paper cites DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models

Reference 54

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.128479Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.128479Z digest=sha256:dbd63933a07bea201b5c3b3ca78a99c2a6b186f86b649be77ac2aff484f6a281

Observation 92036d02-b64c-4ea5-a004-471275f9a9ca · outbound

This paper cites Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow

Reference 55

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.131544Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.131544Z digest=sha256:85da62395c4b46e21c009173ae3438761cc5ce5b213b3f4d77088cb59c803ea4

Observation 4bae04a0-1abc-43d3-8ca3-84f29ebf7d69 · outbound

This paper cites Vmamba: Visual state space model.Advances in neural information processing systems, 37:103031–103063, 2024.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Vmamba: Visual state space model.Advances in neural information processing systems, 37:103031–103063, 2024

Reference 56

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.134615Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.134615Z digest=sha256:177435a9bada993f97aaaa3d885dcf8761f6138e933425a2c130e9e8939f0a8c

Observation 12de7f78-7b2e-4d10-a181-28fc38675a27 · outbound

This paper cites Olmo Hybrid: From Theory to Practice and Back.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Olmo Hybrid: From Theory to Practice and Back

Reference 57

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.137640Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.137640Z digest=sha256:557e254b9ebf5effe842079a2e9e7c799a9d75fad48ce729f4ac28c5b2748183

Observation 0b914026-664f-43da-91dc-1397d6ac4913 · outbound

This paper cites Completed hyperparameter transfer across modules, width, depth, batch and duration.arXiv preprint arXiv:2512.22382, 2025.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Completed hyperparameter transfer across modules, width, depth, batch and duration.arXiv preprint arXiv:2512.22382, 2025

Reference 58

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.140944Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.140944Z digest=sha256:b6ac28160509877a7e1555568ee6c9004f5e820b3407a772f8d6d1a5c2786636

Observation 212799eb-a387-45c3-a07e-2dd1616da5c8 · outbound

This paper cites GLIDE: Towards Photorealistic Image Generation and Editing with Text-Guided Diffusion Models.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers GLIDE: Towards Photorealistic Image Generation and Editing with Text-Guided Diffusion Models

Reference 59

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.143885Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.143885Z digest=sha256:5ad0ccd54c6eb2bedb411c1fe8875eb430753fa88e4424eea01d4a47003f6944

Observation 0d656b73-33cd-494f-88f9-5966961b6d29 · outbound

This paper cites Improveddenoisingdiffusionprobabilisticmodels.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Improveddenoisingdiffusionprobabilisticmodels

Reference 60

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.147126Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.147126Z digest=sha256:6a6b02a26a01e9010b54e596d21d10fb47fee3b7dba5ad894ec3305b0f7d1a06

Observation 8151033e-a9de-42d0-b2bd-8c0c052c7735 · outbound

This paper cites In-context Learning and Induction Heads.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers In-context Learning and Induction Heads

Reference 61

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.149754Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.149754Z digest=sha256:60ad5ff7313863ab0e1ec5b8d9d92a1a833e91037560d29a4552c2b6e563dffe

Observation 8a8e47bb-4377-48bb-9e15-e984c14596f8 · outbound

This paper cites In search of adam’s secret sauce.Advances in Neural Information Processing Systems, 38: 63404–63442, 2026.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers In search of adam’s secret sauce.Advances in Neural Information Processing Systems, 38: 63404–63442, 2026

Reference 62

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.152730Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.152730Z digest=sha256:97843160494a942e725725df27407907729389155509ee2a7adb2f4a9943c81d

Observation 7c7a5ff3-66bd-4dc0-a055-d7724dd27987 · outbound

This paper cites Scalable diffusion models with transformers.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Scalable diffusion models with transformers

Reference 63

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.155647Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.155647Z digest=sha256:5d210cab7a2b60a3de77210640331c9895da41c50608cd5a7bd6d140ce825cda

Observation 42be2ed3-3502-4058-a0a4-6253d0ad9e89 · outbound

This paper cites Smith, and Mike Lewis.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Smith, and Mike Lewis

Reference 64

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.158345Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.158345Z digest=sha256:c97d09e1c6be518de6313444736318dc87586138c3ed2e9b58212641c8826938

Observation efdae082-a1d8-4568-982f-8cfc99517b03 · outbound

This paper cites Exploring the limits of transfer learning with a unified text-to-text transformer.Journal of machine learning research, 21 (140):1–67, 2020.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Exploring the limits of transfer learning with a unified text-to-text transformer.Journal of machine learning research, 21 (140):1–67, 2020

Reference 65

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.161196Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.161196Z digest=sha256:6398baa160500e99ad0f2f97003e610a5c4bc0f269db4be0994273031402d45a

Observation f165b87e-08ef-49b9-aa6f-2f217c342229 · outbound

This paper cites Hierarchical Text-Conditional Image Generation with CLIP Latents.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Hierarchical Text-Conditional Image Generation with CLIP Latents

Reference 66

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.163727Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.163727Z digest=sha256:688c0407a9c371455762a3c66d13e4049d90d59dc567561f3a2aea4bac820b32

Observation 8cd5d4c0-51d7-434e-8f5f-2b421631129c · outbound

This paper cites High-resolution image synthesis with latent diffusion models.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers High-resolution image synthesis with latent diffusion models

Reference 67

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.166787Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.166787Z digest=sha256:ec362c2e340e4bfb6c2eb84f10c62e676fe8ec04b1700974275fdf92fe83a5ff

Observation acc1cb7e-8e03-4849-8d53-eeb3e2d3cca8 · outbound

This paper cites Photorealistic text-to-image diffusion models with deep language understanding.Advances in neural information processing systems, 35:36479–36494, 2022.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Photorealistic text-to-image diffusion models with deep language understanding.Advances in neural information processing systems, 35:36479–36494, 2022

Reference 68

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.169494Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.169494Z digest=sha256:1bdeba4668d34caa5ae6fa79520de6b21bc7a1f4943602bc265f8ca3a1992f96

Observation 0493f57c-70eb-42ea-96f8-66c62baa9b60 · outbound

This paper cites Fast Transformer Decoding: One Write-Head is All You Need.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Fast Transformer Decoding: One Write-Head is All You Need

Reference 69

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.172183Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.172183Z digest=sha256:57adada43da48d7ca01d6d39f40216f06852634a812c6151238b9a858af355ad

Observation f4c7ed8b-d3a9-4ee9-989f-d43470775374 · outbound

This paper cites GLU Variants Improve Transformer.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers GLU Variants Improve Transformer

Reference 70

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.175141Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.175141Z digest=sha256:2b16307ce274bf94e1027c67d827e84796abceab61fb38d3607623ebf8b682ea

Observation 9ca1d191-b33b-4f77-b079-4ad0d40e6e08 · outbound

This paper cites Make-A-Video: Text-to-Video Generation without Text-Video Data.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Make-A-Video: Text-to-Video Generation without Text-Video Data

Reference 71

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.178098Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.178098Z digest=sha256:49ba7dcd49cd6fbfc9ea031a4c0991ab9b5986a57310f90932398aa00875ed37

Observation 89d519d2-650e-482b-86ac-a7cfc9d78284 · outbound

This paper cites History-Guided Video Diffusion.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers History-Guided Video Diffusion

Reference 72

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.181000Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.181000Z digest=sha256:9c40bebf9c85e1ca724a9e1626a6edc412c562d6e615939482a9fe15b0d25d7d

Observation 448d3f28-3376-4196-bdc9-3f608c766d96 · outbound

This paper cites Score-Based Generative Modeling through Stochastic Differential Equations.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Score-Based Generative Modeling through Stochastic Differential Equations

Reference 73

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.183994Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.183994Z digest=sha256:ce0da9fca7493c3c71803e86ab40edd31b83c4c78ea41ee3bbbb0de469163b09

Observation 94342501-a152-46bb-90b4-b7f4cc4a6ec6 · outbound

This paper cites Roformer: Enhanced transformer with rotary position embedding.Neurocomputing, 568:127063, 2024.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Roformer: Enhanced transformer with rotary position embedding.Neurocomputing, 568:127063, 2024

Reference 74

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.187004Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.187004Z digest=sha256:dc1ce33cb041985b49b9513c05c820d2b663536bb259a467735a6331e5a343a4

Observation 0ee61b72-b472-43af-b6ea-35b1efb7a054 · outbound

This paper cites Retentive Network: A Successor to Transformer for Large Language Models.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Retentive Network: A Successor to Transformer for Large Language Models

Reference 75

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.189565Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.189565Z digest=sha256:7c28d836e683fb2ded9b5234a2f7a7eca9d459505c8b4c4ecdb25173bbaca576

Observation e51f221d-5cc8-46df-9a7a-a6308546798d · outbound

This paper cites Dsv: Exploiting dynamic sparsity to accelerate large-scale video dit training.arXiv preprint arXiv:2502.07590, 2025.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Dsv: Exploiting dynamic sparsity to accelerate large-scale video dit training.arXiv preprint arXiv:2502.07590, 2025

Reference 76

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.192329Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.192329Z digest=sha256:6ce3674fd10cc653c708bf7d2504fc347af59971cc3eb8b22fb12f63e8aa2ca0

Observation db331e8e-1600-4fca-90d1-71d58df648a2 · outbound

This paper cites Kimi k3: Open frontier intelligence, 2026.https://arxiv.org/abs/2607.24653.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Kimi k3: Open frontier intelligence, 2026.https://arxiv.org/abs/2607.24653

Reference 77

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.198077Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.198077Z digest=sha256:e8ba727b4e3b7fd65f3f4d0c8c6ff6237b58bc430b119715e96f0fc0728dc672

Observation cee43a81-79fd-4491-bbc7-17946f0ff2af · outbound

This paper cites Kimi Linear: An Expressive, Efficient Attention Architecture.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Kimi Linear: An Expressive, Efficient Attention Architecture

Reference 78

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.200768Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.200768Z digest=sha256:6c92688ed837f478136e8b52a47b97588d48278a3d5401e5e07b4615b6834b96

Observation 69380636-d526-4efb-baa6-b7f03c974c2a · outbound

This paper cites Qwen3.5-Omni Technical Report.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Qwen3.5-Omni Technical Report

Reference 79

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.203599Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.203599Z digest=sha256:91e5116bead8d8af2e0f43162981daeade79e5f4417a6fc707abb1015b45a616

Observation f7183d94-e7ab-4d8d-bdba-4e77f9bd0d92 · outbound

This paper cites Hunyuanvideo 1.5 technical report, 2025.https://arxiv.org/abs/2511.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Hunyuanvideo 1.5 technical report, 2025.https://arxiv.org/abs/2511

Reference 80

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.213747Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.213747Z digest=sha256:0130ce52d358b4b53805cbcc7f31b7eda53d34cfd810195977c610962d6cbc05

Observation 18c04200-4605-452c-ba69-7a8fc7bf8e82 · outbound

This paper cites Gomez, Lukasz Kaiser, and Illia Polosukhin.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Gomez, Lukasz Kaiser, and Illia Polosukhin

Reference 81

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.217148Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.217148Z digest=sha256:3a75d73a60f9bcef47558ba5ae529167bd8c5c5bc08deb99d6d04515cf55cf95

Observation 94a2fd28-715b-4fce-a1cb-909bf7fdcc05 · outbound

This paper cites Wan: Open and Advanced Large-Scale Video Generative Models.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Wan: Open and Advanced Large-Scale Video Generative Models

Reference 82

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.219923Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.219923Z digest=sha256:ba4b6afdff6be7171a32e407f1cbcf96c2d4c91adc58ee233e90c2dabc7e793c

Observation 5c8f58a3-e9c7-45a3-bd6f-16f0cc273bbd · outbound

This paper cites Lingen: Towards high-resolution minute-length text-to-video generation with linear computational complexity.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Lingen: Towards high-resolution minute-length text-to-video generation with linear computational complexity

Reference 83

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.223627Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.223627Z digest=sha256:a58a99a6e713c0e461c4ba07e3b08cb4202ee5de37cfbf0600918e508fcd1721

Observation b71a8927-3d4a-4512-9cbf-46e288aecc79 · outbound

This paper cites Auxiliary-Loss-Free Load Balancing Strategy for Mixture-of-Experts.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Auxiliary-Loss-Free Load Balancing Strategy for Mixture-of-Experts

Reference 84

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.227426Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.227426Z digest=sha256:649c01e74af3b2140256d7e5c52e6dc2601cf75164c1d0f40464733a0ce34120

Observation 945ca130-8d03-433a-b5ba-12e39e89a6d8 · outbound

This paper cites Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution

Reference 85

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.230561Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.230561Z digest=sha256:20e1daba4ed1caf1ad2934ff2a16ea25a4678ff3636b8be6660f3818bcbef813

Observation 5afe614a-3d6a-4bdf-8a7a-c838d0837cf8 · outbound

This paper cites Scaling laws, carefully.lilianweng.github.io, June 2026.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Scaling laws, carefully.lilianweng.github.io, June 2026

Reference 86

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.233526Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.233526Z digest=sha256:022ef46c8911b6d894e85386804bc5a1e9973616aadd7636fcee7640fde8c72e

Observation 18181547-990b-45f6-9678-de8b78d31882 · outbound

This paper cites Qwen-Image Technical Report.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Qwen-Image Technical Report

Reference 87

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.236568Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.236568Z digest=sha256:d06ff02fa1816e08fde2cdb5a9cdb8e8f9885eda067894f18c497173dff8dce0

Observation 7f634608-880a-4d02-b295-6ed5f131e32f · outbound

This paper cites VMoBA: Mixture-of-Block Attention for Video Diffusion Models.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers VMoBA: Mixture-of-Block Attention for Video Diffusion Models

Reference 88

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.239355Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.239355Z digest=sha256:2eebf81ee32ec940ab30a40f8e8b0297108d1baaa59a4636e6a2332cb52f1cef

Observation 9f33261d-732d-49fe-878b-39018db1bfa9 · outbound

This paper cites Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity

Reference 89

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.242540Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.242540Z digest=sha256:e49c4aac8edf5e3502991deb750682669a399df5ba10e028c7e6a5b58f9f2fbd

Observation 6d45c22b-788f-44f7-9d0b-50113234b865 · outbound

This paper cites mHC: Manifold-Constrained Hyper-Connections.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers mHC: Manifold-Constrained Hyper-Connections

Reference 90

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.245486Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.245486Z digest=sha256:636c97bf2268ccb5e8e1e70dc7fdf29af4ca4a8710d6675b9f5fbbfb9309ed25

Observation 63a96bc9-3167-463c-91a2-d6803eb34016 · outbound

This paper cites Qwen3 Technical Report.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Qwen3 Technical Report

Reference 91

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.248478Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.248478Z digest=sha256:fb8688550c796233c97800dbd37a365059fa707b3b880a34fc2f9f45d03894b3

Observation 87e6a1ac-b78f-4ea7-964a-0246e98ecbed · outbound

This paper cites Tuning large neural networks via zero-shot hyperparameter transfer.Advances in Neural Information Processing Systems, 34:17084–17097, 2021.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Tuning large neural networks via zero-shot hyperparameter transfer.Advances in Neural Information Processing Systems, 34:17084–17097, 2021

Reference 92

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.251304Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.251304Z digest=sha256:7b52e7e90ae095b38664eea0edaeb9366b0d938e696ad70ca72006dced2fa989

Observation f9cc9133-94d9-4698-a52f-d1cec4bca3cb · outbound

This paper cites Tensor Programs V: Tuning Large Neural Networks via Zero-Shot Hyperparameter Transfer.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Tensor Programs V: Tuning Large Neural Networks via Zero-Shot Hyperparameter Transfer

Reference 93

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.253839Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.253839Z digest=sha256:793d3d6f29734a1a084591495b088202357e0e917ddbdd354a9ec4390444d5f3

Observation 6e73d0fd-b071-4be4-b8bc-1c395b8298f9 · outbound

This paper cites Parallelizing linear transformers with the delta rule over sequence length.Advances in neural information processing systems, 37:115491–115522, 2024.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Parallelizing linear transformers with the delta rule over sequence length.Advances in neural information processing systems, 37:115491–115522, 2024

Reference 94

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.256882Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.256882Z digest=sha256:6aa39ded2bd205eb65891e21b404567c0c593f31b3b27b97b8d97f32ec724b0f

Observation 9828ea82-a305-4572-b5ab-f0574a808a06 · outbound

This paper cites Cogvideox: Text-to-videodiffusionmodelswithanexperttransformer.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Cogvideox: Text-to-videodiffusionmodelswithanexperttransformer

Reference 95

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.259508Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.259508Z digest=sha256:1c810a3769caabd3f42f454e3ff0c8d47ac1ee3a964821935e1d43f2f7356ba3

Observation 2002f6bb-7974-458f-918f-692d43cc7710 · outbound

This paper cites Pixeldit: Pixel diffusion transformers for image generation.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Pixeldit: Pixel diffusion transformers for image generation

Reference 96

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.262096Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.262096Z digest=sha256:7b5d3efaadf8d314f8a780344aa1ee4c3bc55d45b77a5ec4c7bc6af4c1415aaf

Observation 55100718-4c93-403c-94ee-f06d3b4153f6 · outbound

This paper cites Native sparse attention: Hardware-aligned and natively trainable sparse attention.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Native sparse attention: Hardware-aligned and natively trainable sparse attention

Reference 97

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.265084Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.265084Z digest=sha256:0161961f22ac8cd73ef352a009df0ec9d926869270fafb481c6f9e815e0a1980

Observation d12d853a-dc80-4086-a18f-c623c53a8907 · outbound

This paper cites Bidirectional sparse attention for faster video diffusion training.arXiv preprint arXiv:2509.01085, 2025.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Bidirectional sparse attention for faster video diffusion training.arXiv preprint arXiv:2509.01085, 2025

Reference 98

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.267705Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.267705Z digest=sha256:6a6fbbb4a6e60e5027b2b7500f77945b3d393ca6af4941e14869cc0aeecb1d66

Observation fc1da28f-177a-49d9-83a5-abc89bf29834 · outbound

This paper cites KnapFormer: An Online Load Balancer for Efficient Diffusion Transformers Training.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers KnapFormer: An Online Load Balancer for Efficient Diffusion Transformers Training

Reference 99

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.270116Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.270116Z digest=sha256:436f0d3db942c08fc5f543261c29e5bf3de492d0e4cf49430eef650bc8f20902

Observation a50d4019-bb90-4f5f-a6af-cf9dcc048071 · outbound

This paper cites Faster video diffusion with trainable sparse attention.Advances in Neural Information Processing Systems, 38:152509–152534, 2026.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Faster video diffusion with trainable sparse attention.Advances in Neural Information Processing Systems, 38:152509–152534, 2026

Reference 100

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.272881Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.272881Z digest=sha256:8967d4a7f3e49b5e9d31ebd2e93910717300bc28f95d7f5268d8234983d5dbe7

Observation c1480be5-84c7-4953-8ea8-a5de0a860c4a · outbound

This paper cites PyTorch FSDP: Experiences on Scaling Fully Sharded Data Parallel.

Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers PyTorch FSDP: Experiences on Scaling Fully Sharded Data Parallel

Reference 101

Resolution
unresolved
no resolver link, observed 2026-07-31T02:16:08.275374Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T02:16:08.275374Z digest=sha256:baed2a80d7e428e21b8f9496e86cab1d63b04ca5b74b837061197ed9a5055406

Pith citing papers

No inbound Pith citation observations are available.