Pith. sign in

Paper Citation Record · LEDGER

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer

As of 21 August 2026, this Paper Citation Record lists 100 of 135 outbound references and 0 inbound Pith citation observations for arXiv:2511.19778.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2511.19778 v2

Coverage vector

measured 100 of 135 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-03T20:30:36.333846Z

measured 100 of 100 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-21T06:32:19.484+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

100 of 135 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved100
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation e0ed16a2-9d31-49cf-b141-03222a006b78 · outbound

This paper cites Approximate caching for efficiently serving{Text- to-Image}diffusion models.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Approximate caching for efficiently serving{Text- to-Image}diffusion models

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:24.833693Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:24.833693Z digest=sha256:2c773b2fa7fbec43c2f22129632b5eb81746369861ec0dd71d6e3fd9f4f3329f

Observation c2c081a3-c18f-4e9e-b510-7261d594a3c4 · outbound

This paper cites Qwen Technical Report.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Qwen Technical Report

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:25.011626Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:25.011626Z digest=sha256:5524bb6536f5c3125f78e511ca00b08b5b1ba5977876a32fb607c76f8d19dac4

Observation aa9bb1a7-4d87-4e78-8034-93c7bed08129 · outbound

This paper cites Round and Round We Go! What makes Rotary Positional Encodings useful?.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Round and Round We Go! What makes Rotary Positional Encodings useful?

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:25.133281Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:25.133281Z digest=sha256:5c944d2c053fa03cd2e8184c96393b98a6209657dab65c4433f3dd9192563e6b

Observation 2efe5917-de46-40db-b023-e781c87f8ed6 · outbound

This paper cites Gpt-neox- 20b: An open-source autoregressive language model.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Gpt-neox- 20b: An open-source autoregressive language model

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:25.270630Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:25.270630Z digest=sha256:f7b09430fe320c5d9180256f3f2a016240510dca0798c11570bbaef1d6415781

Observation 38a6f7a2-ce87-4135-a3e1-9e8cedbec33d · outbound

This paper cites Taehv: Tiny autoencoder for hun- yuan video.https://github.com/madebyollin/ taehv, 2025.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Taehv: Tiny autoencoder for hun- yuan video.https://github.com/madebyollin/ taehv, 2025

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:25.374663Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:25.374663Z digest=sha256:f37db77de485e62fca7fa2434fd0f9d910bae570898e3700d34a172a9ff4f0e1

Observation 84d0ef3f-e380-4dff-907d-7793c0119df1 · outbound

This paper cites Token merging for fast stable diffusion.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Token merging for fast stable diffusion

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:25.474450Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:25.474450Z digest=sha256:03157d442cdcc7210b4abc627c37365799e95f192603037de292f9bd0329bcb1

Observation 31ce9347-3152-4476-ac1a-c3bc083815f6 · outbound

This paper cites Ld-pruner: Efficient pruning of latent diffusion models using task-agnostic insights.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Ld-pruner: Efficient pruning of latent diffusion models using task-agnostic insights

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:25.577343Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:25.577343Z digest=sha256:97668359fc49193946b5b18a1c0cfc42c1e769d74590d369c55a999db4b03cf0

Observation ca16a58b-01ce-48d4-86ac-e5d416c99c65 · outbound

This paper cites Sparsedit: Token sparsification for efficient diffusion transformer.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Sparsedit: Token sparsification for efficient diffusion transformer

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:25.675140Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:25.675140Z digest=sha256:f542711261659bd0b96b3e1af6dec00c01b7e0828d5c42ebe7d22edd38be30f9

Observation 670e1e22-1ba3-45d4-9538-933145eea156 · outbound

This paper cites Pixart-α: Fast train- ing of diffusion transformer for photorealistic text-to-image synthesis, 2023.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Pixart-α: Fast train- ing of diffusion transformer for photorealistic text-to-image synthesis, 2023

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:25.756515Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:25.756515Z digest=sha256:c09041fa5c300a2303f8286b8c7c3f780d2cc63bbfc51eb7c8f5e2371dc4dc9c

Observation 1e56d59a-441a-46ac-8d52-72f3086b835e · outbound

This paper cites Q-dit: Ac- curate post-training quantization for diffusion transformers.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Q-dit: Ac- curate post-training quantization for diffusion transformers

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:25.852747Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:25.852747Z digest=sha256:790b55635a8fb88053b7542ff55fca464541737f86108e630dc3c92f56015fdd

Observation a6fdde84-867f-4e05-ab22-9d113dcf9426 · outbound

This paper cites $\Delta$-DiT: A Training-Free Acceleration Method Tailored for Diffusion Transformers.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer $\Delta$-DiT: A Training-Free Acceleration Method Tailored for Diffusion Transformers

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:25.973804Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:25.973804Z digest=sha256:65fa11e9e85d8ead72584c0974e97892bc0c1959b0bc825e38e9c0802ff6615e

Observation 5588daa0-1b4c-4c7b-a408-50218720e742 · outbound

This paper cites Sparse-vDiT: Unleashing the Power of Sparse Attention to Accelerate Video Diffusion Transformers.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Sparse-vDiT: Unleashing the Power of Sparse Attention to Accelerate Video Diffusion Transformers

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:26.075671Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:26.075671Z digest=sha256:de7cf97b852211e9a057746e77cb22cd40795ce96b91c9602492b77676cc5d4f

Observation 7c6ec55f-e690-4746-8d72-58c0828834fb · outbound

This paper cites Extending Context Window of Large Language Models via Positional Interpolation.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Extending Context Window of Large Language Models via Positional Interpolation

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:26.189555Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:26.189555Z digest=sha256:631e6c6360caaabf9be791710325979361216656635c23b3543fceeed1bde541

Observation a2e19cb9-4de0-4135-ac68-b011db4bdc88 · outbound

This paper cites Edt: An efficient diffusion transformer frame- work inspired by human-like sketching.Advances in Neu- ral Information Processing Systems, 37:134075–134106,.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Edt: An efficient diffusion transformer frame- work inspired by human-like sketching.Advances in Neu- ral Information Processing Systems, 37:134075–134106,

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:26.361776Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:26.361776Z digest=sha256:aacedfd331f2520862951f1c19286c9c0ed9a0f1509868f85313af17475b06be

Observation 4e29edbd-83ab-4221-b045-18cc10660614 · outbound

This paper cites an unresolved cited work.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Unresolved cited work

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:26.473632Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:26.473632Z digest=sha256:61c3a2774f9c1f64ce4727c17c9d3f89c6e2c64936e3ff047a1fe58a1f70bc19

Observation 872c2f40-386c-4e93-911d-6117ec0833da · outbound

This paper cites Palm: Scaling language modeling with pathways.Journal of Machine Learning Research, 24(240): 1–113, 2023.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Palm: Scaling language modeling with pathways.Journal of Machine Learning Research, 24(240): 1–113, 2023

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:26.567061Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:26.567061Z digest=sha256:1cbe1971a98bdb0a248eac433e4e3ed073ac27c738c7422262b3750eb6b8e3b2

Observation e6c34b0e-8c19-4989-9c03-71af22d830fa · outbound

This paper cites A deep multi-level network for saliency prediction.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer A deep multi-level network for saliency prediction

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:26.674812Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:26.674812Z digest=sha256:b755947311e58fe59b8c6571e59ad7f94ac39082d7e16b8df864013735cf03b3

Observation 144134a0-3b22-49fa-87ea-4ea9766ce396 · outbound

This paper cites Predicting human eye fixations via an lstm- based saliency attentive model.IEEE Transactions on Im- age Processing, 27(10):5142–5154, 2018.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Predicting human eye fixations via an lstm- based saliency attentive model.IEEE Transactions on Im- age Processing, 27(10):5142–5154, 2018

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:26.844453Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:26.844453Z digest=sha256:d1726e700ce6d1473a1d5e44cd48808a24abd2d648b9171d67476d9c17156aef

Observation 68c5359b-fe50-4902-bf35-f223422e013d · outbound

This paper cites Scalable high-resolution pixel-space image syn- thesis with hourglass diffusion transformers.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Scalable high-resolution pixel-space image syn- thesis with hourglass diffusion transformers

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:26.960316Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:26.960316Z digest=sha256:20a80770b7816d0c94b918898576f337798b989103814607c3af4be8d97c8b6a

Observation 1068bbf4-d072-40c3-be15-91da4d90bc12 · outbound

This paper cites Vq4dit: Efficient post-training vec- tor quantization for diffusion transformers.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Vq4dit: Efficient post-training vec- tor quantization for diffusion transformers

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:27.078408Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:27.078408Z digest=sha256:262b008d146f381ceaa073cff3e251afe02dc25ede80280f7d2899825f253710

Observation 0a79e3c5-740c-42e9-a757-22671dbc3bd5 · outbound

This paper cites LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:27.187880Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:27.187880Z digest=sha256:ab1b59e5865482a2b6a366aeb9d3a229a21455c0e5c49a21cbc6c20e597139c5

Observation cf80460a-6c2b-48bc-a018-62cc57746575 · outbound

This paper cites Patched denoising diffusion models for high-resolution im- age synthesis.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Patched denoising diffusion models for high-resolution im- age synthesis

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:27.347342Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:27.347342Z digest=sha256:416763d6d22b92d5580f66a2e3ec3f1ae7ac38d9c9eb05d2a7fa7ba00a7f343b

Observation 36ffeeff-54bb-4c40-b31b-26a1052cbebb · outbound

This paper cites An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:27.468116Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:27.468116Z digest=sha256:9226029d4c806591ac60cafa6c6e836ac43a5850775b33d8b73deda06469c497

Observation 4f8fe5bc-c994-4e68-8217-1287edfd8125 · outbound

This paper cites Fewer denoising steps or cheaper per-step inference: Towards compute-optimal dif- fusion model deployment.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Fewer denoising steps or cheaper per-step inference: Towards compute-optimal dif- fusion model deployment

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:27.616912Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:27.616912Z digest=sha256:c8a6b5e1791d88d60daa6e4803060c366f3adae940d238b0436cc72f9cfe001b

Observation 9409960e-5c80-44f4-b2e3-08d5520fc90d · outbound

This paper cites The llama 3 herd of models.arXiv e-prints, pages arXiv–2407,.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer The llama 3 herd of models.arXiv e-prints, pages arXiv–2407,

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:27.742484Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:27.742484Z digest=sha256:9399be3e135d049719c15641d6bdad717da0782954d64f7053bfb11d559ef3e6

Observation 17a3f926-b427-4a27-b36b-947dcb1dde41 · outbound

This paper cites Scaling recti- fied flow transformers for high-resolution image synthesis.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Scaling recti- fied flow transformers for high-resolution image synthesis

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:27.877245Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:27.877245Z digest=sha256:d480ceaa9919c1ec2859539d88db3d2644e9acad5331ab07ca83c8f74ff91831

Observation d9dd0a1b-53a7-4b98-ace5-bdb50f1fdf4d · outbound

This paper cites Structural pruning for diffusion models.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Structural pruning for diffusion models

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:27.935055Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:27.935055Z digest=sha256:b0e40e2afa308613f07098d6770dc23e161fdcc7e1989627874b6fb3a19b2a60

Observation 0187e7f4-e393-4e2b-a618-cf7c7bfdd613 · outbound

This paper cites Tinyfusion: Diffusion transformers learned shallow.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Tinyfusion: Diffusion transformers learned shallow

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:28.092684Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:28.092684Z digest=sha256:b7921ba170bf76f79b58172af3683f6ac5ac92e6b42c5918d051ca6a88b4277d

Observation ed0d0cab-40ff-4c6f-ab86-bf5d9103ce55 · outbound

This paper cites Video Diffusion Transformers are In-Context Learners.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Video Diffusion Transformers are In-Context Learners

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:28.157199Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:28.157199Z digest=sha256:515bd5fe015aa019a50b1ca9c277a3b60529faebd4964d214ab3f94e38301588

Observation d81bacbe-e3e6-48fd-9f36-fc2aa6052c75 · outbound

This paper cites Relational diffu- sion distillation for efficient image generation.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Relational diffu- sion distillation for efficient image generation

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:28.232564Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:28.232564Z digest=sha256:8a68c83273302b35c2537299024bc0ee194b767eba225e5cef6f160f71a05acd

Observation a5a37270-357e-45f6-892d-a32495f68057 · outbound

This paper cites Romantex: Decoupling 3d-aware rotary positional embedded multi-attention network for texture synthesis.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Romantex: Decoupling 3d-aware rotary positional embedded multi-attention network for texture synthesis

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:28.337950Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:28.337950Z digest=sha256:38052e7c910cf69a25a7cb60403ed606918d02bfc5272c4f94ccd25e2367b44f

Observation 8a365291-68ac-4f21-8736-ccee511e7369 · outbound

This paper cites Not All Prompts Are Made Equal: Prompt-based Pruning of Text-to-Image Diffusion Models.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Not All Prompts Are Made Equal: Prompt-based Pruning of Text-to-Image Diffusion Models

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:28.408897Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:28.408897Z digest=sha256:b5c6fae25da2a819206c051d02b1d0735d6d3c3c828cc930c715cd3aac446ef9

Observation 2ba9d8a4-e317-4b8a-bc94-b20cffabb96b · outbound

This paper cites DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:28.476861Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:28.476861Z digest=sha256:4addd7ca09f8ae77bf6593e7efee5081503d0c18fc4399a4dd987521f7329785

Observation 8d5f83e2-0f82-4020-9611-f12717be5033 · outbound

This paper cites LTX-Video: Realtime Video Latent Diffusion.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer LTX-Video: Realtime Video Latent Diffusion

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:28.542128Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:28.542128Z digest=sha256:f09e1c24a34962f939bbd651dcb68d24e8de9e6421d0524a65534cb528cf3c3b

Observation 546baabb-291c-4beb-bd2d-f8ad39a5b053 · outbound

This paper cites Graph- based visual saliency.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Graph- based visual saliency

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:28.619373Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:28.619373Z digest=sha256:91b9ac1862c6e9bc2e6ca436e9ab7ddf51a2c679af45cc3fbcdb04f5d15776aa

Observation ccf80bf4-4d0b-4e9c-92a2-83feb7839497 · outbound

This paper cites Rotary position embedding for vision transformer.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Rotary position embedding for vision transformer

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:28.677368Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:28.677368Z digest=sha256:a484c9b09063f46e30459d114969f161101b5dffadb95c1b0eb3f67450cf734a

Observation 77187c48-5a48-49e2-b234-0c0a8b8d999d · outbound

This paper cites Gans trained by a two time-scale update rule converge to a local nash equilib- rium.Advances in neural information processing systems, 30, 2017.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Gans trained by a two time-scale update rule converge to a local nash equilib- rium.Advances in neural information processing systems, 30, 2017

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:28.755185Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:28.755185Z digest=sha256:87f312fe570e9cbbe2ddfe84089c839e78843d84ce79499c9ad5cf6604040f70

Observation 248eea44-bdfb-4dfe-ad25-52c4dc642e16 · outbound

This paper cites Cascaded diffusion models for high fidelity image generation.Jour- nal of Machine Learning Research, 23(47):1–33, 2022.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Cascaded diffusion models for high fidelity image generation.Jour- nal of Machine Learning Research, 23(47):1–33, 2022

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:28.842221Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:28.842221Z digest=sha256:2d8a1a0bd166192bbfc1f6985a251f7ca5c0032928013830f4bbd19f5c9a2e3c

Observation 5f8f55c7-5e8a-455f-8e41-d7806714a872 · outbound

This paper cites Vbench: Comprehensive benchmark suite for video generative models.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Vbench: Comprehensive benchmark suite for video generative models

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:29.000662Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:29.000662Z digest=sha256:8b9847fbcd2c959dd5217927fc3a928ccc9e11dea494e41361a5e1c4ff46a534

Observation 7295cc68-5800-4810-a296-ca5e52085c6c · outbound

This paper cites A model of saliency-based visual attention for rapid scene analysis.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer A model of saliency-based visual attention for rapid scene analysis

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:29.142233Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:29.142233Z digest=sha256:f411c87b81baeb1997235f6563f7118a86f0f8554b1ef88661ac88ee2b246d6b

Observation c86b0e01-4133-4ba2-96df-7212a577672b · outbound

This paper cites Latent space super-resolution for higher-resolution image generation with diffusion models.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Latent space super-resolution for higher-resolution image generation with diffusion models

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:29.326199Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:29.326199Z digest=sha256:8d51ca3bb92e338d860409da0bef285c0d348b5562af9f2a6305a7d472197765

Observation 280e60da-f509-4285-a385-804752bfedb4 · outbound

This paper cites Upsample what matters: Region-adaptive latent sampling for accelerated diffusion transformers.arXiv preprint arXiv:2507.08422, 2025.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Upsample what matters: Region-adaptive latent sampling for accelerated diffusion transformers.arXiv preprint arXiv:2507.08422, 2025

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:29.575894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:29.575894Z digest=sha256:6ee7616e54120818d2a4dfd00924dce65a1996f5ee2da10e70df0b2e35537007

Observation 2fa753cc-1c5f-4ee9-a9b7-a183b32eb2bd · outbound

This paper cites Eml-net: An expandable multi- layer network for saliency prediction.Image and vision computing, 95:103887, 2020.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Eml-net: An expandable multi- layer network for saliency prediction.Image and vision computing, 95:103887, 2020

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:29.715927Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:29.715927Z digest=sha256:4fb4586df599694c2137882348d4d6784f48de91ceac38ee88a9a181795859bc

Observation d1937e08-c35d-4c47-972b-112590eb5f54 · outbound

This paper cites Salicon: Saliency in context.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Salicon: Saliency in context

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:29.858636Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:29.858636Z digest=sha256:64c00171c88cea350ec6a7a986e94f666c074fe33ccffbae6173171dd0143076

Observation 0ceca32e-d177-4023-9dfa-0cf33affaaf4 · outbound

This paper cites Pyramidal flow matching for efficient video generative modeling.arXiv preprint arXiv:2410.05954,.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Pyramidal flow matching for efficient video generative modeling.arXiv preprint arXiv:2410.05954,

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:29.974815Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:29.974815Z digest=sha256:9d409b92cdbb9950ea26a9cfa84754771964548e3fe7f4fcd6a9d9f3dbd1e1ba

Observation 3d7befc1-7629-43f3-bd81-ddfde1b206e1 · outbound

This paper cites Adaptive caching for faster video generation with dif- fusion transformers.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Adaptive caching for faster video generation with dif- fusion transformers

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:30.112218Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:30.112218Z digest=sha256:b1494fa46280cf4a8993bd40ccfcd062de37c530212d9dfa4d7944c84f2f8f89

Observation e1e05970-e027-4bbb-b696-698472925ad3 · outbound

This paper cites Musiq: Multi-scale image quality transformer.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Musiq: Multi-scale image quality transformer

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:30.344863Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:30.344863Z digest=sha256:7274fff30df3960b0a2253a1aabae1aeb18cf077efd5cb55755523e01991572d

Observation 0d4714d8-7548-4eb4-b333-afe636b7e11e · outbound

This paper cites A nonparametric approach to bottom- 10 up visual saliency.Advances in neural information process- ing systems, 19, 2006.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer A nonparametric approach to bottom- 10 up visual saliency.Advances in neural information process- ing systems, 19, 2006

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:30.498070Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:30.498070Z digest=sha256:200ba8d1e2bc30e8a126f0fed9568dba2c66a843d1455421165f5f369e0c5045

Observation 600f4bfc-e528-40ef-b9f0-4f55c436e1a5 · outbound

This paper cites Diffusehigh: Training-free progressive high- resolution image synthesis through structure guidance.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Diffusehigh: Training-free progressive high- resolution image synthesis through structure guidance

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:30.577184Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:30.577184Z digest=sha256:c8e6d02aa0cb28061876b7d3929b982468992ebb9eac78ce724a63c860ace520

Observation 5a831529-3082-4b98-8607-96844a6a58f2 · outbound

This paper cites Imagenet classification with deep convolutional neural net- works.Advances in neural information processing systems, 25, 2012.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Imagenet classification with deep convolutional neural net- works.Advances in neural information processing systems, 25, 2012

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:30.724201Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:30.724201Z digest=sha256:954fe21f934d1441de8363ac46d6f676fe9558a43a9024cc38b73018f50e6ff0

Observation d04ba5e9-6847-447a-a7d8-02b12a54dd91 · outbound

This paper cites Deepfix: A fully convolutional neural network for predicting human eye fixations.IEEE Transactions on Im- age Processing, 26(9):4446–4456, 2017.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Deepfix: A fully convolutional neural network for predicting human eye fixations.IEEE Transactions on Im- age Processing, 26(9):4446–4456, 2017

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:30.874020Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:30.874020Z digest=sha256:19dc7ed0c87f03afad3e6a8e43a0b195132783a243f45b14ae6dc8d4193c50f0

Observation 2ae04c54-a66e-4d87-b5fe-70fcc2d615c1 · outbound

This paper cites Deep Gaze I: Boosting Saliency Prediction with Feature Maps Trained on ImageNet.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Deep Gaze I: Boosting Saliency Prediction with Feature Maps Trained on ImageNet

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:30.977927Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:30.977927Z digest=sha256:47015138a9cf80fb0a822bc4560be7f280fd913c479981a8d71a4cab0b43a594

Observation fac82765-f947-49f6-b157-68ea30780dc9 · outbound

This paper cites Flux.1 kontext: Flow matching for in-context image generation and editing in latent space, 2025.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Flux.1 kontext: Flow matching for in-context image generation and editing in latent space, 2025

Reference 53

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:31.131369Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:31.131369Z digest=sha256:d417531d40266d94ee19c19fba810378289d34ad55069bf213565201883ef657

Observation e89e2380-e22a-43ab-8d62-db81ad126e7e · outbound

This paper cites Efficient Scaling of Diffusion Transformers for Text-to-Image Generation.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Efficient Scaling of Diffusion Transformers for Text-to-Image Generation

Reference 54

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:31.258053Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:31.258053Z digest=sha256:6fb00180e1b0bb9f022cc119ed47614db067913dc0a442c5a93a5f3194680794

Observation c4fe7fb6-23de-4a0f-bf49-78cbefad256a · outbound

This paper cites Svdquant: Absorbing outliers by low- rank components for 4-bit diffusion models.arXiv preprint arXiv:2411.05007, 2024.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Svdquant: Absorbing outliers by low- rank components for 4-bit diffusion models.arXiv preprint arXiv:2411.05007, 2024

Reference 55

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:31.362208Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:31.362208Z digest=sha256:59856c2f0781033dbe18b5657e7342fdead63a9a1b0115bc7df38dcce9322c28

Observation 82cc4082-8d26-4b12-81c4-ecef451579e8 · outbound

This paper cites Snapfusion: Text-to-image diffusion model on mobile de- vices within two seconds.Advances in Neural Information Processing Systems, 36:20662–20678, 2023.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Snapfusion: Text-to-image diffusion model on mobile de- vices within two seconds.Advances in Neural Information Processing Systems, 36:20662–20678, 2023

Reference 56

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:31.537494Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:31.537494Z digest=sha256:74a3c60a78d51aaf6453ef2c0278fa1263c58a27815528324885c8dd997f2c2a

Observation 001e6a19-564b-40af-aef8-eb00406fd66b · outbound

This paper cites Hunyuan-DiT: A Powerful Multi-Resolution Diffusion Transformer with Fine-Grained Chinese Understanding.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Hunyuan-DiT: A Powerful Multi-Resolution Diffusion Transformer with Fine-Grained Chinese Understanding

Reference 57

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:31.643191Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:31.643191Z digest=sha256:7710f529de1b506a256311c90766067eb53bd31bb88722ab297523696cfa8530

Observation f325ef30-433a-4cfe-a48a-9486290203bc · outbound

This paper cites Microsoft coco: Common objects in context.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Microsoft coco: Common objects in context

Reference 58

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:31.827071Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:31.827071Z digest=sha256:6252a8604a314ffd6cc22d28912e71c48bc0222bb42a893c96da068cb891b4f6

Observation 20da9d7f-3dea-4ca2-9fd8-cdbd06dac9af · outbound

This paper cites Deepgaze iie: Calibrated prediction in and out-of-domain for state-of-the-art saliency modeling.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Deepgaze iie: Calibrated prediction in and out-of-domain for state-of-the-art saliency modeling

Reference 59

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:31.894657Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:31.894657Z digest=sha256:8afa8ca34b42300c87d43908c4a9c7b77de6847d87e52c7323bdca2e71735fdd

Observation 33e8180f-4855-4242-861a-8623b62671ea · outbound

This paper cites Deepgaze iie: Calibrated prediction in and out-of-domain for state-of-the-art saliency modeling.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Deepgaze iie: Calibrated prediction in and out-of-domain for state-of-the-art saliency modeling

Reference 60

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:32.054671Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:32.054671Z digest=sha256:1b823d308f718c1a38f1c4ed1383c6dbf9c8541fa2bffbb791be0f5064f987cb

Observation 3ca96e00-8c93-4b9f-b8a6-b616f38bb42b · outbound

This paper cites Timestep embedding tells: It’s time to cache for video diffusion model.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Timestep embedding tells: It’s time to cache for video diffusion model

Reference 61

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:32.092733Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:32.092733Z digest=sha256:e97693e73080ebcd84fe57e5cdf426719e7fa530e942d8c776b4f76c17f8bb1e

Observation 03de78ed-b131-443d-8cea-80a3517d048e · outbound

This paper cites A deep spatial contextual long- term recurrent convolutional network for saliency detec- tion.IEEE Transactions on Image Processing, 27(7):3264– 3274, 2018.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer A deep spatial contextual long- term recurrent convolutional network for saliency detec- tion.IEEE Transactions on Image Processing, 27(7):3264– 3274, 2018

Reference 62

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:32.157068Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:32.157068Z digest=sha256:549a5002436644cd378e6e27963689db2309b0e0dc9b0233a244f675399905d0

Observation e5405504-91a3-4605-9e65-3464cc9dbd0b · outbound

This paper cites Region-adaptive sampling for diffusion transformers.arXiv preprint arXiv:2502.10389, 2025.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Region-adaptive sampling for diffusion transformers.arXiv preprint arXiv:2502.10389, 2025

Reference 63

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:32.329297Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:32.329297Z digest=sha256:b3135b95276b3f4c0d97f2eff2a806b2d665f9e5742b86e81ec80608b962d5a3

Observation 6afdf2cb-377b-4aa2-b498-c065d578fc41 · outbound

This paper cites Transalnet: Towards perceptually relevant visual saliency prediction.Neurocomputing, 494:455–467,.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Transalnet: Towards perceptually relevant visual saliency prediction.Neurocomputing, 494:455–467,

Reference 64

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:32.449314Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:32.449314Z digest=sha256:be7525eea7fe7ba0f2355d312567930d04c3b54acf9997feacf159acec54cfc0

Observation b586c417-93e3-4c4e-9dc5-9649d0600ded · outbound

This paper cites Token caching for diffusion transformer accel- eration.arXiv preprint arXiv:2409.18523, 2024.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Token caching for diffusion transformer accel- eration.arXiv preprint arXiv:2409.18523, 2024

Reference 65

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:32.551857Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:32.551857Z digest=sha256:5ae1cde29ae0ebe083407142d55354f2e77a505c7e42d70354666621bc484916

Observation 89ea124f-8d33-4c80-aa5a-6eb4ed223bad · outbound

This paper cites Dpm-solver: A fast ode solver for diffu- sion probabilistic model sampling in around 10 steps.Ad- vances in neural information processing systems, 35:5775– 5787, 2022.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Dpm-solver: A fast ode solver for diffu- sion probabilistic model sampling in around 10 steps.Ad- vances in neural information processing systems, 35:5775– 5787, 2022

Reference 66

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:32.627689Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:32.627689Z digest=sha256:5b0681479bae5a93e48de4c6a759fe28e388335f65666d3192b104105dba549d

Observation df1ce7f7-9112-4057-83da-c3de12473991 · outbound

This paper cites Dpm-solver++: Fast solver for guided sampling of diffusion probabilistic models.Machine Intel- ligence Research, pages 1–22, 2025.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Dpm-solver++: Fast solver for guided sampling of diffusion probabilistic models.Machine Intel- ligence Research, pages 1–22, 2025

Reference 67

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:32.746814Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:32.746814Z digest=sha256:5837bd303efa66298fbdc6413713b98ec5ddaeff39d2fbea7cf8c389ba2f3611

Observation f64126a2-b27a-449b-8818-07cfecbbca4b · outbound

This paper cites FiT: Flexible Vision Transformer for Diffusion Model.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer FiT: Flexible Vision Transformer for Diffusion Model

Reference 68

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:32.838768Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:32.838768Z digest=sha256:6344eb3fb37edbc9ed69ac015b9f2d4d3680d57b3a6dc5ba149f6fdb90b33413

Observation 0d3fdb25-7947-4c8d-a7b7-cb140fa83d97 · outbound

This paper cites Latent Consistency Models: Synthesizing High-Resolution Images with Few-Step Inference.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Latent Consistency Models: Synthesizing High-Resolution Images with Few-Step Inference

Reference 69

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:32.920590Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:32.920590Z digest=sha256:fd4a8d7e19cb7a2dd93e222dee374bb26793d4cd276f283629da2f2031079a72

Observation 883b67b1-ee34-4df6-95a6-472c4a70a443 · outbound

This paper cites FasterCache: Training-Free Video Diffusion Model Acceleration with High Quality.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer FasterCache: Training-Free Video Diffusion Model Acceleration with High Quality

Reference 70

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:32.981278Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:32.981278Z digest=sha256:f317d0721588cc25d505ee9de9c54e72d7ca0b7487e9e22a6c109e1fc9bd84a4

Observation ee4ec104-5a3d-4396-8999-cca2cc647b36 · outbound

This paper cites Video saliency forecasting transformer.IEEE transactions on circuits and systems for video technology, 32(10):6850–6862, 2022.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Video saliency forecasting transformer.IEEE transactions on circuits and systems for video technology, 32(10):6850–6862, 2022

Reference 71

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:33.030512Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:33.030512Z digest=sha256:785abe1d60ebafe6e96445598a586a9ec81708d0dd7eff56517879d26c580c98

Observation 98cc296d-39f4-4339-b1be-0c7cea862a45 · outbound

This paper cites Learning-to-cache: Accelerating diffusion trans- former via layer caching.Advances in Neural Information Processing Systems, 37:133282–133304, 2024.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Learning-to-cache: Accelerating diffusion trans- former via layer caching.Advances in Neural Information Processing Systems, 37:133282–133304, 2024

Reference 72

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:33.116605Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:33.116605Z digest=sha256:60b68464759c500c0640300b9e8a5c0ac47b3eea9223deb85bcfec1c1d34a330

Observation 01d30cb4-c66b-4087-a6b1-a0e62464c120 · outbound

This paper cites Deepcache: Accelerating diffusion models for free.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Deepcache: Accelerating diffusion models for free

Reference 73

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:33.252340Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:33.252340Z digest=sha256:655da7fbe9128e39eda5e3766218b4cd13c09f5c7d9c8e8fa87bb23cc49294a5

Observation 484e2779-171b-4140-b1c7-e6fe2678e603 · outbound

This paper cites Latte: Latent Diffusion Transformer for Video Generation.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Latte: Latent Diffusion Transformer for Video Generation

Reference 74

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:33.319218Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:33.319218Z digest=sha256:956b4f6776380f6e4d15aa0277c0ce5f2ba99869a754f236e9ba24a7301fd55a

Observation d25ffed7-2d32-4c7c-b8a8-4693e20ad475 · outbound

This paper cites Magcache: Fast video generation with magnitude- aware cache.arXiv preprint arXiv:2506.09045, 2025.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Magcache: Fast video generation with magnitude- aware cache.arXiv preprint arXiv:2506.09045, 2025

Reference 75

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:33.426515Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:33.426515Z digest=sha256:13813bd3465a3f506e7f0f6fd24461e81e0438dc7262a6ad5d801d2aadad9d19

Observation a7c2cf35-981b-40a3-b56e-b167401d6275 · outbound

This paper cites LieRE: Lie Rotational Positional Encodings.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer LieRE: Lie Rotational Positional Encodings

Reference 76

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:33.510808Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:33.510808Z digest=sha256:166d9c67697dd21ec8a02b7f4b725f5f8d7b897bd9461097d075d769d0090c8f

Observation dc8b98ff-ce4a-4a2d-bcd6-fa3ad6a06555 · outbound

This paper cites Scalable diffusion mod- els with transformers.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Scalable diffusion mod- els with transformers

Reference 77

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:33.662966Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:33.662966Z digest=sha256:7ee8705f09eb2601cebe66087c9776c809a3d829e66e7c4442699558fb4da78d

Observation 3f0bc936-b6ed-40cb-b2bc-96eb100559d9 · outbound

This paper cites Ntk-aware scaled rope allows llama models to have extended (8k+) context size without any fine-tuning and minimal perplexity degrada- tion, 2023.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Ntk-aware scaled rope allows llama models to have extended (8k+) context size without any fine-tuning and minimal perplexity degrada- tion, 2023

Reference 78

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:33.839699Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:33.839699Z digest=sha256:4a7d4cb5f6b5093594358a50771a37edda595f9a5d65bff9834f01c8181deabb

Observation 7acbadee-78d0-4b3e-ab79-71a90e569547 · outbound

This paper cites YaRN: Efficient Context Window Extension of Large Language Models.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer YaRN: Efficient Context Window Extension of Large Language Models

Reference 79

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:33.948881Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:33.948881Z digest=sha256:5948fd13da5e630ed4b440da25e101a23796f75c6dd2077b77f39c87de35e941

Observation 4381c461-4fd7-47eb-bc14-b5188c581c79 · outbound

This paper cites Wuerstchen: An Efficient Architecture for Large-Scale Text-to-Image Diffusion Models.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Wuerstchen: An Efficient Architecture for Large-Scale Text-to-Image Diffusion Models

Reference 80

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:34.111709Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:34.111709Z digest=sha256:9e41cc9dab7de58fb572520afc76bc31b56fb88078a4cc1aac011d4a43f62e52

Observation 3713926a-4465-4e44-9092-995673139acc · outbound

This paper cites SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis

Reference 81

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:34.229570Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:34.229570Z digest=sha256:612ec7dae979ac4673f145a808eeabfb5dc5006ecbabc92630f1d6bead9d8777

Observation da37359e-8e51-42a0-a18e-aead4df6f9cc · outbound

This paper cites Video motion transfer with diffusion transformers.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Video motion transfer with diffusion transformers

Reference 82

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:34.306733Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:34.306733Z digest=sha256:dbced9ea9ac1526d3f9842f40d384a48bca0a8fbd9af9e5f505b685142cafed2

Observation bc663ef4-c0fc-4c63-8195-2921165c76cd · outbound

This paper cites Train Short, Test Long: Attention with Linear Biases Enables Input Length Extrapolation.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Train Short, Test Long: Attention with Linear Biases Enables Input Length Extrapolation

Reference 83

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:34.416673Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:34.416673Z digest=sha256:f8014c3a9bf2a888585a26e8f092b9ed20394d89ea5f7f4945dd056b62d13f91

Observation 13039da8-6b1c-4595-a602-72480932028e · outbound

This paper cites CineScale: Free Lunch in High-Resolution Cinematic Visual Generation.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer CineScale: Free Lunch in High-Resolution Cinematic Visual Generation

Reference 84

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:34.493567Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:34.493567Z digest=sha256:74bb9e3dc2f0edbd55810803cf31c160de9dc57d6c5436f11b6fc09997208fe0

Observation 89bab8a5-c88d-46ef-844a-89cf0a7fa820 · outbound

This paper cites Freescale: Unleashing the resolution of diffusion mod- els via tuning-free scale fusion.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Freescale: Unleashing the resolution of diffusion mod- els via tuning-free scale fusion

Reference 85

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:34.564222Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:34.564222Z digest=sha256:57c26bac38326e3e310ad26b2f7ad32dd3adae6b27103db3e3d15d9298639daa

Observation 2295b7ac-8185-43c4-a9b7-df3ad4ed4ab2 · outbound

This paper cites Learn- ing transferable visual models from natural language super- vision.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Learn- ing transferable visual models from natural language super- vision

Reference 86

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:34.747012Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:34.747012Z digest=sha256:57dcb293d82e5be90d3137d998161ed192d06205b1d3fd831e31d8781dd9247b

Observation 14e76cb2-00d3-425c-9c4f-7b750957498c · outbound

This paper cites SAM 2: Segment Anything in Images and Videos.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer SAM 2: Segment Anything in Images and Videos

Reference 87

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:34.898300Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:34.898300Z digest=sha256:2d9dcee2374ad051ecf48dddef5c4991d37ac5353ad0564f30991fa7fe962d91

Observation 4d77bf99-93e8-4681-9931-55517ce6c520 · outbound

This paper cites High-resolution image synthesis with latent diffusion models.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer High-resolution image synthesis with latent diffusion models

Reference 88

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:34.997458Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:34.997458Z digest=sha256:6aaf8b9c81b0f4d874e4d41e231e95102c94679bcea48412007fd104ddcd1830

Observation 6b3dc856-a6ab-4b9e-adb0-6f8f94c9396d · outbound

This paper cites Photorealistic text-to-image diffusion models with deep language understanding.Advances in neural in- formation processing systems, 35:36479–36494, 2022.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Photorealistic text-to-image diffusion models with deep language understanding.Advances in neural in- formation processing systems, 35:36479–36494, 2022

Reference 89

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:35.104572Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:35.104572Z digest=sha256:6bd48701ea3b4b2f0d06c2258079050b75f289f12bbf453af139323d2486cbb5

Observation 0cfa7333-14eb-4e27-bf43-41cb2ee2cfa0 · outbound

This paper cites Progressive Distillation for Fast Sampling of Diffusion Models.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Progressive Distillation for Fast Sampling of Diffusion Models

Reference 90

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:35.167060Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:35.167060Z digest=sha256:2eccf7e546b8bc1623ac063ea302041c27852a436293191220b01b0394de17ea

Observation b348a2c2-8752-421b-ba4d-59a4ee94ed26 · outbound

This paper cites Skrr: Skip and Re-use Text Encoder Layers for Memory Efficient Text-to-Image Generation.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Skrr: Skip and Re-use Text Encoder Layers for Memory Efficient Text-to-Image Generation

Reference 91

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:35.268665Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:35.268665Z digest=sha256:c74e1e440b628e73a53d602c6443563ed2a573d9f3bc6f14ee5769d9be68d52a

Observation 7405d1a7-eb55-41b9-a805-f35dbe90a15b · outbound

This paper cites Post-training quantization on diffusion models.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Post-training quantization on diffusion models

Reference 92

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:35.377423Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:35.377423Z digest=sha256:5c3b7177ca7073d1becb1f5ebeafe7194d5667db2a4d7a1a7206f157483f15d0

Observation 1a2304ef-5e90-4ab0-86d5-1e419724144f · outbound

This paper cites DINOv3.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer DINOv3

Reference 93

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:35.520090Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:35.520090Z digest=sha256:2a4f688f08546250e9cfe84d399cd4c6856fe575bf0353bf6110621277f82ccc

Observation 453e8f68-bf2a-4d2d-b1fb-9e17d941db41 · outbound

This paper cites Very Deep Convolutional Networks for Large-Scale Image Recognition.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Very Deep Convolutional Networks for Large-Scale Image Recognition

Reference 94

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:35.671896Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:35.671896Z digest=sha256:2232ae85509babe4dea933195802ca5a7f9169525b9272451fe04052d6dda57a

Observation c2048fbb-e6cc-477f-abb4-7b44fae98295 · outbound

This paper cites Denoising Diffusion Implicit Models.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Denoising Diffusion Implicit Models

Reference 95

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:35.798920Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:35.798920Z digest=sha256:cfbe1892507a3f7e7c6100d00d0af0482701bdc812347f2cb761f4e1709dd77e

Observation 40868428-7d8b-44ff-a323-6185ac1ff1c7 · outbound

This paper cites Consistency Models.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Consistency Models

Reference 96

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:35.913201Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:35.913201Z digest=sha256:908eefc054fca88359a686f4d247fa92be1272384e2e149c90a465bc3477e3ca

Observation 1bb7fe64-0adc-443c-aff9-4770f27f69de · outbound

This paper cites Roformer: Enhanced transformer with rotary position embedding.Neurocomputing, 568: 127063, 2024.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Roformer: Enhanced transformer with rotary position embedding.Neurocomputing, 568: 127063, 2024

Reference 97

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:36.044216Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:36.044216Z digest=sha256:cf64b6f26995aa6d8b6591c91df6bca771a22019ff3680c83103e2aedcc55622

Observation c5904c76-8d9f-405f-84f7-29e461304773 · outbound

This paper cites A length-extrapolatable transformer.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer A length-extrapolatable transformer

Reference 98

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:36.151686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:36.151686Z digest=sha256:c39eef5b49d95fd0b76494364fdb1ca5a69ceba3d7b13fc2c9a595836965fcd4

Observation 88bd2714-ba7c-4634-a4d8-d1705cc6c909 · outbound

This paper cites Exploring the deep fusion of large language models and diffusion transformers for text-to-image synthesis.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Exploring the deep fusion of large language models and diffusion transformers for text-to-image synthesis

Reference 99

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:36.264238Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:36.264238Z digest=sha256:eea40a6117a6e8e4d993a76638fbc16fe6b58b5a787516c8925f7cd28649c56b

Observation 0162a3f4-26f2-4996-b7aa-0a5b26d00a8b · outbound

This paper cites Gemma: Open Models Based on Gemini Research and Technology.

Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer Gemma: Open Models Based on Gemini Research and Technology

Reference 100

Resolution
unresolved
no resolver link, observed 2026-08-03T20:30:36.333846Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T20:30:36.333846Z digest=sha256:817c2ab7e334abfad2db66842b3c19b09156eea1b36e4659c34ea69e2b44e57f

Pith citing papers

No inbound Pith citation observations are available.