Pith. sign in

Paper Citation Record · LEDGER

Stream-T1: Test-Time Scaling for Streaming Video Generation

As of 2 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 3 inbound Pith citation observations for arXiv:2605.04461.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2605.04461 v1

Coverage vector

measured 57 of 57 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-05-08T18:16:14.985693Z

measured 60 of 60 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-02T06:30:47.504484+00:00

measured 3 of 3 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-01T03:30:25.729920Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: pith, observed 2026-05-21T07:59:50.595450Z

Reference resolution

57 of 57 outbound references displayed

  • verified exact35
  • verified fuzzy20
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch2

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 4f7159f5-d5ca-4da8-a1fe-9bbd642afe20 · outbound

This paper cites Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs.

Stream-T1: Test-Time Scaling for Streaming Video Generation Reasoning on a Budget: A Survey of Adaptive and Controllable Test-Time Compute in LLMs

Reference 1

Resolution
verified exact
arxiv_id, observed 2026-05-09T06:40:39.447330Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:892fe5791bdb9ecba2d3a7a0a6cdafa73e4d53fa54f0597c49991ee89770ddf1

Observation 3c6afa20-1390-48d2-8661-cd799312933a · outbound

This paper cites Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets.

Stream-T1: Test-Time Scaling for Streaming Video Generation Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets

Reference 2

Resolution
verified exact
arxiv_id, observed 2026-05-10T22:58:52.491420Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:9e087b9f48407a8532bfa29a44c2640327ee250c69b1f9059afdfebca3d7a2be

Observation 3dc4a080-ea58-4fce-b65a-3d07585834ef · outbound

This paper cites SkyReels-V2: Infinite-length Film Generative Model.

Stream-T1: Test-Time Scaling for Streaming Video Generation SkyReels-V2: Infinite-length Film Generative Model

Reference 3

Resolution
verified exact
arxiv_id, observed 2026-05-14T20:23:04.486750Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:cce907276dda06e3457a9ebd92a74963243626e2e447a003d5371a585a840f10

Observation ad65406b-a55c-40de-8ae7-716a00eba102 · outbound

This paper cites Autoregressive Video Generation without Vector Quantization.

Stream-T1: Test-Time Scaling for Streaming Video Generation Autoregressive Video Generation without Vector Quantization

Reference 4

Resolution
verified exact
arxiv_id, observed 2026-05-17T15:07:39.939813Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:cec0edce5f5919dd576f66236ce23f45477ebc01aa71157e7257644c36643767

Observation 62b5c462-02c7-4d39-970d-8885c0eaeed1 · outbound

This paper cites Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing.

Stream-T1: Test-Time Scaling for Streaming Video Generation Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing

Reference 5

Resolution
verified exact
arxiv_id, observed 2026-05-09T06:40:39.381562Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:59986e10ca9937846771ca42e87e059eae50fa39eae2cd44398d88f816eed8b8

Observation 3d9dc62f-0c40-47ca-8fa6-dfd6c9c18e24 · outbound

This paper cites Long-Context Autoregressive Video Modeling with Next-Frame Prediction.

Stream-T1: Test-Time Scaling for Streaming Video Generation Long-Context Autoregressive Video Modeling with Next-Frame Prediction

Reference 6

Resolution
verified exact
arxiv_id, observed 2026-05-16T23:05:17.562899Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:bb9418c6cb34a138dd055a3e0d71d015ef11f16255bd0e8e9e93f606012c0c9f

Observation 909a02e4-251c-41e5-bcee-7595e15f8751 · outbound

This paper cites Deepseek-r1 incentivizes reasoning in llms through reinforcement learning.Nature, 645(8081): 633–638.

Stream-T1: Test-Time Scaling for Streaming Video Generation Deepseek-r1 incentivizes reasoning in llms through reinforcement learning.Nature, 645(8081): 633–638

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.821157Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:9ca077f619537eeb44c566bdc78fd229c42b6696c57989751e3966e962f37134

Observation 65c0da35-7216-4f86-8628-4d5a715e1344 · outbound

This paper cites AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning.

Stream-T1: Test-Time Scaling for Streaming Video Generation AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning

Reference 8

Resolution
verified exact
arxiv_id, observed 2026-05-10T22:52:19.777506Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:40f53628c460c27e2dad1fbd4a9666a4209bfafdfecb4ba8465f953bd052603b

Observation 6715b68a-f580-4a69-8dd2-338dbb1ddbc4 · outbound

This paper cites Scaling Image and Video Generation via Test-Time Evolutionary Search.

Stream-T1: Test-Time Scaling for Streaming Video Generation Scaling Image and Video Generation via Test-Time Evolutionary Search

Reference 9

Resolution
verified exact
arxiv_id, observed 2026-05-09T06:40:39.266097Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:b7ba8905e37f15d9ae89b7bbfef37c02a68afac88a0605ca458129df0e7072cc

Observation e0127b0a-35f7-4e7e-9a01-0c0503386fb4 · outbound

This paper cites Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion.

Stream-T1: Test-Time Scaling for Streaming Video Generation Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion

Reference 10

Resolution
verified exact
arxiv_id, observed 2026-05-11T01:36:53.812910Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:0af12898d11feae2a3e924a41509af38d116517a840ab60f0fb0cb420e7f1a73

Observation 8f711057-a0b5-44d5-a349-bbccdb4eb557 · outbound

This paper cites Vbench: Comprehensive benchmark suite for video generative models.

Stream-T1: Test-Time Scaling for Streaming Video Generation Vbench: Comprehensive benchmark suite for video generative models

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.870560Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:d9f4323c64f8e5ead7832fe76351d84fb158270d8b3c8e8bc81e58e6d324aec1

Observation 7bb3c82a-7a6f-4a27-836f-096ee7152f90 · outbound

This paper cites Vbench++: Comprehensive and versatile benchmark suite for video generative models.

Stream-T1: Test-Time Scaling for Streaming Video Generation Vbench++: Comprehensive and versatile benchmark suite for video generative models

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.879025Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:31456f9502a62fbe6835a0a3568e5b3ecc0daeb9dcf731dd745353bf0ed5e271

Observation 3b8763fd-e4ac-4670-a9d0-0fb45e4269f8 · outbound

This paper cites OpenAI o1 System Card.

Stream-T1: Test-Time Scaling for Streaming Video Generation OpenAI o1 System Card

Reference 13

Resolution
verified exact
local_arxiv, observed 2026-05-09T06:40:39.115011Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:3a8fe331bbc692268f08b9667134bf06bcec38971eea49e477cec11e866ddf57

Observation 7d99f900-7788-4e94-b41d-4aebef16200e · outbound

This paper cites Videoar: Autoregressive video generation via next-frame & scale prediction.

Stream-T1: Test-Time Scaling for Streaming Video Generation Videoar: Autoregressive video generation via next-frame & scale prediction

Reference 14

Resolution
verified exact
arxiv_id, observed 2026-05-09T06:40:39.339531Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:514acd924f6db3bffde83aaa08c1672104f0c0a284b3efd7e06441ba095a1e96

Observation f6947854-683c-41f2-b89e-56e9b32ff3c8 · outbound

This paper cites Compositional image synthesis with inference-time scaling.

Stream-T1: Test-Time Scaling for Streaming Video Generation Compositional image synthesis with inference-time scaling

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.865958Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:3ac769cf451fb806ff0a88e510bd39109690e23c7c8b50cdf5ff628af1dbb6ed

Observation df1188a5-0226-4137-af9c-92abd584f8ca · outbound

This paper cites VideoPoet: A Large Language Model for Zero-Shot Video Generation.

Stream-T1: Test-Time Scaling for Streaming Video Generation VideoPoet: A Large Language Model for Zero-Shot Video Generation

Reference 16

Resolution
verified exact
arxiv_id, observed 2026-05-15T17:51:05.830483Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:de5f4ddd7616282b5953b827ab98fffdba69447fde20561d6ba652f2954e6891

Observation 4fd06467-db47-4681-a9cc-fd471207dcea · outbound

This paper cites HunyuanVideo: A Systematic Framework For Large Video Generative Models.

Stream-T1: Test-Time Scaling for Streaming Video Generation HunyuanVideo: A Systematic Framework For Large Video Generative Models

Reference 17

Resolution
verified exact
arxiv_id, observed 2026-05-09T06:40:39.218180Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:3724f75a1835fdc4ba9d36aa319f01270026c29206e10d1736c059eb0851ad3f

Observation 74d05e05-d655-41fe-88a3-0d0485ec1a98 · outbound

This paper cites Rolling Sink: Bridging Limited-Horizon Training and Open-Ended Testing in Autoregressive Video Diffusion.

Stream-T1: Test-Time Scaling for Streaming Video Generation Rolling Sink: Bridging Limited-Horizon Training and Open-Ended Testing in Autoregressive Video Diffusion

Reference 18

Resolution
verified exact
local_arxiv, observed 2026-05-09T06:40:39.314786Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:2884d4b38812f011838e26405c9d114a58373d0b7cd46b597f4ee129a8cdad72

Observation 61cae0a0-9cd7-4099-8f74-0cd8adccd9f8 · outbound

This paper cites Reflect-dit: Inference-time scaling for text-to-image diffusion transformers via in-context reflection.

Stream-T1: Test-Time Scaling for Streaming Video Generation Reflect-dit: Inference-time scaling for text-to-image diffusion transformers via in-context reflection

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.874861Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:b7ff683c6bed51e5156df5e0f8b0f86fa02cede5beded3a7222fd4181d423101

Observation 04239bbe-1acd-41a1-9541-253eaec0a5d3 · outbound

This paper cites ARLON: Boosting Diffusion Transformers with Autoregressive Models for Long Video Generation.

Stream-T1: Test-Time Scaling for Streaming Video Generation ARLON: Boosting Diffusion Transformers with Autoregressive Models for Long Video Generation

Reference 20

Resolution
verified exact
arxiv_id, observed 2026-05-09T06:40:39.477796Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:c02fb12924d3b40317592d92ffa3e55084d2451d57185092b1e5629e564b1f67

Observation dc1b731f-471c-45cd-8ce4-7847e798e7fd · outbound

This paper cites Video-t1: Test-time scaling for video generation.

Stream-T1: Test-Time Scaling for Streaming Video Generation Video-t1: Test-time scaling for video generation

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.882705Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:becdb6b96dc6ecf9cb58638253eb87f6bffc67150b2bfb5e235e40109c1e49a3

Observation 66880af5-85db-4903-b231-7690dabf1a4f · outbound

This paper cites Improving Video Generation with Human Feedback.

Stream-T1: Test-Time Scaling for Streaming Video Generation Improving Video Generation with Human Feedback

Reference 22

Resolution
verified exact
arxiv_id, observed 2026-05-13T15:30:03.116566Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:c7c6e92eb981531ea470ac938ea0fb85bc8a53a4b54d05dcfaa107e963f40d15

Observation f7354b2f-6c8c-453c-9065-8fa80bd029e2 · outbound

This paper cites Rolling Forcing: Autoregressive Long Video Diffusion in Real Time.

Stream-T1: Test-Time Scaling for Streaming Video Generation Rolling Forcing: Autoregressive Long Video Diffusion in Real Time

Reference 23

Resolution
verified exact
arxiv_id, observed 2026-05-16T11:15:29.350628Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:258ca534b6799cf52500d4831319f5e4b57a57c435f436cbd11832090fb35d8c

Observation 11ce872f-0adc-4370-8d30-fe73dc63e331 · outbound

This paper cites Can 1B LLM Surpass 405B LLM? Rethinking Compute-Optimal Test-Time Scaling.

Stream-T1: Test-Time Scaling for Streaming Video Generation Can 1B LLM Surpass 405B LLM? Rethinking Compute-Optimal Test-Time Scaling

Reference 24

Resolution
metadata mismatch
arxiv_id, observed 2026-05-09T06:40:39.485808Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:4b32d1c60189db15229c1c34b8b25234db672e2345d39eeb38095fd0037b5a08

Observation 3c65e886-ca8e-42a6-8e6b-7a87b8ed35e0 · outbound

This paper cites Reward Forcing: Efficient Streaming Video Generation with Rewarded Distribution Matching Distillation.

Stream-T1: Test-Time Scaling for Streaming Video Generation Reward Forcing: Efficient Streaming Video Generation with Rewarded Distribution Matching Distillation

Reference 25

Resolution
verified exact
arxiv_id, observed 2026-05-16T18:17:55.281442Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:773bac4114010855cf6899acafe9ebcc5c294b5e9fab78a0f5eaecbec38f172f

Observation 2dd9ee08-7cf5-4c0b-8a38-eb59955c3898 · outbound

This paper cites Hpsv3: Towards wide-spectrum human preference score.

Stream-T1: Test-Time Scaling for Streaming Video Generation Hpsv3: Towards wide-spectrum human preference score

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.861770Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:83e4599e58d33bb54f6069ad7b6631b10674ee4b12f17f27266271228de29031

Observation ade03136-71a8-4912-9f04-a07fb80f24da · outbound

This paper cites s1: Simple test-time scaling.

Stream-T1: Test-Time Scaling for Streaming Video Generation s1: Simple test-time scaling

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.903273Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:55f10e2c8c5fb23b6fb71098d12a9898eb0e5e79fea2fb5b091a451217aef45d

Observation 0cf6b9c5-b46f-4135-bd5e-660e33622907 · outbound

This paper cites Inference-time text-to-video alignment with diffusion latent beam search.

Stream-T1: Test-Time Scaling for Streaming Video Generation Inference-time text-to-video alignment with diffusion latent beam search

Reference 28

Resolution
verified exact
arxiv_id, observed 2026-05-09T06:40:39.103311Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:49b14d03acae02211e651cfed8535ffbc661faba036fe97aa965eb5b5377a990

Observation bc704297-30ac-4fb3-ad8b-50ac6474299e · outbound

This paper cites Movie Gen: A Cast of Media Foundation Models.

Stream-T1: Test-Time Scaling for Streaming Video Generation Movie Gen: A Cast of Media Foundation Models

Reference 29

Resolution
verified exact
arxiv_id, observed 2026-05-11T14:16:26.778393Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:1166300f9973f1f9c00c8e63f634cdc8df22ffb4a43c2ec98a5bc6387b0d599f

Observation 107a2c90-1a1a-4181-8dcb-4d79596b5c4d · outbound

This paper cites Hierarchical spatio-temporal decoupling for text-to-video generation.

Stream-T1: Test-Time Scaling for Streaming Video Generation Hierarchical spatio-temporal decoupling for text-to-video generation

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.910413Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:9776ae310586e5f531a027727401129bbec26fcecf8721a2f66a978cfe1ba319

Observation 39d4d151-904e-4457-97ad-d7ef043020d3 · outbound

This paper cites Test-Time Scaling of Diffusion Models via Noise Trajectory Search.

Stream-T1: Test-Time Scaling for Streaming Video Generation Test-Time Scaling of Diffusion Models via Noise Trajectory Search

Reference 31

Resolution
verified exact
arxiv_id, observed 2026-05-09T06:40:39.091834Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:01235e62edb4c1365a6686de2d50509fc4c9b667090c45aa17e58f4019eed5f7

Observation acbfbd2e-cde1-4a99-ba18-0f24fb52ba72 · outbound

This paper cites Next Block Prediction: Video Generation via Semi-Autoregressive Modeling.

Stream-T1: Test-Time Scaling for Streaming Video Generation Next Block Prediction: Video Generation via Semi-Autoregressive Modeling

Reference 32

Resolution
metadata mismatch
arxiv_id, observed 2026-05-09T06:40:39.120481Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:ea56bd0124558baba8edf62cc7880c6781f42cfadea6858d3a1f50245ed78e46

Observation d305d8ff-05a2-4c3e-bbac-521b50e38849 · outbound

This paper cites Make-A-Video: Text-to-Video Generation without Text-Video Data.

Stream-T1: Test-Time Scaling for Streaming Video Generation Make-A-Video: Text-to-Video Generation without Text-Video Data

Reference 33

Resolution
verified exact
arxiv_id, observed 2026-05-11T01:13:03.403852Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:abae83983cadf34f4cf071df39554cc0819fc412de2840305b435ba2ad4aa92d

Observation 2cb6755b-5e14-44d8-aacd-392a6db0ebd6 · outbound

This paper cites A General Framework for Inference-time Scaling and Steering of Diffusion Models.

Stream-T1: Test-Time Scaling for Streaming Video Generation A General Framework for Inference-time Scaling and Steering of Diffusion Models

Reference 34

Resolution
verified exact
arxiv_id, observed 2026-05-09T06:40:39.324015Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:d52a1b2e4b394859cca01474cbdb1a45b300dfdca718a3b892e29163b02925a3

Observation 70ecedaf-ca48-4702-9e34-27e454f1bfb5 · outbound

This paper cites Scaling llm test-time compute optimally can be more effective than scaling parameters for reasoning.

Stream-T1: Test-Time Scaling for Streaming Video Generation Scaling llm test-time compute optimally can be more effective than scaling parameters for reasoning

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.848682Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:afa936ffc5d46dcd8a8482cf4f1badc29b97b55f6ed7109a9a75c5f28edabb27

Observation 5c3ef276-96e2-4404-99cc-22d40cdeb3c9 · outbound

This paper cites MAGI-1: Autoregressive Video Generation at Scale.

Stream-T1: Test-Time Scaling for Streaming Video Generation MAGI-1: Autoregressive Video Generation at Scale

Reference 36

Resolution
verified exact
arxiv_id, observed 2026-05-13T20:31:15.871842Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:afd2c52a777ed4d4248c2c3e7662a2d80d46309447ee39961373d0c6d8c545bc

Observation 35c4deb3-a411-475e-9f6d-1c20d6826baf · outbound

This paper cites Wan: Open and Advanced Large-Scale Video Generative Models.

Stream-T1: Test-Time Scaling for Streaming Video Generation Wan: Open and Advanced Large-Scale Video Generative Models

Reference 37

Resolution
verified exact
arxiv_id, observed 2026-05-09T06:40:39.207640Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:1606c0b572b937995467ea2b4216ecf5aa1af59acd90fed81429d5a28eeb1b91

Observation dd8db599-1797-480b-9f2c-971706144eba · outbound

This paper cites ModelScope Text-to-Video Technical Report.

Stream-T1: Test-Time Scaling for Streaming Video Generation ModelScope Text-to-Video Technical Report

Reference 38

Resolution
verified exact
arxiv_id, observed 2026-05-12T19:47:29.701736Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:01fc6175161083502067791207ba4ca9f1584aae3aa773dfea4e74b9207a1d73

Observation c829bd25-08ae-432f-8423-98522d6f6920 · outbound

This paper cites Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution.

Stream-T1: Test-Time Scaling for Streaming Video Generation Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution

Reference 39

Resolution
verified exact
arxiv_id, observed 2026-05-09T06:40:39.142753Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:a9b242ef82defcfad162dabde9fbd1a653e59207251b0c7626d89d4db24b71d9

Observation 9f0ec689-0be9-4d5c-9a38-6012b7a46624 · outbound

This paper cites Art-v: Auto-regressive text-to-video generation with diffusion models.

Stream-T1: Test-Time Scaling for Streaming Video Generation Art-v: Auto-regressive text-to-video generation with diffusion models

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.857511Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:ca891d012016bff8bc12fdb893e1d359541fc6beafa1d96edc36f6759fc0695e

Observation 7bf32e41-c4eb-4ce7-b45f-dfac6686e222 · outbound

This paper cites Imagerysearch: Adaptive test-time search for video generation beyond semantic dependency constraints.

Stream-T1: Test-Time Scaling for Streaming Video Generation Imagerysearch: Adaptive test-time search for video generation beyond semantic dependency constraints

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.808027Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:d316002ded5db39c3ebe125ecf7fad7438ec9af1ab49766e61b11334f4166d73

Observation c8397314-d288-40d6-bf01-a5fb63cfef56 · outbound

This paper cites Imagereward: Learning and evaluating human preferences for text-to-image generation.

Stream-T1: Test-Time Scaling for Streaming Video Generation Imagereward: Learning and evaluating human preferences for text-to-image generation

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.816117Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:f46ba68d433e00daca122c4cccc88a30017a23d4d5432e8e800e1615ca381ef9

Observation 6bf7f549-062f-4b36-bfcd-988b7d0e379f · outbound

This paper cites Visionreward: Fine-grained multi-dimensional human preference learning for image and video generation.

Stream-T1: Test-Time Scaling for Streaming Video Generation Visionreward: Fine-grained multi-dimensional human preference learning for image and video generation

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.812066Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:f044efd855513986f194b389654b845f443db2753044026ed7c01cc279da6dc3

Observation 7ad2f95b-98e4-4565-82e2-eed46028c0c8 · outbound

This paper cites VideoGPT: Video Generation using VQ-VAE and Transformers.

Stream-T1: Test-Time Scaling for Streaming Video Generation VideoGPT: Video Generation using VQ-VAE and Transformers

Reference 44

Resolution
verified exact
arxiv_id, observed 2026-05-13T17:24:33.857072Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:7b76c5ef81631630f0407535fb9b8490a53a2dbab58010a53c2ec5e1107ab9bf

Observation 06318ebc-7ac9-44b7-a820-312cb886c746 · outbound

This paper cites LongLive: Real-time Interactive Long Video Generation.

Stream-T1: Test-Time Scaling for Streaming Video Generation LongLive: Real-time Interactive Long Video Generation

Reference 45

Resolution
verified exact
arxiv_id, observed 2026-05-15T03:52:59.837830Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:a6f3e577048a1b2ca324381fff056d5c053c15d6ff307fe7d5370de84e3536cb

Observation 0c5b2909-fc77-4327-a299-c52a0c577301 · outbound

This paper cites CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer.

Stream-T1: Test-Time Scaling for Streaming Video Generation CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer

Reference 46

Resolution
verified exact
arxiv_id, observed 2026-05-10T18:26:22.534732Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:6e6f89cbfe104d57870a931e5e35773dd991ba0931a0562e67eb2b725fda13cc

Observation 99ae0156-79f0-4524-a1f9-2415b49af3a4 · outbound

This paper cites From slow bidirectional to fast autoregressive video diffusion models.

Stream-T1: Test-Time Scaling for Streaming Video Generation From slow bidirectional to fast autoregressive video diffusion models

Reference 47

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.853255Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:bfbf083b7b2a9dcb68663e96c13f9f5e8a90e29049a5c6e83e853cb05444115e

Observation 43281fb9-6d34-4319-a0fe-f0ba1e9f1583 · outbound

This paper cites VideoMAR: Autoregressive Video Generatio with Continuous Tokens.

Stream-T1: Test-Time Scaling for Streaming Video Generation VideoMAR: Autoregressive Video Generatio with Continuous Tokens

Reference 48

Resolution
verified exact
arxiv_id, observed 2026-05-09T06:40:39.187032Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:7044abdc9700f71dc40b1c79b6af57801bcf0609c1f3b7df2f06974ed79403ca

Observation eac90085-e369-41b6-a08b-70ad1001f64d · outbound

This paper cites Lumos-1: On autoregressive video generation with discrete diffusion from a unified model perspective.

Stream-T1: Test-Time Scaling for Streaming Video Generation Lumos-1: On autoregressive video generation with discrete diffusion from a unified model perspective

Reference 49

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.826129Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:ef30f146479d0fe5de84a3e4f9820229b853b9012cd78b771699f72eae7ae74f

Observation 2091afb9-3c76-45d6-89e7-6f5d9847b3ae · outbound

This paper cites VideoLLaMA 3: Frontier Multimodal Foundation Models for Image and Video Understanding.

Stream-T1: Test-Time Scaling for Streaming Video Generation VideoLLaMA 3: Frontier Multimodal Foundation Models for Image and Video Understanding

Reference 50

Resolution
verified exact
arxiv_id, observed 2026-05-11T01:20:00.737157Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:f78450553e0e7ea70f0c2d7c7e8d9f74851080028c2b8ffd80fda897ca1e214d

Observation 5c7dba27-deb6-45e2-8e89-72a35e1fda04 · outbound

This paper cites Show-1: Marrying pixel and latent diffusion models for text-to-video generation.International Journal of Computer Vision, 133(4):1879–1893.

Stream-T1: Test-Time Scaling for Streaming Video Generation Show-1: Marrying pixel and latent diffusion models for text-to-video generation.International Journal of Computer Vision, 133(4):1879–1893

Reference 51

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.844510Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:f15e7a04e9631c7397d4de354d90b85aa3f78562ffd0cf35cff28dc2d5ef4d9e

Observation cf2b85a0-724e-4107-90b1-9350996c6eb3 · outbound

This paper cites A Survey on Test-Time Scaling in Large Language Models: What, How, Where, and How Well?.

Stream-T1: Test-Time Scaling for Streaming Video Generation A Survey on Test-Time Scaling in Large Language Models: What, How, Where, and How Well?

Reference 52

Resolution
verified exact
arxiv_id, observed 2026-05-13T18:07:52.994249Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:f79287e57ed996c93f42843b1eca285b2031213cd0f3724b8a67ebfc7b2c0a52

Observation a71c6540-4dd1-4ff4-8c21-eb12c53c9052 · outbound

This paper cites Learning multi-dimensional human preference for text-to-image generation.

Stream-T1: Test-Time Scaling for Streaming Video Generation Learning multi-dimensional human preference for text-to-image generation

Reference 53

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.839643Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:e81d56c0f2cbb5f689dd26c9d0dcc2f568fe963d4d98929a049e50cb5742a0b0

Observation 92812db4-1efa-4262-92c6-c7c569e5754f · outbound

This paper cites LatSearch: Latent Reward-Guided Search for Faster Inference-Time Scaling in Video Diffusion.

Stream-T1: Test-Time Scaling for Streaming Video Generation LatSearch: Latent Reward-Guided Search for Faster Inference-Time Scaling in Video Diffusion

Reference 54

Resolution
verified exact
arxiv_id, observed 2026-06-30T02:17:18.172894Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:ca86f261fd29a1d5a3114bd45675a0121044dff2ac274c573b4d071d11100231

Observation e2ca6090-c584-4851-a333-cadcca0038f2 · outbound

This paper cites MagicVideo: Efficient Video Generation With Latent Diffusion Models.

Stream-T1: Test-Time Scaling for Streaming Video Generation MagicVideo: Efficient Video Generation With Latent Diffusion Models

Reference 55

Resolution
verified exact
arxiv_id, observed 2026-05-15T18:47:57.649874Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:c286a53632782d21d6748d14a0f1c5b8e0f1764dec3c667122785ea1dc36dfa1

Observation a8101fbc-fa68-41d4-afa1-88924aeb5ad3 · outbound

This paper cites Golden noise for diffusion models: A learning framework.

Stream-T1: Test-Time Scaling for Streaming Video Generation Golden noise for diffusion models: A learning framework

Reference 56

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.830495Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:3ad5c5608e9091e069100a6cf59e63b7e0bbb324e524a0cf9bd71b935631277b

Observation 7998b363-a012-4fea-9d78-3db92aa0dc4a · outbound

This paper cites From reflection to perfection: Scaling inference-time optimization for text-to-image diffusion models via reflection tuning.

Stream-T1: Test-Time Scaling for Streaming Video Generation From reflection to perfection: Scaling inference-time optimization for text-to-image diffusion models via reflection tuning

Reference 57

Resolution
verified fuzzy
raw_fallback, observed 2026-05-26T05:26:45.834970Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-08T18:16:14.985693Z digest=sha256:aea0d21eb448131d7333107a6d4bf4e090969b46f6980ccaa66820f89ad69a7b

Pith citing papers

Observation 57015be4-cfba-4881-a9db-a6971606329b · inbound

Lance: Unified Multimodal Modeling by Multi-Task Synergy cites this paper.

Lance: Unified Multimodal Modeling by Multi-Task Synergy Stream-T1: Test-Time Scaling for Streaming Video Generation

Reference 109

Resolution
verified exact
local_arxiv, observed 2026-05-20T11:48:14.790869Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-20T11:46:52.658984Z digest=sha256:3961e467a2a0825236dace53aa5c0790423ac308a0e4cc1f2b1beef906c2be41

Observation 7b56ca82-b68f-4341-bcee-62a0d9a38c9b · inbound

Lance: Unified Multimodal Modeling by Multi-Task Synergy cites this paper.

Lance: Unified Multimodal Modeling by Multi-Task Synergy Stream-T1: Test-Time Scaling for Streaming Video Generation

Reference 110

Resolution
verified exact
local_arxiv, observed 2026-05-21T07:59:50.598285Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-21T07:56:34.034047Z digest=sha256:44cb94b334ff125610f89ccc9b47bc73a0fe19d88ccfc88134f8608a6fc553a2

Observation 94b9d04a-88fc-45ed-a1c9-918dae59bee0 · inbound

CachedSearch: Training-Free Cached Exploration for Test-Time Search in Video Diffusion cites this paper.

CachedSearch: Training-Free Cached Exploration for Test-Time Search in Video Diffusion Stream-T1: Test-Time Scaling for Streaming Video Generation

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-01T03:30:25.729920Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T03:30:25.729920Z digest=sha256:22912089897e72e4f0b42b7b492163c8d12afc8f92dd790ea0241227244014c8