Pith. sign in

Paper Citation Record · LEDGER

Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

As of 5 August 2026, this Paper Citation Record lists 16 of 16 outbound references and 59 inbound Pith citation observations for arXiv:2512.13507.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2512.13507 v3

Coverage vector

measured 16 of 16 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-05-16T01:35:37.817082Z

measured 75 of 75 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-05T06:32:48.257954+00:00

measured 59 of 59 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-04T06:45:46.185168Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: pith, observed 2026-07-10T01:46:40.967365Z

Reference resolution

16 of 16 outbound references displayed

  • verified exact14
  • verified fuzzy2
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation a154751c-5818-4559-9135-217fcac24530 · outbound

This paper cites Scaling rectified flow transformers for high-resolution image synthesis.

Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model Scaling rectified flow transformers for high-resolution image synthesis

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-05-16T01:35:37.952137Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-16T01:35:37.817082Z digest=sha256:ba4804507b2ef2e61f1e341a0854975664ffe96f6e41c17555e937e01793d830

Observation 2bff16ca-2f0a-42e3-8572-e457da3bd9bc · outbound

This paper cites Seedream 3.0 Technical Report.

Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model Seedream 3.0 Technical Report

Reference 2

Resolution
verified exact
local_arxiv, observed 2026-05-16T01:35:37.848814Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-16T01:35:37.817082Z digest=sha256:f16dd14e7962828a40f06718abd4c9af18ba2836fdd1df555c482885b89dab29

Observation 8e203a5e-1bed-447a-abfa-a1690171a891 · outbound

This paper cites Seedance 1.0: Exploring the Boundaries of Video Generation Models.

Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model Seedance 1.0: Exploring the Boundaries of Video Generation Models

Reference 3

Resolution
verified exact
local_arxiv, observed 2026-05-16T01:35:37.855835Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-16T01:35:37.817082Z digest=sha256:3c134dbd018b5ceb78d8b15a13c87ce3e87ff098b9b3a666613ac73df0a1256f

Observation 0cecc482-d108-4a0a-9912-ed62dc43d2d0 · outbound

This paper cites Mean Flows for One-step Generative Modeling.

Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model Mean Flows for One-step Generative Modeling

Reference 4

Resolution
verified exact
local_arxiv, observed 2026-05-16T01:35:37.862500Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-16T01:35:37.817082Z digest=sha256:c28e2c536c3f01daba1792d75da722c2dd86ae5ec69b147972a15d1ad2db14a5

Observation ffb81dba-fdad-487e-aff6-9960638aa0c1 · outbound

This paper cites Seedream 2.0: A Native Chinese-English Bilingual Image Generation Foundation Model.

Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model Seedream 2.0: A Native Chinese-English Bilingual Image Generation Foundation Model

Reference 5

Resolution
verified exact
arxiv_id, observed 2026-05-17T08:27:36.473449Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-16T01:35:37.817082Z digest=sha256:cb042ccc2f3ce8a2b829c8af51a03ebea0b0a5053287701f9f9c48dd01467f2c

Observation 576ba46b-a0b7-4efe-a2b4-84cfe3b974c7 · outbound

This paper cites HunyuanVideo: A Systematic Framework For Large Video Generative Models.

Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model HunyuanVideo: A Systematic Framework For Large Video Generative Models

Reference 6

Resolution
verified exact
local_arxiv, observed 2026-05-16T01:35:37.877410Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-16T01:35:37.817082Z digest=sha256:2020110501c6db868aa342c4da887c1784eede4de49c410c0e5cd8f73ffd128f

Observation 82689190-fb0c-4e7c-9713-9689aee4be71 · outbound

This paper cites Flow-GRPO: Training Flow Matching Models via Online RL.

Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model Flow-GRPO: Training Flow Matching Models via Online RL

Reference 7

Resolution
verified exact
local_arxiv, observed 2026-05-16T01:35:37.884638Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-16T01:35:37.817082Z digest=sha256:74f2fefabc1d1a8bef9eaca78bbaea70c38f760cdb06ff2cca822827df1d7320

Observation 2f63d48b-84d7-407a-91ea-c0881407107a · outbound

This paper cites Hyper-sd: Trajectory segmented consistency model for efficient image synthesis.Advancesin Neural Information Processing Systems, 37:117340–117362.

Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model Hyper-sd: Trajectory segmented consistency model for efficient image synthesis.Advancesin Neural Information Processing Systems, 37:117340–117362

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-05-16T01:35:37.946888Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-16T01:35:37.817082Z digest=sha256:21122f947b7a80d35fd50e79b52b979ca08a6164f9faf921ff64f390b7a5ed98

Observation 759511f3-b2ac-4f27-881c-9e5bd12f1e48 · outbound

This paper cites Seedream 4.0: Toward Next-generation Multimodal Image Generation.

Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model Seedream 4.0: Toward Next-generation Multimodal Image Generation

Reference 9

Resolution
verified exact
local_arxiv, observed 2026-05-16T01:35:37.911093Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-16T01:35:37.817082Z digest=sha256:8cff16784c15c4fbfac59cb473324fcec236df44cbc2a7e2edd0c28dc393c217

Observation 01546bdc-a5a8-406c-9d70-b20390575ca1 · outbound

This paper cites RayFlow: Instance-Aware Diffusion Acceleration via Adaptive Flow Trajectories.

Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model RayFlow: Instance-Aware Diffusion Acceleration via Adaptive Flow Trajectories

Reference 10

Resolution
verified exact
arxiv_id, observed 2026-05-16T01:35:37.918949Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-16T01:35:37.817082Z digest=sha256:7d1a0fcd55317d93649fba5365dfc9bb85b0b06246ad9c6e0837967c29a57e0f

Observation 269c8758-fb39-4af2-be86-659a234a75c0 · outbound

This paper cites Wan: Open and Advanced Large-Scale Video Generative Models.

Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model Wan: Open and Advanced Large-Scale Video Generative Models

Reference 11

Resolution
verified exact
local_arxiv, observed 2026-05-16T01:35:37.927025Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-16T01:35:37.817082Z digest=sha256:e084a052bad6247c81eaf27c835599546a7d1fe7d8bb30fe26ecb34987afdcb9

Observation c3c14651-8f78-453b-a76e-1ae5ee9090de · outbound

This paper cites HunyuanVideo 1.5 Technical Report.

Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model HunyuanVideo 1.5 Technical Report

Reference 12

Resolution
verified exact
local_arxiv, observed 2026-05-16T01:35:37.934166Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-16T01:35:37.817082Z digest=sha256:6c33834abd0b480957c0c42a1e71c0d62cf580cbdaca6a5811691e68b918c2be

Observation 1d33587f-4047-4b0b-96ed-863cab106466 · outbound

This paper cites Qwen-Image Technical Report.

Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model Qwen-Image Technical Report

Reference 13

Resolution
verified exact
local_arxiv, observed 2026-05-16T01:35:37.941453Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-16T01:35:37.817082Z digest=sha256:9afa32f05e5a4ff35e27909de2a1f697dbf4ac033c9c61b4f164a690dd8c20ab

Observation 8e67035b-89db-48f8-9eda-19f252874dad · outbound

This paper cites RewardDance: Reward Scaling in Visual Generation.

Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model RewardDance: Reward Scaling in Visual Generation

Reference 14

Resolution
verified exact
arxiv_id, observed 2026-05-16T01:35:37.891530Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-16T01:35:37.817082Z digest=sha256:2b2280f7966ec49f57902e92fc18c63b551d9adb8417634947d516bf064ed224

Observation d0e33d47-11d2-454e-89eb-f16eebb9e1cb · outbound

This paper cites DanceGRPO: Unleashing GRPO on Visual Generation.

Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model DanceGRPO: Unleashing GRPO on Visual Generation

Reference 15

Resolution
verified exact
local_arxiv, observed 2026-05-16T01:35:37.903853Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-16T01:35:37.817082Z digest=sha256:9166d184c4c1fda5ceb72083627676cca099fe68baab9ef5c60ae24814dcc498

Observation 477427bb-38a9-4fa8-a6d2-beccd759686b · outbound

This paper cites UniFL: Improve Latent Diffusion Model via Unified Feedback Learning.

Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model UniFL: Improve Latent Diffusion Model via Unified Feedback Learning

Reference 16

Resolution
verified exact
arxiv_id, observed 2026-05-16T01:35:37.841848Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-16T01:35:37.817082Z digest=sha256:be5f78f105fbdabd450fc1ccb660c53d5889313501d9a0a81aec7c3250893949

Pith citing papers

Observation 55a6e127-874b-4c91-b116-cb2d1a1a8d04 · inbound

Advancing Open-source World Models cites this paper.

Advancing Open-source World Models Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 76

Resolution
verified exact
local_arxiv, observed 2026-05-16T09:07:01.029493Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-16T09:07:00.904794Z digest=sha256:17c416bb242ad189ab7f19f786433db74fb6f3aca4b47acd1c33062d35180749

Observation 024ba903-39c0-40c0-b4df-1157cf7cfc0c · inbound

VideoGPA: Distilling Geometry Priors for 3D-Consistent Video Generation cites this paper.

VideoGPA: Distilling Geometry Priors for 3D-Consistent Video Generation Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 13

Resolution
verified exact
local_arxiv, observed 2026-05-16T09:17:40.232943Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-16T09:16:57.528410Z digest=sha256:7ea839d062d0774da459ad05e93927c2d7ee42de9898859675b136b1afc7df28

Observation 9799fc07-5978-45b9-a96b-bbbc67cff83a · inbound

VideoGPA: Distilling Geometry Priors for 3D-Consistent Video Generation cites this paper.

VideoGPA: Distilling Geometry Priors for 3D-Consistent Video Generation Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-03T06:13:20.174545Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T06:13:20.174545Z digest=sha256:9ce56ad3cb7d1e3d3e20b4ad241e41c9a84233746bdb6464d1ef9cbe97a8f30e

Observation 8637e93c-8edd-4f5f-b589-3ac5489179c3 · inbound

MentisOculi: Revealing the Limits of Reasoning with Mental Imagery cites this paper.

MentisOculi: Revealing the Limits of Reasoning with Mental Imagery Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-03T05:23:35.355587Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T05:23:35.355587Z digest=sha256:60f2bcbddaf0721471465979ec837534e27189e32623ecc25e7fed88fe91de55

Observation f0911bc8-102d-48be-85a2-62d5e9d9493d · inbound

Beyond End-to-End Video Models: An LLM-Based Multi-Agent System for Educational Video Generation cites this paper.

Beyond End-to-End Video Models: An LLM-Based Multi-Agent System for Educational Video Generation Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-03T00:03:26.232585Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T00:03:26.232585Z digest=sha256:16da4c7e5911312ff6131c78a9abe45b230145758931d9e5ba67233b0ed1f142

Observation 8d33bf0a-a2ed-4b87-bd82-cfda7b2d1ba8 · inbound

AHOY! Animatable Humans under Occlusion from YouTube Videos with Gaussian Splatting and Video Diffusion Priors cites this paper.

AHOY! Animatable Humans under Occlusion from YouTube Videos with Gaussian Splatting and Video Diffusion Priors Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 17

Resolution
unresolved
no resolver link, observed 2026-07-13T22:49:03.259461Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T22:49:03.259461Z digest=sha256:b0a0f8d1f2d482b01eba0cf3ceea719e307d2e485a833b608437ccf8b6152109

Observation f18323a4-deaa-4549-a06b-b52460545fb6 · inbound

ImVideoEdit: Image-learning Video Editing via 2D Spatial Difference Attention Blocks cites this paper.

ImVideoEdit: Image-learning Video Editing via 2D Spatial Difference Attention Blocks Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 27

Resolution
verified exact
arxiv_id, observed 2026-05-16T01:35:37.953991Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-10T17:49:33.822264Z digest=sha256:f8daa3262c800ec177b5f3410cd3f5a61d2d54769f1bf1d91b764faf79492787

Observation 229b929c-a899-4e47-951c-85c9d90227d1 · inbound

CapTalk: Unified Voice Design for Single-Utterance and Dialogue Speech Generation cites this paper.

CapTalk: Unified Voice Design for Single-Utterance and Dialogue Speech Generation Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 32

Resolution
verified exact
arxiv_id, observed 2026-05-16T01:35:37.953991Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-10T17:15:28.918204Z digest=sha256:a13cadbc965e5dd3f3c51955379da781216d565acc5e3679dd22260bb4c1459a

Observation 9000eaa8-df4c-4b49-ac77-9d85d0512ddc · inbound

AVGen-Bench: A Task-Driven Benchmark for Multi-Granular Evaluation of Text-to-Audio-Video Generation cites this paper.

AVGen-Bench: A Task-Driven Benchmark for Multi-Granular Evaluation of Text-to-Audio-Video Generation Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 2

Resolution
metadata mismatch
arxiv_id, observed 2026-05-16T01:35:37.953991Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-10T17:14:30.737975Z digest=sha256:8b3ec9bad5cbeeffc1c6f926fdbec538302f1ac55dfcfafad65436b053ebf447

Observation 28c59f1c-b38f-4447-9df4-95506d2bd04d · inbound

Tracking High-order Evolutions via Cascading Low-rank Fitting cites this paper.

Tracking High-order Evolutions via Cascading Low-rank Fitting Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 18

Resolution
verified exact
arxiv_id, observed 2026-05-16T01:35:37.953991Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=arxiv_source observed=2026-05-10T15:55:27.722919Z digest=sha256:4b37e79361e1102a8e03e4b2193dc91a35c2bd9361bbbc8e7b2bbc03ff20f6e0

Observation 23575bc6-0b87-4592-baa2-0e8499704df1 · inbound

Continuous Adversarial Flow Models cites this paper.

Continuous Adversarial Flow Models Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 66

Resolution
metadata mismatch
arxiv_id, observed 2026-05-16T01:35:37.953991Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-10T15:25:53.420119Z digest=sha256:ec51ee5a9d27b8ddca7c2d024143e41270b03f2c1634958cac9cab6bfb0a67bc

Observation d234a1bb-a95d-4a21-870b-5da508d07eaa · inbound

OmniShow: Unifying Multimodal Conditions for Human-Object Interaction Video Generation cites this paper.

OmniShow: Unifying Multimodal Conditions for Human-Object Interaction Video Generation Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 6

Resolution
verified exact
arxiv_id, observed 2026-05-16T01:35:37.953991Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-10T15:09:02.727887Z digest=sha256:3308810d7bad1d467a5426b4cf2fd9d253a7861289b3f56571364924d8db0026

Observation d44bfb3c-8401-40f5-bb6f-2176210b7468 · inbound

Seedance 2.0: Advancing Video Generation for World Complexity cites this paper.

Seedance 2.0: Advancing Video Generation for World Complexity Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 16

Resolution
verified exact
arxiv_id, observed 2026-05-16T01:35:37.953991Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-10T13:34:36.248186Z digest=sha256:71657f49e6510b0080d1f62263a4e7e84250a053757031e213978fe2d3bf5a71

Observation 0ef97cae-6400-408f-ac71-639cc673a27d · inbound

Efficient Video Diffusion Models: Advancements and Challenges cites this paper.

Efficient Video Diffusion Models: Advancements and Challenges Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 17

Resolution
metadata mismatch
arxiv_id, observed 2026-05-16T01:35:37.953991Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-10T08:28:29.706249Z digest=sha256:4c26bc62518ee97bf7417a51baa4caa25323eb41c3d995c1df609c74082d5589

Observation 8c0fda48-d7d0-4dd7-9b2e-7a83bc068b62 · inbound

Motif-Video 2B: Technical Report cites this paper.

Motif-Video 2B: Technical Report Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 34

Resolution
verified exact
arxiv_id, observed 2026-05-16T01:35:37.953991Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-10T15:50:04.001693Z digest=sha256:bce9d061d89acd62ea7298fc5c49510907f99936f61c96de56a73b2dbcc2b1ca

Observation 2bab4669-4972-4e97-a733-64d368830bd0 · inbound

Motif-Video 2B: Technical Report cites this paper.

Motif-Video 2B: Technical Report Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 34

Resolution
verified exact
local_arxiv, observed 2026-05-21T00:13:53.094129Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-21T00:12:23.096146Z digest=sha256:3125c002d1f023d99789bc7257d40c4d27e002e826719e3afb8d70bf75dcaaee

Observation c7420079-6a16-4658-9abd-e0a195f14955 · inbound

OmniHuman: A Large-scale Dataset and Benchmark for Human-Centric Video Generation cites this paper.

OmniHuman: A Large-scale Dataset and Benchmark for Human-Centric Video Generation Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 38

Resolution
metadata mismatch
arxiv_id, observed 2026-05-16T01:35:37.953991Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-10T05:19:49.671136Z digest=sha256:5ae75300db5b6c5473ffb98ad3db388e0ef6c5da6256a97d82fd1960deaa13e6

Observation fa5ece1a-5850-478c-b8e9-8622d87273e5 · inbound

OmniHuman: A Large-scale Dataset and Benchmark for Human-Centric Video Generation cites this paper.

OmniHuman: A Large-scale Dataset and Benchmark for Human-Centric Video Generation Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 38

Resolution
metadata mismatch
local_arxiv, observed 2026-07-05T12:41:04.374148Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-07-05T12:34:41.758238Z digest=sha256:c185ddd598a13918dc59cf716e27406dd47f20070f5183b8f199a9343063b532

Observation d55cae8b-62ff-4634-900c-ff5b9440ef24 · inbound

How Far Are Video Models from True Multimodal Reasoning? cites this paper.

How Far Are Video Models from True Multimodal Reasoning? Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 57

Resolution
metadata mismatch
arxiv_id, observed 2026-05-16T01:35:37.953991Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-10T02:44:52.920816Z digest=sha256:6782cf064db8476a55bef9d3f83768db76550089268e12d91b2c3966b66e8934

Observation 4ae96787-b8e6-434b-9c83-f93a03b1b1a5 · inbound

ViPO: Visual Preference Optimization at Scale cites this paper.

ViPO: Visual Preference Optimization at Scale Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 17

Resolution
verified exact
arxiv_id, observed 2026-05-16T01:35:37.953991Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-08T04:12:47.226661Z digest=sha256:139d3316b79a28db1e46a066adaa93cb265a818bcf27f853745e5ad691d3f417

Observation c8ebb340-0d7f-4826-a686-8bebeedb0c54 · inbound

Leveraging Verifier-Based Reinforcement Learning in Image Editing cites this paper.

Leveraging Verifier-Based Reinforcement Learning in Image Editing Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 48

Resolution
verified exact
arxiv_id, observed 2026-05-16T01:35:37.953991Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-07T08:00:33.307429Z digest=sha256:79ab7e2f5e17f632efd37eb2a43ee8c2c26a359c01f84b1e5ace9fe777972e41

Observation 83c0e3ed-76a5-478a-b508-084bed995916 · inbound

Leveraging Verifier-Based Reinforcement Learning in Image Editing cites this paper.

Leveraging Verifier-Based Reinforcement Learning in Image Editing Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 48

Resolution
verified exact
local_arxiv, observed 2026-05-21T09:14:05.908619Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-21T09:11:02.183133Z digest=sha256:faf6da798ad2d7f4cc3ffb5926e4f7425bb661d667fb56337916ed36cf3f2831

Observation 3d12dd9e-dbdd-441f-b418-43deb0fbb4c8 · inbound

TrajShield: Trajectory-Level Safety Mediation for Defending Text-to-Video Models Against Jailbreak Attacks cites this paper.

TrajShield: Trajectory-Level Safety Mediation for Defending Text-to-Video Models Against Jailbreak Attacks Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 5

Resolution
verified exact
arxiv_id, observed 2026-05-16T01:35:37.953991Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-08T19:27:00.278658Z digest=sha256:ceeef52f2d44a13f93327b6ce657f1f1bea51f2bf0c13534268c1b6a8dfabc75

Observation 5123ef35-7542-4490-8c50-f85e298b1d28 · inbound

AniMatrix: An Anime Video Generation Model that Thinks in Art, Not Physics cites this paper.

AniMatrix: An Anime Video Generation Model that Thinks in Art, Not Physics Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 7

Resolution
verified exact
arxiv_id, observed 2026-05-16T01:35:37.953991Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-08T01:23:27.990472Z digest=sha256:3af8c7413c98ab8e8df671e3a3dab7fb0f54b279ba3d4eac279a6eee34ac72a5

Observation f62a5cc8-59ba-41eb-b556-402bcd456ca8 · inbound

AniMatrix: An Anime Video Generation Model that Thinks in Art, Not Physics cites this paper.

AniMatrix: An Anime Video Generation Model that Thinks in Art, Not Physics Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 7

Resolution
verified exact
arxiv_id, observed 2026-05-16T01:35:37.953991Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-08T19:04:02.414172Z digest=sha256:2c76bc222d0865ca44e1631dbd6af0b3153534e0c9c3feb93c527cf1da0c4181

Observation 46a78ab4-7914-4833-8bc5-0a69b6157d21 · inbound

AniMatrix: An Anime Video Generation Model that Thinks in Art, Not Physics cites this paper.

AniMatrix: An Anime Video Generation Model that Thinks in Art, Not Physics Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 7

Resolution
verified exact
arxiv_id, observed 2026-05-16T01:35:37.953991Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-12T03:39:47.335022Z digest=sha256:587b35fa73828b2e1bc63c85eb9944635842914e9a3c986aab6fe3a5fcdd5ef9

Observation 122855f6-e584-415f-b32a-af388ff8196a · inbound

LIVEditor-14B: Lightning Unified Video Editing via In-Context Sparse Attention cites this paper.

LIVEditor-14B: Lightning Unified Video Editing via In-Context Sparse Attention Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 5

Resolution
verified exact
local_arxiv, observed 2026-07-01T00:25:09.297592Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=arxiv_source observed=2026-07-01T00:24:30.573122Z digest=sha256:4066c4933afe99d8bf2fab577fa535dae5de7d63ea7500cc8840ed04d5f87f43

Observation 75a61d9e-d97b-4b21-baee-d70d7d641625 · inbound

Diffusion-APO: Trajectory-Aware Direct Preference Alignment for Video Diffusion Transformers cites this paper.

Diffusion-APO: Trajectory-Aware Direct Preference Alignment for Video Diffusion Transformers Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 32

Resolution
verified exact
arxiv_id, observed 2026-05-16T01:35:37.953991Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-11T01:58:25.291448Z digest=sha256:cb5444e0fa8a02b7d8418c83efcdcfda9c23e3b1ca8a1e982248200295830f88

Observation 3ca4b3dc-3d86-42b9-bc83-c43bce547d9e · inbound

SyncDPO: Enhancing Temporal Synchronization in Video-Audio Joint Generation via Preference Learning cites this paper.

SyncDPO: Enhancing Temporal Synchronization in Video-Audio Joint Generation via Preference Learning Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 37

Resolution
verified exact
arxiv_id, observed 2026-05-16T01:35:37.953991Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-13T07:01:40.333448Z digest=sha256:e93f1e0d00d274b430d78c38213e87a54b8c8424d7d7c6ffd4c83f60ffc4c2f9

Observation 16684474-5ee6-48f8-a121-c0781104fe1b · inbound

Cutting rules in strong field QED with application to trident pair production cites this paper.

Cutting rules in strong field QED with application to trident pair production Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 16

Resolution
unresolved
no resolver link, observed 2026-07-12T16:57:23.214654Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-12T16:57:23.214654Z digest=sha256:429ac55ff744709a99f6cb7aaae7bcee9c3bb5fdfde369a7927186694dfba5f2

Observation 1ebd594e-cd1e-4c7a-bae8-2a85e5baa869 · inbound

OmniNFT: Modality-wise Omni Diffusion Reinforcement for Joint Audio-Video Generation cites this paper.

OmniNFT: Modality-wise Omni Diffusion Reinforcement for Joint Audio-Video Generation Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 16

Resolution
verified exact
arxiv_id, observed 2026-05-16T01:35:37.953991Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-13T06:16:20.612291Z digest=sha256:3e63ccea2edb5bac8d296f2d9741f4141a7a61c1d7b036ef67a894d2bc644933

Observation 29dd4af4-57b7-4dfc-8b38-6cdcf2c9b781 · inbound

RAVEN: Real-time Autoregressive Video Extrapolation with Consistency-model GRPO cites this paper.

RAVEN: Real-time Autoregressive Video Extrapolation with Consistency-model GRPO Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 11

Resolution
verified exact
local_arxiv, observed 2026-07-01T14:35:47.242206Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-06-30T20:38:28.328436Z digest=sha256:6281fcbab9f37a737cc8a35b62658d20c5546e33d711809c42f41bef9485b1e9

Observation b786b1b1-b1ae-4645-9463-46c154088a4e · inbound

VGenST-Bench: A Benchmark for Spatio-Temporal Reasoning via Active Video Synthesis cites this paper.

VGenST-Bench: A Benchmark for Spatio-Temporal Reasoning via Active Video Synthesis Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 63

Resolution
verified exact
local_arxiv, observed 2026-05-22T07:14:42.803212Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-22T07:12:02.612292Z digest=sha256:f2d73f3701b19adead11bdf3f8a9f46cdc765e59ba261895c05461e887f1cf3d

Observation 82d8deff-88c0-487b-9608-c46a012b312e · inbound

AVBench: Human-Aligned and Automated Evaluation Benchmark for Audio-Video Generative Models cites this paper.

AVBench: Human-Aligned and Automated Evaluation Benchmark for Audio-Video Generative Models Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 26

Resolution
metadata mismatch
local_arxiv, observed 2026-06-30T13:44:41.253589Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-06-30T13:35:01.226818Z digest=sha256:bce2b924745c286cbac426f8f3ebe28456f8b7636e06cce4089766f100444dfc

Observation 946c3892-ee94-42a7-8583-3b70a44bd39b · inbound

WBench: A Comprehensive Multi-turn Benchmark for Interactive Video World Model Evaluation cites this paper.

WBench: A Comprehensive Multi-turn Benchmark for Interactive Video World Model Evaluation Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 75

Resolution
verified exact
local_arxiv, observed 2026-06-29T23:14:02.270565Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-06-29T22:57:08.381846Z digest=sha256:1f8770faee2205b7b311c7a71746cce77fe59f13968319b4851368812340d153

Observation f8a645cc-70f2-4ce5-9cf5-c13afee3d265 · inbound

What-If World: A Causal Benchmark for General World Models in Embodied Scenarios cites this paper.

What-If World: A Causal Benchmark for General World Models in Embodied Scenarios Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 52

Resolution
verified exact
local_arxiv, observed 2026-06-29T18:23:50.358946Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-06-29T18:23:22.987086Z digest=sha256:e3c179026e6cbd5eb54a993e96808f104fe05c2836c1135e797fadc51918d877

Observation 44dc19ab-35b6-4beb-bc2a-431100d36e52 · inbound

VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization cites this paper.

VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 24

Resolution
verified exact
local_arxiv, observed 2026-07-01T22:26:17.328846Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-06-28T15:26:21.284810Z digest=sha256:a65769db4e5a673a8613affa3821f98a1444d2e1d7c393a389a02b52b85f54bb

Observation b99d2df6-a381-4f4e-9bbe-e844073b73ad · inbound

VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization cites this paper.

VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 24

Resolution
verified exact
local_arxiv, observed 2026-06-30T10:44:36.759022Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-06-30T10:38:22.619277Z digest=sha256:5453feab415af43a325c996b4f73bceba6a8478b3f71c6361b299803eb15c22b

Observation c871ff8a-3064-43b8-8b6f-f530e697afec · inbound

FlowCodec: One-Step Flow Prior for Generative Image Compression cites this paper.

FlowCodec: One-Step Flow Prior for Generative Image Compression Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 46

Resolution
verified exact
local_arxiv, observed 2026-07-04T07:29:38.428163Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-06-26T13:28:49.915679Z digest=sha256:d3ecfa712e011ba5193c74d6cb6572c64c4aeea6fdab8b5be30ad55dcb6a79e0

Observation 819fa507-37af-4d40-89d6-f66a1c77f7fe · inbound

Recommendation as Generation: Unifying Personalized Video Generation and Recommendation at Industrial Scale cites this paper.

Recommendation as Generation: Unifying Personalized Video Generation and Recommendation at Industrial Scale Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 17

Resolution
verified exact
local_arxiv, observed 2026-07-04T20:20:07.211661Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-06-25T20:21:09.611166Z digest=sha256:9f69c1c5bd92002fd2c1310dc283a61bcbbdbe793983255521ded845b7b3e157

Observation 5a5dce90-d21f-4971-9bef-90c7f02ae522 · inbound

DomainShuttle: Freeform Open Domain Subject-driven Text-to-video Generation cites this paper.

DomainShuttle: Freeform Open Domain Subject-driven Text-to-video Generation Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 19

Resolution
verified exact
local_arxiv, observed 2026-07-04T21:10:09.687040Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-06-25T19:00:23.260939Z digest=sha256:e2388ce2b0c2b4e1ff39a7d575f9c92ba3576ba2c9f12cba3c5fa105a88c782e

Observation 95225cc9-4e3a-4cfd-a44a-86e3b6b83be3 · inbound

Disco-LoRA: Disentangled Composition of Content, Style, and Motion for Multi-concept Video Customization cites this paper.

Disco-LoRA: Disentangled Composition of Content, Style, and Motion for Multi-concept Video Customization Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 48

Resolution
verified exact
local_arxiv, observed 2026-07-04T12:49:52.793549Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-06-26T05:51:29.839498Z digest=sha256:a86fb7fa3dacb082b6ad5dde73a72ebe7751e1b81332170540ff62f0ae257a40

Observation 5c9586da-043c-4bf1-910f-9380fe8d4511 · inbound

PhysisForcing: Physics Reinforced World Simulator for Robotic Manipulation cites this paper.

PhysisForcing: Physics Reinforced World Simulator for Robotic Manipulation Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 38

Resolution
verified exact
local_arxiv, observed 2026-06-29T20:03:56.964014Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-06-29T04:34:38.286863Z digest=sha256:47302d071647e629fbc8849e696ea537ed496561338924b1ddc311986f859075

Observation 54a8519e-bdde-4167-bfd3-06ee27c731c2 · inbound

World Narrative Model for Highly Controllable Video Generation: A Paradigm Shift from Pixel Sampling to Physical World Orchestration cites this paper.

World Narrative Model for Highly Controllable Video Generation: A Paradigm Shift from Pixel Sampling to Physical World Orchestration Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 4

Resolution
verified exact
local_arxiv, observed 2026-07-01T10:25:41.688593Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-07-01T05:31:43.678762Z digest=sha256:744db4b70ae809ec4063d9b0bbdbd4841df165045de17ce550609d8094e50d74

Observation 1cf158ce-4548-49c4-bf50-44b718672a01 · inbound

World Narrative Model for Highly Controllable Video Generation: A Paradigm Shift from Pixel Sampling to Physical World Orchestration cites this paper.

World Narrative Model for Highly Controllable Video Generation: A Paradigm Shift from Pixel Sampling to Physical World Orchestration Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 4

Resolution
unresolved
no resolver link, observed 2026-07-15T10:20:59.147440Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-15T10:20:59.147440Z digest=sha256:2fed2dbc22a8e660b5818ce38656c3913d8603e68b2fcc71b294bb911b9b0b31

Observation 1a9f6eed-5699-4ddb-82e4-fb62d456eb54 · inbound

GigaWorld-1: A Roadmap to Build World Models for Robot Policy Evaluation cites this paper.

GigaWorld-1: A Roadmap to Build World Models for Robot Policy Evaluation Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 98

Resolution
unresolved
no resolver link, observed 2026-07-12T08:04:48.963890Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-12T08:04:48.963890Z digest=sha256:50761fa3f3a727ada30089a96c53299a8ea94c7f52a3d24013557e3883dc276d

Observation 640a63ec-b9ac-4165-b587-66919f5e2402 · inbound

MoWorld: A Flash World Model cites this paper.

MoWorld: A Flash World Model Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 4

Resolution
verified exact
local_arxiv, observed 2026-07-08T13:14:53.141871Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-07-08T13:10:31.940263Z digest=sha256:113e84d1162e993b8a5880613229161e1a39a17289ed5d52d296ae831c47629d

Observation ef7ecc3c-17f7-47b5-8297-f3e530923d1e · inbound

MoWorld: A Flash World Model cites this paper.

MoWorld: A Flash World Model Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-04T04:32:03.964414Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T04:32:03.964414Z digest=sha256:50543a17306c265360bac91547b908b9117196997540b69c9cd828dcecf6524e

Observation 414590e5-777f-4818-ab82-213f3920114d · inbound

OpenCoF: Learning to Reason Through Video Generation cites this paper.

OpenCoF: Learning to Reason Through Video Generation Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 32

Resolution
verified exact
local_arxiv, observed 2026-07-10T01:46:40.968677Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-07-10T01:43:37.265723Z digest=sha256:a923cc30d73d16a66f1c52d6c65b573e915aec7a0bf17e6f35b02fd441616ac0

Observation 1df2c8ca-31b2-47fa-a3de-c07bda2fee73 · inbound

Wan-Dancer: A Hierarchical Framework for Minute-scale Coherent Music-to-Dance Generation cites this paper.

Wan-Dancer: A Hierarchical Framework for Minute-scale Coherent Music-to-Dance Generation Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 23

Resolution
unresolved
no resolver link, observed 2026-07-13T01:59:43.167178Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T01:59:43.167178Z digest=sha256:8c1ff77ea7111ed53c923991b03d19f099fd041878be6a9f648e82953990d862

Observation 32cf42fd-4a8a-4d25-a7c6-5f04a555ca2a · inbound

Wan-Dancer: A Hierarchical Framework for Minute-scale Coherent Music-to-Dance Generation cites this paper.

Wan-Dancer: A Hierarchical Framework for Minute-scale Coherent Music-to-Dance Generation Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 23

Resolution
unresolved
no resolver link, observed 2026-07-14T15:10:13.757131Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-14T15:10:13.757131Z digest=sha256:21e6fd281096a56c22aae46d02ecc6449b5390b3df48b77f1c372cfe25cf5a50

Observation 9bbae4a9-445f-4ba9-8f7d-0a1b3abff41f · inbound

Wan-Dancer: A Hierarchical Framework for Minute-scale Coherent Music-to-Dance Generation cites this paper.

Wan-Dancer: A Hierarchical Framework for Minute-scale Coherent Music-to-Dance Generation Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-02T07:35:24.824730Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T07:35:24.824730Z digest=sha256:69e39d96f7a0d67e0dbb9df16d3099eaf51f20f0ed2f8db99374d8bbe5374f36

Observation 9586fda1-1b63-4658-82d5-53bfb2ef1cfd · inbound

Apple-$\pi$: Benchmarking Thinking with Video Towards Law-Grounded Physical Intelligence cites this paper.

Apple-$\pi$: Benchmarking Thinking with Video Towards Law-Grounded Physical Intelligence Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 53

Resolution
unresolved
no resolver link, observed 2026-08-01T21:07:27.053016Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T21:07:27.053016Z digest=sha256:8e966b273e15da5aca943bb2a2b25dadb0ad79b3af35b6a6554cdfd638c70a1a

Observation 5056ec1f-3f18-4bf9-a550-51a1da8591fe · inbound

Between Safe Boundaries: Exploiting Temporal Consistency for Jailbreaking Text-To-Video Generation Models cites this paper.

Between Safe Boundaries: Exploiting Temporal Consistency for Jailbreaking Text-To-Video Generation Models Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-01T18:33:05.156863Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T18:33:05.156863Z digest=sha256:9bee6d0f823826b5a9b635e4794865e2c14f2f58a84b485fa3cc0bf8f7afe6b7

Observation d935e25e-d83a-49b5-99c2-74c849191c30 · inbound

ShotPlan: Cinematic Video Generation with Learnable Planning Token cites this paper.

ShotPlan: Cinematic Video Generation with Learnable Planning Token Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-01T17:22:32.116181Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T17:22:32.116181Z digest=sha256:8abd628903da55130d1411658e05ed3d95de2ed498ad2af4358d3dd05ec06602

Observation c0b97634-0ed4-4fe9-a3bf-81d665ef5566 · inbound

HOMIE: Human-object Centric Video Personalization via Multimodal Intelligent Enhancement cites this paper.

HOMIE: Human-object Centric Video Personalization via Multimodal Intelligent Enhancement Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 57

Resolution
unresolved
no resolver link, observed 2026-08-01T15:42:24.521015Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:42:24.521015Z digest=sha256:8b516920bcdcd8f051ce32f67067eacb440941627c7ef4f1268b88152420bd70

Observation 84e1bf0e-39e2-4539-9807-18a55528360e · inbound

KineBench: Benchmarking Embodied World Models via IDM-Free Kinematic Grounding cites this paper.

KineBench: Benchmarking Embodied World Models via IDM-Free Kinematic Grounding Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-01T11:29:24.944764Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T11:29:24.944764Z digest=sha256:3b092eaf7fb21749737104fab28873feed6a52d5e1b87a40ce93cb406e79fd5a

Observation bdf94772-5f16-4d36-805e-1eabfb43d16e · inbound

BWM: A Low-Cost High-Fidelity World Simulator for Robot Learning cites this paper.

BWM: A Low-Cost High-Fidelity World Simulator for Robot Learning Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-03T09:43:31.793781Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T09:43:31.793781Z digest=sha256:6d5435e9cbe9789d1ad3ec016c98d98785bd94ed3d87145adcdc685812f5345c

Observation c3c5a997-5f97-462a-833d-4b2535c98401 · inbound

EchoCache: Energy-Guided Cross-Modal Caching for Efficient Audio-Driven Video Generation cites this paper.

EchoCache: Energy-Guided Cross-Modal Caching for Efficient Audio-Driven Video Generation Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-04T06:45:46.185168Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T06:45:46.185168Z digest=sha256:5b42a7b369cf74a10b7531fbb362d78eea7951e0c7db6a82757eb76431887062