Pith. sign in

Paper Citation Record · LEDGER

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation

As of 20 August 2026, this Paper Citation Record lists 64 of 64 outbound references and 0 inbound Pith citation observations for arXiv:2505.03603.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.03603 v5

Coverage vector

measured 64 of 64 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-15T23:53:10.734059Z

measured 64 of 64 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-20T06:33:59.587034+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

64 of 64 outbound references displayed

  • verified exact0
  • verified fuzzy2
  • unresolved62
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 005af95f-40fd-4416-ab9e-3e691170ca10 · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 1

Resolution
unresolved
raw_fallback, observed 2026-08-15T23:53:11.694893Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T23:53:10.403299Z digest=sha256:ac3d5e991ec5ea16b1da4993d59d9f61889d5a7eb9d4a5b9b679fa20f77fd485

Observation d3a6f0b1-14c9-4dd3-9779-70bd66e9abfd · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 2

Resolution
unresolved
raw_fallback, observed 2026-08-15T23:53:11.662525Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T23:53:10.413088Z digest=sha256:90d94422f9fa2b0a76a6c1442c9a551aa97f9c93f17a3dd6f729b70fcd639701

Observation 6ba4a103-5efc-4666-875d-51d049d5f19a · outbound

This paper cites Diffusion Self-Distillation for Zero-Shot Customized Image Generation.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Diffusion Self-Distillation for Zero-Shot Customized Image Generation

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.419914Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.419914Z digest=sha256:a5faaddedd79d03e6390a984b0508450030bfb898f85f44cdc2fa5aa399bd2f6

Observation 49b23449-0023-488e-9f9f-f7e699383ff6 · outbound

This paper cites TalkinNeRF: Animatable Neural Fields for Full-Body Talking Humans.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation TalkinNeRF: Animatable Neural Fields for Full-Body Talking Humans

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.425457Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.425457Z digest=sha256:9648def539836e5635df58363028cfced41e05473d9603b3059a20a72d4b95e6

Observation 185cb6d0-5542-4303-93cc-88bc4cd406f8 · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.430700Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.430700Z digest=sha256:7281a76967f40b1e6dad6d8b736c5189ba51541e4d0a4153dbd32452a9d286f8

Observation 7dd9f936-42ed-41c7-82e0-f2edbfb001c8 · outbound

This paper cites VLOGGER: Multimodal Diffusion for Embodied Avatar Synthesis.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation VLOGGER: Multimodal Diffusion for Embodied Avatar Synthesis

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.435300Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.435300Z digest=sha256:d2d2f03dd15df93a0974990a811917fae1f121d3df4aa2065a500305e1a037a6

Observation 722de5ee-6f4a-4973-ab22-1871f19a1d4f · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.441037Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.441037Z digest=sha256:abfb56eabeb1d76a6fcc6e3841e519411c712de1c510b5bc984149e72338f78e

Observation a481f56a-d775-465f-b8fd-51ae7b4d808b · outbound

This paper cites LivePortrait: Efficient Portrait Animation with Stitching and Retargeting Control.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation LivePortrait: Efficient Portrait Animation with Stitching and Retargeting Control

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.445901Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.445901Z digest=sha256:d7d77b308e99cb15e3aad327c4ade13a23658b12ff5232c2d41e7f398fa84b47

Observation 1ef3b2ca-1976-4684-aff0-d3ef85777b31 · outbound

This paper cites AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.450533Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.450533Z digest=sha256:84adefe3a078e57011482d3644b680397fc713c17fe873a21e7a5a886b2487e8

Observation c0773feb-bbb6-47f4-87cc-4a7c0e0c37b2 · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 10

Resolution
unresolved
raw_fallback, observed 2026-08-15T23:53:11.623963Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T23:53:10.455230Z digest=sha256:a7c6d7ad69ec89843b48ddcf42b9a03321c7e26ac86cffcf96596cd63351d889

Observation 1054744f-9fea-449f-8c23-8f64091ff361 · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.459848Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.459848Z digest=sha256:6b6c5ef7928f7608ea3023811fa0011314c49ff2fa4a6c33548df18fa75fa48f

Observation 570bd062-4347-43c8-ade6-0fadc0697da8 · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.464437Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.464437Z digest=sha256:3e063d3432df1703666f0bffeff077837f066cc2906a49b1b95284ba10b7dd0c

Observation 5901a5e4-6e56-4065-b3df-7b0790ebc8ea · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 13

Resolution
unresolved
raw_fallback, observed 2026-08-15T23:53:11.586577Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T23:53:10.468650Z digest=sha256:cbfdc6c9c270b67519e0460f9bede4a769973a87824e3c3bf7b23509808716c9

Observation 8c210c54-c825-4510-9167-3205de0ca737 · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.477349Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.477349Z digest=sha256:c25abc7936c0a4b54237a43fe195e74c3cd8973de723db7839c6ea3844bfa2fe

Observation 0a1aa957-c7a4-42d4-8f0b-54ee387975fc · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 15

Resolution
unresolved
raw_fallback, observed 2026-08-15T23:53:11.542059Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T23:53:10.481525Z digest=sha256:c603409e268af47f8ef1339ffa37bf64be503042b5cbfcfb325b424f43b153b8

Observation 33510c13-426f-49eb-b921-173b64dfa8ef · outbound

This paper cites The Kinetics Human Action Video Dataset.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation The Kinetics Human Action Video Dataset

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.486014Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.486014Z digest=sha256:f23e80f756ca4cea3459222e8ae0a84551e0dae8e0c37c6cc13241eff7975bba

Observation 3f73dec6-cc2a-4b71-92e4-83e7909e86d4 · outbound

This paper cites AI Choreographer: Music Conditioned 3D Dance Generation with AIST++.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation AI Choreographer: Music Conditioned 3D Dance Generation with AIST++

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.491758Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.491758Z digest=sha256:628bcb47827b0a9244b17644f893d898138ae50d26e41b573f1d3f1f659ae3ee

Observation 40e798ac-ba3f-4401-b50c-ec51610da179 · outbound

This paper cites SDXL-Lightning: Progressive Adversarial Diffusion Distillation.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation SDXL-Lightning: Progressive Adversarial Diffusion Distillation

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.496803Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.496803Z digest=sha256:5d85bb0a20d227253341d0a5792dbb9f3e5398c112fb84892590f404c643d38c

Observation 4287bf23-297c-41c3-8659-5ffb7507518b · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 19

Resolution
unresolved
raw_fallback, observed 2026-08-15T23:53:11.525063Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T23:53:10.502825Z digest=sha256:e1a22b87846c6294dbc0ea75ee8b7a56f612bd1ec2c6e895e2f04043117cdc6b

Observation 6b9504d4-e80b-4215-9928-a054378dce1a · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 20

Resolution
unresolved
raw_fallback, observed 2026-08-15T23:53:11.509627Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T23:53:10.508026Z digest=sha256:ff32573adcb628776257515f01f2a15d5c812fde3df90d30524ebb0a708728ce

Observation 152fa97d-6b5f-49ec-a272-6ae72f4d90f2 · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 21

Resolution
unresolved
raw_fallback, observed 2026-08-15T23:53:11.493756Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T23:53:10.512922Z digest=sha256:5c6e8a050e362ed5892930968bec2e01986d5f330b7c60b03377dc2fc8c473e5

Observation 88d9163a-c62c-4887-9811-12741f093cc0 · outbound

This paper cites Decoupled Weight Decay Regularization.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Decoupled Weight Decay Regularization

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.518299Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.518299Z digest=sha256:e2931aea8234043ecaff6d82625238a7b17e6edecb6bb67baaa08069a0a75eee

Observation 4a580119-8b08-4141-88f6-c07d75d3481b · outbound

This paper cites MediaPipe: A Framework for Building Perception Pipelines.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation MediaPipe: A Framework for Building Perception Pipelines

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.526995Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.526995Z digest=sha256:970ffb0afcbd4253c15758e352090740fee42eac1b667ca4d8f3778bdacdd16e

Observation 934df314-22a0-4ea5-935f-0225e4a7eade · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 24

Resolution
unresolved
raw_fallback, observed 2026-08-15T23:53:11.478257Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T23:53:10.534542Z digest=sha256:0ddaf3bafc4248408583c1fdda68323b644803f0dbd68d3178e3ec54ab22d98d

Observation 243c102f-64c8-4e22-801b-a22490f7fca2 · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 25

Resolution
unresolved
raw_fallback, observed 2026-08-15T23:53:11.461239Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T23:53:10.539813Z digest=sha256:1d52735bc952357780eb7a32d845293a94f6e13f8da2f889abea9c7b59ac560f

Observation 5943780c-6607-4658-a650-9d1a4be6fc19 · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 26

Resolution
unresolved
raw_fallback, observed 2026-08-15T23:53:11.444741Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T23:53:10.544250Z digest=sha256:19b4a796ba81825011da498286ce05ec7bbb4a88501d0368ac77c64f0cd7f76f

Observation 8d551484-6915-4553-8f65-3a5add798460 · outbound

This paper cites DINOv2: Learning Robust Visual Features without Supervision.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation DINOv2: Learning Robust Visual Features without Supervision

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.549819Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.549819Z digest=sha256:c147318b8f86edf8ec08a121382a3a73ac34045d0f0746cbb94c1050524d6067

Observation 0470dd98-4275-4ece-bc6f-bf3f51b9fe48 · outbound

This paper cites ControlNeXt: Powerful and Efficient Control for Image and Video Generation.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation ControlNeXt: Powerful and Efficient Control for Image and Video Generation

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.555077Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.555077Z digest=sha256:d7e5f57e724e501f2fe51d895d4df9bf4b09bfab68100f76ced0d98477a6d647

Observation 526f71d7-2b24-437b-bc1b-5eaff084742f · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 29

Resolution
unresolved
raw_fallback, observed 2026-08-15T23:53:11.428249Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T23:53:10.560203Z digest=sha256:0bf24a5d91a0e326bfbb6f5c2415a2beec5ed4558b8f8d190cbf106af8a0343a

Observation 09c105c4-df68-4776-9060-d4d293ef14e5 · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 30

Resolution
unresolved
raw_fallback, observed 2026-08-15T23:53:11.410926Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T23:53:10.566543Z digest=sha256:aac3e12e6c944d98392abe05ac567aabfc9608b70747437badbc9ca5a71cd763

Observation ff39cfb5-80da-4a1c-b259-c5d4c245334f · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 31

Resolution
unresolved
raw_fallback, observed 2026-08-15T23:53:11.395603Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T23:53:10.573091Z digest=sha256:0f11ef03d6711a0e4492628f4ec1078e43aca34d19340e7dd3f1d875bd2f14fc

Observation 0ccd88bd-55a6-47f9-8618-316d1f97c6e5 · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 32

Resolution
unresolved
raw_fallback, observed 2026-08-15T23:53:11.377870Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T23:53:10.579626Z digest=sha256:95a6299f7ec17c8bd0d20934d6f25c99ea35dd4224e01ca817fbe6f353c3ba23

Observation ec376700-f940-4ad6-bb8d-14b1b91cd02e · outbound

This paper cites wav2vec: Unsupervised Pre-training for Speech Recognition.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation wav2vec: Unsupervised Pre-training for Speech Recognition

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.585147Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.585147Z digest=sha256:9efacacd0b6cecf377f7ff104489c7ebf7b0c493abfe2870238f639e53a5133e

Observation ba653c28-f1b1-47d0-86f7-c62dda96d3cb · outbound

This paper cites Make-A-Video: Text-to-Video Generation without Text-Video Data.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Make-A-Video: Text-to-Video Generation without Text-Video Data

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.591016Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.591016Z digest=sha256:f88d45e3ee6c55ab1ba7b2cb477ca28d6f9de2d295a008ca9a50146035626edc

Observation d48b7f3e-3088-465a-b1ea-3ae99bd65432 · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.597250Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.597250Z digest=sha256:d50efac9f56d668e5b753144a9b05223c52dda4b8c189f3e09f6b0f3b38f84b9

Observation 8c2cd4b3-9997-4634-bf8a-8adb240c0342 · outbound

This paper cites Denoising Diffusion Implicit Models.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Denoising Diffusion Implicit Models

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.612956Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.612956Z digest=sha256:722996661f13bebc64c9629ad6d4bdf71f8583b270bc375db05c86c9c6e1a95e

Observation f7380701-9000-4697-8f36-f3a5ec9f08db · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 37

Resolution
unresolved
raw_fallback, observed 2026-08-15T23:53:11.342742Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T23:53:10.618432Z digest=sha256:1e5351f4953a0eac7b667a114794a1bb3102f5d5990f8839f14ae70253d1739b

Observation 28bccbb1-c3d1-4dac-9d8e-fc5d5387631d · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.623597Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.623597Z digest=sha256:40759d154960a03e8a1b63c7e734a3675c54540c45a1ec09a9e4f4089fe925ae

Observation 695ff11f-0adf-4324-b61a-1a01e7ed5d5a · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 39

Resolution
unresolved
raw_fallback, observed 2026-08-15T23:53:11.317700Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T23:53:10.628520Z digest=sha256:e518bd57489ff4ce53fb15b42499417e75afaf720d47b7feb1ac1bc45f7cdd45

Observation 9034a1f9-f74a-4dd2-9503-e15695511b5c · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 40

Resolution
unresolved
raw_fallback, observed 2026-08-15T23:53:11.302533Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T23:53:10.633694Z digest=sha256:526f8409613547f732ea3b1f57b7ee5ee347047d2e91c1e9c8bc12468d85ba3c

Observation 0a227b54-e910-4af0-a949-fa881e35e3a3 · outbound

This paper cites Towards Accurate Generative Models of Video: A New Metric & Challenges.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Towards Accurate Generative Models of Video: A New Metric & Challenges

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.638352Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.638352Z digest=sha256:b024ba074a91448766ec9da0509f2b0592b19987bb59aed1c5190ba76ed91189

Observation dc170380-bde5-48af-bd48-64a8ae8fad48 · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.643425Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.643425Z digest=sha256:80a372a76fc9b415ba4808eff9723b488400772b17a0812c27449a88245a9e96

Observation 438b30cd-7b9f-4af1-bffe-e60496149786 · outbound

This paper cites ModelScope Text-to-Video Technical Report.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation ModelScope Text-to-Video Technical Report

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.648192Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.648192Z digest=sha256:98cf50f33234a5d9a6ef5377f14332f7cad5fdd28aade3a0d9975b2c6e3652a5

Observation 84e0847d-c304-47ba-bfa9-30152b57b80e · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 44

Resolution
unresolved
raw_fallback, observed 2026-08-15T23:53:11.277989Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T23:53:10.653510Z digest=sha256:0429a19d9366e08535543d1f2b09e3dbc02cbb8b6461b835673187d97466a419

Observation f35b49f5-4e1a-49d2-88a5-7d436ebc11db · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.658318Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.658318Z digest=sha256:5c5b468431c5fab973bc496139b288fdca295bdf63570ba9670124f361e9fae7

Observation e20d1865-fd3d-499e-be39-03b3c7adaaf8 · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 46

Resolution
unresolved
raw_fallback, observed 2026-08-15T23:53:11.254495Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T23:53:10.663546Z digest=sha256:b0204acd4aacf96743d891a925f11c13618056431a0e4443fb3ea971980c31e2

Observation fc7df374-127c-4936-83e7-6e2639f45238 · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.668792Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.668792Z digest=sha256:cb567161ccc3c451d9294d7701ba91e0cafe5acb391a42ae9b936bd42bef53f7

Observation 29a0538a-5a70-427e-be9b-db4061972ed7 · outbound

This paper cites AniPortrait: Audio-Driven Synthesis of Photorealistic Portrait Animation.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation AniPortrait: Audio-Driven Synthesis of Photorealistic Portrait Animation

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.673843Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.673843Z digest=sha256:1d17d80896fee061e7c8a2290f184a4c7a536bf062ae35d9f8a6df87d72cec24

Observation 93044797-6903-437f-8e77-02ae360dbe3d · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 49

Resolution
unresolved
raw_fallback, observed 2026-08-15T23:53:11.229234Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T23:53:10.678718Z digest=sha256:e4d9a1047b3bbf93f3acde783155e2eb0bbe82489ef0d8b23c61a1f506d9366f

Observation 68eb3081-464b-46f1-957f-0217a99bf74c · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 50

Resolution
unresolved
raw_fallback, observed 2026-08-15T23:53:11.214332Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T23:53:10.683384Z digest=sha256:2a680b3c8d332bd230eca29c46dd679bb60d874d05acfe86202868cdee43e7ad

Observation b8b41908-e160-4ff8-8045-cb71e677f3a3 · outbound

This paper cites Hallo: Hierarchical Audio-Driven Visual Synthesis for Portrait Image Animation.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Hallo: Hierarchical Audio-Driven Visual Synthesis for Portrait Image Animation

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.687815Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.687815Z digest=sha256:0a419fd0f3594a26b38283cbc237640a058e37d1b4c83f9f1adeb3b0370397dd

Observation a76dae3b-2ffe-4383-a3b9-36aff557014b · outbound

This paper cites VASA-1: Lifelike Audio-Driven Talking Faces Generated in Real Time.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation VASA-1: Lifelike Audio-Driven Talking Faces Generated in Real Time

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.692654Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.692654Z digest=sha256:61cc04bac9fe8e32c677e2b93b459a31031ce30b5335b6e892f7f9a2a75bc300

Observation 93b34006-b725-4b4f-a51c-f7c1c76f3d36 · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 53

Resolution
unresolved
raw_fallback, observed 2026-08-15T23:53:11.199391Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T23:53:10.697775Z digest=sha256:2ecfe36c932178f420878be9a32ddad887486f645eb3a03d0ca9de3e5de1f2f6

Observation 11c53886-22d7-4135-9e49-0efee8191c39 · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 54

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.702560Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.702560Z digest=sha256:2240510b06b5d2d440408e271ae32043c1a2937025629f4685784688ead37116

Observation 708f8465-cdf9-440b-8177-0b2c76887735 · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 55

Resolution
unresolved
raw_fallback, observed 2026-08-15T23:53:11.174379Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T23:53:10.707015Z digest=sha256:f8ec5ef3a74b0b4b2eb46e846ca495932af370730039c4b038799e7a9b02b999

Observation 9b1a6ac0-84ff-44cc-a151-2e23c45aacaa · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 56

Resolution
unresolved
raw_fallback, observed 2026-08-15T23:53:11.159064Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T23:53:10.711248Z digest=sha256:7614824a85bcfa8337b52dabe5e935ec6d11e20d31b8ddfa1cb6ffcc0df741d0

Observation 17af8280-5d8b-4dd5-88c4-4503c457eed8 · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 57

Resolution
unresolved
raw_fallback, observed 2026-08-15T23:53:11.143678Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T23:53:10.715926Z digest=sha256:d9c3e1f11498f00eb504c1c0b7e81a693c7240d0bbe7276f431d02033b69e137

Observation 9cd3f0ba-4317-4a76-8085-15056800c643 · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 58

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.720581Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.720581Z digest=sha256:c20e18bccd9dbe5fcdd6eb5faa7a7fb9fb05ce9d2280227059a7537957c0013b

Observation ca9288d0-7764-4d24-9e5f-2b5edab549ab · outbound

This paper cites Tora: Trajectory-oriented Diffusion Transformer for Video Generation.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Tora: Trajectory-oriented Diffusion Transformer for Video Generation

Reference 59

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.724733Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.724733Z digest=sha256:5b9adb0d3ee03b9300033c8c79b5896044e1e8b19378e76a1d335b2f1583196c

Observation e40b2ffd-5e4b-4683-a806-f7fda36a5a30 · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 60

Resolution
unresolved
raw_fallback, observed 2026-08-15T23:53:11.118567Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T23:53:10.729216Z digest=sha256:0042dbdec0902b13d4c8f8760a952113b60fef274af74cb99998b60fbda68453

Observation 430b6695-fea2-4896-b1b3-95fac3d8e465 · outbound

This paper cites an unresolved cited work.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation Unresolved cited work

Reference 61

Resolution
unresolved
raw_fallback, observed 2026-08-15T23:53:11.102561Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T23:53:10.734059Z digest=sha256:021f5d74bfab077fdeba56a65a47746268a2d0a1f6ced51b984a2d100d9ad202

Observation 56434dc3-ae48-4ab4-bc7c-ed9ffbf30afb · outbound

This paper cites In International conference on machine learning.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation In International conference on machine learning

Reference 2015

Resolution
unresolved
no resolver link, observed 2026-08-15T23:53:10.607878Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T23:53:10.607878Z digest=sha256:1281b8e9ef1b5ac9924ac68a2925346b273d72a0c3be34bfcfa2f400d1dd29f4

Observation 0dafdf2d-19ee-4e66-86d4-340166b337fb · outbound

This paper cites InComputer Vision–ECCV 2020: 16th European Conference, Glasgow, UK, August 23–28, 2020, Proceedings, Part XVIII 16.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation InComputer Vision–ECCV 2020: 16th European Conference, Glasgow, UK, August 23–28, 2020, Proceedings, Part XVIII 16

Reference 2020

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T23:53:11.679323Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T23:53:10.408155Z digest=sha256:b603d798fd30cd0e95d1802749e8c29c00c788c794a4a2221d13940267f55fa2

Observation 01ee9dad-d260-4d56-9411-2fa03666a78e · outbound

This paper cites InProceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition.

A Unit Enhancement and Guidance Framework for Audio-Driven Avatar Video Generation InProceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition

Reference 2024

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T23:53:11.570259Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T23:53:10.472950Z digest=sha256:c28078e4a79cc94037cb58b7a0054b7547e4607cc938ff2200fe46e7bd2469ef

Pith citing papers

No inbound Pith citation observations are available.