Pith. sign in

Paper Citation Record · LEDGER

VividTalk: One-Shot Audio-Driven Talking Head Generation Based on 3D Hybrid Prior

As of 20 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 13 inbound Pith citation observations for arXiv:2312.01841.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2312.01841 v2

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 13 of 13 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-19T06:32:44.657259+00:00

measured 13 of 13 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-12T13:17:46.691753Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-23T17:23:15.398525Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 8d8f8fd9-c39e-4a0a-8df3-f130a291b359 · inbound

JoyVASA: Portrait and Animal Image Animation with Diffusion-Based Audio-Driven Facial Dynamics and Head Motion Generation cites this paper.

JoyVASA: Portrait and Animal Image Animation with Diffusion-Based Audio-Driven Facial Dynamics and Head Motion Generation VividTalk: One-Shot Audio-Driven Talking Head Generation Based on 3D Hybrid Prior

Reference 23

Resolution
verified exact
arxiv_id, observed 2026-05-23T17:03:12.608008Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-05-23T16:59:57.727035Z digest=sha256:2603fe5d22b97cdc99603906b35f736d4a2e82fd5da966dccd9901121335c64f

Observation 306e1a67-eaa8-4b57-9930-6848f5967d12 · inbound

Sonic: Shifting Focus to Global Audio Perception in Portrait Animation cites this paper.

Sonic: Shifting Focus to Global Audio Perception in Portrait Animation VividTalk: One-Shot Audio-Driven Talking Head Generation Based on 3D Hybrid Prior

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-12T13:17:46.691753Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T13:17:46.691753Z digest=sha256:826de33ccb242d53d6e078b3ddf65b25fe997dbfe9530061789c524d606b4519

Observation 4635f127-0b1d-40ca-8554-96211389f874 · inbound

Multimodal Diffusion Transformer with Memory Bank for Scalable Long-Duration Talking Video Generation cites this paper.

Multimodal Diffusion Transformer with Memory Bank for Scalable Long-Duration Talking Video Generation VividTalk: One-Shot Audio-Driven Talking Head Generation Based on 3D Hybrid Prior

Reference 37

Resolution
verified exact
arxiv_id, observed 2026-05-23T17:23:15.401997Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-05-23T17:19:51.411937Z digest=sha256:82ec836f940872bc83af22489c2805c57f8bd7fb8c4b09edf2d48e5117860770

Observation 7e462c8e-0aec-4e93-8439-9e98c1bcc939 · inbound

Hallo3: Highly Dynamic and Realistic Portrait Image Animation with Video Diffusion Transformer cites this paper.

Hallo3: Highly Dynamic and Realistic Portrait Image Animation with Video Diffusion Transformer VividTalk: One-Shot Audio-Driven Talking Head Generation Based on 3D Hybrid Prior

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-12T05:06:43.873174Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T05:06:43.873174Z digest=sha256:f85aca26341f8b9fb665d11837bf2f8c7663d2a50b0d1f0d36c2c4b10cb017d2

Observation 5dc7be53-4fd3-42c8-8039-1d4788de8295 · inbound

MEMO: Memory-Guided Diffusion for Expressive Talking Video Generation cites this paper.

MEMO: Memory-Guided Diffusion for Expressive Talking Video Generation VividTalk: One-Shot Audio-Driven Talking Head Generation Based on 3D Hybrid Prior

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-11T21:28:26.433927Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T21:28:26.433927Z digest=sha256:f3745d1854a091df8797d3ac6727212a16482892037ec08688b629a242607652

Observation b13e71d9-e265-4cd3-81b5-a67f07271c7f · inbound

Real-time One-Step Diffusion-based Expressive Portrait Videos Generation cites this paper.

Real-time One-Step Diffusion-based Expressive Portrait Videos Generation VividTalk: One-Shot Audio-Driven Talking Head Generation Based on 3D Hybrid Prior

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-11T13:09:59.680046Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T13:09:59.680046Z digest=sha256:ccfed0adc0b4ee6fe187f83f7ed38efa84f3ef175a78c22e6b1ee31d441bf585

Observation 8646da8b-fec6-4e04-b489-8183f9fb14b4 · inbound

UniAvatar: Taming Lifelike Audio-Driven Talking Head Generation with Comprehensive Motion and Lighting Control cites this paper.

UniAvatar: Taming Lifelike Audio-Driven Talking Head Generation with Comprehensive Motion and Lighting Control VividTalk: One-Shot Audio-Driven Talking Head Generation Based on 3D Hybrid Prior

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-11T01:04:02.544652Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T01:04:02.544652Z digest=sha256:7a61c582f12a99b7b7c68aeb738687b6faaf8f4c5345e7168f5db8590194a03b

Observation 4a7c0ea5-5215-4246-8279-0bee21a27fb5 · inbound

MoEE: Mixture of Emotion Experts for Audio-Driven Portrait Animation cites this paper.

MoEE: Mixture of Emotion Experts for Audio-Driven Portrait Animation VividTalk: One-Shot Audio-Driven Talking Head Generation Based on 3D Hybrid Prior

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-10T22:23:50.687396Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:23:50.687396Z digest=sha256:26382e2401c12e00b6efb7d391ab85376a3357e92e4299d94b90c3ac46eb01d6

Observation d755df50-fff0-4158-a081-9ecf3c07e546 · inbound

Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model cites this paper.

Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model VividTalk: One-Shot Audio-Driven Talking Head Generation Based on 3D Hybrid Prior

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-07T21:11:25.321228Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T21:11:25.321228Z digest=sha256:1afa043c3f7a2e2c0218bce91271871d31e7f40eb4e5b9edf7cea244f5cb0460

Observation be10bb11-5a2c-458e-b027-b03348b3a6a7 · inbound

MirrorMe: Towards Realtime and High Fidelity Audio-Driven Halfbody Animation cites this paper.

MirrorMe: Towards Realtime and High Fidelity Audio-Driven Halfbody Animation VividTalk: One-Shot Audio-Driven Talking Head Generation Based on 3D Hybrid Prior

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-06T22:15:09.615461Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T22:15:09.615461Z digest=sha256:7155c96a8a3a2138b53617b6340f402395a07dda3b834a835230439dee2d3eac

Observation 69a7712c-c0c2-4437-8da7-34c3e4cddbec · inbound

MoDA: Multi-modal Diffusion Architecture for Talking Head Generation cites this paper.

MoDA: Multi-modal Diffusion Architecture for Talking Head Generation VividTalk: One-Shot Audio-Driven Talking Head Generation Based on 3D Hybrid Prior

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-06T20:23:38.901681Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T20:23:38.901681Z digest=sha256:90ed43c4418ce353b2f9bdf68df9065c3a04be808c21e277d53e32422a8a674c

Observation d31bcbb6-b8f8-42cb-b8a4-c4d34335d420 · inbound

MoDiT: Learning Highly Consistent 3D Motion Coefficients with Diffusion Transformer for Talking Head Generation cites this paper.

MoDiT: Learning Highly Consistent 3D Motion Coefficients with Diffusion Transformer for Talking Head Generation VividTalk: One-Shot Audio-Driven Talking Head Generation Based on 3D Hybrid Prior

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-06T19:38:20.536182Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T19:38:20.536182Z digest=sha256:358e5012d549d2d7a7fc4da75914f312243c8aebf98af5b7cff6b4ec9348ffd2

Observation fa57b284-95aa-4720-8122-48f2245aff9c · inbound

Mask-Free Audio-driven Talking Face Generation for Enhanced Visual Quality and Identity Preservation cites this paper.

Mask-Free Audio-driven Talking Face Generation for Enhanced Visual Quality and Identity Preservation VividTalk: One-Shot Audio-Driven Talking Head Generation Based on 3D Hybrid Prior

Reference 74

Resolution
unresolved
no resolver link, observed 2026-08-06T13:10:19.662786Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T13:10:19.662786Z digest=sha256:a3f2482e67a123624da369439c4ffae56586b9f4ee2f90eb924efd229b6ce1e8