Pith. sign in

Paper Citation Record · LEDGER

GenSync: A Generalized Talking Head Framework for Audio-driven Multi-Subject Lip-Sync using 3D Gaussian Splatting

As of 22 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 1 inbound Pith citation observation for arXiv:2505.01928.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.01928 v1

Coverage vector

measured 20 of 20 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-16T04:08:32.948459Z

measured 21 of 21 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-22T06:32:14.747728+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T13:21:46.744817Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: pith, observed 2026-08-07T13:21:52.706013Z

Reference resolution

20 of 20 outbound references displayed

  • verified exact0
  • verified fuzzy10
  • unresolved10
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation f6bde96a-69f0-4a47-b28e-c9a57484603b · outbound

This paper cites Openface: an open source facial behavior anal- ysis toolkit.

GenSync: A Generalized Talking Head Framework for Audio-driven Multi-Subject Lip-Sync using 3D Gaussian Splatting Openface: an open source facial behavior anal- ysis toolkit

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:08:33.268964Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-16T04:08:32.648452Z digest=sha256:f16a4ab06b25e87aad18b5d7cefeaf7a4be1ca4a31a750e889ec12a54ce31300

Observation 919220e9-cde1-412e-8f99-cfd7c6387c3f · outbound

This paper cites Dreamavatar: Text-and-shape guided 3d hu- man avatar generation via diffusion models.

GenSync: A Generalized Talking Head Framework for Audio-driven Multi-Subject Lip-Sync using 3D Gaussian Splatting Dreamavatar: Text-and-shape guided 3d hu- man avatar generation via diffusion models

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-16T04:08:32.651790Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T04:08:32.651790Z digest=sha256:2acafb4f0935cced542b021e86044721612a30bf2e1a68c52d75d94a4e8be0ef

Observation b7d9c9d6-99f9-470f-827f-d9990d410e9c · outbound

This paper cites MI-NeRF: Learning a Single Face NeRF from Multiple Identities.

GenSync: A Generalized Talking Head Framework for Audio-driven Multi-Subject Lip-Sync using 3D Gaussian Splatting MI-NeRF: Learning a Single Face NeRF from Multiple Identities

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-16T04:08:32.742678Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T04:08:32.742678Z digest=sha256:ec294e9d51d1ffdbe4b7ccc68c4e35ce9f199f2367da6379520747ee46d6107b

Observation e59facc4-c995-4511-a342-4ffc7efab046 · outbound

This paper cites GaussianTalker: Real-Time High-Fidelity Talking Head Synthesis with Audio-Driven 3D Gaussian Splatting.

GenSync: A Generalized Talking Head Framework for Audio-driven Multi-Subject Lip-Sync using 3D Gaussian Splatting GaussianTalker: Real-Time High-Fidelity Talking Head Synthesis with Audio-Driven 3D Gaussian Splatting

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-16T04:08:32.820998Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T04:08:32.820998Z digest=sha256:d7b0bbe773ddd8959fbd2722af1b45771685d37fbea5631801d6802bd7539d25

Observation 463cdfb1-613a-4276-b807-1c124b4df3b6 · outbound

This paper cites Morphable face models - an open frame- work.

GenSync: A Generalized Talking Head Framework for Audio-driven Multi-Subject Lip-Sync using 3D Gaussian Splatting Morphable face models - an open frame- work

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:08:33.212062Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-16T04:08:32.902536Z digest=sha256:ae26f1c62259ef70b0363b1d09909845690b42e1176b220dc9df87d0cd0ec24b

Observation c58c29df-e5c8-4b2c-8c1f-85dbdc1fdf3a · outbound

This paper cites Talk-act: Enhance textural- awareness for 2d speaking avatar reenactment with diffusion model.

GenSync: A Generalized Talking Head Framework for Audio-driven Multi-Subject Lip-Sync using 3D Gaussian Splatting Talk-act: Enhance textural- awareness for 2d speaking avatar reenactment with diffusion model

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:08:33.203612Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-16T04:08:32.906477Z digest=sha256:4a808b619ffaf6c74da51bb68bf77caadedc99b51419bd6e657e64ce922d5237

Observation f0c9f9cd-750c-44e6-b765-31f4b4843924 · outbound

This paper cites Ad-nerf: Audio driven neural ra- diance fields for talking head synthesis.

GenSync: A Generalized Talking Head Framework for Audio-driven Multi-Subject Lip-Sync using 3D Gaussian Splatting Ad-nerf: Audio driven neural ra- diance fields for talking head synthesis

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:08:33.195489Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-16T04:08:32.909567Z digest=sha256:4cdd4b67f35c96709d470a387ba74a0beaf4822191d4a8007f105db27ae13f54

Observation fccda072-525a-4500-9468-f97fb1e837bd · outbound

This paper cites Generative adversarial net- works (gans) for audio-visual speech recognition in artificial intelligence iot.

GenSync: A Generalized Talking Head Framework for Audio-driven Multi-Subject Lip-Sync using 3D Gaussian Splatting Generative adversarial net- works (gans) for audio-visual speech recognition in artificial intelligence iot

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:08:33.187252Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-16T04:08:32.914030Z digest=sha256:60063b5e99ca7983f797d7345adab85636db8b0c7bc744515c9c8f16a7a826a5

Observation 4b3e175e-def5-4848-b036-011ada340d34 · outbound

This paper cites Gans trained by a two time-scale update rule converge to a local nash equilib- rium.

GenSync: A Generalized Talking Head Framework for Audio-driven Multi-Subject Lip-Sync using 3D Gaussian Splatting Gans trained by a two time-scale update rule converge to a local nash equilib- rium

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-16T04:08:32.916442Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T04:08:32.916442Z digest=sha256:ac55c2aa2c2a303dd67d1447e251a35593c40014a45b9e6f653a18721d5abacc

Observation be010d8e-5bb0-4ede-a7b1-a1bb2bc6515c · outbound

This paper cites A survey of audio synthesis and lip-syncing for synthetic video generation.

GenSync: A Generalized Talking Head Framework for Audio-driven Multi-Subject Lip-Sync using 3D Gaussian Splatting A survey of audio synthesis and lip-syncing for synthetic video generation

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:08:33.175515Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-16T04:08:32.919694Z digest=sha256:9278739f68b3954854bfc3a541405f14ce29461a40b0fcac72b01b0aeace624f

Observation 155e5280-eea6-4889-85da-7e96c8afcf96 · outbound

This paper cites 3d gaussian splatting for real-time radiance field rendering.

GenSync: A Generalized Talking Head Framework for Audio-driven Multi-Subject Lip-Sync using 3D Gaussian Splatting 3d gaussian splatting for real-time radiance field rendering

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-16T04:08:32.922374Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T04:08:32.922374Z digest=sha256:a8eee12dac6fbeb0c8c21312f24833de54ea6bd3933d7e42af6ac7fb5ed49fb7

Observation 624a95c4-3457-40f5-ba91-63c5cc76f5d3 · outbound

This paper cites Diff2lip: Audio conditioned dif- fusion models for lip-synchronization.

GenSync: A Generalized Talking Head Framework for Audio-driven Multi-Subject Lip-Sync using 3D Gaussian Splatting Diff2lip: Audio conditioned dif- fusion models for lip-synchronization

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:08:33.164191Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-16T04:08:32.926010Z digest=sha256:d7bab8776be9c1a620108c7dc07ebf022d65a79e8aec3bfde0fdeeca60a5cb50

Observation b3d4ae0f-a286-4262-944e-4694dbfe03f4 · outbound

This paper cites Synctalk: The devil is in the synchronization for talking head synthesis.

GenSync: A Generalized Talking Head Framework for Audio-driven Multi-Subject Lip-Sync using 3D Gaussian Splatting Synctalk: The devil is in the synchronization for talking head synthesis

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-16T04:08:32.929068Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T04:08:32.929068Z digest=sha256:21455442688bd083286ce8ee5ae88632da2fa9b209a4f32431baac782b9de4d6

Observation 56ccf865-76f7-4458-a05c-629d517c4dff · outbound

This paper cites 3dgs-avatar: Animatable avatars via deformable 3d gaussian splatting.

GenSync: A Generalized Talking Head Framework for Audio-driven Multi-Subject Lip-Sync using 3D Gaussian Splatting 3dgs-avatar: Animatable avatars via deformable 3d gaussian splatting

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:08:33.085803Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-16T04:08:32.931449Z digest=sha256:72baaf8b7abd6bc8664898ebfaeb69a4e4f2b721e63de1d3d8737548e92695f8

Observation 8eb210d7-1eff-4ae3-afbb-40b7feaeae13 · outbound

This paper cites SyncNet: correlating objective for time delay estimation in audio signals.

GenSync: A Generalized Talking Head Framework for Audio-driven Multi-Subject Lip-Sync using 3D Gaussian Splatting SyncNet: correlating objective for time delay estimation in audio signals

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-16T04:08:32.933299Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T04:08:32.933299Z digest=sha256:c013069cbdaae5ec9a912cd12a0e5640d53d52d0d9bc737878be7025cf05109a

Observation 5ff00ffa-3f77-4c24-94c5-317cd657c25f · outbound

This paper cites First order motion model for image animation.

GenSync: A Generalized Talking Head Framework for Audio-driven Multi-Subject Lip-Sync using 3D Gaussian Splatting First order motion model for image animation

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-16T04:08:32.935914Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T04:08:32.935914Z digest=sha256:7d23ea0bc9fc26ea12a3a8deed75a407050f2aa0f15e63f685c891c126e1dfaa

Observation e4207b2b-7394-496e-a5aa-1684d574cdd4 · outbound

This paper cites Masked lip-sync prediction by audio-visual contextual exploitation in transformers.

GenSync: A Generalized Talking Head Framework for Audio-driven Multi-Subject Lip-Sync using 3D Gaussian Splatting Masked lip-sync prediction by audio-visual contextual exploitation in transformers

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:08:33.010326Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-16T04:08:32.939488Z digest=sha256:82e5f56c504670590825d5c11e91fce73b9941336b8fc5e7d6c85d855c27a61a

Observation 6d58b878-16b3-4f1e-b640-c6fdb86540c1 · outbound

This paper cites X2face: A network for controlling face generation using images, audio, and pose codes.

GenSync: A Generalized Talking Head Framework for Audio-driven Multi-Subject Lip-Sync using 3D Gaussian Splatting X2face: A network for controlling face generation using images, audio, and pose codes

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:08:32.996210Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-16T04:08:32.942154Z digest=sha256:0b4c4ef658a02688806e076252516b575b17ede3cede403ceb445debe9be2b5b

Observation 8203e57d-0705-4c05-94d6-d044801f0215 · outbound

This paper cites X-portrait: Expressive portrait anima- tion with hierarchical motion attention.

GenSync: A Generalized Talking Head Framework for Audio-driven Multi-Subject Lip-Sync using 3D Gaussian Splatting X-portrait: Expressive portrait anima- tion with hierarchical motion attention

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-16T04:08:32.944881Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T04:08:32.944881Z digest=sha256:96d2a8171de66f98a1c45ca9533d16d4edd97eb40a52b65d7c3f84bbb0b0bcae

Observation efa63d35-3cac-4b31-891c-2ce05e50e885 · outbound

This paper cites The unreasonable effectiveness of deep features as a perceptual metric.

GenSync: A Generalized Talking Head Framework for Audio-driven Multi-Subject Lip-Sync using 3D Gaussian Splatting The unreasonable effectiveness of deep features as a perceptual metric

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-16T04:08:32.948459Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T04:08:32.948459Z digest=sha256:e05b02956a05d4c43fa10fde193f45804f582ffd21ce01bef43ab5a71af2aa22

Pith citing papers

Observation 0f4d8eed-6231-425c-93d5-77a7b2c782fe · inbound

FaceEditTalker: Controllable Talking Head Generation with Facial Attribute Editing cites this paper.

FaceEditTalker: Controllable Talking Head Generation with Facial Attribute Editing GenSync: A Generalized Talking Head Framework for Audio-driven Multi-Subject Lip-Sync using 3D Gaussian Splatting

Reference 32

Resolution
verified exact
local_arxiv, observed 2026-08-07T13:21:52.787831Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-07T13:21:46.744817Z digest=sha256:627ec187c078835614a1fbdc02f55d7f96a2d2dd6d36904070f717f904bcb07f