{"as_of":"2026-08-14T19:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:01487332bfa62e6cde455e39c5f83cf91045af49a3e14ceccf2b59aaf4a7307c","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T10:11:08.907606Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.19525/citation-record","integrity":"/paper/2411.19525/integrity","json":"/paper/2411.19525/citation-record.json","paper":"/paper/2411.19525"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1801.01442","last_updated":"2017-12-06T16:18:31Z","snapshot_observed_at":"2026-07-06T06:17:13.488115Z","submitted_at":"2017-12-06T16:18:31Z","title":"ObamaNet: Photo-realistic lip-sync from text","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.01442","snapshot_observed_at":"2026-08-12T10:11:08.783110Z","title":"Obamanet: Photo-realistic lip-sync from text","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.783110Z"},"links":{"cited_paper":"/paper/1801.01442","citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:fab9466cfb1389914d6a3c43d2bf9f97b3c1cbbfe9637bdd2283443863cfd36b","observation_id":"7a4a2c2a-fc44-4d18-bc5f-005925d2ab8f","resolution":{"observed_at":"2026-08-12T10:11:08.783110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:09.440448Z","title":"Audio2face: Generating speech/face animation from single audio with attention-based bidirectional lstm networks","venue":null,"work_id":"83a89319-6d95-4416-af66-5e314ecbea2c","year":2019},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.787422Z"},"links":{"citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:dc66d738ca66d98d71e1d1e9436a74cc17b472b80cf08eff29d0be2a7933fc47","observation_id":"7559cd9b-095d-44d3-848e-92fd78c32f64","resolution":{"observed_at":"2026-08-12T10:11:09.444956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:09.427198Z","title":"A neural lip-sync framework for synthesizing photorealistic virtual news anchors","venue":null,"work_id":"156b8145-b661-411e-b29d-7bf3f9ac9ad5","year":2020},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.790828Z"},"links":{"citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:4a7d3365ac93dbf1a6cd42df181036b6b31af00fe03814d4179c0afabc34d7d1","observation_id":"c6c4d786-b12d-4fd1-b6d8-bba0436721b7","resolution":{"observed_at":"2026-08-12T10:11:09.431730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:09.414292Z","title":"Depth-aware generative adversarial network for talking head video generation","venue":null,"work_id":"1a69c4cd-73cb-434c-98e2-61cfa06be67c","year":2022},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.794825Z"},"links":{"citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:223cc51b6a62d505e35b4192a65ffb5d18043a0df93654314ca27f6f4bc44cd9","observation_id":"5572b86d-2f6c-4451-b0ab-464942b81ba6","resolution":{"observed_at":"2026-08-12T10:11:09.418687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:09.403536Z","title":"Sadtalker: Learning realistic 3d motion coefficients for stylized audio- driven single image talking face animation","venue":null,"work_id":"30445532-eaa1-4173-a281-3a39e6c8ad95","year":2023},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.798487Z"},"links":{"citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:d22269b2ddee404bd9dfc546abf0ab63ad6db62fbe6720247790e6236edec7cc","observation_id":"0372cc4c-6f0f-4297-a55e-523c808c4eb4","resolution":{"observed_at":"2026-08-12T10:11:09.407155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:09.391785Z","title":"Videoretalking: Audio-based lip synchronization for talking head video editing in the wild","venue":null,"work_id":"f911c715-cc66-4688-9da0-9c277d77fa17","year":2022},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.802316Z"},"links":{"citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:415aa29f214ebc9eea7f240678d64466d79a880bdc57b2858befe968451309ca","observation_id":"22d08750-1235-4dba-bf0c-8341f0e3c7a0","resolution":{"observed_at":"2026-08-12T10:11:09.395727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17485","last_updated":"2024-08-08T03:48:38Z","snapshot_observed_at":"2026-08-13T04:09:10.236494Z","submitted_at":"2024-02-27T13:10:11Z","title":"EMO: Emote Portrait Alive -- Generating Expressive Portrait Videos with Audio2Video Diffusion Model under Weak Conditions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17485","snapshot_observed_at":"2026-08-12T10:11:08.805681Z","title":"Emo: Emote portrait alive-generating expressive portrait videos with audio2video diffusion model under weak conditions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.805681Z"},"links":{"cited_paper":"/paper/2402.17485","citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:36792cb2b541d94b874e362c8d4dda1b1f47b355ae00b77d034ddd72dd99218f","observation_id":"ba1635b7-4e00-4d3d-8ac9-e1536416a271","resolution":{"observed_at":"2026-08-12T10:11:08.805681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:09.380449Z","title":"Talking-head generation with rhythmic head motion","venue":null,"work_id":"8405503e-ec38-4fef-8433-691316b7db62","year":2020},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.808811Z"},"links":{"citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:e002a04d518a4b05489c165028976e1921e1952eb01a85864649ac6574c5c74d","observation_id":"caead509-ebbe-4c85-8694-ce036dadcd85","resolution":{"observed_at":"2026-08-12T10:11:09.384529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:09.368709Z","title":"Synthesizing obama: learn- ing lip sync from audio","venue":null,"work_id":"828514b7-0bd1-47bd-99d9-2c19ffda2a87","year":2017},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.812110Z"},"links":{"citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:1305888cc66e65ba336ee39b39cf4a489a4a0e3c217cffc6e30714ea82049096","observation_id":"dfc755ab-af5d-42d9-9e05-ddd7a6277569","resolution":{"observed_at":"2026-08-12T10:11:09.373366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:08.815284Z","title":"Neural voice puppetry: Audio-driven facial reenactment","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.815284Z"},"links":{"citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:c29ad0bc15466d40ea5d45d16571d1ec77c754c41947f63d21941d65a256aa4a","observation_id":"442357ad-987f-4674-bcf6-befb4c09b018","resolution":{"observed_at":"2026-08-12T10:11:08.815284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:09.350830Z","title":"Learning pose-adaptive lip sync with cascaded temporal convolu- tional network","venue":null,"work_id":"7c836b1f-d934-41d2-b019-72be9be3112e","year":2021},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.818236Z"},"links":{"citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:d0f810988cb1a6a25e070289b9d1bf4e292e5e26f5f73ffcd4c570954f11887c","observation_id":"3c9ea162-67fa-49cb-a15a-b1bde91b524c","resolution":{"observed_at":"2026-08-12T10:11:09.354893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:09.339996Z","title":"A lip sync expert is all you need for speech to lip generation in the wild","venue":null,"work_id":"3fcf1cc5-a9f5-4ef9-acd6-f98f381d8e40","year":2020},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.822257Z"},"links":{"citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:fff1e9f7aa8e59f5d09d50bc911fc1431e23d0f8cdeca4832b5c177d26876c6e","observation_id":"147a5071-00de-430d-9423-f4d0748b2e46","resolution":{"observed_at":"2026-08-12T10:11:09.343578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:09.329134Z","title":"Talking face generation by adversarially disentan- gled audio-visual representation","venue":null,"work_id":"21ccccd8-89a4-4956-8694-5bb93dadc8d5","year":2019},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.825215Z"},"links":{"citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:bc3a42572adb75300b3cf891f1053ba4a8cf491a88523ed7b7333868131a8096","observation_id":"c3bb7893-910a-409a-a1f5-b9b534d29b2d","resolution":{"observed_at":"2026-08-12T10:11:09.332874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:09.316465Z","title":"Synctalk: The devil is in the synchronization for talking head synthesis","venue":null,"work_id":"07650a36-7594-42b8-8051-9a218f7b47f1","year":2024},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.828079Z"},"links":{"citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:c6ae7f7f7b819a3d5e35c64c59ec8e84283a395d24607b1658749b1458dbb9b6","observation_id":"d1e2c7ea-dfc6-4748-8a04-9430da64e059","resolution":{"observed_at":"2026-08-12T10:11:09.320747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:08.831031Z","title":"Nerf: Representing scenes as neural radiance fields for view syn- thesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.831031Z"},"links":{"citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:35b35f9f73f468ebc62939e78362d9b7c5d08bd4ec610c417c7510ede969bf8e","observation_id":"5fba9adf-81ac-4173-a5f2-d0ecc63cd4a1","resolution":{"observed_at":"2026-08-12T10:11:08.831031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:09.298147Z","title":"Ad-nerf: Audio driven neural radiance fields for talking head synthesis","venue":null,"work_id":"c52c4272-911f-46e8-b032-2bbbad4298fd","year":2021},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.834144Z"},"links":{"citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:4f5aa8229ff76eab452634518e87eb59f44e9dc96353c3b217921424587a500c","observation_id":"aa5d515b-1385-4ee7-a4cc-32173c0cbe0d","resolution":{"observed_at":"2026-08-12T10:11:09.301744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.12368","last_updated":"2022-11-22T16:03:11Z","snapshot_observed_at":"2026-08-13T15:00:51.699760Z","submitted_at":"2022-11-22T16:03:11Z","title":"Real-time Neural Radiance Talking Portrait Synthesis via Audio-spatial Decomposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.12368","snapshot_observed_at":"2026-08-12T10:11:08.837738Z","title":"Real-time neural radiance talking portrait synthesis via audio-spatial decomposition","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.837738Z"},"links":{"cited_paper":"/paper/2211.12368","citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:d005496c45c1c526467480683f39aaa5261191bac5cdd2b4906a8f988d1e7073","observation_id":"a27703f4-dc55-48d7-9830-8eda9d0ef8e6","resolution":{"observed_at":"2026-08-12T10:11:08.837738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:09.286456Z","title":"Efficient region-aware neural radiance fields for high- fidelity talking portrait synthesis","venue":null,"work_id":"6feaf8a5-ba6c-4842-a792-a8c77d8c85bb","year":2023},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.841107Z"},"links":{"citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:338cf8f662150d900c1efa1dc8b62e311e835f56d7c715b91a28a15b33483717","observation_id":"f70928cc-9c46-4f73-8d04-9daea19fc4f7","resolution":{"observed_at":"2026-08-12T10:11:09.290371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.00791","last_updated":"2022-01-03T18:23:38Z","snapshot_observed_at":"2026-08-13T17:04:44.798985Z","submitted_at":"2022-01-03T18:23:38Z","title":"DFA-NeRF: Personalized Talking Head Generation via Disentangled Face Attributes Neural Rendering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.00791","snapshot_observed_at":"2026-08-12T10:11:08.844249Z","title":"Dfa-nerf: Personalized talking head generation via disentangled face attributes neural rendering","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.844249Z"},"links":{"cited_paper":"/paper/2201.00791","citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:5bbae97eb5a77994161e250092586a8dd2928b0ae111b1d905ac6a934f93a273","observation_id":"8b8d94ec-ab66-462c-9726-ebbcacad1914","resolution":{"observed_at":"2026-08-12T10:11:08.844249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:09.275524Z","title":"Semantic-aware implicit neural audio- driven video portrait generation","venue":null,"work_id":"438d66cf-02d5-44b8-b9b0-3e48a88e7bca","year":2022},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.847802Z"},"links":{"citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:0923b1fdb67724ec3469031d43cb4ab3b0fae5ad35a5069a40a94925fa9141bd","observation_id":"2ec982fd-fc8e-4e65-ae87-d8d9731c38a1","resolution":{"observed_at":"2026-08-12T10:11:09.279186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:09.264052Z","title":"Learning dynamic facial radiance fields for few-shot talking head synthesis","venue":null,"work_id":"0ac8e146-da7c-4c29-8902-e6f0a94477ae","year":2022},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.850799Z"},"links":{"citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:f52679ae077e9c8c3ad724f8b8fb30e05e5606d375d946064ab0c60e7a1f3ab1","observation_id":"1de81af3-d628-4083-93cf-f2164a46d178","resolution":{"observed_at":"2026-08-12T10:11:09.267618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:09.251634Z","title":"Learning dynamic tetrahedra for high-quality talking head synthesis","venue":null,"work_id":"394c75fb-f723-4bbe-aa10-e78419a58888","year":2024},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.854112Z"},"links":{"citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:f64d68d6d0bafbe8fff9c9261e53ba21cbfd67f5ff228a90f217f6326bda6014","observation_id":"6c10c047-ee5e-42ef-a90e-d0deb97743e8","resolution":{"observed_at":"2026-08-12T10:11:09.255353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:09.239437Z","title":"Neural body: Implicit neural representations with structured latent codes for novel view synthesis of dynamic humans","venue":null,"work_id":"e0fe062a-e284-431d-854b-b1045d4078fe","year":2021},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.857755Z"},"links":{"citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:98555e9b8965c45c17588f94a63194c67fd9ac2ab39b5b56e4d6fa1d299762e7","observation_id":"94babcf0-119b-4f27-8ffe-d85c1f197106","resolution":{"observed_at":"2026-08-12T10:11:09.244276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:09.227721Z","title":"An- imatable neural radiance fields for modeling dynamic human bodies","venue":null,"work_id":"1636bd78-a4a0-4f17-be4f-3239bdf23e32","year":2021},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.860836Z"},"links":{"citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:2ee5ad41b9310c4706e4f04187050728d88fab4765fd89589f94da1af7653cd8","observation_id":"ab51c7bc-91e1-474e-8cb8-d1caf10e11c4","resolution":{"observed_at":"2026-08-12T10:11:09.231614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:09.216081Z","title":"Neural scene flow fields for space-time view syn- thesis of dynamic scenes","venue":null,"work_id":"59fa8554-681e-4125-a697-679d90d1f61d","year":2021},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.863867Z"},"links":{"citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:d4bb1f209b2a0a8e803a62d6772634b8a222bde3dbf681f1f1ab859b2018fb23","observation_id":"97a4a990-38e5-43b3-8edc-13e0a6099d6f","resolution":{"observed_at":"2026-08-12T10:11:09.219758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:09.203977Z","title":"Dynamic neural radiance fields for monocular 4d facial avatar reconstruction","venue":null,"work_id":"19c9c368-3c70-41dc-85d9-5a7e67a9697e","year":2021},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.866867Z"},"links":{"citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:07e0fa05b7300befa392cd480c4316300ae771a7e5d84d417092c1c8145ec765","observation_id":"239925f6-02de-498c-bc08-f77d1654168f","resolution":{"observed_at":"2026-08-12T10:11:09.207906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:09.191063Z","title":"Barron, Sofien Bouaziz, Dan B Goldman, Steven M","venue":null,"work_id":"deacaa2b-dc19-428a-9b04-6123c9bd5cda","year":2021},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.870315Z"},"links":{"citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:85219cfce85dfb8395aa575801d1e79f145923843f475a31ce7196a4430614df","observation_id":"dfeb053d-339c-4269-b3c5-23a540b85454","resolution":{"observed_at":"2026-08-12T10:11:09.195255Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.13228","last_updated":"2021-09-10T06:34:46Z","snapshot_observed_at":"2026-08-09T08:50:52.811232Z","submitted_at":"2021-06-24T17:59:03Z","title":"HyperNeRF: A Higher-Dimensional Representation for Topologically Varying Neural Radiance Fields","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.13228","snapshot_observed_at":"2026-08-12T10:11:08.873771Z","title":"Hypernerf: A higher- dimensional representation for topologically varying neu- ral radiance fields","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.873771Z"},"links":{"cited_paper":"/paper/2106.13228","citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:a30687835245f619f3da1ef1cf28ad72a1c41396672979af6cbcc2f691a295c8","observation_id":"ada9ffa6-3686-40eb-80b2-aab54cd126a7","resolution":{"observed_at":"2026-08-12T10:11:08.873771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:09.179227Z","title":"Dynamic neural radiance fields for monoc- ular 4d facial avatar reconstruction","venue":null,"work_id":"bab4986e-bffa-4463-820a-bbd19cec0fec","year":2021},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.877574Z"},"links":{"citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:99df53858a83ab381d0a0d16c7dc79a0493d6943967ea6b1e0dacee16b72cd6e","observation_id":"cc2712ca-313c-4562-a00a-045fd4f6cc53","resolution":{"observed_at":"2026-08-12T10:11:09.183023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:09.167710Z","title":"Fast bi-layer neural syn- thesis of one-shot realistic head avatars","venue":null,"work_id":"33581790-ce9d-4bcf-86ec-de8665c08f7a","year":2020},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.880699Z"},"links":{"citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:1244cc5e07dca8f3458cb8a65251431d6242ecd0a0c9bdaecfc95573127abe69","observation_id":"3d5808e6-39aa-4bd3-a369-caae99252066","resolution":{"observed_at":"2026-08-12T10:11:09.171840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.12713","last_updated":"2019-10-28T14:33:09Z","snapshot_observed_at":"2026-08-11T11:01:28.157312Z","submitted_at":"2019-10-28T14:33:09Z","title":"Few-shot Video-to-Video Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.12713","snapshot_observed_at":"2026-08-12T10:11:08.884173Z","title":"Few-shot video-to-video synthesis","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.884173Z"},"links":{"cited_paper":"/paper/1910.12713","citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:9fa80926e25d79c0f02bff9bbac0bf00ee14bdf5393b6ed38f220e31061be794","observation_id":"c0181536-59c1-4547-8953-e68d33750727","resolution":{"observed_at":"2026-08-12T10:11:08.884173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:09.155470Z","title":"Live speech portraits: Real-time photorealistic talking-head anima- tion","venue":null,"work_id":"7331e902-1984-47ef-861a-0f0a12cb317b","year":2021},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.888152Z"},"links":{"citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:0606a0ea53d8c1922bf46538beea32d8f47f8c900cbefa4baf42c8cd1ca7ff2a","observation_id":"2361ecf2-8140-4168-810e-0cb173ec8e09","resolution":{"observed_at":"2026-08-12T10:11:09.159117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:09.144540Z","title":"The unreasonable e ffectiveness of deep features as a perceptual metric","venue":null,"work_id":"fd51c63a-1a56-45c9-9f66-22209af75231","year":2018},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.899924Z"},"links":{"citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:1ff9af775df39e91a838ab31da5484e34003b8b2b64e28c151d805d086a40035","observation_id":"2fa0cc66-1673-44e6-91c9-70c119afa782","resolution":{"observed_at":"2026-08-12T10:11:09.148280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10404","last_updated":"2018-05-21T22:23:50Z","snapshot_observed_at":"2026-08-14T19:31:42.431718Z","submitted_at":"2018-03-28T04:02:33Z","title":"Lip Movements Generation at a Glance","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.10404","snapshot_observed_at":"2026-08-12T10:11:08.903990Z","title":"Maddox, Zhiyao Duan, and Chenliang Xu","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.903990Z"},"links":{"cited_paper":"/paper/1803.10404","citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:cde42a608581b17aae5345fcf49f78d9578144ecf882dfc0d020703f0c8bd70e","observation_id":"815c0b98-c06f-4637-8830-ec5cdb6c873b","resolution":{"observed_at":"2026-08-12T10:11:08.903990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:09.130955Z","title":"Out of time: Automated lip sync in the wild","venue":null,"work_id":"f1caf92c-0a0a-467b-932d-e5387f9763b6","year":2016},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.907606Z"},"links":{"citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:a4d5f585728eb689fe7e2652e99864d114e710cd728064c30fc33ce9a1782a51","observation_id":"2cb816bd-7723-4572-aa27-519c08dcd098","resolution":{"observed_at":"2026-08-12T10:11:09.136626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:11:08.896359Z","title":"URL https: //doi.org/10.1145/3478513.3480484","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis","version":2},"reference_index":301,"source":"pdf_text","source_observed_at":"2026-08-12T10:11:08.896359Z"},"links":{"citing_paper":"/paper/2411.19525"},"observation_digest":"sha256:f12992f5cede363a54d3d420cb3e5b344805e9982ba9d57f88d6600ce471abf8","observation_id":"f7e8cb40-789a-4892-b681-560880c6c7c7","resolution":{"observed_at":"2026-08-12T10:11:08.896359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.19525","last_updated":"2024-12-23T14:15:50Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T18:18:03.031526Z","submitted_at":"2024-11-29T07:49:44Z","title":"LokiTalk: Learning Fine-Grained and Generalizable Correspondences to Enhance NeRF-based Talking Head Synthesis"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":26},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2411.19525."}