{"as_of":"2026-08-15T15:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:01e4a738acaf1d5605a02d07ce2a3dbe711033404db4e8dc0453fedab78f3e67","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T20:56:17.597774Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:21:44.925785Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T13:21:54.053071Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"cited_work":{"arxiv_id":"2411.09268","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.09268","snapshot_observed_at":"2026-08-07T13:21:54.053071Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","venue":"cs.CV","work_id":"820b6e84-3458-4800-9822-0a3897171f81","year":2024},"citing_paper":{"arxiv_id":"2505.22141","last_updated":"2025-08-27T16:33:34Z","snapshot_observed_at":"2026-08-10T20:19:26.392892Z","submitted_at":"2025-05-28T09:04:00Z","title":"FaceEditTalker: Controllable Talking Head Generation with Facial Attribute Editing","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:44.925785Z"},"links":{"cited_paper":"/paper/2411.09268","citing_paper":"/paper/2505.22141"},"observation_digest":"sha256:ff1212a26704120562adef3b65310f36b7e7933729f25abc756e12a48c468769","observation_id":"f7d87b56-7094-472f-9c10-5045947ecaa4","resolution":{"observed_at":"2026-08-07T13:21:54.173228Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.09268/citation-record","integrity":"/paper/2411.09268/integrity","json":"/paper/2411.09268/citation-record.json","paper":"/paper/2411.09268"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:18.698037Z","title":"Facetalk: Audio-driven motion diffusion for neural parametric head models","venue":null,"work_id":"43a4195a-eb33-42df-8ef5-cf03dbaa68db","year":2024},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.322008Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:b137d41e97bb966893f6f59da09c8517f0065f635fe45c21aeae42cc8fdff818","observation_id":"dae1f2a2-1198-482d-9530-af8d423ef6ef","resolution":{"observed_at":"2026-08-12T20:56:18.703088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:18.679098Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations","venue":null,"work_id":"e6b4b7f9-1456-4793-aaaf-8e4bfcc44400","year":2020},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.327475Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:0dea859f8f2eb9f7328308606e981bb73db5ed2b41dde02d83d928e52ca9747d","observation_id":"27a88048-05e0-471d-adc0-a1bf4a73c942","resolution":{"observed_at":"2026-08-12T20:56:18.684798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:18.659386Z","title":"Openface: an open source facial behavior anal- ysis toolkit","venue":null,"work_id":"f31ffebc-3747-4126-bb8d-c47788ad780b","year":2016},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.333364Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:ba409065a34cbd0d6374feb858b376353bb52101437a4629f4882008b1e4f0dd","observation_id":"f2c6ae4f-7dbf-4399-843e-db1e91506ffb","resolution":{"observed_at":"2026-08-12T20:56:18.665097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:18.640657Z","title":"A morphable model for the synthesis of 3d faces","venue":null,"work_id":"df794d9e-9013-4e32-b71f-cca0dba647d9","year":1999},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.339545Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:8f7516d814b60b658befa95c3ff460e4c3bf3201aa1d6d08f40ae043ba517df2","observation_id":"8aeebfa7-3dde-4305-b1fa-c42b62d55318","resolution":{"observed_at":"2026-08-12T20:56:18.646425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:17.345377Z","title":"Crema-d: Crowd-sourced emotional multimodal actors dataset","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.345377Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:448aa776dc2f065064d6fcb1a98e216622283dc2c69e8f1fb047ca67ab7db8e3","observation_id":"d8c0a337-d48c-4a3d-9b31-a225556349d6","resolution":{"observed_at":"2026-08-12T20:56:17.345377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00654","last_updated":"2025-02-02T04:01:54Z","snapshot_observed_at":"2026-08-13T01:23:46.864931Z","submitted_at":"2025-02-02T04:01:54Z","title":"EmoTalkingGaussian: Continuous Emotion-conditioned Talking Head Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00654","snapshot_observed_at":"2026-08-12T20:56:17.351568Z","title":"Emotalkinggaussian: Con- tinuous emotion-conditioned talking head synthesis","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.351568Z"},"links":{"cited_paper":"/paper/2502.00654","citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:a4fe371ef6410823a3b86740e14a3034e18d330185d3e86f37622559b6524a83","observation_id":"dc6a5180-1f7c-4165-88fa-f1723b58fff9","resolution":{"observed_at":"2026-08-12T20:56:17.351568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:18.611924Z","title":"Diffsheg: A diffusion-based approach for real-time speech-driven holistic 3d expression and ges- ture generation","venue":null,"work_id":"b51d9d8c-a3ab-4fd8-8a7a-5d605b18599d","year":2024},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.357576Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:a95c4d3e7f71a5772ebb37bacc0869095cf635f56b66cee8b81d0d0b855eac2f","observation_id":"0ac83653-5c6e-44d9-b802-0988f2d70613","resolution":{"observed_at":"2026-08-12T20:56:18.617004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:18.592257Z","title":"3d face reconstruction and gaze tracking in the hmd for virtual interaction","venue":null,"work_id":"d23b50ff-7884-4ec1-aab1-b3d57b8771fa","year":2022},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.361876Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:25dd5e78ad1b62b2bc48891fad9f1c920f0e58be5e76a4e0924b0535dff8cf1c","observation_id":"e0a036e9-6a95-4bb0-9bcc-2916b51e6aed","resolution":{"observed_at":"2026-08-12T20:56:18.598226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:18.568174Z","title":"Videoretalking: Audio-based lip synchronization for talking head video editing in the wild","venue":null,"work_id":"3d7b77c7-9a70-4309-8c33-ad3df2d8837b","year":2022},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.366603Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:e3ac99a64da5a8f6c3821e888b51cc1d4cf4eb26ad486bd767e2e1c700762dd1","observation_id":"a868bcd1-6444-4ac0-97f2-f6528024be82","resolution":{"observed_at":"2026-08-12T20:56:18.574144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:18.547043Z","title":"Gaus- siantalker: Real-time talking head synthesis with 3d gaus- sian splatting","venue":null,"work_id":"52713c8c-62d5-4a24-af91-72b3f14fa0fb","year":2024},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.372940Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:68c95dbf508a1600d2dc79fdff50e41da37ef3d62e2890f3da5984d7c313bbe1","observation_id":"4f7aa377-9559-4abe-9d35-fda09deeafba","resolution":{"observed_at":"2026-08-12T20:56:18.554278Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:17.378218Z","title":"Out of time: auto- mated lip sync in the wild","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.378218Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:62fe681edf69fbd3f3c72508f59321420a60bf364a1dc4698ebbda8b3d8c529c","observation_id":"3f191f44-0300-4b0b-b6b9-ca5aed19686f","resolution":{"observed_at":"2026-08-12T20:56:17.378218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:18.509556Z","title":"Accurate 3d face reconstruction with weakly-supervised learning: From single image to image set","venue":null,"work_id":"81e1e142-085e-4ea7-9d9f-d586443fcf3d","year":2019},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.383294Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:f5d820996c67a4fa158cab80bcb8be28dede6ced8924a93c2b1a42825477a3ed","observation_id":"cedeb1ea-0069-41ce-bf98-9a8124ebf80e","resolution":{"observed_at":"2026-08-12T20:56:18.517742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:18.490270Z","title":"Megaportraits: One-shot megapixel neural head avatars","venue":null,"work_id":"1ee8edaf-eec8-4278-a671-1a713d31ce8b","year":2022},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.390000Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:d07078498ea3cee5571f7994d5a52d50fe87c7f8b11e2a6a031dea240b4a894f","observation_id":"c770b037-5e90-4133-9bee-bd6041790683","resolution":{"observed_at":"2026-08-12T20:56:18.495108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:17.396203Z","title":"Facial action coding system","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.396203Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:1e53fb1ebe3f773b374fd274fae55ba51a7786af99789a35f8007923a5b48737","observation_id":"31811171-1793-45a4-915c-2c1d64053bc2","resolution":{"observed_at":"2026-08-12T20:56:17.396203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:18.450223Z","title":"Facial action coding system affect interpretation dictionary (facsaid)","venue":null,"work_id":"7f5b844d-d3dd-4481-b030-30d92e9582e3","year":1998},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.402166Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:13623553b0ea964f23060d454436c3eefac7702b05132121bd56d27718f22496","observation_id":"4bfd2b82-1441-462f-8c4f-094c9db96014","resolution":{"observed_at":"2026-08-12T20:56:18.455754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01422","last_updated":"2024-02-02T14:04:18Z","snapshot_observed_at":"2026-08-15T11:21:41.312846Z","submitted_at":"2024-02-02T14:04:18Z","title":"EmoSpeaker: One-shot Fine-grained Emotion-Controlled Talking Face Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01422","snapshot_observed_at":"2026-08-12T20:56:17.406676Z","title":"Emospeaker: One-shot fine-grained emotion-controlled talking face generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.406676Z"},"links":{"cited_paper":"/paper/2402.01422","citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:538e8f272d4bd40a49b52793ad7e53f9ac3c237f0c262c7a363343fdccfaea4d","observation_id":"0f52dc20-ee00-4438-a8cb-2d58d6dc5aa0","resolution":{"observed_at":"2026-08-12T20:56:17.406676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:18.426943Z","title":"Emfacs-7: Emotional facial action coding system","venue":null,"work_id":"71439a4c-12f5-4c99-bba5-0941fd74fb69","year":1983},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.412534Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:79d9c282694e728b0b1676f1c205cc9e3e5a1c50500818591de8783c8b633a08","observation_id":"ab7c9d75-9bd2-4e45-bb07-4575444702f2","resolution":{"observed_at":"2026-08-12T20:56:18.432431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:18.404876Z","title":"Efficient emotional adaptation for audio-driven talking-head generation","venue":null,"work_id":"812b6ff2-f751-4edf-9747-e0e93a4ca4b9","year":2023},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.417951Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:a01907bc87cdc3d1042080e8b987aaecf58792c98c7fa00f547771dbca1d9ae2","observation_id":"f1518501-611f-48fa-85fc-1fbe79dcdc6b","resolution":{"observed_at":"2026-08-12T20:56:18.411532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:17.422841Z","title":"Ad-nerf: Audio driven neural ra- diance fields for talking head synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.422841Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:bae064df90a2a257a98f76d67a8cd41157aab302c9293b1127c34368403c4f9c","observation_id":"6b5ad5d5-1a55-460e-a5b6-dd9ad8e78e52","resolution":{"observed_at":"2026-08-12T20:56:17.422841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:17.427611Z","title":"Diffted: One-shot audio-driven ted talk video generation with diffusion-based co-speech ges- tures","venue":null,"work_id":null,"year":1922},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.427611Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:b40ba7f9542eff6ea9a05e2103f44eaf658e988a18e8761259fcd8782d213da0","observation_id":"f009a902-4852-408f-b252-93d127b43a21","resolution":{"observed_at":"2026-08-12T20:56:17.427611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:18.356981Z","title":"Audio-driven emotional video portraits","venue":null,"work_id":"f3af7cc7-2bf7-4455-b9e0-085e8b9c448d","year":2021},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.432535Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:ae32fbe8b9b0b84361ca00f2dde45d0663ce949ca30f5c9436aa1cbd6ca001db","observation_id":"6513cfa3-051b-4af1-9963-5a4b3c18d4fb","resolution":{"observed_at":"2026-08-12T20:56:18.361722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:18.338651Z","title":"Eamm: One-shot emotional talking face via audio-based emotion-aware motion model","venue":null,"work_id":"ba750e79-52bf-4698-9f8a-5256d78b89f9","year":2022},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.437652Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:94993219197624d24a8aa8a0459011700f64c2e57ad48535b2fc24381ffed079","observation_id":"3f4bafd3-07bc-4dff-93ed-d6598b0a6b61","resolution":{"observed_at":"2026-08-12T20:56:18.344467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:17.442757Z","title":"Float: Generative motion latent flow matching for audio-driven talking portrait","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.442757Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:640966e25fdbaa6f1164d04ac263cb54b5f2d5c65a1c720bf9278f760315fbd0","observation_id":"30dcf451-9b68-44fa-8f30-0d598f01725f","resolution":{"observed_at":"2026-08-12T20:56:17.442757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:18.321636Z","title":"Efficient region-aware neural radiance fields for high-fidelity talking portrait synthesis","venue":null,"work_id":"3aa9397f-57ae-46d7-8b4f-d4c23dc2525d","year":2023},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.447849Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:cc68d45527df13f688fe4065337fe4eda37e07bfeaffe227c08768b8cdbcbbef","observation_id":"8c213ea3-508f-4bba-a966-0c3d66db5324","resolution":{"observed_at":"2026-08-12T20:56:18.327535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:18.298528Z","title":"Talkinggaussian: Structure-persistent 3d talking head synthesis via gaussian splatting","venue":null,"work_id":"0b15447f-949e-4be3-9473-90c98f040301","year":null},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.452501Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:4614539e74e359bf6906513011e4ae8868bed84b856fadc9e54894ad3636342e","observation_id":"e09d3327-c557-4f10-8e2f-99dd5ca7a6cd","resolution":{"observed_at":"2026-08-12T20:56:18.305809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01808","last_updated":"2025-01-09T02:45:43Z","snapshot_observed_at":"2026-08-15T11:48:32.516737Z","submitted_at":"2025-01-03T13:43:21Z","title":"MoEE: Mixture of Emotion Experts for Audio-Driven Portrait Animation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01808","snapshot_observed_at":"2026-08-12T20:56:17.457673Z","title":"Moee: Mixture of emotion experts for audio-driven portrait animation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.457673Z"},"links":{"cited_paper":"/paper/2501.01808","citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:1a66e318aca1ac1ebaed7d1487ec968c99c259256618c38eea6a0d4c63687a7d","observation_id":"2bfda1b7-ce2f-48c9-b771-09f780c6bef2","resolution":{"observed_at":"2026-08-12T20:56:17.457673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:18.273381Z","title":"Li-net: Large-pose identity-preserving face reenactment network","venue":null,"work_id":"3e26ca9e-d536-41ce-ac80-a96c59513c1c","year":2021},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.464009Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:d10c6c3930e1e7f0873ba5f56fe9743eb6eca561d0d2cbbd729c9d0a64e250eb","observation_id":"2642b170-1223-4f19-8e82-9067b7ce06e5","resolution":{"observed_at":"2026-08-12T20:56:18.278923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:17.469597Z","title":"Styletalk: One-shot talking head generation with controllable speaking styles","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.469597Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:350e935dc453fb630867fc6d62a0f38b2fd483343015602daf23974d0d494270","observation_id":"fa433cd6-0208-4f90-8fac-3b37cdc6b0e2","resolution":{"observed_at":"2026-08-12T20:56:17.469597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:18.234950Z","title":"Emotalk: Speech-driven emotional disentanglement for 3d face anima- tion","venue":null,"work_id":"6318b6e1-1acc-4fd9-8157-4d15417f9c14","year":2023},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.475084Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:0847451c6a78a8f5b723e8f052e1e50efbda2bc18caa162c83871b40297a6619","observation_id":"7dc170bd-814b-4ab0-89a6-4d69ecac4e6f","resolution":{"observed_at":"2026-08-12T20:56:18.241942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:17.479721Z","title":"A lip sync expert is all you need for speech to lip generation in the wild","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.479721Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:8eb79faf3c1ee4bacd6b5d2b6c180975dbc63d7b3a983ed3303291c2ac08dd5b","observation_id":"ff224917-79cb-42a7-9425-d226f8409992","resolution":{"observed_at":"2026-08-12T20:56:17.479721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:18.206376Z","title":"Talking head generation based on 3d morphable facial model","venue":null,"work_id":"ed150ebb-3d88-4543-befe-e09fa0e93b65","year":2024},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.483941Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:c025944ea09fc365edf3016d3508bb6e3b5ad265fe5bf2e2460894573d7bb331","observation_id":"f512e542-75bb-43c5-bf8c-c151ca6207a1","resolution":{"observed_at":"2026-08-12T20:56:18.211646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:18.188539Z","title":"Sd-nerf: Towards lifelike talking head animation via spatially-adaptive dual-driven nerfs","venue":null,"work_id":"5f489f1e-d4b3-4ef0-b0e2-1c3751d633af","year":2023},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.489130Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:af82981235e3f91cadeb38babd77df17053b60ef1f9ce99cb80aa971ced6f948","observation_id":"afce107e-4910-41d7-86ac-6fecf97ff85c","resolution":{"observed_at":"2026-08-12T20:56:18.194694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:17.493218Z","title":"Diffusion-based signed distance fields for 3d shape gener- ation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.493218Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:36323218282fe72b0828d98231a29f4bd9c631f7a32c2ff0952fe4525eca855b","observation_id":"b3bf7a56-03ca-46f2-abad-9e1c953447cc","resolution":{"observed_at":"2026-08-12T20:56:17.493218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:18.160313Z","title":"Diffposetalk: Speech-driven stylistic 3d facial animation and head pose generation via diffusion models","venue":null,"work_id":"fcb0c11a-39fd-47cf-b6df-d8834ab7b75e","year":2024},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.497714Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:79ce59ca34f40663179d78750a5b5fcd0a3552947f5b9928a42d5703f2b9c721","observation_id":"ff7d9caa-51a0-4144-b3e1-f82469383101","resolution":{"observed_at":"2026-08-12T20:56:18.166574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:17.501513Z","title":"Fg- emotalk: Talking head video generation with fine-grained controllable facial expressions","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.501513Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:b31616f9b3ed4ed0e79b251b10a20b69bf5a9687db7d926e098ff82b66d451df","observation_id":"45e73af0-5b0b-4632-be20-970a29e86da4","resolution":{"observed_at":"2026-08-12T20:56:17.501513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:17.505596Z","title":"Emmn: Emotional motion memory network for audio-driven emotional talking face generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.505596Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:c7ea9d3c41e911442867b938746748c8faca82d7d2d8d56ce6c6ae4c4410ab61","observation_id":"5a6fb362-3d00-4dee-84c1-7388543aafc0","resolution":{"observed_at":"2026-08-12T20:56:17.505596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01647","last_updated":"2024-04-02T05:32:39Z","snapshot_observed_at":"2026-08-15T11:21:42.329642Z","submitted_at":"2024-04-02T05:32:39Z","title":"EDTalk: Efficient Disentanglement for Emotional Talking Head Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01647","snapshot_observed_at":"2026-08-12T20:56:17.509719Z","title":"Edtalk: Effi- cient disentanglement for emotional talking head synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.509719Z"},"links":{"cited_paper":"/paper/2404.01647","citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:9963a571e28c8c11aa76220d02eb107472f53541cdfd1c557df6897605758bdd","observation_id":"ead709d9-1a97-412b-89b7-78e1df42561e","resolution":{"observed_at":"2026-08-12T20:56:17.509719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:17.514087Z","title":"Progressive disentangled representation learning for fine-grained controllable talking head synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.514087Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:17d3d4a8f9de6cfed355ff3f01ca813fe8a49f8d36cf911fb91c6818d6a9a29c","observation_id":"67e233a4-9216-4a2b-990b-ee8a8f7488b1","resolution":{"observed_at":"2026-08-12T20:56:17.514087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16726","last_updated":"2024-12-16T17:11:49Z","snapshot_observed_at":"2026-08-15T11:21:30.068737Z","submitted_at":"2024-11-23T04:38:51Z","title":"EmotiveTalk: Expressive Talking Head Generation through Audio Information Decoupling and Emotional Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16726","snapshot_observed_at":"2026-08-12T20:56:17.518212Z","title":"Emotivetalk: Expressive talking head generation through audio information decoupling and emotional video diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.518212Z"},"links":{"cited_paper":"/paper/2411.16726","citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:79538e9973f5a4c811ce36458100b7d0bbecdedc025a29a1973ba72b2113c8df","observation_id":"163a61d1-0572-4801-b7d4-d8332e3d57ad","resolution":{"observed_at":"2026-08-12T20:56:17.518212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:18.104415Z","title":"Mead: A large-scale audio-visual dataset for emotional talking-face generation","venue":null,"work_id":"f56453f0-349f-40a1-b272-6f0df07dc3c6","year":2020},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.522841Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:231c913fb449a15da27fe1c9841b1c0c421d78700affe290c5ee47a9ddf5fcbe","observation_id":"73eb3f12-92bb-4327-85ed-f3bb3b44e35d","resolution":{"observed_at":"2026-08-12T20:56:18.109802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:17.527325Z","title":"One- shot talking face generation from single-speaker audio-visual correlation learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.527325Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:402435f9b8d5156857d2545d41f94f7bb92587eb101b485872cb65202add4a2d","observation_id":"9ce3c2f7-3390-4851-b7ce-56fa4838047c","resolution":{"observed_at":"2026-08-12T20:56:17.527325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:17.532565Z","title":"One-shot free-view neural talking-head synthesis for video conferenc- ing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.532565Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:ec36ac6b68c75e92cebacb4c55af4224030a2017bfee83072ac591395465e117","observation_id":"637eac1c-e0b9-4efc-8010-cc8ebf62343d","resolution":{"observed_at":"2026-08-12T20:56:17.532565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:17.538049Z","title":"Omniavatar: Geometry-guided controllable 3d head synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.538049Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:12608799a6d88382790cb420ccd3b212038f8ed16337f03419837d65c16740d6","observation_id":"72ab0328-f342-4563-a0e3-c9732e8f0aa2","resolution":{"observed_at":"2026-08-12T20:56:17.538049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:18.041928Z","title":"Facial expression-aware talking head generation with 3d morphable model","venue":null,"work_id":"9b88cd57-d46f-481e-81ef-6037c3e65902","year":2024},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.543394Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:1ab847cbd991ef7720d9144376905638239033d3d13c432b22017237cace97d5","observation_id":"3df9aeb9-988f-4a1f-b92e-f06f76700235","resolution":{"observed_at":"2026-08-12T20:56:18.047341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14037","last_updated":"2024-08-09T08:45:26Z","snapshot_observed_at":"2026-08-15T11:21:30.151918Z","submitted_at":"2024-04-22T09:51:43Z","title":"GaussianTalker: Speaker-specific Talking Head Synthesis via 3D Gaussian Splatting","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14037","snapshot_observed_at":"2026-08-12T20:56:17.549359Z","title":"Gaussiantalker: Speaker-specific talking head synthesis via 3d gaussian splatting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.549359Z"},"links":{"cited_paper":"/paper/2404.14037","citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:0a5445fbc647bf3f1cf575f3f41b157abf9c77854be2dcfe18c014bef2f60da0","observation_id":"ae5120b8-8eb0-4c1b-a774-56f6ec5d930b","resolution":{"observed_at":"2026-08-12T20:56:17.549359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:17.555277Z","title":"Talking head generation with probabilistic audio-to-visual diffusion priors","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.555277Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:92bb7f737e8218cfc1e2ed83c003ef7740d1ac4632d2c807ed7b6298851f3e70","observation_id":"8efeea02-fb8f-4d17-afbb-041aa89aa620","resolution":{"observed_at":"2026-08-12T20:56:17.555277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.13578","last_updated":"2023-12-21T05:03:18Z","snapshot_observed_at":"2026-08-13T06:20:41.841078Z","submitted_at":"2023-12-21T05:03:18Z","title":"DREAM-Talk: Diffusion-based Realistic Emotional Audio-driven Method for Single Image Talking Face Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.13578","snapshot_observed_at":"2026-08-12T20:56:17.559813Z","title":"Dream-talk: Diffusion-based realistic emotional audio-driven method for single image talking face generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.559813Z"},"links":{"cited_paper":"/paper/2312.13578","citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:35c701e68aa336f4b5d5800f75a5adb084b9c0bfe2fc1fd6a587001678dd2227","observation_id":"70cddd5b-4ec1-4cc3-82a0-5d3bc3dde328","resolution":{"observed_at":"2026-08-12T20:56:17.559813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:18.007901Z","title":"Sadtalker: Learning realistic 3d motion coefficients for stylized audio- driven single image talking face animation","venue":null,"work_id":"2d8be074-0229-4ce6-a8e3-86d68323eccc","year":2023},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.566096Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:722fb62096ff556d4eb8d0bc4523e1df483bee28af7b88315d4173dbf4268bdb","observation_id":"ad86cad0-2ad8-4a67-b8dd-26e8688b6d54","resolution":{"observed_at":"2026-08-12T20:56:18.013301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06421","last_updated":"2024-03-11T04:13:38Z","snapshot_observed_at":"2026-08-15T11:21:27.906588Z","submitted_at":"2024-03-11T04:13:38Z","title":"A Comparative Study of Perceptual Quality Metrics for Audio-driven Talking Head Videos","version":1},"cited_work":{"arxiv_id":"2403.06421","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.06421","snapshot_observed_at":"2026-08-12T20:56:17.640025Z","title":"A Comparative Study of Perceptual Quality Metrics for Audio-driven Talking Head Videos","venue":"cs.CV","work_id":"6676f881-3255-4e9d-8a50-b00a8b8722e4","year":2024},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.570504Z"},"links":{"cited_paper":"/paper/2403.06421","citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:c44c13e1b0ac3377cfefd65a4e2974538f7cbb5ddf26702e2a37d55c8db40607","observation_id":"b738a1e8-bacc-467d-ac23-6de2ee30e7c4","resolution":{"observed_at":"2026-08-12T20:56:17.647846Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:17.575480Z","title":"Flow-guided one-shot talking face generation with a high-resolution audio-visual dataset","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.575480Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:0a83f589eebafd0017b5906c7cfcb5afbf39495b70a03631a333cadaf8c85450","observation_id":"5bda8f62-fef7-463a-a346-bb0519796248","resolution":{"observed_at":"2026-08-12T20:56:17.575480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:17.580030Z","title":"A reduced-reference quality assessment metric for textured mesh digital humans","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.580030Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:5192e1b327e7145511377468be809a3963fc196c8e8d28e60e4a0b2ec2c94925","observation_id":"18bb40f8-d69f-46e6-bf7f-b53574196d9f","resolution":{"observed_at":"2026-08-12T20:56:17.580030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:17.584966Z","title":"Thin-plate spline motion model for image animation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.584966Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:526d25ed1e97e26a406b6cdfdf0e4de1b445592cff3ba79debaabf78d678d7c8","observation_id":"9c106ffc-7498-49dd-9d99-395cc10d4f56","resolution":{"observed_at":"2026-08-12T20:56:17.584966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:17.589519Z","title":"Locally attentional sdf diffusion for controllable 3d shape generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.589519Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:56ea94a986b5d963e68cc1145f792d45429c07f924bef73d670969ba61a7a036","observation_id":"6f78db1f-d2e6-4171-a6d0-b6c09f796d88","resolution":{"observed_at":"2026-08-12T20:56:17.589519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:17.593671Z","title":"Pose-controllable talking face generation by implicitly modularized audio-visual rep- resentation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.593671Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:6beb33c32342c423b0f06fe9adf5e0b6a0fba65bd1c1efbc65f01690119ef8f2","observation_id":"73903460-6b01-46dd-a0bb-c5e66b557ec4","resolution":{"observed_at":"2026-08-12T20:56:17.593671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T20:56:17.936868Z","title":null,"venue":null,"work_id":"7c9ff98c-765e-419c-99e3-3e1edf8966dc","year":null},"citing_paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-12T20:56:17.597774Z"},"links":{"citing_paper":"/paper/2411.09268"},"observation_digest":"sha256:10e029e99907e2c5a7fd7e6dcd1bdc6ce0884355a730ab106d6c33ccb1e310d7","observation_id":"0f50f777-25f2-4441-9939-f7644d7ec87e","resolution":{"observed_at":"2026-08-12T20:56:17.941951Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.09268","last_updated":"2025-03-08T08:53:40Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T01:23:40.663784Z","submitted_at":"2024-11-14T08:12:16Z","title":"LES-Talker: Fine-Grained Emotion Editing for Talking Head Generation in Linear Emotion Space"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":1,"verified_fuzzy":25},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 1 inbound Pith citation observation for arXiv:2411.09268."}