{"as_of":"2026-08-08T02:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b59acc6d1b0f988a760a3c3ff732e0eadd8b581253e474fde41081a18339eb57","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:49:54.279621Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.20861/citation-record","integrity":"/paper/2505.20861/integrity","json":"/paper/2505.20861/citation-record.json","paper":"/paper/2505.20861"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:04.736841Z","title":"Facetalk: Audio-driven motion diffusion for neural parametric head models","venue":null,"work_id":"917d8c8f-11de-4bf5-aa0a-9f2feb544c9d","year":2024},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:48.163584Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:a69c5f3cd64f6f90b02c51dda655ead9d74efbb82422e6abb85b22ce0d3d2329","observation_id":"e8f3d26e-c437-48ba-8b30-7823348a0832","resolution":{"observed_at":"2026-08-07T13:50:04.840247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:04.488237Z","title":"Teach: Temporal action composition for 3d hu- mans","venue":null,"work_id":"4ca36197-a769-4529-a7e0-24e5e1a9a1a1","year":2022},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:48.274962Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:b2ccbe0795b97a809b0d870a798f9731f75315192e1bcc2766b29df386b951a8","observation_id":"fe2f996b-c31d-4885-abb5-64bffbfc8bab","resolution":{"observed_at":"2026-08-07T13:50:04.573660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:04.376990Z","title":"Seamless human motion composition with blended posi- tional encodings","venue":null,"work_id":"c8238f3c-07a2-4c39-bbe5-5fcecfbf8036","year":2024},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:48.409933Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:e415e49ca0619ca45367e42957b0e04d99438c65ca22faed173d283d3707e95c","observation_id":"6f71fbf8-c1c5-4618-8f0d-ab45897180f3","resolution":{"observed_at":"2026-08-07T13:50:04.434110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:04.176999Z","title":"Video generation models as world simulators","venue":null,"work_id":"c693c372-a5f0-4b87-a5fc-66c226d77e8c","year":2024},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:48.473574Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:0dd2e5f7d1a9e0e725619c4597701ce860513bc060e93263575f688760729718","observation_id":"6ae2a930-2173-4b1b-8a5d-f18abc55febe","resolution":{"observed_at":"2026-08-07T13:50:04.260523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:03.987385Z","title":"Animated conversation: rule- based generation of facial expression, gesture & spoken in- tonation for multiple conversational agents","venue":null,"work_id":"5229d05b-3d76-4d60-b47c-ecfd238465f9","year":1994},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:48.530163Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:5d3666a9cdcf6ee97715aa5c0dc2f512723cf5c76e588e9261089a971c0549bc","observation_id":"27264f34-ed73-43a0-8ca8-39f359726ba2","resolution":{"observed_at":"2026-08-07T13:50:04.074037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08136","last_updated":"2024-07-12T02:41:51Z","snapshot_observed_at":"2026-08-05T23:17:13.069591Z","submitted_at":"2024-07-11T02:26:51Z","title":"EchoMimic: Lifelike Audio-Driven Portrait Animations through Editable Landmark Conditions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08136","snapshot_observed_at":"2026-08-07T13:49:48.623861Z","title":"Echomimic: Lifelike audio-driven por- trait animations through editable landmark conditions.arXiv preprint arXiv:2407.08136, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:48.623861Z"},"links":{"cited_paper":"/paper/2407.08136","citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:9e418e998a1d86544b520b8078cfd8a28c3a1621af7ecdd96055460526dc9aff","observation_id":"17f683c4-da09-48fb-9451-d598bf33cdd2","resolution":{"observed_at":"2026-08-07T13:49:48.623861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:03.809668Z","title":"Capture, learning, and syn- thesis of 3d speaking styles","venue":null,"work_id":"a3831cb2-6190-44af-824c-083f97e2d65f","year":null},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:48.727652Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:1660951407ff38dde469d9f0933238633754217056b4d0f8aa43e48b711e8fbc","observation_id":"07b1eb48-97c4-4717-bd2a-aebb57b7b7d4","resolution":{"observed_at":"2026-08-07T13:50:03.883957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08990","last_updated":"2023-09-26T16:25:03Z","snapshot_observed_at":"2026-07-06T15:42:52.549767Z","submitted_at":"2023-06-15T09:31:31Z","title":"Emotional Speech-Driven Animation with Content-Emotion Disentanglement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08990","snapshot_observed_at":"2026-08-07T13:49:48.844014Z","title":"Emotional speech-driven animation with content-emotion disentangle- ment.arXiv preprint arXiv:2306.08990, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:48.844014Z"},"links":{"cited_paper":"/paper/2306.08990","citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:7e4683443a3a470dd1c82914c081c36c2830aa37f3b0f8f77c810e390bd704a0","observation_id":"e0ae3a21-b1c7-4a09-b263-56c7e858a2b1","resolution":{"observed_at":"2026-08-07T13:49:48.844014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.20799","last_updated":"2026-04-11T11:32:41Z","snapshot_observed_at":"2026-07-06T18:53:57.980865Z","submitted_at":"2024-07-30T13:02:08Z","title":"SpotFormer: Multi-Scale Spatio-Temporal Transformer for Facial Expression Spotting","version":3},"cited_work":{"arxiv_id":"2407.20799","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.20799","snapshot_observed_at":"2026-08-07T13:49:55.846656Z","title":"SpotFormer: Multi-Scale Spatio-Temporal Transformer for Facial Expression Spotting","venue":"cs.CV","work_id":"55ada082-8a03-4526-bb43-18e731a2dc15","year":2024},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:48.933064Z"},"links":{"cited_paper":"/paper/2407.20799","citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:b0fa33bd0751c43e1f40132b7a3977d197ab7c45898f9c727db8d57a295bb0af","observation_id":"b1b53d5c-bd2d-48bb-aaf1-bad0ce9fdec8","resolution":{"observed_at":"2026-08-07T13:49:55.964439Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:03.686714Z","title":"Facial action coding system (facs).A Human Face, Salt Lake City, 2002","venue":null,"work_id":"2cc9f6e8-700b-4259-80bb-2b0f62180f4a","year":2002},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:49.028666Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:412fb506eb10144f4f69cbbc36f074c8d352743d9e34a73813eb61b27915f5af","observation_id":"822efe5f-76e2-4f27-8abc-8f0a3ce42fde","resolution":{"observed_at":"2026-08-07T13:50:03.735132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00762","last_updated":"2024-08-01T17:59:27Z","snapshot_observed_at":"2026-07-06T18:55:45.493755Z","submitted_at":"2024-08-01T17:59:27Z","title":"UniTalker: Scaling up Audio-Driven 3D Facial Animation through A Unified Model","version":1},"cited_work":{"arxiv_id":"2408.00762","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.00762","snapshot_observed_at":"2026-08-07T13:49:55.536102Z","title":"UniTalker: Scaling up Audio-Driven 3D Facial Animation through A Unified Model","venue":"cs.CV","work_id":"97045f98-3b19-4d64-9631-cf1c6b9b0ab0","year":2024},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:49.139392Z"},"links":{"cited_paper":"/paper/2408.00762","citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:14bb613358a45fbbbb7a8c609523d6d3b80671bd0fb6a0b6f98f840e3beddd8b","observation_id":"a7ddf34d-a855-4df6-8cb1-0381a09944cd","resolution":{"observed_at":"2026-08-07T13:49:55.678185Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:03.581602Z","title":"Faceformer: Speech-driven 3d facial anima- tion with transformers","venue":null,"work_id":"20ebd828-9c8b-43e4-bf92-cfe3b832cbbe","year":2022},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:49.256063Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:8417f81b33d1ef6545c5ed5db6ec13f96cc393daec92598d4905b21ac90edf58","observation_id":"fe52b9b4-c4ad-4789-a00d-a04be8fa1760","resolution":{"observed_at":"2026-08-07T13:50:03.675102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.10939","last_updated":"2023-01-26T05:00:09Z","snapshot_observed_at":"2026-07-06T14:44:45.326057Z","submitted_at":"2023-01-26T05:00:09Z","title":"Affective Faces for Goal-Driven Dyadic Communication","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.10939","snapshot_observed_at":"2026-08-07T13:49:49.337095Z","title":"Affective faces for goal-driven dyadic communication.arXiv preprint arXiv:2301.10939, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:49.337095Z"},"links":{"cited_paper":"/paper/2301.10939","citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:15b2c33ccc86b9b45832a2b107dd2bbace50fca69791deda110c2fabcdfdb01d","observation_id":"d4f137cf-6685-47d6-b02b-643efebeddff","resolution":{"observed_at":"2026-08-07T13:49:49.337095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03284","last_updated":"2024-08-06T16:31:45Z","snapshot_observed_at":"2026-07-06T18:57:31.323769Z","submitted_at":"2024-08-06T16:31:45Z","title":"ReSyncer: Rewiring Style-based Generator for Unified Audio-Visually Synced Facial Performer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03284","snapshot_observed_at":"2026-08-07T13:49:49.426666Z","title":"Resyncer: Rewiring style-based generator for unified audio-visually synced fa- cial performer.arXiv preprint arXiv:2408.03284, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:49.426666Z"},"links":{"cited_paper":"/paper/2408.03284","citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:6583d45aeff9c106818dac2a869b0d6d02c3e877fe5a7e15ae3ca83d6e516f8c","observation_id":"aad20c1e-9712-48f9-bd8c-dbfc7eebeb56","resolution":{"observed_at":"2026-08-07T13:49:49.426666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:03.164511Z","title":"Ac- tion2motion: Conditioned generation of 3d human motions","venue":null,"work_id":"bd6d6295-52d9-4223-9ffe-4c0de43706ae","year":2021},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:49.488190Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:3cc8f2be4286437480b090932a621a6c99579a585f002d559378b96d3ce7b62f","observation_id":"22f7283d-2b19-4f7d-8bef-763e52069d5e","resolution":{"observed_at":"2026-08-07T13:50:03.328214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:02.863829Z","title":"Generating diverse and natural 3d human motions from text","venue":null,"work_id":"af11ab51-fa16-438e-bc23-1115c4295710","year":2022},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:49.614660Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:669d553ea3ae0b947a49f98c50f398b4eb4f897cd1e3ea56d3687b084d1bc0b5","observation_id":"8836d187-ae97-423d-9065-3015b5ce0353","resolution":{"observed_at":"2026-08-07T13:50:03.054404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:02.488472Z","title":"Micro-expression spotting with multi-scale local transformer in long videos.Pattern Recognition Letters, 168:146–152,","venue":null,"work_id":"0e897f03-caf2-4259-abd3-0cc7ef42ba1a","year":null},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:49.702574Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:d1e656c9575f8ceb7572331f1adf69a08cc7cad92ca272b60ebd5f161d11bcae","observation_id":"be5a18b7-4a50-4142-840c-442dc86ac749","resolution":{"observed_at":"2026-08-07T13:50:02.655173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:02.170630Z","title":"Toeplitz inverse covariance-based clustering of multivariate time series data","venue":null,"work_id":"5222efb7-0c0a-4c1c-b620-58665f9eddbd","year":2017},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:49.787589Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:665ffa13b5689d7f27b9221513aec3914e09a7c1578583c2c008e6209e7f8ba9","observation_id":"2b08c393-1a02-4c93-a9f9-d48d1b22493c","resolution":{"observed_at":"2026-08-07T13:50:02.255990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15230","last_updated":"2024-03-14T11:49:40Z","snapshot_observed_at":"2026-07-06T16:52:27.457437Z","submitted_at":"2023-11-26T08:04:43Z","title":"GAIA: Zero-shot Talking Avatar Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15230","snapshot_observed_at":"2026-08-07T13:49:49.888105Z","title":"Gaia: Zero-shot talking avatar generation.arXiv preprint arXiv:2311.15230, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:49.888105Z"},"links":{"cited_paper":"/paper/2311.15230","citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:4110f0435ca5ce2e3ccf0883dd5b03a924a92c2dc86a5cbd9b609931bd140786","observation_id":"22a6ae26-72c3-4ca4-9321-01241a6c5239","resolution":{"observed_at":"2026-08-07T13:49:49.888105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:49.960005Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:49.960005Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:5ee5ea1113ecd137d7e4548c57e0d336169d664c1f35c4f82b918ee391e0f789","observation_id":"ee7f8684-adb2-42ab-aa47-4dbbccd8a1cd","resolution":{"observed_at":"2026-08-07T13:49:49.960005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:01.912497Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":"acca37be-b5bc-464c-8e03-a077ed4eb62a","year":2020},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:50.036450Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:5a0a00552d06e5f57e91a1f124a35812cb206de1d10a52121fcc5dfc19e32764","observation_id":"b6c6ff47-0767-434e-9a14-75e61fffe57f","resolution":{"observed_at":"2026-08-07T13:50:01.993307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:01.815539Z","title":"Multi-aspect mining of complex sensor sequences","venue":null,"work_id":"859333d9-c583-443e-8969-ed89d672ff07","year":2019},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:50.138655Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:14f94f71595b15e447ed16dc389a22bef8d15995f363b9e18649615a127c76df","observation_id":"4f32f28f-b3e8-4e23-82e4-0c8a45e95da2","resolution":{"observed_at":"2026-08-07T13:50:01.856176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-05T07:44:02.175955Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-07T13:49:50.225081Z","title":"Loopy: Taming audio-driven portrait avatar with long-term motion dependency.arXiv preprint arXiv:2409.02634, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:50.225081Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:6f4b10ebe507660e55f635b726ed977e2b0977e35513d19c1a67aeb1d0061e7b","observation_id":"daea6143-b097-4dcd-9655-0baf2b2e4c00","resolution":{"observed_at":"2026-08-07T13:49:50.225081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:01.599847Z","title":"Audio-driven facial animation by joint end- to-end learning of pose and emotion.ACM Transactions on Graphics (TOG), 36(4):1–12, 2017","venue":null,"work_id":"77b9811e-e778-491f-868a-e141521fb33a","year":2017},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:50.291313Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:e9a578dea4dd61998cbb2060fb4d6ce5719bc42475b94891b0e82760ac51eb1e","observation_id":"e8a73c3e-bb03-4a1f-adb0-f4d6a886b69e","resolution":{"observed_at":"2026-08-07T13:50:01.699979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:01.407514Z","title":"Kmtalk: Speech-driven 3d facial animation with key motion embedding","venue":null,"work_id":"7deddd71-b716-4c1a-b417-66751a03f730","year":2024},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:50.366335Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:91739fb7bf28d5b374594d73eb5f1b60570e01478dcf4b58019beae023b11c9c","observation_id":"490f9ba2-21a9-4c6a-8d8c-fce972478b48","resolution":{"observed_at":"2026-08-07T13:50:01.508258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:01.217300Z","title":"Talkinggaussian: Structure-persistent 3d talking head synthesis via gaussian splatting","venue":null,"work_id":"82634402-29ee-458a-ab0c-8332c9b1da05","year":null},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:50.439421Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:392ca30ae8947f9d6417ea6dfd9e620496f653c90980a34f3687b23ca21c4598","observation_id":"81dbbc9c-8254-40e5-a8a8-75a950bf2ed4","resolution":{"observed_at":"2026-08-07T13:50:01.301208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02657","last_updated":"2024-09-04T12:30:25Z","snapshot_observed_at":"2026-08-04T13:25:29.160877Z","submitted_at":"2024-09-04T12:30:25Z","title":"PoseTalk: Text-and-Audio-based Pose Control and Motion Refinement for One-Shot Talking Head Generation","version":1},"cited_work":{"arxiv_id":"2409.02657","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.02657","snapshot_observed_at":"2026-08-07T13:49:55.352621Z","title":"PoseTalk: Text-and-Audio-based Pose Control and Motion Refinement for One-Shot Talking Head Generation","venue":"cs.CV","work_id":"46be024f-dc29-4a23-a555-af9db3cb32db","year":2024},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:50.530894Z"},"links":{"cited_paper":"/paper/2409.02657","citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:d78b35c2c975717769eba6004496f7198b9171c5e4525a8db252979dab8b9e67","observation_id":"b53e64dc-1548-4177-8884-3f649be8e618","resolution":{"observed_at":"2026-08-07T13:49:55.422351Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.00334","last_updated":"2024-08-11T10:01:03Z","snapshot_observed_at":"2026-07-06T15:10:52.936785Z","submitted_at":"2023-04-01T15:10:02Z","title":"TalkCLIP: Talking Head Generation with Text-Guided Expressive Speaking Styles","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.00334","snapshot_observed_at":"2026-08-07T13:49:50.626113Z","title":"Talkclip: Talking head generation with text-guided expres- sive speaking styles.arXiv preprint arXiv:2304.00334, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:50.626113Z"},"links":{"cited_paper":"/paper/2304.00334","citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:7b402a161c4bb092bed0260805cb8b7f831f2119fe42e977bc4dc0a0f5226518","observation_id":"6c502d7a-fa97-41c4-8b13-25c3d36acaa5","resolution":{"observed_at":"2026-08-07T13:49:50.626113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:50.755671Z","title":"Amass: Archive of motion capture as surface shapes","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:50.755671Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:5c1e50e426474e1b2d2422d686b1b701d1fb27ad9715a80c23540261c7e3cd38","observation_id":"2e233ae7-dcc4-47b7-8109-b47e81b207eb","resolution":{"observed_at":"2026-08-07T13:49:50.755671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:00.927840Z","title":"Autoplait: Automatic mining of co-evolving time se- quences","venue":null,"work_id":"721f2a7f-879d-4fff-b978-02fa04d67c9a","year":2014},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:50.855167Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:139a2a601c7f779f0f365e53e84e70e6e4da63621948614125fbba58a59ee9a8","observation_id":"66ea1bf1-d86a-4fab-b44e-a970f349f47f","resolution":{"observed_at":"2026-08-07T13:50:01.018947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:00.749464Z","title":"From audio to photoreal embodiment: Synthesizing humans in conversations","venue":null,"work_id":"7e60df8e-5d0a-4fc1-bf43-87e5c0ded5bb","year":2024},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:50.954333Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:8e1a2275dc7124e262c60bb7cb4954cb32a14634148ced14438b058b5c40e942","observation_id":"3d041e45-53be-4903-9741-7e1c872a4d74","resolution":{"observed_at":"2026-08-07T13:50:00.836240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.10942","last_updated":"2024-09-25T09:42:45Z","snapshot_observed_at":"2026-08-06T23:02:47.092311Z","submitted_at":"2024-03-16T14:58:58Z","title":"ScanTalk: 3D Talking Heads from Unregistered Scans","version":3},"cited_work":{"arxiv_id":"2403.10942","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.10942","snapshot_observed_at":"2026-08-07T13:49:55.036499Z","title":"ScanTalk: 3D Talking Heads from Unregistered Scans","venue":"cs.CV","work_id":"ae2c7613-6e8d-4c31-bf33-7950128d2a73","year":2024},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:51.060403Z"},"links":{"cited_paper":"/paper/2403.10942","citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:9bbf0110355ac85253b52cb3fbffa4e24abc4bb3879a202ab1895fdd6aa7784e","observation_id":"fba965a2-de61-4c99-bb49-a20b5e3efd38","resolution":{"observed_at":"2026-08-07T13:49:55.159075Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:00.466913Z","title":"Generating facial expressions for speech.Cognitive science, 20(1):1–46, 1996","venue":null,"work_id":"fa52ff6b-d469-4c50-afbc-4beaeec3084f","year":1996},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:51.131465Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:af4b9891af0f06ec99c0fe319aae68fb1b6ce7347beccb3ac80bbd3a514aa210","observation_id":"e67917d9-6478-48db-b074-3fc7c96540ea","resolution":{"observed_at":"2026-08-07T13:50:00.584576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:00.265731Z","title":"Emotalk: Speech-driven emotional disentanglement for 3d face anima- tion","venue":null,"work_id":"9a72786e-3e66-4f81-abcc-3f6e96f448b5","year":2023},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:51.228539Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:422bb085fe4f51393b7907444ba82e6ed6322f0886c6781358a6a8b1514e08d6","observation_id":"d02df5be-365c-4f9e-8465-673fedcf9f4a","resolution":{"observed_at":"2026-08-07T13:50:00.332064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:00.080458Z","title":"Multi-track timeline control for text-driven 3d human motion generation","venue":null,"work_id":"1ebbbc5a-b4f3-4d11-ac6e-d1b1a2442777","year":1911},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:51.332307Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:f010abfe5b2e3d08c0d7116643fbccff5d3443c91b172db27e43e5ad7ae36e26","observation_id":"dea93a64-0405-45d3-8630-0b68523be7b5","resolution":{"observed_at":"2026-08-07T13:50:00.174781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:51.419858Z","title":"The kit motion-language dataset.Big data, 4(4):236–252,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:51.419858Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:3b6adcfb2df38469c21620e9375bb9c4dbb0cd32818be55a0ab21fdc5851a6a6","observation_id":"2e22b04f-63c2-49c5-be05-b3c7611b7687","resolution":{"observed_at":"2026-08-07T13:49:51.419858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:59.859065Z","title":"A lip sync expert is all you need for speech to lip generation in the wild","venue":null,"work_id":"fd87bc62-667e-4228-80eb-e08995066146","year":2020},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:51.551263Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:e4f56f847bf4f6adc751cf6271a49f553bdb1eba293baf17b6f589d6bd928130","observation_id":"2558f091-5f20-4e36-a206-ab1e78618df1","resolution":{"observed_at":"2026-08-07T13:49:59.952512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:59.677574Z","title":"Cas(me) 2 : A database for sponta- neous macro-expression and micro-expression spotting and recognition.IEEE Transactions on Affective Computing, 9 (4):424–436, 2018","venue":null,"work_id":"db8742b8-2bf6-441f-9dfb-da3e3d92a930","year":2018},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:51.652249Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:6a88061e40b4a34571f144716e7057d1aee0eda53ae7c7328cd86c9bc8f2a2cb","observation_id":"894cb30f-0a81-43d1-95e1-5d2ef6b154ec","resolution":{"observed_at":"2026-08-07T13:49:59.740373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01418","last_updated":"2023-08-30T04:41:10Z","snapshot_observed_at":"2026-08-04T22:38:03.106382Z","submitted_at":"2023-03-02T17:09:27Z","title":"Human Motion Diffusion as a Generative Prior","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01418","snapshot_observed_at":"2026-08-07T13:49:51.788235Z","title":"Human motion diffusion as a generative prior","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:51.788235Z"},"links":{"cited_paper":"/paper/2303.01418","citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:b043494736b0b26fda859c16a76aba5b286256080e06897dc89c5b1572784281","observation_id":"5934baf1-ad13-4c1b-b06c-947ff71c23f1","resolution":{"observed_at":"2026-08-07T13:49:51.788235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-07T13:49:51.922931Z","title":"Score-based generative modeling through stochastic differential equa- tions.arXiv preprint arXiv:2011.13456, 2020","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:51.922931Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:c4918ff23931301f68d0d0c3b2fc8b593566e682b0e027d74456d867a2fd144c","observation_id":"f04e6d3f-db93-4a87-a9ea-b8a7ffbe50fd","resolution":{"observed_at":"2026-08-07T13:49:51.922931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:59.484658Z","title":"Diffposetalk: Speech-driven stylistic 3d facial animation and head pose generation via diffusion models.ACM Transactions on Graphics (TOG), 43(4):1–9, 2024","venue":null,"work_id":"35c4ec30-4530-4d3d-bdb9-b771d1a43f92","year":2024},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:52.027296Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:0081ec0159705aee6103ed5d4e134ae48e5c30cfc5672159cf9298df3450c25c","observation_id":"d6088f83-614d-48a6-a733-135abd67b98c","resolution":{"observed_at":"2026-08-07T13:49:59.569621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:52.129530Z","title":"Edtalk: Effi- cient disentanglement for emotional talking head synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:52.129530Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:93dbdd6b7bc27c2510fc7312be029a7a32eb7e0a8530d2a7e527a96a90a86cf9","observation_id":"def676ab-7ab8-4b0a-bb2d-d85fc603ab6b","resolution":{"observed_at":"2026-08-07T13:49:52.129530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17485","last_updated":"2024-08-08T03:48:38Z","snapshot_observed_at":"2026-07-06T17:36:11.854303Z","submitted_at":"2024-02-27T13:10:11Z","title":"EMO: Emote Portrait Alive -- Generating Expressive Portrait Videos with Audio2Video Diffusion Model under Weak Conditions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17485","snapshot_observed_at":"2026-08-07T13:49:52.227418Z","title":"Emo: Emote portrait alive-generating expressive portrait videos with audio2video diffusion model under weak conditions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:52.227418Z"},"links":{"cited_paper":"/paper/2402.17485","citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:a097ebdffce4849c6832091a656ebbd52732cfc50f12db9ad84cc7d787dac9a4","observation_id":"0994e012-ab48-468a-aab5-4d606b581965","resolution":{"observed_at":"2026-08-07T13:49:52.227418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17465","last_updated":"2023-12-04T16:49:18Z","snapshot_observed_at":"2026-07-06T16:54:14.216770Z","submitted_at":"2023-11-29T09:13:00Z","title":"AgentAvatar: Disentangling Planning, Driving and Rendering for Photorealistic Avatar Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17465","snapshot_observed_at":"2026-08-07T13:49:52.324149Z","title":"Agentavatar: Disentangling planning, driving and ren- dering for photorealistic avatar agents.arXiv preprint arXiv:2311.17465, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:52.324149Z"},"links":{"cited_paper":"/paper/2311.17465","citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:ae49452518644866476ebbf67c02afb52e25b003e4e595f638fa6f2510989433","observation_id":"63d6ad76-c6d6-4f36-a81e-063e2c86f0d4","resolution":{"observed_at":"2026-08-07T13:49:52.324149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:59.269700Z","title":"Mead: A large-scale audio-visual dataset for emotional talking-face generation","venue":null,"work_id":"b7f595fa-aaf2-4084-8910-7cecae483f67","year":null},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:52.431506Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:c1d391eb790048c5a557b26855de1a5dbbda7ad9bb0727d105fbf165d828ba0a","observation_id":"ee323b2a-e72e-4563-ac71-c1c1da63d329","resolution":{"observed_at":"2026-08-07T13:49:59.382601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:59.035840Z","title":"Faceverse: a fine-grained and detail- controllable 3d face morphable model from a hybrid dataset","venue":null,"work_id":"2a34fa77-4fab-4fb3-a4e9-69648b45e9a5","year":2022},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:52.513665Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:a66026ea47cbe8b1b79b16faa286cbb237e10006d91dcaa2466d925c485600e7","observation_id":"89f5637d-4240-4a0f-92d6-10bbdb6f5231","resolution":{"observed_at":"2026-08-07T13:49:59.144125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:58.808031Z","title":"Styletalk++: A unified framework for controlling the speaking styles of talking heads.IEEE Transactions on Pattern Analysis and Machine Intelligence, 2024","venue":null,"work_id":"a12d178b-f961-4c05-bdb8-f3bd5ff9631c","year":2024},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:52.583573Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:6510dfc39129e8c9ff9bc4e34f1d47a72d6cf95b506095a4951d549a2738a252","observation_id":"e0b2f31c-4e2d-4d98-a6de-9374520f3c1d","resolution":{"observed_at":"2026-08-07T13:49:58.921199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:58.610502Z","title":"Mes- net: A convolutional neural network for spotting multi-scale micro-expression intervals in long videos.IEEE Transac- tions on Image Processing, 30:3956–3969, 2021","venue":null,"work_id":"06634bf3-c9d2-466a-9412-7fb4a1156803","year":2021},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:52.674076Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:c9f355296574a54eb0653b230ac112fc69435f7b13edbe257388040ab70ce1d0","observation_id":"0c779b70-8aea-4196-8848-70e36ee8f2fb","resolution":{"observed_at":"2026-08-07T13:49:58.687769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15758","last_updated":"2024-05-24T17:53:54Z","snapshot_observed_at":"2026-07-06T18:19:29.996982Z","submitted_at":"2024-05-24T17:53:54Z","title":"InstructAvatar: Text-Guided Emotion and Motion Control for Avatar Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15758","snapshot_observed_at":"2026-08-07T13:49:52.775927Z","title":"Instructavatar: Text- guided emotion and motion control for avatar generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:52.775927Z"},"links":{"cited_paper":"/paper/2405.15758","citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:c0205bfdbaa1a2d1ac25013c7bde76435189ae97692c1d4740bf319dbf13f948","observation_id":"5d68c1b8-b243-44ec-bda2-288fa97dce0e","resolution":{"observed_at":"2026-08-07T13:49:52.775927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17694","last_updated":"2024-03-26T13:35:02Z","snapshot_observed_at":"2026-08-07T20:48:39.175359Z","submitted_at":"2024-03-26T13:35:02Z","title":"AniPortrait: Audio-Driven Synthesis of Photorealistic Portrait Animation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17694","snapshot_observed_at":"2026-08-07T13:49:52.852981Z","title":"Aniportrait: Audio-driven synthesis of photorealistic portrait animation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:52.852981Z"},"links":{"cited_paper":"/paper/2403.17694","citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:c38efd0a0c89b58631b33cf599eba32cf467dbf8ebfc6ae3271f60add5fe9cdf","observation_id":"1f0bcfd1-d675-4f87-ae55-6c336198b589","resolution":{"observed_at":"2026-08-07T13:49:52.852981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07757","last_updated":"2024-10-10T09:37:01Z","snapshot_observed_at":"2026-08-06T09:41:39.335850Z","submitted_at":"2024-10-10T09:37:01Z","title":"MMHead: Towards Fine-grained Multi-modal 3D Facial Animation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07757","snapshot_observed_at":"2026-08-07T13:49:52.938222Z","title":"Mmhead: Towards fine- grained multi-modal 3d facial animation.arXiv preprint arXiv:2410.07757, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:52.938222Z"},"links":{"cited_paper":"/paper/2410.07757","citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:3c74192164c2a53d478f7f9e5eb0964711f189689d0231640c74a9e1c0eff58d","observation_id":"5f9d5c69-790c-4151-a5fd-34304171d249","resolution":{"observed_at":"2026-08-07T13:49:52.938222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:58.355993Z","title":"Codetalker: Speech-driven 3d facial animation with discrete motion prior","venue":null,"work_id":"5894db58-0bc2-4fa3-980c-5a802f91cb72","year":2023},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:53.034434Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:6c41adb0f283abc7ca4a137b77013fc7865e3d08334866e9a6fd7e67c0342181","observation_id":"d2c14f9a-e377-4885-858a-e8fec47d3c01","resolution":{"observed_at":"2026-08-07T13:49:58.476783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08801","last_updated":"2024-06-16T07:10:41Z","snapshot_observed_at":"2026-07-06T18:30:06.570612Z","submitted_at":"2024-06-13T04:33:20Z","title":"Hallo: Hierarchical Audio-Driven Visual Synthesis for Portrait Image Animation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08801","snapshot_observed_at":"2026-08-07T13:49:53.135171Z","title":"Hallo: Hierarchical audio-driven vi- sual synthesis for portrait image animation.arXiv preprint arXiv:2406.08801, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:53.135171Z"},"links":{"cited_paper":"/paper/2406.08801","citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:630dfc38e00a4204f0ce10a64d4ab27ade7cd26ebee6e9d2753b96b3824396b0","observation_id":"2bc0af3b-65de-4f02-bee0-74fa0848f548","resolution":{"observed_at":"2026-08-07T13:49:53.135171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10667","last_updated":"2024-10-31T07:43:14Z","snapshot_observed_at":"2026-07-06T18:01:01.206270Z","submitted_at":"2024-04-16T15:43:22Z","title":"VASA-1: Lifelike Audio-Driven Talking Faces Generated in Real Time","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10667","snapshot_observed_at":"2026-08-07T13:49:53.235375Z","title":"Vasa-1: Lifelike audio-driven talking faces generated in real time.arXiv preprint arXiv:2404.10667,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:53.235375Z"},"links":{"cited_paper":"/paper/2404.10667","citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:8adbef0d8e4eb22b65ec0bd226653e99a8d6734ce1eb793ed6df0bec559a0e93","observation_id":"888ee6e9-f674-4db1-8804-01986df3a000","resolution":{"observed_at":"2026-08-07T13:49:53.235375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:58.143555Z","title":"Probabilistic speech- driven 3d facial motion synthesis: New benchmarks meth- ods and applications","venue":null,"work_id":"da52fea4-daca-4729-8660-28bde5822823","year":2024},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:53.331132Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:31bc513eb315c7b845c29db1207da64449bb5b90791fc190e7d5998a69f8c030","observation_id":"c4d05344-ae25-49bd-b38e-f2ce30f0c207","resolution":{"observed_at":"2026-08-07T13:49:58.258184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:57.958752Z","title":"Samm long videos: A spontaneous facial micro-and macro- expressions dataset","venue":null,"work_id":"b8ca3bef-0049-43b0-bcf7-56a917a1f98f","year":2020},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:53.398064Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:94e932a06cefa364f985b8930628580c3b2edfdca32c150395f3747487c2dba7","observation_id":"59a38717-3606-49db-9fec-a5fb10493703","resolution":{"observed_at":"2026-08-07T13:49:58.039505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:57.719282Z","title":"3d-cnn for facial micro-and macro-expression spotting on long video sequences using temporal oriented reference frame","venue":null,"work_id":"1253d7ca-0036-4fc6-84f2-e926450fbbdf","year":2022},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:53.512356Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:3a0d2c3ed0d1edbaad23cd233b1cba32fe69fb64915a470773f9a637bf575def","observation_id":"a4ab37a4-bc3d-4553-bda2-888af71a5990","resolution":{"observed_at":"2026-08-07T13:49:57.843948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13430","last_updated":"2023-01-31T05:56:06Z","snapshot_observed_at":"2026-07-06T14:46:26.697969Z","submitted_at":"2023-01-31T05:56:06Z","title":"GeneFace: Generalized and High-Fidelity Audio-Driven 3D Talking Face Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13430","snapshot_observed_at":"2026-08-07T13:49:53.598544Z","title":"Geneface: Generalized and high- fidelity audio-driven 3d talking face synthesis.arXiv preprint arXiv:2301.13430, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:53.598544Z"},"links":{"cited_paper":"/paper/2301.13430","citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:ce677f355f6bc4b146ec3724d4aa53022214970dd1a547bbddad75dab5c01906","observation_id":"5769b326-6566-4671-a8bf-db05c7da5412","resolution":{"observed_at":"2026-08-07T13:49:53.598544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:57.292015Z","title":"Facial expression spotting based on optical flow features","venue":null,"work_id":"351f7312-3eaa-43a2-ba35-635553be97df","year":2022},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:53.737429Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:975682252f04b73a8bf65c42344b943e4b1376896c7366effbc8a5f6570509fb","observation_id":"d4088ada-b6a2-4119-818e-defb0818f912","resolution":{"observed_at":"2026-08-07T13:49:57.505213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:56.912368Z","title":"CelebV-Text: A large-scale facial text-video dataset","venue":null,"work_id":"f4a20b1a-e022-49b7-81b6-969851d3f1be","year":2023},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:53.833576Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:36ce7c206c2dee57739e1b326c008820b78fb616bc15f18e5869ce64dac7bd9a","observation_id":"674c982a-6c39-4fdf-b4bf-a1cb43c28784","resolution":{"observed_at":"2026-08-07T13:49:57.077407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04248","last_updated":"2022-12-07T17:55:41Z","snapshot_observed_at":"2026-07-06T14:28:17.748673Z","submitted_at":"2022-12-07T17:55:41Z","title":"Talking Head Generation with Probabilistic Audio-to-Visual Diffusion Priors","version":1},"cited_work":{"arxiv_id":"2212.04248","doi":null,"metadata_source":"pith","pith_arxiv_id":"2212.04248","snapshot_observed_at":"2026-08-07T13:49:54.649602Z","title":"Talking Head Generation with Probabilistic Audio-to-Visual Diffusion Priors","venue":"cs.GR","work_id":"1e829a42-c5f1-42c3-8fa7-ba218ae52419","year":2022},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:53.927766Z"},"links":{"cited_paper":"/paper/2212.04248","citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:e173a20239b0704eba456db2e6191ed7b16fa971aa620d8161e569baf61160ac","observation_id":"8dd5130e-983b-4f44-9e1c-42c0c2714fbc","resolution":{"observed_at":"2026-08-07T13:49:54.743484Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:56.661424Z","title":"Talking head generation with probabilistic audio-to-visual diffusion priors","venue":null,"work_id":"50d8bb10-9bad-4ac6-9dac-84ec3fed45af","year":2023},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:54.016200Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:d7511712e96c8e070655c9579442b61813df37b889ef1b52bdc52077571ed103","observation_id":"0037c0d5-adbf-4eea-9e87-e6602698941c","resolution":{"observed_at":"2026-08-07T13:49:56.774445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05379","last_updated":"2024-09-09T07:23:28Z","snapshot_observed_at":"2026-07-06T19:12:23.792177Z","submitted_at":"2024-09-09T07:23:28Z","title":"PersonaTalk: Bring Attention to Your Persona in Visual Dubbing","version":1},"cited_work":{"arxiv_id":"2409.05379","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.05379","snapshot_observed_at":"2026-08-07T13:49:54.436093Z","title":"PersonaTalk: Bring Attention to Your Persona in Visual Dubbing","venue":"cs.CV","work_id":"0f1c6398-ebdf-4ec6-b4d1-c6affcd9ab05","year":2024},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:54.116546Z"},"links":{"cited_paper":"/paper/2409.05379","citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:22923f4cfdec8326724894bf29e88b06800d58d7bdc6c1ebf091ff99d4973fa5","observation_id":"85deecbd-cb63-473f-9204-68e68961d28d","resolution":{"observed_at":"2026-08-07T13:49:54.502560Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:56.398309Z","title":"Sadtalker: Learning realistic 3d motion coefficients for stylized audio- driven single image talking face animation","venue":null,"work_id":"f2485250-72e0-428a-8dfb-c5ee9a4d7f89","year":2023},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:54.196437Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:b8a0763ee7d55599cef191b7169899971f1c47bae5b78ff3944db7ad0f80feb4","observation_id":"f548c61a-4c08-4251-888e-d79c7a6c3c74","resolution":{"observed_at":"2026-08-07T13:49:56.504965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:49:56.161583Z","title":"Media2face: Co-speech facial animation gen- eration with multi-modality guidance","venue":null,"work_id":"c34f7934-0bf3-40e4-996a-d0fdf4285622","year":2024},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:54.279621Z"},"links":{"citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:f2b2411544807f2108ae0d6f01d9cfa95b46ed497a63a09ba085c098cafb2cdd","observation_id":"a075f5fe-8e44-415f-b1c2-12a5ab345e62","resolution":{"observed_at":"2026-08-07T13:49:56.242846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T20:50:38.502292Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":6,"verified_fuzzy":38},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 0 inbound Pith citation observations for arXiv:2505.20861."}