{"as_of":"2026-08-09T11:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7a1c9311effbb693db7504315af01e13d18d4d17ef2f2b0e8e6425d100defa3a","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T20:23:52.980432Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.10566/citation-record","integrity":"/paper/2508.10566/integrity","json":"/paper/2508.10566/citation-record.json","paper":"/paper/2508.10566"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:57.740452Z","title":"Openface 2.0: Facial behavior analysis toolkit","venue":null,"work_id":"37625dda-d29a-4fea-9651-80cf8ae41fcc","year":2018},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:50.844471Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:719ddc08d24047574c57ddbd6073cb47a03f3085019bd3dbb7dc4420ae9082ba","observation_id":"9be8d162-5f1a-48e6-a436-a2526d57a70c","resolution":{"observed_at":"2026-08-05T20:23:57.823532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:57.549799Z","title":"A morphable model for the synthesis of 3d faces","venue":null,"work_id":"683f5d10-f06b-4464-a835-22e879369391","year":1999},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:50.900701Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:f91478fcfbbd3936786dba9052ca95448b4dcc97d17ccbbf27664a4377e97545","observation_id":"bfb99bc6-e204-4ec3-aad4-d9259f903570","resolution":{"observed_at":"2026-08-05T20:23:57.646436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:57.354028Z","title":"A morphable model for the synthesis of 3d faces","venue":null,"work_id":"6f241ca0-0fb7-4e82-b054-ad072fa5b578","year":2023},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:50.953721Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:23ac302edb347c4d5fc826b6e1a59b475df9b69bda6dbaf833c8ab124fd69c50","observation_id":"51a6349f-d1ed-4f2f-844b-8abc5bb5ab29","resolution":{"observed_at":"2026-08-05T20:23:57.443967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:57.206086Z","title":"Lip movements generation at a glance","venue":null,"work_id":"c0382276-854a-4c93-82b4-dc974b6d9838","year":null},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:51.029278Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:f1c5338a83ac07a75ab8e3486a2657d488f7ccb08f527191b775179587ed9ba1","observation_id":"2ad98d9a-f983-4a87-9987-b034dd74f716","resolution":{"observed_at":"2026-08-05T20:23:57.275070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:56.941852Z","title":"Gaus- siantalker: Real-time high-fidelity talking head synthesis with audio-driven 3d gaussian splatting","venue":null,"work_id":"bb19a360-7c9c-4ee1-b585-ba07cb7a2f5f","year":null},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:51.096300Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:6e29a677e3d7d263d56b391f00ee54c9bc9927552ac4446ce651a7276f1db407","observation_id":"722b9970-7bc3-4e5c-956f-c8c483b267e0","resolution":{"observed_at":"2026-08-05T20:23:57.104449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:56.762787Z","title":"Generalizable and ani- matable gaussian head avatar, 2025","venue":null,"work_id":"31f23bbe-9fc4-406e-93eb-df0405996112","year":2025},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:51.156714Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:db27daae555b7994155a84729242490fbd0827b07addeeedf4082d8b2d0c4d3b","observation_id":"8ca06bde-a813-400e-81f7-a93e87dbf3d2","resolution":{"observed_at":"2026-08-05T20:23:56.831726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:56.613098Z","title":"Lip reading in the wild","venue":null,"work_id":"f1888428-9a4a-48c8-8d3b-e07b77ee652a","year":null},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:51.237122Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:2e6f8677d22254dbeb26093823b7e635049eaa35bab89774be78d2bfb3a60984","observation_id":"f8ae2f6f-fa7d-4da4-bfc4-c247f7652d1a","resolution":{"observed_at":"2026-08-05T20:23:56.657397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:56.365452Z","title":"Out of time: auto- mated lip sync in the wild","venue":null,"work_id":"9fa7b517-a7f0-419e-8ffa-e56911dbb85a","year":2017},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:51.339790Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:eabf5946085360b7cc350868e50528a8cd259b6297815c4a5e18a10b810f6bef","observation_id":"1b24a173-7bdf-49e7-b9cd-3cd07fc5abbd","resolution":{"observed_at":"2026-08-05T20:23:56.456554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:56.176948Z","title":"Facial action coding system.Environmental Psychology & Nonverbal Behavior,","venue":null,"work_id":"eb333062-c4f1-4204-a9cc-98245915a945","year":null},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:51.394822Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:1b4a91acdf7413b3d5ace355867d36469190d23e14525db8e7597ba015fa64be","observation_id":"3fa436dc-cdbe-4de8-b903-1986103aea25","resolution":{"observed_at":"2026-08-05T20:23:56.292634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:55.960765Z","title":"Monocular and generalizable gaussian talking head animation","venue":null,"work_id":"54722cba-fe73-4cf6-b41f-56f305448dd3","year":2025},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:51.462315Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:7b809abddc1853f3c8e93909da3349fb63d209dbf068aaeea4eb7ab472a1f2a2","observation_id":"4eaebfb2-4baa-44ab-9ab1-b51c96bc8d01","resolution":{"observed_at":"2026-08-05T20:23:56.070403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:55.815735Z","title":"Beyond self-attention: External attention using two linear layers for visual tasks.IEEE Transactions on Pattern Analysis and Machine Intelligence, 45(5):5436–5447, 2022","venue":null,"work_id":"7f132d3e-5a12-40c8-b81b-2a713f97f4df","year":2022},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:51.557593Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:1629bf6374c85fe40ee96660842f746c70cd0a3250277d05a1a58936fe69cac9","observation_id":"cbccb63d-f2f0-4937-8ada-b845755e04ec","resolution":{"observed_at":"2026-08-05T20:23:55.899164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:55.560458Z","title":"Ad-nerf: Audio driven neural ra- diance fields for talking head synthesis","venue":null,"work_id":"92cb1037-6058-4f19-a367-9569d6b15b11","year":null},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:51.614815Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:d5f49f3616efe4f6665d5963e99c59df8f167ae11a7e319b0b873d457656410c","observation_id":"be27c7d8-1577-4d6c-b806-c6956d8a671c","resolution":{"observed_at":"2026-08-05T20:23:55.680819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.5567","last_updated":"2014-12-19T21:36:13Z","snapshot_observed_at":"2026-07-06T04:03:56.251710Z","submitted_at":"2014-12-17T20:39:45Z","title":"Deep Speech: Scaling up end-to-end speech recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.5567","snapshot_observed_at":"2026-08-05T20:23:51.658851Z","title":"Deep speech: Scaling up end-to-end speech recognition.arXiv preprint arXiv:1412.5567, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:51.658851Z"},"links":{"cited_paper":"/paper/1412.5567","citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:98f8518381a66b5e08954e5c2a42a7fa55f0067f8d9efac8fd7a5f2db4f9bbb9","observation_id":"f4b98128-934c-44e5-b2b2-5a6d7dd6dc0c","resolution":{"observed_at":"2026-08-05T20:23:51.658851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:55.344567Z","title":"3d gaussian splatting for real-time radiance field rendering.ACM Transactions on Graphics, 42 (4), 2023","venue":null,"work_id":"05bbf849-26db-471d-bb63-afe5cbf28906","year":2023},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:51.740309Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:a47b3e60faeb919014f795ac2ddfaf1417a43bf9481ba7e58af6ecedadb66c55","observation_id":"1c4bf9b9-bfe3-47dd-aafb-bca16ae209f8","resolution":{"observed_at":"2026-08-05T20:23:55.459727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-05T20:23:51.834726Z","title":"Adam: A method for stochastic optimization.arXiv preprint arXiv:1412.6980,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:51.834726Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:c4352ae80fb2f884a0bb908d63a83c01e545229f1566618719f1ab7297d6f192","observation_id":"60dde6c4-38fd-4165-8c5a-1086758e47bf","resolution":{"observed_at":"2026-08-05T20:23:51.834726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:55.168315Z","title":null,"venue":null,"work_id":"7174876b-f909-4dbf-bd2d-aeb2964c3db3","year":null},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:51.918953Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:b840e68959ca2525bad2e088a786740f62fe2ff924474664465f24f07f60faa4","observation_id":"6aaf3b7f-2bf7-4ca3-91ff-563dbdcac839","resolution":{"observed_at":"2026-08-05T20:23:55.253319Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:55.027689Z","title":"Ef- ficient region-aware neural radiance fields for high-fidelity talking portrait synthesis","venue":null,"work_id":"23888d35-20f2-4d92-8280-3f215416e43c","year":2023},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:51.961010Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:0c600633765406e357369f230ac781bcc19cc9a1a366ccd7d3827c2a6420952f","observation_id":"ce4a03eb-25ad-42b9-8dbf-2a63420d1b69","resolution":{"observed_at":"2026-08-05T20:23:55.079838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:54.832562Z","title":"Talkinggaussian: Structure-persistent 3d talking head synthesis via gaussian splatting","venue":null,"work_id":"6c5d5d49-64d8-43a1-b305-855f19c1e575","year":2025},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:52.025486Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:571614f8e9a9c1becccdad70e81e322e0886454acb706e2fcd451081e13c85aa","observation_id":"5f6a9738-8966-451a-a28c-b1b31bdcf5a1","resolution":{"observed_at":"2026-08-05T20:23:54.922441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:54.649754Z","title":"Instag: Learning personalized 3d talking head from few-second video","venue":null,"work_id":"6dcea0a9-2c8e-47f6-814d-239e723e5c52","year":2025},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:52.094160Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:3db1fa7a2de1ca44078ff39eb57dc78618e3427cb8f766c04bdf60f23bf06c18","observation_id":"8f245418-631d-4205-a9a9-d1b9d485dc96","resolution":{"observed_at":"2026-08-05T20:23:54.725824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:52.159983Z","title":"Decoupled weight de- cay regularization","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:52.159983Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:d4701a4f9a50016deb02c69721ca05c0125a0738d881202ba41c7d4dd8b921db","observation_id":"911c665e-52a4-4b84-b467-439c5306a771","resolution":{"observed_at":"2026-08-05T20:23:52.159983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:52.214274Z","title":"Nerf: Representing scenes as neural radiance fields for view syn- thesis.Communications of the ACM, 65(1):99–106, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:52.214274Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:50a492a398568d19092e1a47e536ffeeb00ecc73949716d54c717a372b17265d","observation_id":"921af4c2-181f-410e-b2ee-4eaaf47a5ee2","resolution":{"observed_at":"2026-08-05T20:23:52.214274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:54.439511Z","title":"Synctalk: The devil is in the synchronization for talking head synthesis","venue":null,"work_id":"bf128270-e88c-4633-b8d5-c690f55c02b9","year":2024},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:52.280660Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:615cb9bbc2421354a45a2ef5ae289e19462265c215ab01cc0f805f7f3eaa801e","observation_id":"2140df8f-5e69-42f3-a18c-aaaa550926c4","resolution":{"observed_at":"2026-08-05T20:23:54.550024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:54.280736Z","title":"A lip sync expert is all you need for speech to lip generation in the wild","venue":null,"work_id":"3dd4323f-4844-477f-937d-07506b6481a8","year":2020},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:52.338864Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:03b43cc6f37a72df3670144b4f14318e4419997662e6d2876f0926b4c9e96ade","observation_id":"8109fb47-85af-4506-bdf1-7b5b10e83fc4","resolution":{"observed_at":"2026-08-05T20:23:54.360498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:54.132417Z","title":"Facial action coding system.Environmental Psychology & Nonverbal Behavior, 1, 2015","venue":null,"work_id":"82a89ebf-86d4-4bc8-9052-1ad7c6c4cfde","year":2015},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:52.424634Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:9f78de0b5e842607ef40f7cab08cbf6f34c8353d25d6fad596d4c7cc2e558320","observation_id":"db031e85-a59a-4858-aa38-6cda160e7abb","resolution":{"observed_at":"2026-08-05T20:23:54.213839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.12368","last_updated":"2022-11-22T16:03:11Z","snapshot_observed_at":"2026-08-01T10:41:24.348491Z","submitted_at":"2022-11-22T16:03:11Z","title":"Real-time Neural Radiance Talking Portrait Synthesis via Audio-spatial Decomposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.12368","snapshot_observed_at":"2026-08-05T20:23:52.498086Z","title":"Real-time neural radiance talking portrait synthesis via audio-spatial decomposition.arXiv preprint arXiv:2211.12368, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:52.498086Z"},"links":{"cited_paper":"/paper/2211.12368","citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:b683913fe345c58e6ea7548afcf570513b926475f363f6ca223acd61154e4cef","observation_id":"19b8ed82-0855-4c3a-8b3f-95ad11660669","resolution":{"observed_at":"2026-08-05T20:23:52.498086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:54.017360Z","title":"Seeing what you said: Talking face genera- tion guided by a lip reading expert","venue":null,"work_id":"4d77511e-0f4d-448a-83f1-93c7cae30b62","year":2023},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:52.556214Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:06677857f327db5d0d07ad1f2fb6c34bc7670d70d8d115bdc621d5afbf3303e6","observation_id":"ee1803ff-5773-4f6b-acc9-daccfd91cf29","resolution":{"observed_at":"2026-08-05T20:23:54.070994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:53.840006Z","title":"Image quality assessment: from error visibility to structural similarity.IEEE Transactions on Image Process- ing, 13(4):600–612, 2004","venue":null,"work_id":"06b6430a-2fa2-4e6a-9544-72958949d185","year":2004},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:52.650641Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:aa1fae0e7215d6e79d2d3b707b83757b246ff93ff36e3747a9b81ee6dfd4e42e","observation_id":"fb0bd39b-06cb-4e10-8f81-26429e6ae4fa","resolution":{"observed_at":"2026-08-05T20:23:53.916238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:53.692506Z","title":"Geneface: Generalized and high-fidelity audio-driven 3d talking face synthesis","venue":null,"work_id":"dbc4cb86-8552-4e78-9269-e17a69aead5c","year":2023},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:52.706624Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:bf27074ba8f61115788fbcf81c868958d484bf1fb84a57c2d7cca2c19e54c927","observation_id":"8f189a74-9219-4d6b-b466-c10873dfc34d","resolution":{"observed_at":"2026-08-05T20:23:53.744748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:53.534213Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":"f960f37c-658d-4698-9b71-762efc26a421","year":null},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:52.775081Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:9dcdaa301ba8137e417829ea287129c6bbf3838574d702971e7e52959397f510","observation_id":"e61bd745-e9a1-45d3-ac4a-4362c9d07ae3","resolution":{"observed_at":"2026-08-05T20:23:53.593170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:53.375393Z","title":"Sadtalker: Learning realistic 3d motion coefficients for stylized audio- driven single image talking face animation","venue":null,"work_id":"ca798f38-7ce4-41c7-bd0b-9d4bcd8128bf","year":null},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:52.836382Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:f9d444bea6f1fa0b7111230864b6d98e6f0eac111217182d0265696e7f290fbf","observation_id":"82fe8876-c3b4-4530-abc9-11bd8f3cc70f","resolution":{"observed_at":"2026-08-05T20:23:53.442457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:53.224632Z","title":"Dinet: Deformation inpainting network for realistic face visually dubbing on high resolution video","venue":null,"work_id":"25f0c387-b3bd-4caf-9f90-cec5674f1790","year":2023},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:52.914598Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:6541eee7198df9119b4f8ada2a269bd2b4ebdf96c72c3c0ce78c42f4d14ac636","observation_id":"3f9f2f41-0c00-4995-a103-8103cd4fcc55","resolution":{"observed_at":"2026-08-05T20:23:53.303808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:53.072119Z","title":"Identity- preserving talking face generation with landmark and ap- pearance priors","venue":null,"work_id":"f040166c-8e6e-4465-8af6-870985c55125","year":2023},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:52.980432Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:94acc3b2cdfc895e7bdd2029fd56a9b8d31859bdb75251a32633f2382467918e","observation_id":"5cf28392-1eb7-408b-b578-0865d088a583","resolution":{"observed_at":"2026-08-05T20:23:53.146284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:56.519972Z","title":null,"venue":null,"work_id":"5ab346b1-760c-45c2-ba97-b2332e199011","year":2017},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":103,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:51.285642Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:a55e79d1943764be0fa48280f739a8dc9275cffa943cbde43d04252d90c08a15","observation_id":"34d2b8bb-59ec-46d4-9028-3eb00fb98ebf","resolution":{"observed_at":"2026-08-05T20:23:56.608009Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-05T20:23:50.495359Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":6,"verified_exact":0,"verified_fuzzy":26},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 0 inbound Pith citation observations for arXiv:2508.10566."}