{"as_of":"2026-08-13T19:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0d72ce8fac8a53e0166b4eaf454f6753ac12071f332df35ce89bf776d530d2a8","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T14:22:40.992230Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.15436/citation-record","integrity":"/paper/2411.15436/integrity","json":"/paper/2411.15436/citation-record.json","paper":"/paper/2411.15436"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:22:41.957998Z","title":null,"venue":null,"work_id":"6a33c7ab-d623-43d4-acf7-ab8b48f9d8a4","year":null},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.732032Z"},"links":{"citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:240b4f53d353d25c67b358542eac9ea541b728793ff03a617e5f72422eb4955d","observation_id":"895a3c51-a187-49a6-99a3-d2f3c4331c6d","resolution":{"observed_at":"2026-08-12T14:22:41.963200Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:22:41.942152Z","title":null,"venue":null,"work_id":"066b7d4f-728d-4c6f-9baf-14a05b1ae65a","year":1999},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.743131Z"},"links":{"citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:9e61dc48690acebc2ea011fc2c1e17a461b1f399107385cb13ef5a2acbcabbd9","observation_id":"5090cb0e-a8f1-4c06-8360-3b8d57c81869","resolution":{"observed_at":"2026-08-12T14:22:41.947139Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.11312","last_updated":"2022-04-24T15:58:35Z","snapshot_observed_at":"2026-08-13T15:57:01.151525Z","submitted_at":"2022-04-24T15:58:35Z","title":"EMOCA: Emotion Driven Monocular Face Capture and Animation","version":1},"cited_work":{"arxiv_id":"2204.11312","doi":null,"metadata_source":"pith","pith_arxiv_id":"2204.11312","snapshot_observed_at":"2026-08-12T14:22:41.685578Z","title":"EMOCA: Emotion Driven Monocular Face Capture and Animation","venue":"cs.CV","work_id":"a70127b1-5650-4c22-9a0f-3381e0e13dfe","year":2022},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.748331Z"},"links":{"cited_paper":"/paper/2204.11312","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:517b2f48c38f86be0c1b07295008e66062e0f1793d5ec07e97e6ab29436cf647","observation_id":"4fe39c4d-2f89-4ff9-aba5-1b68c1909f26","resolution":{"observed_at":"2026-08-12T14:22:41.691049Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.11660","last_updated":"2020-09-04T04:32:25Z","snapshot_observed_at":"2026-08-13T00:42:11.552772Z","submitted_at":"2020-04-24T11:21:13Z","title":"Disentangled and Controllable Face Image Generation via 3D Imitative-Contrastive Learning","version":2},"cited_work":{"arxiv_id":"2004.11660","doi":null,"metadata_source":"pith","pith_arxiv_id":"2004.11660","snapshot_observed_at":"2026-08-12T14:22:41.661902Z","title":"Disentangled and Controllable Face Image Generation via 3D Imitative-Contrastive Learning","venue":"cs.CV","work_id":"f626e3f2-3262-42ed-9016-f206fab9f255","year":2020},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.753476Z"},"links":{"cited_paper":"/paper/2004.11660","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:03fc6c7650369d94e6886743363f77e073a6f4d8149dc051b1fbb229dd991099","observation_id":"77813dc9-426e-4d4f-baea-b26e65e4805d","resolution":{"observed_at":"2026-08-12T14:22:41.667228Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.08527","last_updated":"2020-04-09T16:42:09Z","snapshot_observed_at":"2026-08-12T10:17:31.166385Z","submitted_at":"2019-03-20T14:44:45Z","title":"Accurate 3D Face Reconstruction with Weakly-Supervised Learning: From Single Image to Image Set","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.08527","snapshot_observed_at":"2026-08-12T14:22:40.758957Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.758957Z"},"links":{"cited_paper":"/paper/1903.08527","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:c2ff008dc9277faea2a0fed90b688a6a04ff8f3672d59c0d6dbea37e59409c09","observation_id":"81f2e4c5-8cee-4043-a042-06dbe01af8e7","resolution":{"observed_at":"2026-08-12T14:22:40.758957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06711","last_updated":"2023-04-13T17:58:00Z","snapshot_observed_at":"2026-08-13T12:03:21.626708Z","submitted_at":"2023-04-13T17:58:00Z","title":"DiffusionRig: Learning Personalized Priors for Facial Appearance Editing","version":1},"cited_work":{"arxiv_id":"2304.06711","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.06711","snapshot_observed_at":"2026-08-12T14:22:41.620678Z","title":"DiffusionRig: Learning Personalized Priors for Facial Appearance Editing","venue":"cs.CV","work_id":"c5e70c7c-3b9a-4a97-a520-b3be70dc3a28","year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.764111Z"},"links":{"cited_paper":"/paper/2304.06711","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:778702806761063da0b8df2725d95ac1cae488ad2a0754fdd4fe5c101a248a55","observation_id":"d5e0521a-76db-4b8b-ba97-72b24b5dbb08","resolution":{"observed_at":"2026-08-12T14:22:41.626000Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.04012","last_updated":"2021-06-02T17:52:42Z","snapshot_observed_at":"2026-08-13T00:42:18.557668Z","submitted_at":"2020-12-07T19:30:45Z","title":"Learning an Animatable Detailed 3D Face Model from In-The-Wild Images","version":2},"cited_work":{"arxiv_id":"2012.04012","doi":null,"metadata_source":"pith","pith_arxiv_id":"2012.04012","snapshot_observed_at":"2026-08-12T14:22:41.596361Z","title":"Learning an Animatable Detailed 3D Face Model from In-The-Wild Images","venue":"cs.CV","work_id":"d05182bf-3036-4c03-9766-064e71999f6e","year":2020},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.769303Z"},"links":{"cited_paper":"/paper/2012.04012","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:f5fcf09ebea55e3bd7e22444ae5aa4ad75adea47c7d0e3421eba062ab290e5cf","observation_id":"796c8720-5be9-435c-80df-c2bc728e6dc1","resolution":{"observed_at":"2026-08-12T14:22:41.601944Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:22:41.926022Z","title":null,"venue":null,"work_id":"64497091-ca0a-41b8-a12b-4ee54a950fec","year":2021},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.774982Z"},"links":{"citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:277abe2b4bdfc6fce0b2d4d544f5fc61d7cecb2b682802e1d86864e603cca17f","observation_id":"54cdcd3f-542a-4b69-b6bd-6a6e4f135b35","resolution":{"observed_at":"2026-08-12T14:22:41.931109Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.02761","last_updated":"2023-04-14T17:47:42Z","snapshot_observed_at":"2026-08-13T13:27:38.172070Z","submitted_at":"2022-12-06T05:24:42Z","title":"Learning Neural Parametric Head Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.02761","snapshot_observed_at":"2026-08-12T14:22:40.780171Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.780171Z"},"links":{"cited_paper":"/paper/2212.02761","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:4c02589c60e64ebf047fee75b2837526d72c60a1989a8d664294591ef4eb127e","observation_id":"ad8fd179-2475-4254-8260-cf760939a372","resolution":{"observed_at":"2026-08-12T14:22:40.780171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:22:41.909410Z","title":null,"venue":null,"work_id":"c8eb7f63-4759-4702-ad1c-46fe6199b2b3","year":2022},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.785415Z"},"links":{"citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:db87e1c683b3906a60e00f3dde85510d1f82a826f5f478ab5737e4c130001107","observation_id":"e8d8d28e-b3e5-49a8-91c2-c9129a5cf02e","resolution":{"observed_at":"2026-08-12T14:22:41.914417Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.09224","last_updated":"2019-11-21T00:07:43Z","snapshot_observed_at":"2026-07-06T08:38:39.515418Z","submitted_at":"2019-11-21T00:07:43Z","title":"FLNet: Landmark Driven Fetching and Learning Network for Faithful Talking Facial Animation Synthesis","version":1},"cited_work":{"arxiv_id":"1911.09224","doi":null,"metadata_source":"pith","pith_arxiv_id":"1911.09224","snapshot_observed_at":"2026-08-12T14:22:41.554133Z","title":"FLNet: Landmark Driven Fetching and Learning Network for Faithful Talking Facial Animation Synthesis","venue":"cs.CV","work_id":"04cc74d7-286b-4a9f-a64b-d0e6401915e7","year":2019},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.790241Z"},"links":{"cited_paper":"/paper/1911.09224","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:f639a24f2b710822894e5ee4ba9b9aa6c58d947d977924e53e1f2ccafa895e41","observation_id":"05958a49-e682-4e08-8a7a-f8a30867ca89","resolution":{"observed_at":"2026-08-12T14:22:41.559646Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00551","last_updated":"2023-12-31T17:41:48Z","snapshot_observed_at":"2026-08-13T04:50:44.096784Z","submitted_at":"2023-12-31T17:41:48Z","title":"A Generalist FaceX via Learning Unified Facial Representation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00551","snapshot_observed_at":"2026-08-12T14:22:40.795225Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.795225Z"},"links":{"cited_paper":"/paper/2401.00551","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:250ce34a14ce14b9729ff5049f0a90660cacf0e5f2b5e06ba2ccb90aa4b4cdaf","observation_id":"302484db-6cb1-42a2-b9c6-3993fcd86cf1","resolution":{"observed_at":"2026-08-12T14:22:40.795225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.11239","last_updated":"2020-12-16T21:15:05Z","snapshot_observed_at":"2026-08-10T05:21:27.485481Z","submitted_at":"2020-06-19T17:24:44Z","title":"Denoising Diffusion Probabilistic Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.11239","snapshot_observed_at":"2026-08-12T14:22:40.800584Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.800584Z"},"links":{"cited_paper":"/paper/2006.11239","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:6089549951ddc43abfee09ded12ee7c451d4abf377c5ed97aeeffa3ca8e62e2c","observation_id":"45240e48-2fa3-4118-870a-07d21b714b7f","resolution":{"observed_at":"2026-08-12T14:22:40.800584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.07452","last_updated":"2021-05-20T02:48:26Z","snapshot_observed_at":"2026-08-13T19:39:23.733743Z","submitted_at":"2021-04-15T13:37:13Z","title":"Audio-Driven Emotional Video Portraits","version":2},"cited_work":{"arxiv_id":"2104.07452","doi":null,"metadata_source":"pith","pith_arxiv_id":"2104.07452","snapshot_observed_at":"2026-08-12T14:22:41.495306Z","title":"Audio-Driven Emotional Video Portraits","venue":"cs.CV","work_id":"f77e0610-d796-4d52-87fd-dcb40d313e78","year":2021},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.806060Z"},"links":{"cited_paper":"/paper/2104.07452","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:b0db6311a3f478fa3b81c799c986bc2b0dd5f358199eb265b6b5a0d6cda27b08","observation_id":"481106dd-69eb-4889-8708-041abe49d05b","resolution":{"observed_at":"2026-08-12T14:22:41.500654Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.04948","last_updated":"2019-03-29T11:08:46Z","snapshot_observed_at":"2026-08-10T12:08:24.752628Z","submitted_at":"2018-12-12T13:59:43Z","title":"A Style-Based Generator Architecture for Generative Adversarial Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.04948","snapshot_observed_at":"2026-08-12T14:22:40.811550Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.811550Z"},"links":{"cited_paper":"/paper/1812.04948","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:96b207ae7c938bce90e8d586ab1862c0090e46f2627b91b3312596afd07b5eaf","observation_id":"aa904ff8-9065-4fc9-9715-faa03c54255b","resolution":{"observed_at":"2026-08-12T14:22:40.811550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.04958","last_updated":"2020-03-23T17:21:07Z","snapshot_observed_at":"2026-08-11T01:44:55.174462Z","submitted_at":"2019-12-03T11:44:01Z","title":"Analyzing and Improving the Image Quality of StyleGAN","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.04958","snapshot_observed_at":"2026-08-12T14:22:40.817610Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.817610Z"},"links":{"cited_paper":"/paper/1912.04958","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:1a25647218fa9225bc1a188ba7eb599ebb5af847e411e14d601b8d2799a2d438","observation_id":"5d620a45-9d84-44d5-9646-341887cc28a4","resolution":{"observed_at":"2026-08-12T14:22:40.817610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.08343","last_updated":"2022-06-16T17:45:23Z","snapshot_observed_at":"2026-08-13T15:22:32.528393Z","submitted_at":"2022-06-16T17:45:23Z","title":"Realistic One-shot Mesh-based Head Avatars","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.08343","snapshot_observed_at":"2026-08-12T14:22:40.822715Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.822715Z"},"links":{"cited_paper":"/paper/2206.08343","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:84a207abfeb6eb302ecc873efffdca284224c645373a9c607d320c911d2e528c","observation_id":"584d66ad-a30f-4275-a8c5-e03ed2eafd56","resolution":{"observed_at":"2026-08-12T14:22:40.822715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.02802","last_updated":"2023-03-27T11:15:59Z","snapshot_observed_at":"2026-08-13T13:27:35.058630Z","submitted_at":"2022-12-06T07:41:51Z","title":"Diffusion Video Autoencoders: Toward Temporally Consistent Face Video Editing via Disentangled Video Encoding","version":2},"cited_work":{"arxiv_id":"2212.02802","doi":null,"metadata_source":"pith","pith_arxiv_id":"2212.02802","snapshot_observed_at":"2026-08-12T14:22:41.412866Z","title":"Diffusion Video Autoencoders: Toward Temporally Consistent Face Video Editing via Disentangled Video Encoding","venue":"cs.CV","work_id":"f5457747-2b45-4739-9926-ad448c691f69","year":2022},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.828650Z"},"links":{"cited_paper":"/paper/2212.02802","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:cfc83cc19257d0e72d515ff4486a6c528d8a89c11c2c4d3c2bd0b708c8b8177e","observation_id":"0bdf380b-40c9-452f-86d6-b91ba983c41b","resolution":{"observed_at":"2026-08-12T14:22:41.418402Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07060","last_updated":"2023-04-14T11:31:49Z","snapshot_observed_at":"2026-08-13T12:02:57.643426Z","submitted_at":"2023-04-14T11:31:49Z","title":"DCFace: Synthetic Face Generation with Dual Condition Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07060","snapshot_observed_at":"2026-08-12T14:22:40.833406Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.833406Z"},"links":{"cited_paper":"/paper/2304.07060","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:5eb4dcbceccfe9c36f71b551eb0e4c40eb51130b8cbe824acf3600d46eb6774f","observation_id":"1107de5b-22e2-4d18-9438-26e9bbd94da6","resolution":{"observed_at":"2026-08-12T14:22:40.833406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:22:40.838416Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.838416Z"},"links":{"citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:a8cf47ab4269c05537b17b9ebf3fa066f54435aa67bc9b4fdc3043429e807943","observation_id":"135f5448-27a6-41d6-891a-2c3171c6c2da","resolution":{"observed_at":"2026-08-12T14:22:40.838416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.18635","last_updated":"2024-04-16T18:07:51Z","snapshot_observed_at":"2026-08-13T05:13:18.694488Z","submitted_at":"2023-11-30T15:43:13Z","title":"DiffusionAvatars: Deferred Diffusion for High-fidelity 3D Head Avatars","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.18635","snapshot_observed_at":"2026-08-12T14:22:40.843585Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.843585Z"},"links":{"cited_paper":"/paper/2311.18635","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:29490e7bde9c7beeb4089a48fa3b281201dab20bd72bd8b15131149393305217","observation_id":"897721db-361f-4291-949b-1a89d74f5e2f","resolution":{"observed_at":"2026-08-12T14:22:40.843585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:22:41.882466Z","title":"Black, Hao Li, and Javier Romero","venue":null,"work_id":"a1d43b1f-ab45-4992-839a-29d45fc8ed06","year":2017},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.848451Z"},"links":{"citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:33fcd315963a515394e97d23675e9aef566bdaae60a937aadc158a069310bf94","observation_id":"bbbee7db-ae3f-4afe-bfd5-efea24d12992","resolution":{"observed_at":"2026-08-12T14:22:41.887719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04378","last_updated":"2023-10-06T17:11:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-06T17:11:58Z","title":"Latent Consistency Models: Synthesizing High-Resolution Images with Few-Step Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04378","snapshot_observed_at":"2026-08-12T14:22:40.854085Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.854085Z"},"links":{"cited_paper":"/paper/2310.04378","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:14d01982255a26df100affddb845aa34f3c3c2146e29deda2250333d0f5ce8f9","observation_id":"af5bf530-0fcc-42cd-8372-79e4210f91b1","resolution":{"observed_at":"2026-08-12T14:22:40.854085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:22:41.866081Z","title":null,"venue":null,"work_id":"af013a4a-25ef-4ded-adfc-0f6a193c9a88","year":2020},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.859640Z"},"links":{"citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:51b490383249008da5e2f8da03db6201bdfad48a182060d90e2fbb87b6a503ea","observation_id":"d3ef5b10-534e-468f-b708-d0c3cf5e427f","resolution":{"observed_at":"2026-08-12T14:22:41.871100Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.09672","last_updated":"2021-02-18T23:44:17Z","snapshot_observed_at":"2026-08-06T00:36:41.660457Z","submitted_at":"2021-02-18T23:44:17Z","title":"Improved Denoising Diffusion Probabilistic Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.09672","snapshot_observed_at":"2026-08-12T14:22:40.864303Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.864303Z"},"links":{"cited_paper":"/paper/2102.09672","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:71108292f0f3a7ff8e4330503990bc27f51f4cb0fcbf21528287f786ae3be5b6","observation_id":"1686ee07-eaeb-45a7-8aab-8cbaa65e5d4c","resolution":{"observed_at":"2026-08-12T14:22:40.864303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.08839","last_updated":"2022-09-27T08:00:14Z","snapshot_observed_at":"2026-08-13T15:59:40.216927Z","submitted_at":"2022-04-19T12:10:18Z","title":"Unsupervised Learning of Efficient Geometry-Aware Neural Articulated Representations","version":2},"cited_work":{"arxiv_id":"2204.08839","doi":null,"metadata_source":"pith","pith_arxiv_id":"2204.08839","snapshot_observed_at":"2026-08-12T14:22:41.319788Z","title":"Unsupervised Learning of Efficient Geometry-Aware Neural Articulated Representations","venue":"cs.CV","work_id":"c2261fd8-c759-434a-869b-daff0d3db40f","year":2022},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.869833Z"},"links":{"cited_paper":"/paper/2204.08839","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:916ce2711dc082b2534340bd1db556ab412bac2e485aefe7a28421926b472f8b","observation_id":"938042a2-c433-40ef-a7bb-44c5021c536c","resolution":{"observed_at":"2026-08-12T14:22:41.325415Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11089","last_updated":"2023-08-25T04:50:47Z","snapshot_observed_at":"2026-08-13T12:20:47.164835Z","submitted_at":"2023-03-20T13:22:04Z","title":"EmoTalk: Speech-Driven Emotional Disentanglement for 3D Face Animation","version":2},"cited_work":{"arxiv_id":"2303.11089","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.11089","snapshot_observed_at":"2026-08-12T14:22:41.295271Z","title":"EmoTalk: Speech-Driven Emotional Disentanglement for 3D Face Animation","venue":"cs.CV","work_id":"957fb89b-234e-4dfe-a538-0f87df64ea2e","year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.875307Z"},"links":{"cited_paper":"/paper/2303.11089","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:3f2927cbb25ca6128af2e233472bb0f12f1567c7f9e9857c812bc719e130c8cb","observation_id":"a8865b72-0145-4ae5-ad99-442c727ef146","resolution":{"observed_at":"2026-08-12T14:22:41.300549Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-12T14:22:40.880268Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.880268Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:f7564fc045bc9b3a7b358bff3eec34a593bd2fe0af041e93b8b41b92bde53ee4","observation_id":"526b711c-c7a0-459a-9e34-b77320cdbfb1","resolution":{"observed_at":"2026-08-12T14:22:40.880268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02069","last_updated":"2024-03-28T15:51:05Z","snapshot_observed_at":"2026-08-13T05:10:14.044033Z","submitted_at":"2023-12-04T17:28:35Z","title":"GaussianAvatars: Photorealistic Head Avatars with Rigged 3D Gaussians","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02069","snapshot_observed_at":"2026-08-12T14:22:40.886025Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.886025Z"},"links":{"cited_paper":"/paper/2312.02069","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:d7ab61e3fb413c661d0cc7a23c5effed90aa96082c23ed30859d8026be9d0b0b","observation_id":"74c37eb5-c31d-4d29-a365-31eb3b9f559e","resolution":{"observed_at":"2026-08-12T14:22:40.886025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-12T14:22:40.891364Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.891364Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:1a76720589030f228ca9067c01e235078922f0fa3c26fe4a8a334792f59aa89f","observation_id":"ae0ea332-53dd-4af7-be87-8b8b7124e398","resolution":{"observed_at":"2026-08-12T14:22:40.891364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:22:41.849117Z","title":"Dauphin, Percy Liang, and Jennifer Wortman Vaughan (Eds.)","venue":null,"work_id":"04bad2a4-cbd8-4b92-bc73-a6028277bb4a","year":2021},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.896987Z"},"links":{"citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:406b1f68ba946d107dd8fe871a5a918055de680f0f9a0b1cdcc6f2dbb03ae873","observation_id":"2e115603-25a0-4497-8704-7ce27991b674","resolution":{"observed_at":"2026-08-12T14:22:41.854248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.08379","last_updated":"2021-09-17T07:24:16Z","snapshot_observed_at":"2026-08-13T18:09:47.856523Z","submitted_at":"2021-09-17T07:24:16Z","title":"PIRenderer: Controllable Portrait Image Generation via Semantic Neural Rendering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.08379","snapshot_observed_at":"2026-08-12T14:22:40.901935Z","title":"Li, and Shan Liu","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.901935Z"},"links":{"cited_paper":"/paper/2109.08379","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:69b057c65ce32b08723baf4400ce3d22e2c7520023f897546eac582e302b35e9","observation_id":"ed2debcf-bdd1-4bdb-b8c6-5246da478819","resolution":{"observed_at":"2026-08-12T14:22:40.901935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:22:40.906947Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.906947Z"},"links":{"citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:ca7137f6073d71751804bee01df917ba1c8d60d25fcb811ae738f41325989d65","observation_id":"92634b80-4e4e-4e66-b730-3f70586de3a6","resolution":{"observed_at":"2026-08-12T14:22:40.906947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.06817","last_updated":"2019-05-16T14:57:45Z","snapshot_observed_at":"2026-07-06T07:53:31.905695Z","submitted_at":"2019-05-16T14:57:45Z","title":"Learning to Regress 3D Face Shape and Expression from an Image without 3D Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.06817","snapshot_observed_at":"2026-08-12T14:22:40.911826Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.911826Z"},"links":{"cited_paper":"/paper/1905.06817","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:c46545b730ba13a66fc0963220f47ef0926bccac32f3a2f059df49409fb62f32","observation_id":"17d3bc6a-71cc-485b-9c48-01bb741b08f1","resolution":{"observed_at":"2026-08-12T14:22:40.911826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.03786","last_updated":"2023-04-20T08:51:11Z","snapshot_observed_at":"2026-08-13T13:07:23.704000Z","submitted_at":"2023-01-10T05:11:25Z","title":"DiffTalk: Crafting Diffusion Models for Generalized Audio-Driven Portraits Animation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.03786","snapshot_observed_at":"2026-08-12T14:22:40.916684Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.916684Z"},"links":{"cited_paper":"/paper/2301.03786","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:ac43c2b497ca756b18af41759283f049f105c2e465d8e6e00a6a92b8a06e7f4b","observation_id":"c3dd463d-700b-4397-8f8f-0fa3797a208d","resolution":{"observed_at":"2026-08-12T14:22:40.916684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.00196","last_updated":"2020-10-01T15:26:15Z","snapshot_observed_at":"2026-08-13T06:25:00.599960Z","submitted_at":"2020-02-29T07:08:56Z","title":"First Order Motion Model for Image Animation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.00196","snapshot_observed_at":"2026-08-12T14:22:40.921625Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.921625Z"},"links":{"cited_paper":"/paper/2003.00196","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:a651bc7ad72432eba2eb5e039e1399dd61bc9bc1044faec24e59f7b5b43dc173","observation_id":"2686ea4f-5a85-4014-9231-a59b126d80b3","resolution":{"observed_at":"2026-08-12T14:22:40.921625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:22:41.822608Z","title":null,"venue":null,"work_id":"2ce5b7af-59dd-4eb6-ae70-cf73fe7b7e7e","year":null},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.926736Z"},"links":{"citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:b096878f4794fb907d851b3c5545d413b413350b7f29c9423ca37f08b71f80c5","observation_id":"06b92161-906a-414b-bfed-19f60774f8f3","resolution":{"observed_at":"2026-08-12T14:22:41.827380Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:22:41.805304Z","title":null,"venue":null,"work_id":"3ec9cc5c-ef14-4153-a08e-a9c97cfc16eb","year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.936909Z"},"links":{"citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:e4bbb3377326f1fc67640e32b631a7dc218d083ad2b7a9664c5c4ad14d1947a4","observation_id":"996bfa01-78b3-4b1a-aff8-ad12dd304804","resolution":{"observed_at":"2026-08-12T14:22:41.810897Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01155","last_updated":"2022-05-02T18:41:36Z","snapshot_observed_at":"2026-08-13T15:51:51.152475Z","submitted_at":"2022-05-02T18:41:36Z","title":"Emotion-Controllable Generalized Talking Face Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01155","snapshot_observed_at":"2026-08-12T14:22:40.931760Z","title":"arXiv:2205.01155 [cs.CV]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.931760Z"},"links":{"cited_paper":"/paper/2205.01155","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:9f878a230d54c86f8ba52762229d00e698de859b3ca3ae9fc07055218033ba14","observation_id":"dbdee44e-58d5-45b8-adcb-61777c5e40e4","resolution":{"observed_at":"2026-08-12T14:22:40.931760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:22:41.770739Z","title":null,"venue":null,"work_id":"ee8a1f2f-6048-4535-8810-6f3266ea6974","year":2020},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.947326Z"},"links":{"citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:49a1a61735f3462860306ad67aac6a5987ff6e9fef295ab0e942f56230f12b23","observation_id":"0d2e2bcc-fe31-40a4-b972-a0c4468ce548","resolution":{"observed_at":"2026-08-12T14:22:41.775839Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:22:41.786885Z","title":null,"venue":null,"work_id":"039173da-34ee-49e8-b14f-d5edc0b69ac6","year":2020},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.942447Z"},"links":{"citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:b5d5e8db87a7ece5642fefaad462e8e39706c2454d291703a2246cbe2f3f7c3a","observation_id":"c61025a3-f3b5-46d3-9fc7-4e78423976dc","resolution":{"observed_at":"2026-08-12T14:22:41.791863Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:22:41.754159Z","title":null,"venue":null,"work_id":"de63e2bb-6a09-406c-8e55-7b9847c36568","year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.957398Z"},"links":{"citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:00a6197e28d0a176645d005b4351b5c256d95b3b4355d199e5c1ba0550725c1c","observation_id":"a7446fae-07ad-4a66-a352-b30c9b9a8a0c","resolution":{"observed_at":"2026-08-12T14:22:41.759267Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07669","last_updated":"2025-03-27T08:47:12Z","snapshot_observed_at":"2026-08-13T05:03:52.132150Z","submitted_at":"2023-12-12T19:03:04Z","title":"GMTalker: Gaussian Mixture-based Audio-Driven Emotional Talking Video Portraits","version":3},"cited_work":{"arxiv_id":"2312.07669","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.07669","snapshot_observed_at":"2026-08-12T14:22:41.130714Z","title":"GMTalker: Gaussian Mixture-based Audio-Driven Emotional Talking Video Portraits","venue":"cs.CV","work_id":"ba07066e-fe95-435a-8454-10fa05491040","year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.952395Z"},"links":{"cited_paper":"/paper/2312.07669","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:7253dc4649b34e1b5778f4129ef965d16a9eae55f6733ab3929835b47911bd5c","observation_id":"aa34fc1e-72e2-4e5e-983f-42e3a37fea19","resolution":{"observed_at":"2026-08-12T14:22:41.136134Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05543","last_updated":"2023-11-26T22:26:12Z","snapshot_observed_at":"2026-08-04T15:27:22.366324Z","submitted_at":"2023-02-10T23:12:37Z","title":"Adding Conditional Control to Text-to-Image Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05543","snapshot_observed_at":"2026-08-12T14:22:40.967296Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.967296Z"},"links":{"cited_paper":"/paper/2302.05543","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:b8e6252b8484242de86d041cf32ea5d5ccd53ce889828573c5f9dad78c1cc120","observation_id":"615d101a-ae1d-45c9-889b-7450cd7f94df","resolution":{"observed_at":"2026-08-12T14:22:40.967296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-12T14:22:40.962182Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.962182Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:b46f2262e8e0b6de529a810b590140bc324b13c500a1c81562465427ad2d620d","observation_id":"f343a9ef-0c82-4fd6-a672-e96dccb282eb","resolution":{"observed_at":"2026-08-12T14:22:40.962182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.00471","last_updated":"2021-09-03T04:05:08Z","snapshot_observed_at":"2026-08-13T18:19:06.531739Z","submitted_at":"2021-09-01T16:23:57Z","title":"Sparse to Dense Motion Transfer for Face Image Animation","version":2},"cited_work":{"arxiv_id":"2109.00471","doi":null,"metadata_source":"pith","pith_arxiv_id":"2109.00471","snapshot_observed_at":"2026-08-12T14:22:41.050621Z","title":"Sparse to Dense Motion Transfer for Face Image Animation","venue":"cs.CV","work_id":"efb6c7b7-ddc2-4233-96a6-c2009b88a5ef","year":2021},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.977100Z"},"links":{"cited_paper":"/paper/2109.00471","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:bfb5d0b6ba1ae1740601db33bf17bd05fc6c73091b8465f3954a3f7f8e5f3997","observation_id":"cdc5199d-7f51-49bd-97c0-2c5599edbb08","resolution":{"observed_at":"2026-08-12T14:22:41.058386Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.12194","last_updated":"2023-03-13T08:40:32Z","snapshot_observed_at":"2026-08-13T13:37:31.824133Z","submitted_at":"2022-11-22T11:35:07Z","title":"SadTalker: Learning Realistic 3D Motion Coefficients for Stylized Audio-Driven Single Image Talking Face Animation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.12194","snapshot_observed_at":"2026-08-12T14:22:40.972138Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.972138Z"},"links":{"cited_paper":"/paper/2211.12194","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:860ac92c201b303fc431a963c9dc33e22b2b39a7ffcc21947b936227381a6c72","observation_id":"3a5694d7-dfcb-4068-a04e-1303187cd1c9","resolution":{"observed_at":"2026-08-12T14:22:40.972138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08377","last_updated":"2023-02-28T09:00:33Z","snapshot_observed_at":"2026-08-13T13:20:13.615202Z","submitted_at":"2022-12-16T10:05:31Z","title":"PointAvatar: Deformable Point-based Head Avatars from Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08377","snapshot_observed_at":"2026-08-12T14:22:40.987173Z","title":"Black, and Otmar Hilliges","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.987173Z"},"links":{"cited_paper":"/paper/2212.08377","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:457ca47c3251324010c713557c7dded426613847084f3b60ffcee6b227c57a9f","observation_id":"7fc9e0b0-43db-4012-85ac-6160fb8314a3","resolution":{"observed_at":"2026-08-12T14:22:40.987173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:22:41.737292Z","title":"Bühler, Xu Chen, Michael J","venue":null,"work_id":"d58aa567-1ca3-4fbf-b417-0e1ad4843339","year":2022},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.982248Z"},"links":{"citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:b6f09ce3f6f5c0764650d7d2c146550a4bfe258cc75701920d26d2591b97b7d8","observation_id":"0d4c6001-e695-4e80-8171-9a95486a4e69","resolution":{"observed_at":"2026-08-12T14:22:41.742543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:22:41.720685Z","title":null,"venue":null,"work_id":"b5f70d9f-521e-4c69-b459-bc7ebf815ff8","year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.992230Z"},"links":{"citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:43a38f5986ffef0e80c15e8bde17cd00b1cfcc82f13145a4a66b3d61cdd2434f","observation_id":"ca912acf-79d7-41f2-b458-0597d14eae2f","resolution":{"observed_at":"2026-08-12T14:22:41.725613Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.06481","last_updated":"2022-06-13T21:28:34Z","snapshot_observed_at":"2026-08-13T15:24:32.613824Z","submitted_at":"2022-06-13T21:28:34Z","title":"RigNeRF: Fully Controllable Neural 3D Portraits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.06481","snapshot_observed_at":"2026-08-12T14:22:40.737451Z","title":"arXiv:2206.06481 [cs.CV]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.737451Z"},"links":{"cited_paper":"/paper/2206.06481","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:db6a343bfb91803a4641584f2b0f81f85ddb13a6759811b6ee070b68142c3fad","observation_id":"bd666fe0-45f9-4c2d-81f4-a99683d7ba4c","resolution":{"observed_at":"2026-08-12T14:22:40.737451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T00:49:49.157715Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":37,"verified_exact":9,"verified_fuzzy":3},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 0 inbound Pith citation observations for arXiv:2411.15436."}