{"as_of":"2026-08-17T14:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b8677ed6b607c7835289fcba62b996c6246588f5c1dd9a34700dc756089ea0e3","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T17:47:14.894920Z","state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.20562/citation-record","integrity":"/paper/2507.20562/integrity","json":"/paper/2507.20562/citation-record.json","paper":"/paper/2507.20562"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.827681Z","title":"Verma, N","venue":null,"work_id":"32a4b033-dfbd-4c61-8e17-6c79a6e187cd","year":2003},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.626608Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:f4522af3460a1247d65d35f61bf1fc0b641b3387ae8b7dedd11b2df10b28e198","observation_id":"f27e8377-c80d-4c5a-b04b-efee28f3aeed","resolution":{"observed_at":"2026-08-15T17:47:15.831946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.812850Z","title":"Facetalk: Audio-driven motion diffusion for neural parametric head models","venue":null,"work_id":"5f000a07-a180-4f3f-add4-7f45ce4b85b6","year":2024},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.631809Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:2ff1bbaf92137e4e723f3e06fb379d7c0d6225c53842a7f6c246ba643e25bf6d","observation_id":"b204302f-539e-4458-bbde-65660f84dcd3","resolution":{"observed_at":"2026-08-15T17:47:15.817297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.17011","last_updated":"2023-10-25T21:22:28Z","snapshot_observed_at":"2026-08-16T14:48:48.603154Z","submitted_at":"2023-10-25T21:22:28Z","title":"Personalized Speech-driven Expressive 3D Facial Animation Synthesis with Style Control","version":1},"cited_work":{"arxiv_id":"2310.17011","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.17011","snapshot_observed_at":"2026-08-15T17:47:14.970611Z","title":"Personalized Speech-driven Expressive 3D Facial Animation Synthesis with Style Control","venue":"cs.AI","work_id":"ca8fc721-8d28-4ff9-9e01-a6dd69c9c8d5","year":2023},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.637046Z"},"links":{"cited_paper":"/paper/2310.17011","citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:13a0062e79e0465849d14a89892994bdf87c4e863a83f30c245bd566e9f8e5b7","observation_id":"8faf1b82-517c-4e45-bc5d-84f888d0b235","resolution":{"observed_at":"2026-08-15T17:47:14.978257Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.797273Z","title":"Memory matching networks for one-shot image recognition","venue":null,"work_id":"a8574f89-c541-423d-9a34-f5e55d5fb6eb","year":2018},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.642720Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:3bcd988eaed4f4c4e49083665571f17cadd6dd7aa8d4e65532ed737542e8c152","observation_id":"5695e79e-4e1b-4749-b08e-5450a9762437","resolution":{"observed_at":"2026-08-15T17:47:15.802045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.780532Z","title":"Avface: Towards detailed audio-visual 4d face reconstruction","venue":null,"work_id":"92d4c4f9-f024-48e1-90a4-cfe48ad88417","year":2023},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.648714Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:a12e08c59c5206377dfae71188a9da5883c73dae1cd27bc18deb2caee10247f0","observation_id":"cb4d684f-55b4-4fa3-9427-9e162a17b0a1","resolution":{"observed_at":"2026-08-15T17:47:15.786176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.763839Z","title":"Capture, learning, and synthesis of 3D speaking styles","venue":null,"work_id":"9383245d-655a-4c37-a14c-cbe53647643b","year":null},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.653743Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:db82c10a284ad80bba9681b32692bf13d62cee7761dd727daa13e13ae216d65b","observation_id":"d159d98e-c6d0-4b25-bbdf-182de3f7fa98","resolution":{"observed_at":"2026-08-15T17:47:15.768737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.746881Z","title":"Facial animation based on context-dependent visemes","venue":null,"work_id":"964f4d7a-f70c-4d70-ac73-c841e4d2736b","year":2006},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.659144Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:3f7d21ec1712f57b4fd8a065d7ca1d55b2345b02d45d8ba70a273ef8ddb00020","observation_id":"54ee15fa-a3a4-4bbc-83bf-d3df2af24925","resolution":{"observed_at":"2026-08-15T17:47:15.752074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.729833Z","title":"Disentanglement of emotional style and speaker identity for expressive voice conversion","venue":null,"work_id":"1096f9f0-2031-4c5e-bc6e-968cbb9fd388","year":2022},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.664730Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:cbcde7d95987b7f6758784aabf4e64a32a7da4faa47ec2b00167027ccd9aebd3","observation_id":"e37fd667-988c-4696-9cf5-65a098511238","resolution":{"observed_at":"2026-08-15T17:47:15.735406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.710525Z","title":"Jali: an animator-centric viseme model for ex- pressive lip synchronization","venue":null,"work_id":"e178eb73-9bd9-44d3-be9c-4c97ca7aeb2a","year":2016},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.669701Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:9edc48653ed43e5bb9ae08b52c621917c24723520c39672f94546259ccbe4331","observation_id":"a428a782-7101-4e7b-bead-cb9210592cb2","resolution":{"observed_at":"2026-08-15T17:47:15.716136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.692591Z","title":"Enhancing speech-driven 3d facial an- imation with audio-visual guidance from lip reading expert","venue":null,"work_id":"8687d6a9-3a0e-4ffd-b8b4-930fe5b8d061","year":2024},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.674420Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:e7096bc398f70b1d5555b69ec9fbdcb3735c4f45a0ef28cb84a2f3013f7de09b","observation_id":"332a3c02-d716-481f-9fb4-b597a7ad99f8","resolution":{"observed_at":"2026-08-15T17:47:15.697376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.676576Z","title":"Unitalker: Scaling up audio-driven 3d facial animation through a unified model","venue":null,"work_id":"f1fda2bd-0e7d-46b5-98ea-2b4e4623cad6","year":null},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.679436Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:b31a47d746a129225d94356f243d8550e1bc76db3a2b680549d2893788041703","observation_id":"d454376e-5819-46c2-919c-4cb8f90fc2ec","resolution":{"observed_at":"2026-08-15T17:47:15.681495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.661037Z","title":"Faceformer: Speech-driven 3d facial animation with transformers","venue":null,"work_id":"2904b6eb-5aa5-44e0-9e09-1d874461ecf9","year":2022},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.684519Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:106ac82daf21351bc898d05da9eebe91eb46129c1f4d8e796fcc9379d6d22ec8","observation_id":"1a7a467c-c37f-499f-87b2-592761539171","resolution":{"observed_at":"2026-08-15T17:47:15.665652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.644893Z","title":"A 3-d audio-visual corpus of affective communication","venue":null,"work_id":"3526559e-86dd-4e2d-8554-c39c655eca64","year":2010},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.689201Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:5cc288d6cd6b65aa3781f9318d2150b99a6c5633d9d4b992dbb5beed84922a26","observation_id":"7fa5acd1-b4b8-4033-822f-02b0ea9076ea","resolution":{"observed_at":"2026-08-15T17:47:15.650308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.629491Z","title":"Stmtrack: Template-free visual tracking with space-time memory networks","venue":null,"work_id":"176391f8-8737-4dc2-8344-96fcd7f6b598","year":2021},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.693585Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:e986b7c4d79e45b1cd6c8fc31cde9a98306ec8eae6ef96f4b74cf8fba1fb6bf3","observation_id":"36935371-1ec4-4455-9323-d371a5544ea9","resolution":{"observed_at":"2026-08-15T17:47:15.634319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.611827Z","title":"Memorizing normality to detect anomaly: Memory-augmented deep autoencoder for un- supervised anomaly detection","venue":null,"work_id":"b34b5596-b1c1-47d8-80b2-f4c0bcce3db8","year":2019},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.697808Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:41e8356bae40ac96fe239164dae10bb251d2789af672baebec934d2b0a1108c4","observation_id":"54beafb0-7e8b-4fd1-aa95-3452aa00b92d","resolution":{"observed_at":"2026-08-15T17:47:15.617362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.594253Z","title":"Speech4mesh: Speech-assisted monocular 3d facial reconstruction for speech-driven 3d facial ani- mation","venue":null,"work_id":"9b0c0f69-48e0-4c57-992c-dd374a5787ea","year":null},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.702074Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:746ef7d7409dedeea4c6801434e405bf43994dadf7363756d1c0e37b27e8b08f","observation_id":"68452c95-6b07-4f47-ba76-f8f35b1b15a0","resolution":{"observed_at":"2026-08-15T17:47:15.599896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.577372Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium","venue":null,"work_id":"91cbdf9f-74ad-4e45-92f1-aa02d895b343","year":2017},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.706248Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:c84557d25177675f3c29fc021fa41176fb11d6aad69131789a16ed43b4f2d695","observation_id":"974f984e-f8f0-4048-a5ea-85b6b9700c0d","resolution":{"observed_at":"2026-08-15T17:47:15.582683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.561467Z","title":"Hubert: Self-supervised speech representation learning by masked prediction of hidden units","venue":null,"work_id":"13e39c58-9bf0-42d1-9f85-15825ab9e61e","year":2021},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.710472Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:b2002c0dbe634e04504b355a43c3e610ed5071a4f9d137dba0f082358d185dac","observation_id":"411c487f-1804-4feb-a9e7-bee8b776f2b9","resolution":{"observed_at":"2026-08-15T17:47:15.566518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.545614Z","title":"Mimic: Speaking style disentanglement for speech- driven 3d facial animation","venue":null,"work_id":"54120b10-a709-44a4-bd91-4cab40e173cd","year":2024},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.714719Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:d713ac751f1f2450f07efad837224a354d27038ee307f827d2bbb510fb05b1db","observation_id":"c425c38d-e8ec-4806-8773-f4d2674c117a","resolution":{"observed_at":"2026-08-15T17:47:15.550653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.528796Z","title":"An- alyzing visible articulatory movements in speech pro- duction for speech-driven 3d facial animation","venue":null,"work_id":"875aace6-3505-4f48-91b3-9c23600f9531","year":2024},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.719365Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:fe366f7ca4e7147da1cca63c148d20ba21b6f7b5f25fa03dfbb042473ff40401","observation_id":"6b80a946-c969-46b3-816e-24f06d46a153","resolution":{"observed_at":"2026-08-15T17:47:15.534054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.512407Z","title":"Multi-modality associative bridging through mem- ory: Speech sound recollected from face video","venue":null,"work_id":"5a442ada-dce1-4487-993f-8acb80235d8f","year":2021},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.724554Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:a41a61ba8a434f8f9a85467bd0d15e4e109b84353c000112e1a3a7afdb5805af","observation_id":"075ff89c-becb-46de-8939-f78442c5544e","resolution":{"observed_at":"2026-08-15T17:47:15.517620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.495921Z","title":"Dis- tinguishing homophenes using multi-head visual-audio memory for lip reading","venue":null,"work_id":"ae1af4b6-0ec5-4608-b4da-f1c63570279e","year":null},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.729593Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:4138e65b8407755f3e67e35a0d489f42fcb10b41bf509619467b0547872751f4","observation_id":"70f682b7-c41d-457e-96ad-cc0f66e94449","resolution":{"observed_at":"2026-08-15T17:47:15.501127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.481104Z","title":"Video prediction recalling long-term motion context via memory alignment learn- ing","venue":null,"work_id":"cc9580bf-96bc-4c44-8b03-3c6e461718cd","year":2021},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.734190Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:6cfe7f0361926e3f65448bd198d87bbda5925e13f8d51dc2df299740cf5b60d0","observation_id":"3c9fca3c-35f8-48f9-a375-e16fdc3d49a4","resolution":{"observed_at":"2026-08-15T17:47:15.485701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.466611Z","title":"Weakly paired associative learning for sound and im- age representations via bimodal associative memory","venue":null,"work_id":"8fa3c081-a33c-4773-a815-c99611be0aca","year":2022},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.739413Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:3450e1d333f5c31de6231e1b28b0588d09b983307b834dc9b0792a9346ddaea5","observation_id":"7bf78ab7-a050-456a-ad8a-141ca506337f","resolution":{"observed_at":"2026-08-15T17:47:15.471172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.451421Z","title":"Learning a model of facial shape and expression from 4d scans","venue":null,"work_id":"cca8f280-4928-46b6-be03-5c4ba56e9a61","year":2017},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.744782Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:f7978e9404a4908ab4e503e04021534209a0b37648da37feb884fc24ff72d2f5","observation_id":"c24fc4ab-55ce-403b-b1f0-0690a5a46807","resolution":{"observed_at":"2026-08-15T17:47:15.456047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.435859Z","title":"Emage: To- wards unified holistic co-speech gesture generation via expressive masked audio gesture modeling","venue":null,"work_id":"2a815fdf-8ce5-43bb-942b-cf4c96a5259c","year":2024},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.750122Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:415d5d9d4a0e0a62955cfe0831c46330d19258ed7f735ebfcfc493b3f7c13260","observation_id":"f312b2f1-785c-420d-b7c0-5b49480533cf","resolution":{"observed_at":"2026-08-15T17:47:15.440690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.418851Z","title":"Geometry-guided dense perspective network for speech-driven facial animation","venue":null,"work_id":"02773727-a657-4873-89f0-9aca38ccd096","year":2021},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.755023Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:db6c69baa0d98af7f4107d0eb7e9bd9063d41242e11f1f0b80d761d0efe12dee","observation_id":"008b19cb-638e-498b-854f-4b56c06af01b","resolution":{"observed_at":"2026-08-15T17:47:15.423764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.402246Z","title":"Key-value memory networks for directly reading doc- uments","venue":null,"work_id":"751a404f-9626-4926-80e2-21f76eacfc91","year":2016},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.761280Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:dc99443aca9e9360349e8a72f72deff6ebc87f929288c54eed08db1f4cb3967d","observation_id":"5cd8174b-c11e-4c6c-84ed-3c43707d15b7","resolution":{"observed_at":"2026-08-15T17:47:15.407662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.385413Z","title":"Network anomaly detection using memory-augmented deep autoencoder","venue":null,"work_id":"a7048123-42cd-4278-a739-cf491d3c27a7","year":2021},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.766062Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:8a647a2a4d91314745e815dcab72c696ed74db689759959e2dd54bb5414ebf57","observation_id":"9a01bb4e-e20f-4c46-bbd4-f07f1333573a","resolution":{"observed_at":"2026-08-15T17:47:15.390643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.368409Z","title":"Graph- level anomaly detection via hierarchical memory net- works","venue":null,"work_id":"f2f1097e-15e3-4e7c-a2e9-f835c50edca5","year":2023},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.771910Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:3b136d8894a82ac0c4d3f1fb0aaa599badac90f3c3fc8fe0ea2d50675cfe7696","observation_id":"3eb22e30-d017-471d-817f-308a6db2449d","resolution":{"observed_at":"2026-08-15T17:47:15.373686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.352249Z","title":"Scantalk: 3d talking heads from unregistered scans","venue":null,"work_id":"322684d7-eced-4014-9d2c-c429171a291a","year":2024},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.776421Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:749a19cb6294694528955f7e30b554786322c62f993601509d06e368ef6806d2","observation_id":"2ef589c0-a00d-4b4f-877c-2f120828444c","resolution":{"observed_at":"2026-08-15T17:47:15.357155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.335770Z","title":"Synctalkface: Talking face gener- ation with precise lip-syncing via audio-lip memory","venue":null,"work_id":"dfbfd49b-7225-4be4-8612-c0bed5e393dd","year":2022},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.781311Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:3472315e7a9e47a37360c56e6678782d8222e8bd90d532883b3316d423b04233","observation_id":"18e0ab19-8dcd-4254-a27c-482ddc96601c","resolution":{"observed_at":"2026-08-15T17:47:15.340928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.319519Z","title":"Self- talk: A self-supervised commutative training diagram to comprehend 3d talking faces","venue":null,"work_id":"13966915-8e02-44c7-b7d0-14ac6fa31536","year":2023},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.785712Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:ace78ed3a84fe9d3522432bc0de113418c0908151cebcfac5c73c13d2d2cbdae","observation_id":"4e399bf9-2297-498f-aefd-5c21d7eb9b9b","resolution":{"observed_at":"2026-08-15T17:47:15.325327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.302769Z","title":"Emotalk: Speech-driven emotional disentanglement for 3d face animation","venue":null,"work_id":"4251340d-af5f-42c9-be93-e70e23f40bb8","year":2023},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.790323Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:bb626457079769478df752c72b35c1f3d94d8f60f298bb7c62eae3a06135cd9e","observation_id":"78d82b71-536e-4512-9aff-6c074d05f1cf","resolution":{"observed_at":"2026-08-15T17:47:15.308428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.287120Z","title":"Memory based fusion for multi-modal deep learning","venue":null,"work_id":"b64416ec-f0b1-4442-9990-a4bb5a10eb19","year":2021},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.794556Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:605f114a04b5c36e41e946523663c06eb5fc4465f07a40c626be35f9728de60f","observation_id":"b8111a1a-84d2-41f3-9290-04b9c29b9bfa","resolution":{"observed_at":"2026-08-15T17:47:15.291712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.271717Z","title":"Meshtalk: 3d face animation from speech using cross-modality dis- entanglement","venue":null,"work_id":"200cc31e-e888-4781-b080-f6f71bcca5ed","year":2021},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.799227Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:74094ab40201fd17742609e2af562d3db0fe563c8abe03220ea2747fffa9df71","observation_id":"8b86a3ee-0f95-403a-b2e9-29041a74e233","resolution":{"observed_at":"2026-08-15T17:47:15.276324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.256738Z","title":"Toward accurate dy- namic time warping in linear time and space.Intelligent Data Analysis, 11(5):561–580, 2007","venue":null,"work_id":"e7d19061-7305-4a70-ae99-4b78075c7130","year":2007},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.804280Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:2cd7407740a8923da924ce205cb7649ca0da169902d4fdd773fd7b29d42c9a1a","observation_id":"ce139155-e2c9-419d-bab5-6fb59aef14e7","resolution":{"observed_at":"2026-08-15T17:47:15.261264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.241825Z","title":"Towards end-to-end prosody trans- fer for expressive speech synthesis with tacotron","venue":null,"work_id":"2bbb2085-c23a-4e85-aca9-74c7f17fa7e6","year":2018},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.809249Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:5fceef5a440d9fcb04fe1dfdcd0e980151a9770a455d26419e52f444ee758d5e","observation_id":"6688c7e9-cc60-49a3-93f0-619046309200","resolution":{"observed_at":"2026-08-15T17:47:15.246536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.226362Z","title":"Diffposetalk: Speech-driven stylistic 3d facial anima- tion and head pose generation via diffusion models","venue":null,"work_id":"9a773b2c-678b-4725-9da9-6e4c5e1a465d","year":null},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.814313Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:9847fc7b57ede933928d5efde8e9f57331c33058fa431708444a9bfcb59ed274","observation_id":"0ea6a149-9d98-4060-a32f-e95a5900d848","resolution":{"observed_at":"2026-08-15T17:47:15.231130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.210722Z","title":"Emmn: Emotional mo- tion memory network for audio-driven emotional talk- ing face generation","venue":null,"work_id":"0f0fa3fc-1690-4dfd-a1dc-740f1115a039","year":2023},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.820449Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:31d5aab6ebd7fac611f15a0c6208bf587624c28e05c87f8bb2ea72bff311af54","observation_id":"38062c0c-89be-4e40-90a9-59789d5b4105","resolution":{"observed_at":"2026-08-15T17:47:15.215738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.193650Z","title":"Imitator: Personalized speech-driven 3d facial animation","venue":null,"work_id":"6a5937de-c31e-42b9-a3cf-3aec46555554","year":2023},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.825669Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:a920089174b3d864fca8e3679138f125bad503c199e64b1e3bd2981f1fed276f","observation_id":"97fa25fe-08e7-4ed3-aed1-7d4e12fb5d08","resolution":{"observed_at":"2026-08-15T17:47:15.199246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.176659Z","title":"Visu- alizing data using t-sne","venue":null,"work_id":"41bb31a5-1f20-4fdb-87d1-3ded05ba11da","year":2008},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.830920Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:76836033ce720486f4adc52bdc8e949ccdd41ca0db66b1f593fca35ec2a47059","observation_id":"570ceb3f-1a23-4e98-b529-1d6fe8378e27","resolution":{"observed_at":"2026-08-15T17:47:15.182066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1410.3916","last_updated":"2015-11-29T07:00:41Z","snapshot_observed_at":"2026-08-14T23:15:41.300240Z","submitted_at":"2014-10-15T03:13:18Z","title":"Memory Networks","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1410.3916","snapshot_observed_at":"2026-08-15T17:47:14.835933Z","title":"Memory networks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.835933Z"},"links":{"cited_paper":"/paper/1410.3916","citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:81afdb1fa92c6b253aa894dc52078b7fac94b6cc89f4039243d90ec3caa09c45","observation_id":"5cad59e5-1eb0-4d4f-b5d1-f71607b4ba57","resolution":{"observed_at":"2026-08-15T17:47:14.835933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.159547Z","title":"Speech-driven 3d face animation with composite and regional facial movements","venue":null,"work_id":"be5322ad-2aff-404c-83d1-9c1f37905eec","year":null},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.842026Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:c2cfc3a658eafc602e09787e4c7d8d0ba00a08eae2ddecebd369563c0da5087a","observation_id":"7a315566-fc0f-4763-a0d9-331283e1ccd8","resolution":{"observed_at":"2026-08-15T17:47:15.164657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.126542Z","title":"Codetalker: Speech-driven 3d facial animation with discrete mo- tion prior","venue":null,"work_id":"d81b904f-e41e-426e-8060-ac57ba45f902","year":2023},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.850934Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:b3f790cced76d9274fcb01f783cec910df36521888974976f26b88b842972421","observation_id":"0b09badc-0993-49d7-b256-a21b50a1df1c","resolution":{"observed_at":"2026-08-15T17:47:15.131203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.111391Z","title":"Kmtalk: Speech-driven 3d facial animation with key motion embedding","venue":null,"work_id":"c2725b83-381b-4511-8ee7-ad3169b4a12f","year":2024},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.855472Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:cb4730d488f44f9d45a99780c5454959aa0b542774689cfd5e6c912d5bde085e","observation_id":"a979e263-1d07-4d6a-ace6-bec27ab0c3db","resolution":{"observed_at":"2026-08-15T17:47:15.115801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.095384Z","title":"Probabilistic speech-driven 3d facial motion synthesis: new bench- marks methods and applications","venue":null,"work_id":"208ec83f-422e-488c-a92b-a97eb3709d58","year":2024},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.860039Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:35c023692a27c09eb79ce5d2fa7e66ba8abce29e0d30eb98a4e0f35158f465f3","observation_id":"b387bc03-b81d-4261-8f79-95190c294470","resolution":{"observed_at":"2026-08-15T17:47:15.100931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.077884Z","title":null,"venue":null,"work_id":"a4ffe6d6-cf3d-4fa9-a455-e1990ea8643f","year":null},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.864437Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:d73adcf2f9eb3d0a7e559093d9b9d6b4155aa877a3a5c4f8ea3a753eceead068","observation_id":"52c822eb-da74-46e2-b195-d3bc03f595c1","resolution":{"observed_at":"2026-08-15T17:47:15.083754Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.10137","last_updated":"2020-03-05T10:06:22Z","snapshot_observed_at":"2026-08-13T14:31:07.907623Z","submitted_at":"2020-02-24T10:02:10Z","title":"Audio-driven Talking Face Video Generation with Learning-based Personalized Head Pose","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.10137","snapshot_observed_at":"2026-08-15T17:47:14.868643Z","title":"Audio-driven talking face video genera- tion with learning-based personalized head pose","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.868643Z"},"links":{"cited_paper":"/paper/2002.10137","citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:ec7f3ef662788b1430678e13250472aa78e1bfe901dd261a86b060ede392df78","observation_id":"799397f3-de85-455f-80d0-869cdb9bbcee","resolution":{"observed_at":"2026-08-15T17:47:14.868643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.060352Z","title":"Fake news detection via multi- modal topic memory network","venue":null,"work_id":"a5537d09-0d9c-47a0-a327-c6cddb196f3c","year":2021},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.874163Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:d7f28b6aeffabe54adc3fba0d44d194238ad23a787e6b07148dac668db55905c","observation_id":"0fc1833b-a003-42b1-9b87-337efcbad7bd","resolution":{"observed_at":"2026-08-15T17:47:15.065629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.044591Z","title":"Media2face: Co-speech facial animation generation with multi-modality guidance","venue":null,"work_id":"efe6edec-8b9b-4e5b-a2ce-91bc7efa82a8","year":2024},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.879627Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:8ab4f36b1c05bd4a447afbf1a8d65e2465dbcf7f88e1d085d07e13365dde0fbf","observation_id":"130eb9e8-3cb9-4302-ae4f-dc5c3164e015","resolution":{"observed_at":"2026-08-15T17:47:15.049471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.028644Z","title":"Inflated episodic memory with region self-attention for long-tailed visual recog- nition","venue":null,"work_id":"bb91f447-d74e-49d0-97fa-09085dd5e94f","year":2020},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.884624Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:da83c28bbe5fe23ee665c9c1510ab7be4b4e83d9430d6dd745a0720b2824bcd0","observation_id":"7617bd0e-323c-4fdb-91b8-b00554136644","resolution":{"observed_at":"2026-08-15T17:47:15.033398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.009349Z","title":"Kangaroo","venue":null,"work_id":"440dbc20-a34e-44cb-9028-01162858ab6a","year":2024},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.889308Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:b95137c847ee9cdd0855ba6376c6d4836fa9f0bc7f943ee3d9eada4d1cf7c060","observation_id":"65dd0dff-7de8-4e73-9935-35b67cc4f24f","resolution":{"observed_at":"2026-08-15T17:47:15.015791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:14.990745Z","title":"/a:/” and “/w/","venue":null,"work_id":"a9743447-d315-4744-8955-8d671853a55d","year":null},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.894920Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:fd594beb4e73ec8bc15c0f9f385dc4acb6f00461c3c54344a4d6de35c519b973","observation_id":"5f41a49c-61d3-427b-9ea7-800876bc4ae9","resolution":{"observed_at":"2026-08-15T17:47:14.996611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:47:15.142763Z","title":null,"venue":null,"work_id":"b65194cc-81c1-41cc-8a06-2857d4c0166a","year":null},"citing_paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-15T17:47:14.846548Z"},"links":{"citing_paper":"/paper/2507.20562"},"observation_digest":"sha256:f3e8d51d9f6b9b09ecdb6d2a0e61d3564071e457105d63f9818f6d7e5d177e56","observation_id":"e5511c72-e259-4e85-bac5-90145fe1d79e","resolution":{"observed_at":"2026-08-15T17:47:15.148030Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.20562","last_updated":"2025-08-25T07:44:57Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T17:39:06.174856Z","submitted_at":"2025-07-28T06:47:59Z","title":"MemoryTalker: Personalized Speech-Driven 3D Facial Animation via Audio-Guided Stylization"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":1,"verified_fuzzy":50},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 0 inbound Pith citation observations for arXiv:2507.20562."}