{"as_of":"2026-08-10T01:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0498e0f6204ffbd77bb916232970f3f4aae2c5a0fa823593c9e421f379e96063","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-18T14:18:02.076576Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-18T14:18:02.076576Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-05-18T14:21:28.416903Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"cited_work":{"arxiv_id":"2509.20128","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.20128","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","venue":"cs.GR","work_id":"a477d2c1-e906-4446-961a-9deb0b9a08fa","year":2025},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"cited_paper":"/paper/2509.20128","citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:aa3fc01c8fb55ace9918623ab69b0cf2145ce171ef1c92289d96f40d77e9f30b","observation_id":"eb3ed498-689b-41fc-b7e1-efa123530228","resolution":{"observed_at":"2026-05-18T14:21:28.419042Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2509.20128/citation-record","integrity":"/paper/2509.20128/integrity","json":"/paper/2509.20128/citation-record.json","paper":"/paper/2509.20128"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"cited_work":{"arxiv_id":"2509.20128","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.20128","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","venue":"cs.GR","work_id":"a477d2c1-e906-4446-961a-9deb0b9a08fa","year":2025},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"cited_paper":"/paper/2509.20128","citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:aa3fc01c8fb55ace9918623ab69b0cf2145ce171ef1c92289d96f40d77e9f30b","observation_id":"eb3ed498-689b-41fc-b7e1-efa123530228","resolution":{"observed_at":"2026-05-18T14:21:28.419042Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a628cc40-206e-4565-a2ba-98f831e468c7","year":null},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:891221fc48c1b835a593065828ed919681437efc9e5030ae03c69779375f85b5","observation_id":"524236a2-c7a1-4ce4-893b-6c9f7f13bd94","resolution":{"observed_at":"2026-05-18T14:22:40.870577Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dataset We train and evaluate our model on two benchmarks","venue":null,"work_id":"35628ab8-71f6-4bc7-8ed9-74d617fd282d","year":null},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:d8e906ade7a684e323962a7a51254dac67be8c5d3af0df8924bef1006e90aa91","observation_id":"14298c15-b4c2-4b14-ae3c-182f77e4ca19","resolution":{"observed_at":"2026-05-18T14:22:40.862010Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fa0f70ef-9e58-4485-8f63-5c3f2490a4f1","year":null},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:91372bd44021e02ef42b8db55b2882a694d6c4621be35712a46403eafc421c7e","observation_id":"d6425d6b-ceee-4d6f-8f3c-03fd823e1784","resolution":{"observed_at":"2026-05-18T14:22:40.865213Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9dea35ee-f20e-4161-a06d-652c17d2444a","year":null},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:b92a27646aec89ff23b1bfcb9dd3da347a43274260055fbb277ceeb588106cf0","observation_id":"1c9ed7f2-7038-438f-9ee1-122cb4a34e54","resolution":{"observed_at":"2026-05-18T14:22:40.823338Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Facediffuser: Speech- driven 3d facial animation synthesis using diffusion","venue":null,"work_id":"3b829a8e-4f90-4ef1-911d-4c6853250b47","year":2023},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:a71a5b88e396d4cad671b2aef3a61cdfd013b6da00b4309948872fe4ebf51f36","observation_id":"fa464dfa-eaa9-437d-adbc-9de5b15d5c7f","resolution":{"observed_at":"2026-05-18T14:22:40.837800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Difftalk: Crafting diffusion models for generalized audio- driven portraits animation","venue":null,"work_id":"de755872-e47b-4bc5-b18b-a959a3fe9b9e","year":2023},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:ceca3e84f255dd1d5cbbe36cacc00fede7beebbf238364c018c67008fa883f9d","observation_id":"1223e6a9-01d4-4471-8fd8-0e2ba71ed2f5","resolution":{"observed_at":"2026-05-18T14:22:40.809585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05712","last_updated":"2024-02-08T14:39:16Z","snapshot_observed_at":"2026-08-04T13:02:13.622096Z","submitted_at":"2024-02-08T14:39:16Z","title":"DiffSpeaker: Speech-Driven 3D Facial Animation with Diffusion Transformer","version":1},"cited_work":{"arxiv_id":"2402.05712","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.05712","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffs- peaker: Speech-driven 3d facial animation with diffusion trans- former","venue":null,"work_id":"0788dd02-e888-4bab-89e0-ce9d71636547","year":2024},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"cited_paper":"/paper/2402.05712","citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:3e34b16e82fa589a00ac656e83a70dc7e0c558b60cce8a153dc1b4bcd78ad03c","observation_id":"56562c9d-a4e3-488b-9d83-2ceeb5410941","resolution":{"observed_at":"2026-05-18T14:21:28.415049Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emotivetalk: Ex- pressive talking head generation through audio information de- coupling and emotional video diffusion","venue":null,"work_id":"808861e5-1975-4612-9eed-2c6f73342b76","year":2025},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:f0efa86f2fb9ef4b50ac83f2066fa62002449cd1fdac40a97a72b3c346112f42","observation_id":"7d31c9a5-3cca-4099-9c66-8b439395e30b","resolution":{"observed_at":"2026-05-18T14:22:40.805335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sadtalker: Learning realistic 3d motion coefficients for stylized audio-driven single image talking face animation","venue":null,"work_id":"e8fcd689-9814-44ae-b6bb-f7b343d0cfe3","year":2023},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:d3c489c8bb29f680cd5e5712a6b1baf289b5c4572fe35c0e51561d435efcb9fe","observation_id":"eefb76c7-2aeb-43b9-8a5b-05ef2b929d1f","resolution":{"observed_at":"2026-05-18T14:22:40.799341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Synctalk: The devil is in the synchro- nization for talking head synthesis","venue":null,"work_id":"c9b7766a-702c-4b00-9ad8-6b6a1df023a6","year":2024},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:b0ca4ad387d902c47d190866d1434d13dd656ea4a844f44e2def48d96f715f60","observation_id":"4c23ca70-4119-46f6-b3f5-e1dbc91596bf","resolution":{"observed_at":"2026-05-18T14:22:40.924511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Prosodytalker: 3d visual speech animation via prosody de- composition","venue":null,"work_id":"34394c0e-b494-41ca-b013-62b349048cfd","year":2025},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:feaf251599d9b56a01f0e5274f6aeb904c86a0aa54f777608aad8e1129fb9a80","observation_id":"4075752b-5b85-4d09-bc8e-aba6af630474","resolution":{"observed_at":"2026-05-18T14:22:40.920557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Keyface: Expressive audio-driven facial animation for long sequences via keyframe interpolation","venue":null,"work_id":"3cd192c5-5722-4b0c-aeed-6eb0766303e7","year":2025},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:ff39a2be6338e8c0fbefac1b3b672a67a389829608e7a7b3342b6890c109137e","observation_id":"41225913-770f-4596-b402-a9bcc0d97999","resolution":{"observed_at":"2026-05-18T14:22:40.916558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Speak: Speech-driven pose and emotion- adjustable talking head generation","venue":null,"work_id":"5c4e85d4-0999-4289-828f-67c6bc2aaaf4","year":2025},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:8c3f19ce1f7da6c19f6d222e1031a6fd1b924c1c2589b396e788ac5483884f0e","observation_id":"a7a3b5e2-9c9c-4751-a504-daf40d7dae21","resolution":{"observed_at":"2026-05-18T14:22:40.913070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fd2talk: Towards gener- alized talking head generation with facial decoupled diffusion model","venue":null,"work_id":"fe183561-b4ee-4fab-a44f-d84e8cb84426","year":2024},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:71b1b02825068971dbb39fcd6dea40ac3bfa3e3e6cfb0b71f2a18f1b44aed64a","observation_id":"29bd2907-6bf2-4142-8af7-a179eb30449d","resolution":{"observed_at":"2026-05-18T14:22:40.909664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning an animatable detailed 3d face model from in-the-wild images","venue":null,"work_id":"e0a3f84b-faab-4269-9899-5f82d77abdcf","year":2021},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:c5db8e750cab205a02b8373381dd34f94365c371cd9089d1d7476238118c0af0","observation_id":"e66ee7f3-c55a-4a14-8053-eb40964e37bd","resolution":{"observed_at":"2026-05-18T14:22:40.905080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Disco- head: audio-and-video-driven talking head generation by dis- entangled control of head pose and facial expressions","venue":null,"work_id":"46e014bb-9e62-4da4-bda6-c0ec93480a02","year":2023},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:d7d6c3de0b1a2854759170e20f53cb0ee118b54c13301bae3fda87e3e6cbe8bc","observation_id":"da8c9033-b841-4664-b959-90a603d48439","resolution":{"observed_at":"2026-05-18T14:22:40.900229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Nerf-3dtalker: Neural radiance field with 3d prior aided audio disentanglement for talking head syn- thesis","venue":null,"work_id":"f4e801e0-94c8-4e3b-9291-8568183ffc49","year":2025},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:7722000b61c394dd4a856c6115ee3d54127d1371c2550c6349d262307f0700de","observation_id":"8f62fb29-327d-45b3-98ca-ec67218cc8bd","resolution":{"observed_at":"2026-05-18T14:22:40.896595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"wav2vec: Unsupervised pre-training for speech recognition","venue":null,"work_id":"0cd9bcac-c589-471a-b591-618e051db627","year":2019},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:daedaed5eabea741df195caa2777294bae5a6225301b2bfad05bff49ef22d941","observation_id":"8ab9707f-82e6-449a-82c1-25603f0328b2","resolution":{"observed_at":"2026-05-18T14:22:40.892830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spsinger: Multi-singer singing voice synthesis with short reference prompt","venue":null,"work_id":"c5b3e4ef-4cbc-4bd5-9394-82b4a5224f26","year":2025},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:60d6c983486c9d10f8e9ee89acac595eed63755ccf4b5b7ec9d7c6080865baf1","observation_id":"dc6a7aa7-8566-4c2b-9638-1c258428a924","resolution":{"observed_at":"2026-05-18T14:22:40.887342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Prosody-Adaptable Audio Codecs for Zero-Shot V oice Conversion via In-Context Learn- ing","venue":null,"work_id":"fb8372ff-93b8-48d6-8e3c-74bc9568e5d1","year":2025},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:30343ba13836c7e125d7b7d9b686798909ffd76a8be2e187398b626765b046d0","observation_id":"c2560861-549d-47fe-b38d-d0a98e250f28","resolution":{"observed_at":"2026-05-18T14:22:40.883688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Film: Visual reasoning with a general conditioning layer","venue":null,"work_id":"97c6a317-10ff-495b-ab49-93d7844d6cee","year":2018},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:34f9c298f53ac8d67468f94fc3bae514b8d3f726e3f0c9824d89f1f0bb2f28c8","observation_id":"26b28b96-2fd3-445b-bf14-db9b433fe9bc","resolution":{"observed_at":"2026-05-18T14:22:40.879932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improved parallel wavegan vocoder with per- ceptually weighted spectrogram loss","venue":null,"work_id":"32ef8a45-249d-4f7f-a62d-07dc28ebef6b","year":2021},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:26d8b541566ce5188fe0576f6e1dadc260d87fe2a2b7876ae248482dcd64cdb6","observation_id":"164b0662-aa5c-47ac-9d5a-6e6e0e64ecd4","resolution":{"observed_at":"2026-05-18T14:22:40.876106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flow-guided one- shot talking face generation with a high-resolution audio-visual dataset","venue":null,"work_id":"23212dd3-62ba-4204-a257-492082cbede6","year":2021},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:7aed635b7f6241cdcd9da9c303a0379e959ac91c3d949d3a170d518f5e71b40e","observation_id":"6dc7dfbd-83c9-44a3-80c8-a88b3a5dfee1","resolution":{"observed_at":"2026-05-18T14:22:40.871754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"V oxceleb: A large-scale speaker identification dataset","venue":null,"work_id":"9e4dd6c1-f991-4ed0-bebf-ac0b882ae576","year":2017},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:4fbbbe202dae6cd65712aa3caba66ffecaf967b682cdeb8596409410e5dfca84","observation_id":"19b246d7-0020-49fd-8cf5-9eb74c6546ec","resolution":{"observed_at":"2026-05-18T14:22:40.864861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hallo2: Long-duration and high- resolution audio-driven portrait image animation","venue":null,"work_id":"b878b83e-149a-4cc3-8667-72da0347eaba","year":2025},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:e5e3b04c89b5cb37239f075dd41805c9b1c3b251ce6623c28e9827719683d873","observation_id":"4baf7e6b-bcc6-4e7e-b8d3-eabe5609d273","resolution":{"observed_at":"2026-05-18T14:22:40.859854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Meshtalk: 3d face animation from speech using cross- modality disentanglement","venue":null,"work_id":"6b7e3141-fb60-43f9-978c-751570b0ac6f","year":2021},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:506f169b99db76b09e9c521be615fc703d1ead4f24a9cb54c664db7d0a0b0ca4","observation_id":"026f25cf-ed6c-4621-b2cc-8d4f843ab51b","resolution":{"observed_at":"2026-05-18T14:22:40.852453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A lip sync expert is all you need for speech to lip generation in the wild","venue":null,"work_id":"c4e5c1f4-cbf8-4c59-a1d3-9e622acce1f5","year":2020},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:b0977fb26e3aeb0dac4b397423f8921c013cd89838d5b312696d5d80534f12cd","observation_id":"daca2d65-86e7-47af-9fb2-7760c3dbc0d6","resolution":{"observed_at":"2026-05-18T14:22:40.848920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fine-grained head pose estimation without keypoints","venue":null,"work_id":"e73f29c7-095b-4984-9400-47be4b8b202d","year":2018},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:f3c8cdf30ac048ba3641003ee126a7b060a3d47e8aa50c9b92751cd81fe144bc","observation_id":"ec6bad9b-95f9-479c-afbb-ac19f0b4c697","resolution":{"observed_at":"2026-05-18T14:22:40.844160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bailando: 3d dance generation by actor- critic gpt with choreographic memory","venue":null,"work_id":"8549da36-bdbe-4c85-a6b0-cb7620e4bbae","year":2022},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:fbd76ebe3f0e6aedb085728d46b7eafbdcb0f02fa4888089792cb377bd92f12b","observation_id":"21fcfb77-80ee-4ee8-93a2-68dfb07fc2cf","resolution":{"observed_at":"2026-05-18T14:22:40.839699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Robust speech recognition via large-scale weak supervision","venue":null,"work_id":"5c58086a-6b07-45dd-91ae-a5b7b04161ca","year":2023},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:2b522e911d9c3abd7aead64bfae0b2c13544c824e8914541ac9f1df8f7a48859","observation_id":"0241366b-e474-4b36-be55-2c3d835f8e63","resolution":{"observed_at":"2026-05-18T14:22:40.836070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","latest_version":2,"primary_category":"cs.GR","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":3,"verified_exact":1,"verified_fuzzy":25},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 1 inbound Pith citation observation for arXiv:2509.20128."}