{"as_of":"2026-08-21T07:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a99634344ae8ea336dd226c2353ccb8b512a318a4a8eb01d04ade3d8b872f679","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T21:33:20.047608Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T01:07:49.064263Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T15:45:48.564618Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"cited_work":{"arxiv_id":"2501.04586","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.04586","snapshot_observed_at":"2026-07-01T15:45:48.564618Z","title":"Identity-preserving video dubbing using motion warping.arXiv preprint arXiv:2501.04586, 2025","venue":null,"work_id":"ccb8f96e-812b-4a88-987c-ec2324803db8","year":2025},"citing_paper":{"arxiv_id":"2606.28568","last_updated":"2026-06-26T19:48:44Z","snapshot_observed_at":"2026-08-21T03:44:24.193409Z","submitted_at":"2026-06-26T19:48:44Z","title":"KM-Speaker: Keypoint-Based Style Control for High-Quality Speech-Driven 3D Facial Animation and Dialogue Localization","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-30T01:07:49.064263Z"},"links":{"cited_paper":"/paper/2501.04586","citing_paper":"/paper/2606.28568"},"observation_digest":"sha256:85f3e9f79a0e8d4cd92f74cbad38117d815cdc182ebfcf5179c061b408266026","observation_id":"9837e775-7815-4679-b8e8-0d6b09b77fa7","resolution":{"observed_at":"2026-07-01T15:45:48.566525Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.04586/citation-record","integrity":"/paper/2501.04586/integrity","json":"/paper/2501.04586/citation-record.json","paper":"/paper/2501.04586"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:33:20.438462Z","title":"A lip sync expert is all you need for speech to lip generation in the wild,","venue":null,"work_id":"f13ddc63-aab6-4406-a909-20bcb0771d7f","year":2020},"citing_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T21:33:19.936940Z"},"links":{"citing_paper":"/paper/2501.04586"},"observation_digest":"sha256:30d9d27bddda0bae6b54c5ffa249094b9af4c36ea5823b98a0900fc3c5bbf0bd","observation_id":"f6b97bc2-2d69-4782-9e45-790c8109709b","resolution":{"observed_at":"2026-08-10T21:33:20.442649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:33:20.425394Z","title":"Identity- preserving talking face generation with landmark and appearance priors,","venue":null,"work_id":"746b8e92-3e6d-484f-bc64-b44a346218e3","year":2023},"citing_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T21:33:19.941263Z"},"links":{"citing_paper":"/paper/2501.04586"},"observation_digest":"sha256:4974baaf1f761cba59fe5f14a6c7f74d9bef4a62c9e47a1aab973325f05a83e4","observation_id":"98ed4075-273b-43e4-8a9c-5a2054b8a440","resolution":{"observed_at":"2026-08-10T21:33:20.430322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:33:20.412814Z","title":"Makelttalk: speaker-aware talking-head animation,","venue":null,"work_id":"0385a520-4278-41de-acf2-c048a1d50f65","year":2020},"citing_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T21:33:19.945130Z"},"links":{"citing_paper":"/paper/2501.04586"},"observation_digest":"sha256:6078e1f8fac204a39793c0c6a326f84668f8388077c366853a47a350e0e96ea6","observation_id":"a0a86678-78d2-46be-a0b9-b0c66d232278","resolution":{"observed_at":"2026-08-10T21:33:20.417064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:33:20.400884Z","title":"Towards realistic visual dubbing with heteroge- neous sources,","venue":null,"work_id":"3a3c29d7-2b41-4f5d-903f-bc9cf6a37fa4","year":2021},"citing_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T21:33:19.948962Z"},"links":{"citing_paper":"/paper/2501.04586"},"observation_digest":"sha256:defbb533100899b2e6982f0b63567ef6c960508ef64502fb024964bde829c286","observation_id":"321b9ccf-fe5a-44e9-b522-4b6835cea730","resolution":{"observed_at":"2026-08-10T21:33:20.405427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:33:20.387047Z","title":"Towards automatic face-to-face translation,","venue":null,"work_id":"89f25d31-1a2d-4e34-9a7f-055b50473247","year":2019},"citing_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T21:33:19.952855Z"},"links":{"citing_paper":"/paper/2501.04586"},"observation_digest":"sha256:f75dc9ad0359e6e6fe50450fd30e9804babeeaa1dd7e478b44c85f741432f14e","observation_id":"e0546987-95f9-4999-beb6-1d608424ac57","resolution":{"observed_at":"2026-08-10T21:33:20.391706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:33:20.374733Z","title":"Semantic-aware implicit neural audio-driven video portrait generation,","venue":null,"work_id":"3d981d80-e498-4665-9690-a5925c0bd8fe","year":2022},"citing_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T21:33:19.956621Z"},"links":{"citing_paper":"/paper/2501.04586"},"observation_digest":"sha256:e1a7e8891ef8c999f0e353e231c9f26609f21fd516033181efa51a1cda3c2d42","observation_id":"f039edde-b4ea-4ec1-8d39-268d5ffa2f38","resolution":{"observed_at":"2026-08-10T21:33:20.378501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:33:20.363307Z","title":"Learning dynamic facial radiance fields for few-shot talking head synthesis,","venue":null,"work_id":"0f6ebc3f-7b7e-48e4-898e-89095f4b49a6","year":2022},"citing_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T21:33:19.960811Z"},"links":{"citing_paper":"/paper/2501.04586"},"observation_digest":"sha256:300f41b21197099d4ddb93150e2bf02d004a232427a418ef51698f2de7fc3efa","observation_id":"9a086f91-0dcc-4cc3-9e75-38e27c1044db","resolution":{"observed_at":"2026-08-10T21:33:20.367292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:33:20.351043Z","title":"Ad-nerf: Audio driven neural radiance fields for talking head synthesis,","venue":null,"work_id":"0e5f2fcb-a4d1-4172-bbc1-6295e43e28c3","year":2021},"citing_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T21:33:19.964405Z"},"links":{"citing_paper":"/paper/2501.04586"},"observation_digest":"sha256:97077508708c09b6037bf9b7ccbb4e769de082040154153cc1252e6629556a16","observation_id":"2fa95ff0-e4f6-4bbd-a099-81151c5b5c67","resolution":{"observed_at":"2026-08-10T21:33:20.355607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:33:20.337506Z","title":"Expressive talking head generation with granular audio-visual control,","venue":null,"work_id":"4e6e902f-93f7-4964-8962-f39c5d26b0c8","year":2022},"citing_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T21:33:19.968023Z"},"links":{"citing_paper":"/paper/2501.04586"},"observation_digest":"sha256:d24f59e01b2a7967cae847654d5957609a73677d2c0faa2902dca8aff4d3f60a","observation_id":"6de5c8ec-6312-4955-a102-3d588bba4056","resolution":{"observed_at":"2026-08-10T21:33:20.342269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:33:20.323040Z","title":"Vfhq: A high-quality dataset and benchmark for video face super-resolution,","venue":null,"work_id":"afb8300f-eff1-472f-8d48-43d2b3170c15","year":2022},"citing_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T21:33:19.971610Z"},"links":{"citing_paper":"/paper/2501.04586"},"observation_digest":"sha256:7102de7d2d957eb18cee65230dae2a8fcd42347cae63d2bf90aca1f105b389fc","observation_id":"2af13967-d630-4524-9de8-8a88f3b51861","resolution":{"observed_at":"2026-08-10T21:33:20.327670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:33:20.308731Z","title":"Flow-guided one-shot talking face generation with a high-resolution audio-visual dataset,","venue":null,"work_id":"bc5e7321-8bf4-43cc-8c59-bc3c95290613","year":2021},"citing_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T21:33:19.975293Z"},"links":{"citing_paper":"/paper/2501.04586"},"observation_digest":"sha256:31662b0e092503b5c428b716fdd66242366ec6706856ebc6eccad6b3392f60ea","observation_id":"b9148167-636c-4398-9b32-84782ea83571","resolution":{"observed_at":"2026-08-10T21:33:20.313593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:33:20.294867Z","title":"A morphable model for the synthesis of 3d faces,","venue":null,"work_id":"49ffe42c-3217-4ecc-a468-89c7a4f5ba52","year":2002},"citing_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T21:33:19.978797Z"},"links":{"citing_paper":"/paper/2501.04586"},"observation_digest":"sha256:e9774f18de504da0919f4d40b6a72bb8f3c599baa005ba00b11d88e8892ff588","observation_id":"6d78fc0b-0f1a-4a77-90bf-0803da937fd8","resolution":{"observed_at":"2026-08-10T21:33:20.299923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:33:20.281725Z","title":"Styletalk: One-shot talking head generation with controllable speaking styles,","venue":null,"work_id":"79607665-f5c1-41cd-bc8d-ea009403b26a","year":2023},"citing_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T21:33:19.982087Z"},"links":{"citing_paper":"/paper/2501.04586"},"observation_digest":"sha256:3dd424f702a20baabe70f801bcdac2d880e383c06e8bc627d275e5192ef3067d","observation_id":"1f020e12-d836-4225-9492-3e1509f42fa9","resolution":{"observed_at":"2026-08-10T21:33:20.286215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:33:19.985252Z","title":"Nerf: Representing scenes as neural radiance fields for view synthesis,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T21:33:19.985252Z"},"links":{"citing_paper":"/paper/2501.04586"},"observation_digest":"sha256:8ccc87d072de0b9b9052811839860616f5b0b60a3d027902312993bac1bc18d1","observation_id":"e50816ea-6815-4186-8edd-469687d262ce","resolution":{"observed_at":"2026-08-10T21:33:19.985252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:33:19.988266Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T21:33:19.988266Z"},"links":{"citing_paper":"/paper/2501.04586"},"observation_digest":"sha256:80e2220900fbf2340d95ff8b2ecb9a4f47f32f88fe44cdad50c86683e94f3499","observation_id":"43a5bcc9-3997-461f-9c45-a4e422a1664a","resolution":{"observed_at":"2026-08-10T21:33:19.988266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:33:20.255200Z","title":"Dinet: Deformation inpainting network for realistic face visually dubbing on high resolution video,","venue":null,"work_id":"2da7cbfa-1e66-4af6-827c-b99df4b2f0ef","year":2023},"citing_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T21:33:19.991250Z"},"links":{"citing_paper":"/paper/2501.04586"},"observation_digest":"sha256:af5708984ca9a0e4f8b5f8873eb2a95ad2bbb2ac89d86ba8848b134133251fc3","observation_id":"2528ce05-625b-41e9-ab33-92ba21ac7815","resolution":{"observed_at":"2026-08-10T21:33:20.259490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:33:20.244602Z","title":"Adaptive affine transformation: A simple and effective operation for spatial misaligned image generation,","venue":null,"work_id":"88ba551a-35fc-4a9c-8984-b4f39bbac5d6","year":2022},"citing_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T21:33:19.994059Z"},"links":{"citing_paper":"/paper/2501.04586"},"observation_digest":"sha256:08b91d5966d9aacb96d6904f97ba585dc946cf49afd46a3b6ccbbebd75286dc8","observation_id":"a6288e1a-b07a-4d0f-90ab-ce19f5a93ad7","resolution":{"observed_at":"2026-08-10T21:33:20.248355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:33:20.231717Z","title":"Pirenderer: Controllable portrait image generation via semantic neural rendering,","venue":null,"work_id":"fe313b41-d8c9-4059-a2a8-01a520475f0e","year":2021},"citing_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T21:33:19.996963Z"},"links":{"citing_paper":"/paper/2501.04586"},"observation_digest":"sha256:71dfd4e4eaabab9cbc4fa18ee1f7b54cfa6dab72e20175c6c1f3d85cbfc2fe54","observation_id":"68a38553-035e-49de-b206-eb9c5de09a40","resolution":{"observed_at":"2026-08-10T21:33:20.236230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:33:19.999961Z","title":"Arbitrary style transfer in real-time with adaptive instance normalization,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T21:33:19.999961Z"},"links":{"citing_paper":"/paper/2501.04586"},"observation_digest":"sha256:25625d22a377d863c8d160df98b32d0cf6cf2a29880304efe211e52a3a827b91","observation_id":"e034d0e2-be52-495c-a857-98a479d1898c","resolution":{"observed_at":"2026-08-10T21:33:19.999961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:33:20.211309Z","title":"First order motion model for image animation,","venue":null,"work_id":"36284829-042e-4426-81ff-57d2378bfb8b","year":2019},"citing_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T21:33:20.002853Z"},"links":{"citing_paper":"/paper/2501.04586"},"observation_digest":"sha256:14d624f2b7fa1f6a4390e12bdccf4ddcaf995ad84abffd49e9329617a1505f36","observation_id":"3b6fc4d0-de6b-419f-921c-cdf418a739e4","resolution":{"observed_at":"2026-08-10T21:33:20.216187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.08172","last_updated":"2019-06-14T05:49:22Z","snapshot_observed_at":"2026-08-20T11:52:04.914215Z","submitted_at":"2019-06-14T05:49:22Z","title":"MediaPipe: A Framework for Building Perception Pipelines","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.08172","snapshot_observed_at":"2026-08-10T21:33:20.006197Z","title":"Mediapipe: A framework for building perception pipelines,","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T21:33:20.006197Z"},"links":{"cited_paper":"/paper/1906.08172","citing_paper":"/paper/2501.04586"},"observation_digest":"sha256:3ccfb8cc2af12a80191ebf2685e3ffe6e72878729ec4f25b7ea024126ead151a","observation_id":"916c99e5-c375-4aeb-aee5-a96ca41b4956","resolution":{"observed_at":"2026-08-10T21:33:20.006197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:33:20.197375Z","title":"Semantic image synthesis with spatially-adaptive normalization,","venue":null,"work_id":"6d890be8-c897-4494-bbb2-55e241bf1998","year":2019},"citing_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T21:33:20.009779Z"},"links":{"citing_paper":"/paper/2501.04586"},"observation_digest":"sha256:e114dc51d6bda02bbdff98ab6357d1c56b0d9ff55bb3a1d12d7c19caf93a1b0d","observation_id":"2da28093-0eda-4ad2-9ab5-c8d50dc12217","resolution":{"observed_at":"2026-08-10T21:33:20.202034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:33:20.013297Z","title":"Perceptual losses for real-time style transfer and super-resolution,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T21:33:20.013297Z"},"links":{"citing_paper":"/paper/2501.04586"},"observation_digest":"sha256:05c16926472f03ac25d9b4c00ed17352a95dbd09f93cedf83821b983f990ebc6","observation_id":"b0f986ce-dcd5-4269-81e7-5b8195dd8939","resolution":{"observed_at":"2026-08-10T21:33:20.013297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:33:20.177647Z","title":"Least squares generative adversarial networks,","venue":null,"work_id":"9e7fb49f-c5f6-4be3-8160-e252ad5224bc","year":2017},"citing_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T21:33:20.016815Z"},"links":{"citing_paper":"/paper/2501.04586"},"observation_digest":"sha256:561b93bcc2773fd73c8cc027aa70bebbed11dbfba28b9ee15976617b11b8b212","observation_id":"6d9a882d-f5e5-4c0d-a5f7-66ecc26d6638","resolution":{"observed_at":"2026-08-10T21:33:20.181914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-08-17T19:17:06.411141Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-10T21:33:20.020274Z","title":"Very deep convolutional networks for large-scale image recognition,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T21:33:20.020274Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2501.04586"},"observation_digest":"sha256:a67d4ecbc8e3d463855d4bad3bf6e34a66870ce2d9883bd2f18901abe2a2caa8","observation_id":"7da0b854-af17-4118-a6ca-85ca81bd8044","resolution":{"observed_at":"2026-08-10T21:33:20.020274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09767","last_updated":"2024-08-10T09:37:55Z","snapshot_observed_at":"2026-08-20T18:01:03.560904Z","submitted_at":"2023-12-15T13:15:42Z","title":"DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09767","snapshot_observed_at":"2026-08-10T21:33:20.024188Z","title":"Dreamtalk: When expressive talking head generation meets diffusion probabilistic models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T21:33:20.024188Z"},"links":{"cited_paper":"/paper/2312.09767","citing_paper":"/paper/2501.04586"},"observation_digest":"sha256:dc9e670f808c855fd94967f6cf13a79c97ea873affada3bbf2dfafed14b3085d","observation_id":"63eaae43-c52f-475f-ab8f-29971d333160","resolution":{"observed_at":"2026-08-10T21:33:20.024188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.09293","last_updated":"2021-07-20T07:22:42Z","snapshot_observed_at":"2026-08-17T16:29:54.452859Z","submitted_at":"2021-07-20T07:22:42Z","title":"Audio2Head: Audio-driven One-shot Talking-head Generation with Natural Head Motion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.09293","snapshot_observed_at":"2026-08-10T21:33:20.028036Z","title":"Audio2head: Audio- driven one-shot talking-head generation with natural head motion,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T21:33:20.028036Z"},"links":{"cited_paper":"/paper/2107.09293","citing_paper":"/paper/2501.04586"},"observation_digest":"sha256:5239349d560223a0640a610e56a31eae99524b0d70bf67116d50ecaca9462248","observation_id":"4fafed32-fa17-4481-810f-3c079d939cc3","resolution":{"observed_at":"2026-08-10T21:33:20.028036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:33:20.155339Z","title":"Sadtalker: Learning realistic 3d motion coefficients for stylized audio-driven single image talking face animation,","venue":null,"work_id":"dec2b2f8-26dd-4b1a-b55d-bc97254a0323","year":2023},"citing_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T21:33:20.031977Z"},"links":{"citing_paper":"/paper/2501.04586"},"observation_digest":"sha256:ffba1b3ff7f2277a07384aae00bcd5841976edb4086f7a9089ba5e0a0986ee05","observation_id":"c7467d18-e775-41e5-b2e1-4cb2b6c62ecc","resolution":{"observed_at":"2026-08-10T21:33:20.169093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08801","last_updated":"2024-06-16T07:10:41Z","snapshot_observed_at":"2026-08-18T10:23:27.377504Z","submitted_at":"2024-06-13T04:33:20Z","title":"Hallo: Hierarchical Audio-Driven Visual Synthesis for Portrait Image Animation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08801","snapshot_observed_at":"2026-08-10T21:33:20.035895Z","title":"Hallo: Hierarchical audio-driven visual synthesis for portrait image animation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T21:33:20.035895Z"},"links":{"cited_paper":"/paper/2406.08801","citing_paper":"/paper/2501.04586"},"observation_digest":"sha256:2192fba864ea43153b94298d3f5d1d6d219b1acd72799a7900de75c3f01adafd","observation_id":"ba43f0de-9237-4519-b331-337ed749f485","resolution":{"observed_at":"2026-08-10T21:33:20.035895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17694","last_updated":"2024-03-26T13:35:02Z","snapshot_observed_at":"2026-08-18T10:29:36.587877Z","submitted_at":"2024-03-26T13:35:02Z","title":"AniPortrait: Audio-Driven Synthesis of Photorealistic Portrait Animation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17694","snapshot_observed_at":"2026-08-10T21:33:20.039736Z","title":"Aniportrait: Audio-driven synthesis of photorealistic portrait animation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T21:33:20.039736Z"},"links":{"cited_paper":"/paper/2403.17694","citing_paper":"/paper/2501.04586"},"observation_digest":"sha256:4f7f1cf97c0b9ee627c512576ef52ca87c35ee8ce3d29eab93bbce4f9d7493b2","observation_id":"e7c0954f-f1e7-4092-9389-10f6f9747d3e","resolution":{"observed_at":"2026-08-10T21:33:20.039736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:33:20.141945Z","title":"Image quality assessment: Form error visibility to structural similarity,","venue":null,"work_id":"82803a84-d171-4b38-a441-67441ce81b20","year":2004},"citing_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T21:33:20.043859Z"},"links":{"citing_paper":"/paper/2501.04586"},"observation_digest":"sha256:999651cd9cfc8b519779d997db0746d6a1725828ae4ae0a27605194b1f4fcd18","observation_id":"026c6ca1-1821-4c9e-9810-af851643ce9f","resolution":{"observed_at":"2026-08-10T21:33:20.147658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:33:20.047608Z","title":"The unreasonable effectiveness of deep features as a perceptual metric,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T21:33:20.047608Z"},"links":{"citing_paper":"/paper/2501.04586"},"observation_digest":"sha256:64f50396d6049f744560a0fb44b4d4e24053813be0e8ca355675c1e8e7fdf656","observation_id":"00a3884e-3a5c-41cc-ab7d-e0e59a5a92c8","resolution":{"observed_at":"2026-08-10T21:33:20.047608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.04586","last_updated":"2025-01-09T15:27:58Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T10:29:16.382021Z","submitted_at":"2025-01-08T16:06:21Z","title":"Identity-Preserving Video Dubbing Using Motion Warping"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":21},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 1 inbound Pith citation observation for arXiv:2501.04586."}