{"as_of":"2026-08-09T23:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e7b31ce454bd239f86841421f201dd9af3066975e9c0f457e4436d6808cdc11a","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T20:46:54.281971Z","state":"measured"},{"denominator":61,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":61,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T15:28:58.839701Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-21T19:04:19.314384Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"cited_work":{"arxiv_id":"2508.09959","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09959","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A recipe for scaling up text-to-video generation with text-free videos","venue":null,"work_id":"2335c51e-4704-4efe-a5d0-77a99e5a27c4","year":null},"citing_paper":{"arxiv_id":"2511.04520","last_updated":"2026-05-20T15:14:20Z","snapshot_observed_at":"2026-07-31T21:47:41.347121Z","submitted_at":"2025-11-06T16:34:10Z","title":"THEval. Evaluation Framework for Talking Head Video Generation","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-21T19:00:48.999456Z"},"links":{"cited_paper":"/paper/2508.09959","citing_paper":"/paper/2511.04520"},"observation_digest":"sha256:1b094caa8130150d123df7c4ef097421c53e59590668481cc2128c63402be935","observation_id":"466da993-75e9-457f-8c91-3a58a96200e3","resolution":{"observed_at":"2026-05-21T19:04:19.318078Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.09959","snapshot_observed_at":"2026-08-03T15:28:58.839701Z","title":"Lia-x: Interpretable latent portrait animator.arXiv preprint arXiv:2508.09959, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.16893","last_updated":"2026-06-26T16:02:20Z","snapshot_observed_at":"2026-08-09T14:59:21.358895Z","submitted_at":"2025-12-18T18:53:28Z","title":"Instant Expressive Gaussian Head Avatars at Over 100 FPS","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-03T15:28:58.839701Z"},"links":{"cited_paper":"/paper/2508.09959","citing_paper":"/paper/2512.16893"},"observation_digest":"sha256:da69c2423a2ea453a8e9c8b5d086a51fe8464714f31565591c7aebfbc13c2085","observation_id":"d10608a8-1cda-4c67-832c-b3d122e52465","resolution":{"observed_at":"2026-08-03T15:28:58.839701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"cited_work":{"arxiv_id":"2508.09959","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09959","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A recipe for scaling up text-to-video generation with text-free videos","venue":null,"work_id":"2335c51e-4704-4efe-a5d0-77a99e5a27c4","year":null},"citing_paper":{"arxiv_id":"2604.23586","last_updated":"2026-08-04T09:15:37Z","snapshot_observed_at":"2026-08-07T23:09:24.588848Z","submitted_at":"2026-04-26T07:48:47Z","title":"Talker-T2AV: Joint Talking Audio-Video Generation with Autoregressive Diffusion Modeling","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-08T06:44:36.000353Z"},"links":{"cited_paper":"/paper/2508.09959","citing_paper":"/paper/2604.23586"},"observation_digest":"sha256:214e6704ff5ba3ef9b2b1f5401feadc872fd9439f99c2798e2cf91be93a38fc1","observation_id":"c2559550-d0bf-4ef6-b1b6-8f68d8ea845a","resolution":{"observed_at":"2026-05-11T21:06:14.366989Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.09959/citation-record","integrity":"/paper/2508.09959/integrity","json":"/paper/2508.09959/citation-record.json","paper":"/paper/2508.09959"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.791458Z","title":"Align your latents: High-resolution video synthesis with la- tent diffusion models","venue":null,"work_id":"f5fb8da7-dd9b-409e-9d54-998214f3c0b3","year":2023},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.130061Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:3926be2da60b995838a3c185692757391fbd28679e338483576158832c49f050","observation_id":"6a40b247-6d55-491d-a39c-c08b5c4f7768","resolution":{"observed_at":"2026-08-05T20:46:54.794776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.782882Z","title":"Generating long videos of dynamic scenes","venue":null,"work_id":"02a49b41-b5a9-402b-8a51-d71dcb78ed1e","year":2022},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.133241Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:766e571a4e1c5f1b5577c24545f90d2b805e7eb9ccd0b99035edc3f153ea71a8","observation_id":"ecc37aeb-4300-430d-b414-ac49f0d5f108","resolution":{"observed_at":"2026-08-05T20:46:54.785695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.136241Z","title":"Video generation models as world simulators","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.136241Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:d082c83645e2cd6578bff439acb71db206baa0c242fa66fb9848383833ce81c2","observation_id":"860bd75e-4cdf-4e3e-bd10-6d5ae8320eed","resolution":{"observed_at":"2026-08-05T20:46:54.136241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.769279Z","title":"Everybody dance now","venue":null,"work_id":"c6a11be5-da4c-49c5-9062-41ec4c4fb72c","year":2019},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.139082Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:38406c3432e69b195462fff4887d7274a09e6676244ebbf3fd2967c20e00c3b0","observation_id":"9b269fa2-15b1-49d5-90dc-1438496c8aa3","resolution":{"observed_at":"2026-08-05T20:46:54.772594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12052","last_updated":"2024-05-05T05:07:34Z","snapshot_observed_at":"2026-08-01T16:10:16.293275Z","submitted_at":"2023-11-18T10:22:44Z","title":"MagicPose: Realistic Human Poses and Facial Expressions Retargeting with Identity-aware Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12052","snapshot_observed_at":"2026-08-05T20:46:54.142060Z","title":"Magicdance: Realistic human dance video gen- eration with motions & facial expressions transfer","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.142060Z"},"links":{"cited_paper":"/paper/2311.12052","citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:de9821d3d4fd9d9b31ca6d4863479c21750b067443458eb4b6af58d78c06736d","observation_id":"d2d56ade-c32f-4ec7-8ae8-f8ff51bfa50d","resolution":{"observed_at":"2026-08-05T20:46:54.142060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.761691Z","title":"Joint generative and con- trastive learning for unsupervised person re-identification","venue":null,"work_id":"62286fae-32b0-4001-9794-2bc12f9b6d0d","year":2021},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.145189Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:869bd93aa21dfbb020480394a17237112f824fced76d77ccdf57bd47cbc04f41","observation_id":"753b57d6-524d-4aba-a944-7531b59ed9aa","resolution":{"observed_at":"2026-08-05T20:46:54.764319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.753802Z","title":"Videocrafter2: Overcoming data limitations for high-quality video diffusion models","venue":null,"work_id":"43731b23-e348-4f79-aac3-eb6aad3779bf","year":2024},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.147928Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:7e17abece8314c0df6b3c478debd084706ce32819ce0be18a1b5dd687a517f09","observation_id":"e4c97c71-e230-4cba-9492-c5a5c8630718","resolution":{"observed_at":"2026-08-05T20:46:54.756556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.745757Z","title":"Seine: Short-to-long video diffusion model for generative transition and prediction","venue":null,"work_id":"6b27d48d-cda0-44b9-8c3d-1d5f3d8bd18c","year":2023},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.150695Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:df9a7e12cd6f3f5c3dd3d3a1e7fd4acbeac531580892f18ad3b4a2e88d1395c9","observation_id":"da4ccdd3-a9db-4904-9c9a-103363c16682","resolution":{"observed_at":"2026-08-05T20:46:54.748521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.06571","last_updated":"2019-09-25T16:37:55Z","snapshot_observed_at":"2026-07-06T08:07:47.943239Z","submitted_at":"2019-07-15T16:27:04Z","title":"Adversarial Video Generation on Complex Datasets","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.06571","snapshot_observed_at":"2026-08-05T20:46:54.153220Z","title":"Adver- sarial video generation on complex datasets","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.153220Z"},"links":{"cited_paper":"/paper/1907.06571","citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:3e341608dc9b9763dfb1779b664ebb0ca48d34da1e6dac8daf59cc92b6067db2","observation_id":"2bab6b86-4575-425b-b211-2878e63776d9","resolution":{"observed_at":"2026-08-05T20:46:54.153220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.737055Z","title":"Generative adversarial nets","venue":null,"work_id":"acc2652c-a70c-426d-bd55-4d48e7f9238a","year":2014},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.156113Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:3869c48b9e2eb3e044377f9365ea4dd9cf6b1d253877a1a631115782525bde07","observation_id":"82cff072-b54d-4e41-a35d-68a0afa609a8","resolution":{"observed_at":"2026-08-05T20:46:54.740117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03168","last_updated":"2025-02-28T14:39:17Z","snapshot_observed_at":"2026-08-08T10:55:01.205999Z","submitted_at":"2024-07-03T14:41:39Z","title":"LivePortrait: Efficient Portrait Animation with Stitching and Retargeting Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.03168","snapshot_observed_at":"2026-08-05T20:46:54.158624Z","title":"Livepor- trait: Efficient portrait animation with stitching and retarget- ing control","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.158624Z"},"links":{"cited_paper":"/paper/2407.03168","citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:0f470c80ffc0a926bf8dea07e856ddf5105150754087d1b56639c6d4bad37942","observation_id":"2b083382-7765-43cc-8ed8-2139cf5d5285","resolution":{"observed_at":"2026-08-05T20:46:54.158624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.728307Z","title":"Animatediff: Animate your personalized text-to- image diffusion models without specific tuning","venue":null,"work_id":"43ba0ebe-470c-4112-851d-1e019d86071e","year":2024},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.161496Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:ae00f77c6f33dbf2f38e7f967d791b90c1fa680d897aeba652560f5c18888be4","observation_id":"eb21ecd7-b84c-4206-9f22-3c603516758f","resolution":{"observed_at":"2026-08-05T20:46:54.731888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.719496Z","title":"Denoising diffu- sion probabilistic models","venue":null,"work_id":"c48da578-b9ae-414f-b570-d381782c2884","year":2020},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.164595Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:32f876775724d26c92f3ab0e3d7bcd5317b739f133e0acda910c748b68471be6","observation_id":"ae2004a0-ca36-4eb1-affb-4720ba0a7512","resolution":{"observed_at":"2026-08-05T20:46:54.722724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02303","last_updated":"2022-10-05T14:41:38Z","snapshot_observed_at":"2026-07-06T13:59:57.800591Z","submitted_at":"2022-10-05T14:41:38Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02303","snapshot_observed_at":"2026-08-05T20:46:54.167133Z","title":"Imagen video: High definition video generation with diffusion mod- els","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.167133Z"},"links":{"cited_paper":"/paper/2210.02303","citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:692a3b82509f18e70779979841287ee811a1fc0077fa34e4d31ee65331651c51","observation_id":"da4ad382-b3b1-464a-9616-202720c2d411","resolution":{"observed_at":"2026-08-05T20:46:54.167133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.710677Z","title":"Implicit identity representation conditioned memory compensation network for talking head video generation","venue":null,"work_id":"d17e3a91-56fb-4f8c-9465-fc4059de61ec","year":2023},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.170010Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:eac9323e57fbfbde3c7adf58c2b54795d6c74d7e4e572c04934430eb58062c4a","observation_id":"8240a8df-b30b-4d85-be42-cc9d7b63f9dc","resolution":{"observed_at":"2026-08-05T20:46:54.713712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.701576Z","title":"Depth-aware generative adversarial network for talking head video generation","venue":null,"work_id":"82b6316e-1ced-4555-83b1-0e3d2acd2a1a","year":2022},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.172441Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:e86c59ff6f917a20812814be727839918e8f52e502da1365c961b75b3705610d","observation_id":"685938ef-161b-4bbc-9e9f-d65265fcfa2f","resolution":{"observed_at":"2026-08-05T20:46:54.705130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.693049Z","title":"Flow-grounded spatial-temporal video prediction from still images","venue":null,"work_id":"599cc249-5f98-46f5-998a-58402bbb9cca","year":2018},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.174812Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:96e3c2d71c5420fd714facfe8d7977a0a553474edc118adc1b63e2c8adbbda56","observation_id":"3b076f1c-fb1c-4b15-a541-1e0810a70bb3","resolution":{"observed_at":"2026-08-05T20:46:54.695962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.684678Z","title":"Blendgan: Implicitly gan blending for arbitrary stylized face generation","venue":null,"work_id":"77a3a2c5-30e8-4a2f-a78f-9db6f61d890a","year":2021},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.177376Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:8324c3f39195aa27639ecfe9f92f82c2668509edc7efd40efdace267ee09a6e7","observation_id":"62bcd284-f542-4cd0-b3cb-70b22484b20c","resolution":{"observed_at":"2026-08-05T20:46:54.687569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.675710Z","title":"Liquid warping gan: A unified framework for human motion imitation, appearance transfer and novel view synthesis","venue":null,"work_id":"2eea26aa-5bda-48c6-97a8-06dffbb7a594","year":2019},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.180046Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:f5ec3d88120458e80f81d2e49229f69932b7b9d1984eb191ae8868345f72aeb7","observation_id":"b1dfa6fc-d6c4-4ab9-ba40-c98bc9f972c4","resolution":{"observed_at":"2026-08-05T20:46:54.679039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.182415Z","title":"Latte: La- tent diffusion transformer for video generation.Transactions on Machine Learning Research, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.182415Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:f0974d54f02dc1497bb308208c428a9a9c562db2343a8e56e7f4384a70728110","observation_id":"b54bb9fa-89fc-48e5-8a9f-04a947170742","resolution":{"observed_at":"2026-08-05T20:46:54.182415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01900","last_updated":"2024-06-07T02:57:36Z","snapshot_observed_at":"2026-08-07T23:04:56.801786Z","submitted_at":"2024-06-04T02:05:57Z","title":"Follow-Your-Emoji: Fine-Controllable and Expressive Freestyle Portrait Animation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01900","snapshot_observed_at":"2026-08-05T20:46:54.184990Z","title":"Follow-your-emoji: Fine-controllable and expressive freestyle portrait animation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.184990Z"},"links":{"cited_paper":"/paper/2406.01900","citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:2f506875213a61ac9a18c4cdaf64775046817f6191e8a19ce149818297a99b59","observation_id":"22e27576-9d32-45bc-bf3c-00694160a4db","resolution":{"observed_at":"2026-08-05T20:46:54.184990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.662483Z","title":"Snap video: Scaled spatiotemporal transformers for text-to-video synthesis","venue":null,"work_id":"48f113ec-c200-4dd7-b6de-1b2e2d503052","year":2024},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.187787Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:84d44d53bd793369917079da94d687377353d5e8d3b1886e0b1bcac54448898b","observation_id":"a9e1aadf-2798-49fd-bec4-0f063157af43","resolution":{"observed_at":"2026-08-05T20:46:54.665313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.654317Z","title":"Hierarchical video generation from or- thogonal information: Optical flow and texture","venue":null,"work_id":"0c45787f-f814-41e1-97d1-133ce759080d","year":null},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.190286Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:21f77adc9610dcdf41a6340ee7de4237966bdddebca3270d3737845325cb5af6","observation_id":"0f1ca2b5-66a2-4dd0-a93d-455a085ef14d","resolution":{"observed_at":"2026-08-05T20:46:54.657258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.646239Z","title":"Emergence of simple- cell receptive field properties by learning a sparse code for natural images","venue":null,"work_id":"d179e9d0-3a94-4410-b0f8-1b4e0cd3285c","year":1996},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.193350Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:36e457422a0c8ea8910ee8f7009d03a08574e55a805fdfd930df7a0b1fed89ae","observation_id":"68469150-5edd-4372-a1c5-0388dc21cf76","resolution":{"observed_at":"2026-08-05T20:46:54.649093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09748","last_updated":"2023-03-02T09:06:55Z","snapshot_observed_at":"2026-07-06T14:32:37.317828Z","submitted_at":"2022-12-19T18:59:58Z","title":"Scalable Diffusion Models with Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09748","snapshot_observed_at":"2026-08-05T20:46:54.195863Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.195863Z"},"links":{"cited_paper":"/paper/2212.09748","citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:db5772a2b991c33d00dd5b4ba2011dec04dff262cec521fabdc025b9db4bd83c","observation_id":"0571ae8f-d37b-403b-a99f-728c7a2248d3","resolution":{"observed_at":"2026-08-05T20:46:54.195863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.637046Z","title":"Tempo- ral generative adversarial nets with singular value clipping","venue":null,"work_id":"d075341f-ef9f-41ca-87cb-3fdc4a0f86ae","year":2017},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.198711Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:0e2f2e023f6bf77d7122e6c0ba7811043520bac41774c161db8d8a889c2d9578","observation_id":"3b9de7d9-9977-46b4-a1e0-316cab554298","resolution":{"observed_at":"2026-08-05T20:46:54.639938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.628289Z","title":"StyleGAN-T: Unlocking the power of GANs for fast large-scale text-to-image synthesis","venue":null,"work_id":"f223b6d0-1553-4ee6-81c8-92b7a9391dc0","year":2023},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.201291Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:8ea508d0431f918711aa37319ca24f0d291087a05401e16dc1f29c915e26c3ad","observation_id":"a7582b50-baee-4e8c-86b5-90f0f2faaa0d","resolution":{"observed_at":"2026-08-05T20:46:54.631246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.619452Z","title":"First order motion model for image animation","venue":null,"work_id":"c4bbe295-e27c-4db1-8ebc-62e2a41a39ea","year":2019},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.203931Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:18613473d5675a67837b4dc868a139786f17182d08b5d57a8d75c9c663235741","observation_id":"2d39c415-ffee-4791-8b9b-ebab1c565370","resolution":{"observed_at":"2026-08-05T20:46:54.622358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.610560Z","title":"Motion representations for ar- ticulated animation","venue":null,"work_id":"39d8991f-d465-4990-a15a-585f234f3018","year":2021},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.207064Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:1072791e4a1b956d5ea77cbb21b5cb1deefa4b1bdc4198a7beda2f9954bf8dff","observation_id":"40d1679e-ebd8-4f0b-9dcb-07b4df5ad13d","resolution":{"observed_at":"2026-08-05T20:46:54.613860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.602506Z","title":"Make-a-video: Text-to-video generation without text-video data","venue":null,"work_id":"1b841009-5f41-41a6-bc20-a79d5a50b8bd","year":2023},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.209654Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:5f0b78b86074d96d322efd249acf3e6a117187dd7329c08f9c3a6a993e1ba903","observation_id":"4942ae01-b218-454a-afee-c0344d009925","resolution":{"observed_at":"2026-08-05T20:46:54.605280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.593764Z","title":"Stylegan-v: A continuous video generator with the price, image quality and perks of stylegan2","venue":null,"work_id":"114e6ea1-9868-4169-8cbd-5adec75ecc66","year":2022},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.212606Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:3c78ea7040ef6830129d0378f3a77af3716cf8b390713d2ba437d63570597e00","observation_id":"004c71b5-2596-4a53-94bd-8cdadc2212e9","resolution":{"observed_at":"2026-08-05T20:46:54.597211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.215433Z","title":"Denois- ing diffusion implicit models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.215433Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:8e88030a4c1dc7033044566946c20212bfe0a1d3f176979b5c63e16ac79e88ab","observation_id":"838df8df-0572-484c-a9a2-7e07e8dc432d","resolution":{"observed_at":"2026-08-05T20:46:54.215433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.580826Z","title":"Blindly assess image qual- ity in the wild guided by a self-adaptive hyper network","venue":null,"work_id":"457d87b6-092a-4a77-aca2-1a0a94a0c818","year":2020},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.218029Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:84e0c950265e6422ca2a7d8b4c1e2e858d8f6180f7bb6cd039f764cf619d24da","observation_id":"410a1d7d-ff0e-4be3-b671-01823120efc7","resolution":{"observed_at":"2026-08-05T20:46:54.583602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.572697Z","title":"Metaxas, and Sergey Tulyakov","venue":null,"work_id":"427ffda2-12cb-446f-bdb5-09e30bcdd816","year":2021},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.220965Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:5c8e7bb085bb2ed40665e0c685e2fd32b858adf4f2a93a38d278e03930b1744d","observation_id":"75ee3ea5-0cc6-4c1b-ac0e-38a59efcbe8f","resolution":{"observed_at":"2026-08-05T20:46:54.575305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.565081Z","title":"MoCoGAN: Decomposing motion and content for video generation","venue":null,"work_id":"a9d78f2a-a300-4d31-a982-53c2d7510936","year":2018},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.223750Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:00441c42f196aeba27835298dee554a833f1971ede9710a89f4ef6618b61c345","observation_id":"332f6aba-1574-48c8-8824-1ea3231ac04f","resolution":{"observed_at":"2026-08-05T20:46:54.567859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.557384Z","title":"Generating videos with scene dynamics","venue":null,"work_id":"d660e27e-7c4e-4073-bbbf-d99ebdb90c08","year":2016},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.226525Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:2aa79556943b4df03a0fef2170db10a2cabf28f51a6ac997d1c177e2eb5c9db6","observation_id":"e0fa7279-db62-48c1-9c0e-c7875d8add60","resolution":{"observed_at":"2026-08-05T20:46:54.560052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.549051Z","title":"Mead: A large-scale audio-visual dataset for emotional talking-face generation","venue":null,"work_id":"f1329aa8-ae61-4df9-af60-f4e4070ba30d","year":2020},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.229283Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:f031c319fd830250fd25267b12266651d22bfc8c529c28faa01a48d6260d1d6a","observation_id":"e7616339-454c-4728-bf10-de2677ebd462","resolution":{"observed_at":"2026-08-05T20:46:54.551871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.540987Z","title":"Video-to- video synthesis","venue":null,"work_id":"88a4d81d-ab49-40cb-8e0b-d711288cf11a","year":2018},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.231644Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:546b9167682b276079a64f9c2f120b166ec8e8cb6e6f103357553f2a238e8cd2","observation_id":"f91b7d8d-ab3d-4688-be9e-e3ef56be82ae","resolution":{"observed_at":"2026-08-05T20:46:54.543586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.532714Z","title":"Few-shot video-to-video synthesis","venue":null,"work_id":"534f2aeb-3004-46a2-a779-54ec8dba0b6f","year":2019},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.234067Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:e2b554a391e688f8b061df86454ae4479b5d0a63fe720b302f8c1c49d35af2cb","observation_id":"cdd97b47-f28f-4c06-b116-db83cc37e1c9","resolution":{"observed_at":"2026-08-05T20:46:54.536085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.524927Z","title":"One-shot free-view neural talking-head synthesis for video conferenc- ing","venue":null,"work_id":"525a46e5-99a1-46c8-b8ea-650ff1bf75fc","year":2021},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.236482Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:bc065abdf19b63caa279f2632593db59167634ca958aa5f8a98415e4f35ac492","observation_id":"2def8e80-1540-43ce-ac67-47a20d6ab802","resolution":{"observed_at":"2026-08-05T20:46:54.527792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.517247Z","title":"Learning to Generate Human Videos","venue":null,"work_id":"cf9ba313-d749-4556-ae6a-ed24a6fc1479","year":2021},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.239133Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:8f843378aa626c27ff312f3f091c0053b76eab5d3824ca00010370c3437c59b9","observation_id":"f7c303cc-2024-4b97-bf57-cb1b3af2569a","resolution":{"observed_at":"2026-08-05T20:46:54.519831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.508720Z","title":"G3AN: Disentangling appearance and motion for video generation","venue":null,"work_id":"893dc54d-f24d-4d78-9df6-a89ba5f18979","year":2020},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.241371Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:26a337a7eca64e346d47bc60031cd6a072673aa1268175fe011542680a8b2eb0","observation_id":"e2fb5de9-0cf1-4f2f-97c8-d08fb0a71f96","resolution":{"observed_at":"2026-08-05T20:46:54.511771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.500499Z","title":"ImaGINator: Conditional Spatio-Temporal GAN for Video Generation","venue":null,"work_id":"878b426b-6ff9-4263-aaac-5f528ffbcd96","year":2020},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.243750Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:165dc081f0c640df055e1b125cf1314da45a738b7443a2f391f1b76a9ed5e817","observation_id":"09e25815-99be-457a-b0c6-8cb2532c55fd","resolution":{"observed_at":"2026-08-05T20:46:54.503746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.03049","last_updated":"2021-01-08T15:02:28Z","snapshot_observed_at":"2026-08-07T14:09:40.654122Z","submitted_at":"2021-01-08T15:02:28Z","title":"InMoDeGAN: Interpretable Motion Decomposition Generative Adversarial Network for Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.03049","snapshot_observed_at":"2026-08-05T20:46:54.246176Z","title":"Inmodegan: Interpretable motion decomposition generative adversarial network for video generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.246176Z"},"links":{"cited_paper":"/paper/2101.03049","citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:f27e02d46a9f00ad3b31796b5c508f15b8da520dfce0cdc2cac6da9915e88b33","observation_id":"cedc1872-957e-4dc7-8b0c-d8ff5a841e83","resolution":{"observed_at":"2026-08-05T20:46:54.246176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.492234Z","title":"Latent image animator: Learning to animate im- ages via latent space navigation","venue":null,"work_id":"08d898cd-c622-449a-94bf-2c744f48c16d","year":2022},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.248909Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:74dbf292895a7a8f2387dc3165f44cce60efef9b23b272a922031e83e465f3cd","observation_id":"d7df6231-b489-49e7-956b-ab3199c53ee4","resolution":{"observed_at":"2026-08-05T20:46:54.495037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15103","last_updated":"2023-09-27T03:51:52Z","snapshot_observed_at":"2026-07-06T16:23:57.143116Z","submitted_at":"2023-09-26T17:52:03Z","title":"LAVIE: High-Quality Video Generation with Cascaded Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15103","snapshot_observed_at":"2026-08-05T20:46:54.251157Z","title":"Lavie: High-quality video gener- ation with cascaded latent diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.251157Z"},"links":{"cited_paper":"/paper/2309.15103","citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:0faa8741ab549611c3f07df53b1bf5cb2fdaa93289754c80d70b5eb8034b02d2","observation_id":"538597d6-3c36-4ef4-9650-2901dd930386","resolution":{"observed_at":"2026-08-05T20:46:54.251157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.03989","last_updated":"2024-11-12T09:52:53Z","snapshot_observed_at":"2026-08-08T08:14:08.553905Z","submitted_at":"2023-05-06T09:29:12Z","title":"LEO: Generative Latent Image Animator for Human Video Synthesis","version":3},"cited_work":{"arxiv_id":"2305.03989","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.03989","snapshot_observed_at":"2026-08-05T20:46:54.318675Z","title":"LEO: Generative Latent Image Animator for Human Video Synthesis","venue":"cs.CV","work_id":"9182a058-2609-408c-acf3-d1da1ef18a4c","year":2023},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.253977Z"},"links":{"cited_paper":"/paper/2305.03989","citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:f79b32588ee3aefe1687d0d622c100098270c894b278f4cb3239357d5032837e","observation_id":"da2694ec-e1b2-45b4-9990-d595d2a247d5","resolution":{"observed_at":"2026-08-05T20:46:54.323903Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.484081Z","title":"Lia: Latent image animator","venue":null,"work_id":"d1ce93ab-0150-4316-bb2e-c9fdd53084c0","year":null},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.256663Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:8da82212988e5cb0647737760c77435c93761af9c282034df7000bde5c64fcc6","observation_id":"e3629ca6-69a9-452c-bcef-6d24af18f3da","resolution":{"observed_at":"2026-08-05T20:46:54.486832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.475575Z","title":"X-portrait: Expressive portrait anima- tion with hierarchical motion attention","venue":null,"work_id":"b35648d2-be7e-4c2c-b112-a8b2246d6982","year":2024},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.259162Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:b04034e1a9e9efff80dbca9e5fb4f283573fdb3b0e5900e21b7170b7249b7cfa","observation_id":"9499e5db-fff3-4e55-86e3-4b42615e212e","resolution":{"observed_at":"2026-08-05T20:46:54.478917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.467421Z","title":"Omniavatar: Geometry-guided controllable 3d head synthesis","venue":null,"work_id":"9e895c68-84ae-4e42-a079-86f8edd3ea9e","year":2023},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.261649Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:10d32814aa440afe7dfa5ed64de2985e766365faec17c5cb70cfb8e415e3103f","observation_id":"2442e814-c905-4f27-8770-79a805aae71f","resolution":{"observed_at":"2026-08-05T20:46:54.470448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10157","last_updated":"2021-09-14T21:20:06Z","snapshot_observed_at":"2026-07-06T11:02:11.424356Z","submitted_at":"2021-04-20T17:58:03Z","title":"VideoGPT: Video Generation using VQ-VAE and Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.10157","snapshot_observed_at":"2026-08-05T20:46:54.264040Z","title":"Videogpt: Video generation using vq-vae and trans- formers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.264040Z"},"links":{"cited_paper":"/paper/2104.10157","citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:0c9d1218fcbe233681cc323a1046f961b65d110c65057fe82e4473de86b10070","observation_id":"82cd1881-b648-450a-92d2-f980ba2f2982","resolution":{"observed_at":"2026-08-05T20:46:54.264040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.458586Z","title":"Transmomo: Invariance-driven unsupervised video motion retargeting","venue":null,"work_id":"8dde8bda-15dc-4ae9-9914-e72554cc7562","year":2020},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.266580Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:f52314fc50857215a5edd24a5382a56057e5e2b6ba166530501512a84ef17fb6","observation_id":"70b075d4-9154-4fda-9343-a24d3a38bf3f","resolution":{"observed_at":"2026-08-05T20:46:54.461700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.448054Z","title":"Generating videos with dynamics-aware implicit generative adversarial net- works","venue":null,"work_id":"70c4cd19-fa19-48a0-b312-88a57e8d4191","year":2022},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.269423Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:ade7598f954e4946f672698a3aa3fcb8f7d4236aa1e644d9e39374c93af3a648","observation_id":"1a0f97b1-69e3-486b-a2db-22d1517988f1","resolution":{"observed_at":"2026-08-05T20:46:54.451893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.437659Z","title":"Toontalker: Cross-domain face reenactment, 2023","venue":null,"work_id":"b10c6f71-79bd-4286-92aa-8a38b51750db","year":2023},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.271775Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:87136a9226399b0b97b121e8d5519fc1c3d0854402436688f228fe3df674aeb6","observation_id":"8f91d0f4-0eec-40a1-a3fa-32bd482f02c0","resolution":{"observed_at":"2026-08-05T20:46:54.440984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.426833Z","title":"Few-shot adversarial learning of realis- tic neural talking head models","venue":null,"work_id":"d4b5e8cb-c806-4fc1-8d82-c760428cc7fb","year":2019},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.274246Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:a75c22d6459542fef8ac483f54989e5eb46f394f3dc7cc0874b50bc981fafa2c","observation_id":"f80d463d-d8c1-4f50-b5a3-d2284d7fd9b9","resolution":{"observed_at":"2026-08-05T20:46:54.430498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.418121Z","title":"Show-1: Marrying pixel and latent diffusion models for text-to-video generation","venue":null,"work_id":"cdf2c7f9-40ed-4e79-a55f-f91ab5b1ef9e","year":2024},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.276818Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:0224a60feb208bc7f22ec0ac3b1ecfa0b0829189f874c5eed030a5c3c8347088","observation_id":"32124425-4c7f-4e6a-89e0-4f85c6d957c3","resolution":{"observed_at":"2026-08-05T20:46:54.421151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.409435Z","title":"Flow-guided one-shot talking face generation with a high- resolution audio-visual dataset","venue":null,"work_id":"bf34ab29-794f-4e17-ae0e-49a50d90482c","year":2021},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.279556Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:3c05d9303c11568e510a385f71b65ca42a4ca520a27e5c9d45f7ba63fa30a23a","observation_id":"ffb87620-4952-4d2c-b637-2027376d663a","resolution":{"observed_at":"2026-08-05T20:46:54.412250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.400954Z","title":"Thin-plate spline motion model for image animation","venue":null,"work_id":"4b66e004-bcfe-4e6c-8199-898a45bb51e7","year":2022},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.281971Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:7e862544684c0c23dcfddf995bc7ca2f3f31132a8542a8435547c4a8baee940c","observation_id":"a2675240-c3e1-45e5-af02-e0f62eef8f15","resolution":{"observed_at":"2026-08-05T20:46:54.403940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":1,"verified_fuzzy":45},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 3 inbound Pith citation observations for arXiv:2508.09959."}