{"as_of":"2026-08-22T00:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:eaeb205e3a99cb3133fe479266eb786e1b56a26c5cdd0b78b50695cc1c2e7e1d","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":45,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T10:28:21.096477Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T07:53:13.362380Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":"2409.02634","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-06-29T07:53:13.362380Z","title":"Loopy: Taming audio- driven portrait avatar with long-term motion dependency","venue":null,"work_id":"859b3e77-263d-470a-b684-a710acd16630","year":2024},"citing_paper":{"arxiv_id":"2411.09209","last_updated":"2026-04-16T07:45:17Z","snapshot_observed_at":"2026-08-15T03:57:26.784859Z","submitted_at":"2024-11-14T06:13:05Z","title":"JoyVASA: Portrait and Animal Image Animation with Diffusion-Based Audio-Driven Facial Dynamics and Head Motion Generation","version":5},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-23T16:59:57.727035Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2411.09209"},"observation_digest":"sha256:e042befe9446d64d2dee281468fcdb5be5df26d1cbe4efd714c6b7577d7dd229","observation_id":"81bf1d80-3a4d-45d6-a9a3-59376834d9ae","resolution":{"observed_at":"2026-05-23T17:03:12.612108Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-12T13:17:46.639196Z","title":"Loopy: Taming audio-driven portrait avatar with long-term motion dependency","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16331","last_updated":"2025-06-05T11:49:59Z","snapshot_observed_at":"2026-08-14T22:06:30.252612Z","submitted_at":"2024-11-25T12:24:52Z","title":"Sonic: Shifting Focus to Global Audio Perception in Portrait Animation","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T13:17:46.639196Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2411.16331"},"observation_digest":"sha256:572879b48970f37d2cd0e10b6bc0bfe1c0b3c3044c46790cac562f7c3e89d72c","observation_id":"349e693c-f17c-4d7b-8b62-b6021fafb75c","resolution":{"observed_at":"2026-08-12T13:17:46.639196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-12T05:06:43.812422Z","title":"Loopy: Taming audio-driven portrait avatar with long-term motion dependency","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00733","last_updated":"2025-03-13T08:23:27Z","snapshot_observed_at":"2026-08-18T10:30:20.725493Z","submitted_at":"2024-12-01T08:54:30Z","title":"Hallo3: Highly Dynamic and Realistic Portrait Image Animation with Video Diffusion Transformer","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T05:06:43.812422Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2412.00733"},"observation_digest":"sha256:f74968e58ad1e56dff4eb0e0583f9262e509708c70a960f41d51bceb23ad1c3d","observation_id":"c1820e2b-d724-4c08-88ff-6d956ab145d6","resolution":{"observed_at":"2026-08-12T05:06:43.812422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-11T21:28:25.720312Z","title":"Loopy: Taming audio-driven portrait avatar with long-term motion dependency","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04448","last_updated":"2024-12-05T18:57:26Z","snapshot_observed_at":"2026-08-17T10:09:04.714513Z","submitted_at":"2024-12-05T18:57:26Z","title":"MEMO: Memory-Guided Diffusion for Expressive Talking Video Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T21:28:25.720312Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2412.04448"},"observation_digest":"sha256:8d3629fe74d946a2aa3710a52b70568d8f85c310bb3ae52ac5aae4c0f7f9ab39","observation_id":"5a4ffecd-14d3-4733-91c0-e16db59c0a10","resolution":{"observed_at":"2026-08-11T21:28:25.720312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-11T06:04:29.423177Z","title":"Loopy: Taming audio-driven portrait avatar with long-term motion dependency","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16915","last_updated":"2025-04-04T06:07:56Z","snapshot_observed_at":"2026-08-13T21:37:31.598943Z","submitted_at":"2024-12-22T08:19:22Z","title":"FADA: Fast Diffusion Avatar Synthesis with Mixed-Supervised Multi-CFG Distillation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T06:04:29.423177Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2412.16915"},"observation_digest":"sha256:91ab25960bd224dcf6109a1891020079302d0720f36165ebef3af267e4acf1b7","observation_id":"1de6bf62-6e5b-4a89-9a7b-b249db10ab93","resolution":{"observed_at":"2026-08-11T06:04:29.423177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-10T22:23:14.829035Z","title":"Loopy: Taming audio-driven portrait avatar with long-term motion dependency","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01798","last_updated":"2025-01-03T13:14:52Z","snapshot_observed_at":"2026-08-18T10:26:38.678815Z","submitted_at":"2025-01-03T13:14:52Z","title":"JoyGen: Audio-Driven 3D Depth-Aware Talking-Face Video Editing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T22:23:14.829035Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2501.01798"},"observation_digest":"sha256:41997662a362b16bb949d8d35a35ae5c09ba8cbb630aa53c94426c631da9f637","observation_id":"de3c407e-f5f8-4344-a0b0-24342fa5d697","resolution":{"observed_at":"2026-08-10T22:23:14.829035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-10T22:23:50.550549Z","title":"Loopy: Taming audio-driven portrait avatar with long-term motion dependency","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01808","last_updated":"2025-01-09T02:45:43Z","snapshot_observed_at":"2026-08-18T10:24:14.556586Z","submitted_at":"2025-01-03T13:43:21Z","title":"MoEE: Mixture of Emotion Experts for Audio-Driven Portrait Animation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T22:23:50.550549Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2501.01808"},"observation_digest":"sha256:7fb0434bd9da2f51d94d150b9a038ee185ed2ccc599ce0c3113f098ac7eccd67","observation_id":"9daa186e-ac0b-43ca-b072-2c3af1aa899b","resolution":{"observed_at":"2026-08-10T22:23:50.550549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-10T20:25:06.012825Z","title":"Loopy: Taming audio-driven portrait avatar with long-term motion dependency","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08649","last_updated":"2025-01-15T08:24:35Z","snapshot_observed_at":"2026-08-18T10:26:05.917744Z","submitted_at":"2025-01-15T08:24:35Z","title":"Joint Learning of Depth and Appearance for Portrait Image Animation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:06.012825Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2501.08649"},"observation_digest":"sha256:b6148dadac72a3dc62506b588a52574044c9782e0d18da413cb6572e0b23e6ad","observation_id":"5b657e65-84c4-474d-b378-661ba28f7d5c","resolution":{"observed_at":"2026-08-10T20:25:06.012825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-10T19:07:45.056563Z","title":"Loopy: Taming audio-driven portrait avatar with long-term motion dependency, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10687","last_updated":"2025-01-18T07:51:29Z","snapshot_observed_at":"2026-08-21T19:00:26.945663Z","submitted_at":"2025-01-18T07:51:29Z","title":"EMO2: End-Effector Guided Audio-Driven Avatar Video Generation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-10T19:07:45.056563Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2501.10687"},"observation_digest":"sha256:da649f5f7bd5c2ae7625a4469ca91b1ff2abca4a00d97b97b8b367d3380d62d5","observation_id":"6506d9d8-ce50-460e-85ec-ad7e171e272d","resolution":{"observed_at":"2026-08-10T19:07:45.056563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-09T16:47:12.965433Z","title":"Loopy: Taming audio-driven portrait avatar with long-term motion dependency","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01061","last_updated":"2025-06-30T08:26:56Z","snapshot_observed_at":"2026-08-20T06:05:18.569195Z","submitted_at":"2025-02-03T05:17:32Z","title":"OmniHuman-1: Rethinking the Scaling-Up of One-Stage Conditioned Human Animation Models","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T16:47:12.965433Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2502.01061"},"observation_digest":"sha256:763c50823b140f863c2409704073200a43f83f1f80b92afaae405720a93b1508","observation_id":"67ab2d73-b1fe-4ae2-b20a-73f3601ea5b3","resolution":{"observed_at":"2026-08-09T16:47:12.965433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-07T21:11:25.297338Z","title":"Loopy: Taming audio-driven portrait avatar with long-term motion dependency","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-18T10:27:30.093404Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T21:11:25.297338Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2502.09533"},"observation_digest":"sha256:f399d0486a0ae8da8bea496514c91451b4624059fac85a00ffeaae54328d42c6","observation_id":"474d90ea-2f89-43c4-bdbc-6378b95be8b4","resolution":{"observed_at":"2026-08-07T21:11:25.297338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-16T10:28:21.096477Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18087","last_updated":"2025-08-06T03:43:07Z","snapshot_observed_at":"2026-08-20T02:18:16.596793Z","submitted_at":"2025-04-25T05:28:21Z","title":"Disentangle Identity, Cooperate Emotion: Correlation-Aware Emotional Talking Portrait Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T10:28:21.096477Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2504.18087"},"observation_digest":"sha256:98a4ba9240d6b8ca1e8281fc912df8169b4885fbaef277e6ea2090be70c37917","observation_id":"163754eb-11b5-4277-9ded-f4f142716046","resolution":{"observed_at":"2026-08-16T10:28:21.096477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-15T23:29:36.630489Z","title":"Jiang, C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.04512","last_updated":"2025-05-08T08:29:00Z","snapshot_observed_at":"2026-08-18T10:31:16.201312Z","submitted_at":"2025-05-07T15:33:18Z","title":"HunyuanCustom: A Multimodal-Driven Architecture for Customized Video Generation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T23:29:36.630489Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2505.04512"},"observation_digest":"sha256:b8ca91cbd25e381af4aee9385dc53d84d9a9fe2985b595c5958edd2e29afecba","observation_id":"a590e925-8974-451e-b620-dcdda94cb8e9","resolution":{"observed_at":"2026-08-15T23:29:36.630489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-07T14:02:27.924996Z","title":"Jiang, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20156","last_updated":"2025-06-03T15:15:31Z","snapshot_observed_at":"2026-08-19T03:06:29.083756Z","submitted_at":"2025-05-26T15:57:27Z","title":"HunyuanVideo-Avatar: High-Fidelity Audio-Driven Human Animation for Multiple Characters","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:02:27.924996Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2505.20156"},"observation_digest":"sha256:7959d1fd7beaf12f81dcd0286957db146762d2edc3b528801cf9644152e8acaa","observation_id":"75e72959-7ebf-4db8-90cb-21aa6a743f7f","resolution":{"observed_at":"2026-08-07T14:02:27.924996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-07T13:49:50.225081Z","title":"Loopy: Taming audio-driven portrait avatar with long-term motion dependency.arXiv preprint arXiv:2409.02634, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20861","last_updated":"2025-05-27T08:13:38Z","snapshot_observed_at":"2026-08-18T10:24:11.812141Z","submitted_at":"2025-05-27T08:13:38Z","title":"Exploring Timeline Control for Facial Motion Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:50.225081Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2505.20861"},"observation_digest":"sha256:3eba1bf413c1ecf74121634f3f04a2c035936f5aee2bc87fddb99d63be34b339","observation_id":"daea6143-b097-4dcd-9655-0baf2b2e4c00","resolution":{"observed_at":"2026-08-07T13:49:50.225081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":"2409.02634","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-06-29T07:53:13.362380Z","title":"Loopy: Taming audio- driven portrait avatar with long-term motion dependency","venue":null,"work_id":"859b3e77-263d-470a-b684-a710acd16630","year":2024},"citing_paper":{"arxiv_id":"2505.21996","last_updated":"2026-05-28T06:02:27Z","snapshot_observed_at":"2026-08-11T02:52:16.529454Z","submitted_at":"2025-05-28T05:55:44Z","title":"VRAG: Learning World Models for Interactive Video Generation","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-19T12:35:19.379364Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2505.21996"},"observation_digest":"sha256:21e1a97a220a6fb2f4c355253f671b2a445c70c3a18c51cf0972c89dcd4c0f20","observation_id":"04a4c4a9-8020-4cab-9b42-9dab13ddfd18","resolution":{"observed_at":"2026-05-19T12:37:17.475838Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-07T13:23:26.001907Z","title":"Limitations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21996","last_updated":"2026-05-28T06:02:27Z","snapshot_observed_at":"2026-08-11T02:52:16.529454Z","submitted_at":"2025-05-28T05:55:44Z","title":"VRAG: Learning World Models for Interactive Video Generation","version":4},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:26.001907Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2505.21996"},"observation_digest":"sha256:aaf9aeba7171f9f8c1ec8d6952a9d11f24fc0703a8f670e6140fed3d3d562764","observation_id":"9d5bf1bf-af64-474f-8a1d-5b56038acaad","resolution":{"observed_at":"2026-08-07T13:23:26.001907Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-07T13:07:31.988771Z","title":"Loopy: Taming audio-driven portrait avatar with long-term motion dependency.arXiv preprint arXiv:2409.02634, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22647","last_updated":"2025-05-28T17:57:06Z","snapshot_observed_at":"2026-08-07T20:49:17.257002Z","submitted_at":"2025-05-28T17:57:06Z","title":"Let Them Talk: Audio-Driven Multi-Person Conversational Video Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:07:31.988771Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2505.22647"},"observation_digest":"sha256:bf4c4f56d2ce8bd6b94ba74f9f10639276c7af6d5361402720b34a572c8d8ea9","observation_id":"54b61ee0-15ce-4696-8d2b-805a45979bb4","resolution":{"observed_at":"2026-08-07T13:07:31.988771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-07T12:48:33.623830Z","title":"Jiang, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23465","last_updated":"2025-05-29T14:16:27Z","snapshot_observed_at":"2026-08-14T01:35:59.912517Z","submitted_at":"2025-05-29T14:16:27Z","title":"Semantics-Aware Human Motion Generation from Audio Instructions","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:48:33.623830Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2505.23465"},"observation_digest":"sha256:841b007883460091a131a1bfa93c90165752765ddba7ca8b9118f47f25b267a7","observation_id":"80a0caee-1176-4f7a-9ba9-c988ee5e6f94","resolution":{"observed_at":"2026-08-07T12:48:33.623830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-07T12:01:06.223848Z","title":"Loopy: Taming audio-driven portrait avatar with long-term motion dependency.arXiv preprint arXiv:2409.02634, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00830","last_updated":"2025-06-01T04:27:13Z","snapshot_observed_at":"2026-08-15T11:14:14.860047Z","submitted_at":"2025-06-01T04:27:13Z","title":"SkyReels-Audio: Omni Audio-Conditioned Talking Portraits in Video Diffusion Transformers","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:06.223848Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2506.00830"},"observation_digest":"sha256:874b2d8cc0bb0258a07ff79034967c0b8a3fcb77446dbb4e6ff4f63db3517ff3","observation_id":"e5ab0ec4-5864-45ea-a4f2-1c29fda9eda8","resolution":{"observed_at":"2026-08-07T12:01:06.223848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-07T11:54:20.099641Z","title":"Young Adult Male Doing Handstand on the beach","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-17T04:56:26.147278Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:20.099641Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:9f5a2b0003f5392cc6973186fb2309ee223ee2d7b699b284211ee2cbfa5830e5","observation_id":"35d18506-4223-4ae8-bf53-66c4e275635a","resolution":{"observed_at":"2026-08-07T11:54:20.099641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-07T10:18:24.712720Z","title":"Loopy: Taming audio- driven portrait avatar with long-term motion dependency.arXiv preprint arXiv:2409.02634, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05806","last_updated":"2025-06-06T07:09:07Z","snapshot_observed_at":"2026-08-18T10:26:01.171354Z","submitted_at":"2025-06-06T07:09:07Z","title":"LLIA -- Enabling Low-Latency Interactive Avatars: Real-Time Audio-Driven Portrait Video Generation with Diffusion Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:24.712720Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2506.05806"},"observation_digest":"sha256:bc19ef9e90ee500cb96e75f7325a11ebdcf0df9a11a580493e154c87708bf1ae","observation_id":"33133a8a-1ce5-4dcc-8d69-a991d324d416","resolution":{"observed_at":"2026-08-07T10:18:24.712720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-15T18:47:48.952122Z","title":"Kingma, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18866","last_updated":"2025-06-23T17:33:03Z","snapshot_observed_at":"2026-08-20T08:51:50.797362Z","submitted_at":"2025-06-23T17:33:03Z","title":"OmniAvatar: Efficient Audio-Driven Avatar Video Generation with Adaptive Body Animation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:48.952122Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2506.18866"},"observation_digest":"sha256:c1f314211e1b23edf455a23f42870ee1cbfb93fe1bd98411403c80edef1f74bf","observation_id":"183fdf21-0fcd-4cb1-b79d-4df8631a2fac","resolution":{"observed_at":"2026-08-15T18:47:48.952122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-06T22:15:07.893234Z","title":"Loopy: Taming audio-driven portrait avatar with long-term motion dependency","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22065","last_updated":"2025-06-27T09:57:23Z","snapshot_observed_at":"2026-08-18T10:24:16.169385Z","submitted_at":"2025-06-27T09:57:23Z","title":"MirrorMe: Towards Realtime and High Fidelity Audio-Driven Halfbody Animation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T22:15:07.893234Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2506.22065"},"observation_digest":"sha256:b7db962e162f7d8aee462b68d693b08f275a0e5f9a42fe95cb3912c11ae70fce","observation_id":"6cca46f8-22f5-49c0-8595-7d013c542b4c","resolution":{"observed_at":"2026-08-06T22:15:07.893234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-06T21:19:13.373197Z","title":"Loopy: Taming audio-driven portrait avatar with long-term motion dependency","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00472","last_updated":"2025-07-01T06:38:14Z","snapshot_observed_at":"2026-08-13T00:10:14.450963Z","submitted_at":"2025-07-01T06:38:14Z","title":"ARIG: Autoregressive Interactive Head Generation for Real-time Conversations","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:13.373197Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2507.00472"},"observation_digest":"sha256:d2d2b308aae9d6ee42affd417596a0edb0a974b7acf38f2555f5fca23e7d5625","observation_id":"fe639de8-507f-4ec0-8dc1-5e8722177752","resolution":{"observed_at":"2026-08-06T21:19:13.373197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-06T20:58:25.497728Z","title":"Loopy: Taming audio-driven portrait avatar with long-term motion dependency","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01390","last_updated":"2025-07-02T06:10:52Z","snapshot_observed_at":"2026-08-14T07:12:00.142810Z","submitted_at":"2025-07-02T06:10:52Z","title":"FixTalk: Taming Identity Leakage for High-Quality Talking Head Generation in Extreme Cases","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T20:58:25.497728Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2507.01390"},"observation_digest":"sha256:2163c57e4e58388ce88003653753b0fc7334d53f559df8f0440091af237a5ac6","observation_id":"a8f7659b-237e-432f-b8f1-d8c16d291a53","resolution":{"observed_at":"2026-08-06T20:58:25.497728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-06T13:07:28.328153Z","title":"Jiang, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20987","last_updated":"2025-07-29T04:13:25Z","snapshot_observed_at":"2026-08-20T03:01:27.596912Z","submitted_at":"2025-07-28T16:47:44Z","title":"JWB-DH-V1: Benchmark for Joint Whole-Body Talking Avatar and Speech Generation Version 1","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T13:07:28.328153Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2507.20987"},"observation_digest":"sha256:4bbcfd7ee1358425eb486dbeae6fa470e8b577fc03aa12fbac59246fb74ec798","observation_id":"466c15f3-68e5-430a-a523-6f0b68f7208f","resolution":{"observed_at":"2026-08-06T13:07:28.328153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-06T04:46:04.100602Z","title":"Loopy: Taming audio-driven portrait avatar with long-term motion dependency","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.03050","last_updated":"2025-08-05T03:54:18Z","snapshot_observed_at":"2026-08-17T20:51:58.214103Z","submitted_at":"2025-08-05T03:54:18Z","title":"Multi-human Interactive Talking Dataset","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T04:46:04.100602Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2508.03050"},"observation_digest":"sha256:48aed8803ac57613eb7b55e3bc364711e42be8af175c5b995cd90d11acabe7db","observation_id":"12f37f79-c744-4589-aa63-959fc0534037","resolution":{"observed_at":"2026-08-06T04:46:04.100602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-15T17:42:41.170885Z","title":"Loopy: Taming audio-driven portrait avatar with long-term motion dependency","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08248","last_updated":"2025-08-11T17:58:24Z","snapshot_observed_at":"2026-08-18T02:40:00.948380Z","submitted_at":"2025-08-11T17:58:24Z","title":"StableAvatar: Infinite-Length Audio-Driven Avatar Video Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T17:42:41.170885Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2508.08248"},"observation_digest":"sha256:ba94f92ecbbcb76a3ce1b05dab25d3e11ec5c7ea05f3f98c85180951218fe6b7","observation_id":"d894506c-96fe-4f5a-8312-9ad9101195b8","resolution":{"observed_at":"2026-08-15T17:42:41.170885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-05T21:24:06.431313Z","title":"Loopy: Taming audio-driven portrait avatar with long-term motion dependency.arXiv preprint arXiv:2409.02634, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08891","last_updated":"2025-08-12T12:25:56Z","snapshot_observed_at":"2026-08-10T04:41:21.813549Z","submitted_at":"2025-08-12T12:25:56Z","title":"Preview WB-DH: Towards Whole Body Digital Human Bench for the Generation of Whole-body Talking Avatar Videos","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T21:24:06.431313Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2508.08891"},"observation_digest":"sha256:2141f2a43e45e64cd2776ce22e5a37813fce21fd59579f492c41d071438572d9","observation_id":"80926fae-08ce-4f87-9008-0757494756b5","resolution":{"observed_at":"2026-08-05T21:24:06.431313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-05T19:07:36.004678Z","title":"Loopy: Taming audio-driven portrait avatar with long-term motion depen- dency,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.13442","last_updated":"2025-08-19T01:55:25Z","snapshot_observed_at":"2026-08-18T01:56:32.902193Z","submitted_at":"2025-08-19T01:55:25Z","title":"EDTalk++: Full Disentanglement for Controllable Talking Head Synthesis","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T19:07:36.004678Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2508.13442"},"observation_digest":"sha256:38943a52e63c73adddad2e3de5269612052eff4ca2a249118976b661c01c9a6f","observation_id":"3266505e-8eb2-418e-945d-7f1cd0b85e64","resolution":{"observed_at":"2026-08-05T19:07:36.004678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-05T18:50:16.242885Z","title":"Loopy: Taming audio-driven portrait avatar with long-term motion dependency.arXiv preprint arXiv:2409.02634,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.14033","last_updated":"2025-08-19T17:55:23Z","snapshot_observed_at":"2026-08-18T04:45:00.241729Z","submitted_at":"2025-08-19T17:55:23Z","title":"InfiniteTalk: Audio-driven Video Generation for Sparse-Frame Video Dubbing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T18:50:16.242885Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2508.14033"},"observation_digest":"sha256:8e4eaf8220efc286f0231c2b84edc11def10397c8973901ec5a77b7c18c45ded","observation_id":"e8210801-9375-422e-81ab-622b02bb236d","resolution":{"observed_at":"2026-08-05T18:50:16.242885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-05T16:01:30.758960Z","title":"Loopy: Taming audio-driven portrait avatar with long-term motion dependency","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.19320","last_updated":"2025-08-28T09:15:43Z","snapshot_observed_at":"2026-08-18T00:00:45.235091Z","submitted_at":"2025-08-26T14:00:16Z","title":"MIDAS: Multimodal Interactive Digital-humAn Synthesis via Real-time Autoregressive Video Generation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T16:01:30.758960Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2508.19320"},"observation_digest":"sha256:1fbf38914eec1ef28de9338d840b1ae80dcc49b435c6ab816887fe15034cd815","observation_id":"87e2ecc3-0a5f-4fa9-ba94-ac0d8c4a75e5","resolution":{"observed_at":"2026-08-05T16:01:30.758960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-05T15:19:37.153799Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20210","last_updated":"2025-08-27T18:36:30Z","snapshot_observed_at":"2026-08-11T09:08:07.295323Z","submitted_at":"2025-08-27T18:36:30Z","title":"InfinityHuman: Towards Long-Term Audio-Driven Human","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:37.153799Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2508.20210"},"observation_digest":"sha256:b814f8b7165c1ad484bbd9eecb2412fad1dfb0d1c3b768acd27594b335d48dc8","observation_id":"146a4c50-26b6-4f83-a965-e321afbfb3c1","resolution":{"observed_at":"2026-08-05T15:19:37.153799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":"2409.02634","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-06-29T07:53:13.362380Z","title":"Loopy: Taming audio- driven portrait avatar with long-term motion dependency","venue":null,"work_id":"859b3e77-263d-470a-b684-a710acd16630","year":2024},"citing_paper":{"arxiv_id":"2509.12052","last_updated":"2026-04-20T18:20:15Z","snapshot_observed_at":"2026-08-13T00:57:42.458936Z","submitted_at":"2025-09-15T15:34:02Z","title":"FluentAvatar: Flicker-Free Talking-Head Animation via Phoneme-Guided Autoregressive Modeling","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-18T16:42:25.803856Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2509.12052"},"observation_digest":"sha256:f3215d2dcd48c3232a587d0b68c737205b005be6a0e07a8921dd0eebe89187d9","observation_id":"0a1d7632-f5a7-4544-b158-dc4d2df0b2af","resolution":{"observed_at":"2026-05-18T16:42:43.849913Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-03T16:30:34.578349Z","title":"Loopy: Taming audio-driven portrait avatar with long-term motion dependency.arXiv preprint arXiv:2409.02634, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.13247","last_updated":"2026-07-17T19:41:30Z","snapshot_observed_at":"2026-08-18T11:12:51.481768Z","submitted_at":"2025-12-15T11:59:01Z","title":"STARCaster: Spatio-Temporal AutoRegressive Video Diffusion for Identity- and View-Aware Talking Portraits","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T16:30:34.578349Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2512.13247"},"observation_digest":"sha256:d65f403b322d190be12c0e4cc684e3149b4f39c6fa87b5a5efb6f4d2a4374cf5","observation_id":"f7011014-8836-48d4-92f4-1778890ff7a3","resolution":{"observed_at":"2026-08-03T16:30:34.578349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":"2409.02634","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-06-29T07:53:13.362380Z","title":"Loopy: Taming audio- driven portrait avatar with long-term motion dependency","venue":null,"work_id":"859b3e77-263d-470a-b684-a710acd16630","year":2024},"citing_paper":{"arxiv_id":"2512.14234","last_updated":"2026-04-14T19:54:15Z","snapshot_observed_at":"2026-08-11T06:36:50.773707Z","submitted_at":"2025-12-16T09:41:21Z","title":"ViBES: A Conversational Agent with Behaviorally-Intelligent 3D Virtual Body","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-16T22:04:07.403410Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2512.14234"},"observation_digest":"sha256:33d4a063e5cebe5eb20afbe46e50ed7101b6a9c96ae74c4f9770dd472ccaef79","observation_id":"a18efe7e-f724-4d94-8072-c232887cc28d","resolution":{"observed_at":"2026-05-16T22:08:36.192129Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-03T13:04:39.020688Z","title":"Loopy: Taming audio-driven portrait avatar with long-term motion dependency.arXiv preprint arXiv:2409.02634, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.00664","last_updated":"2026-05-30T08:41:30Z","snapshot_observed_at":"2026-08-16T11:13:21.639093Z","submitted_at":"2026-01-02T11:58:48Z","title":"Avatar Forcing: Real-Time Interactive Head Avatar Generation for Natural Conversation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T13:04:39.020688Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2601.00664"},"observation_digest":"sha256:98f3443d084baf87a1d95c22ca3a52e71725f27b6409fdfe41b5e00cafdf254b","observation_id":"bf9adfa4-31d8-4c62-a2bb-7e60ef8249ef","resolution":{"observed_at":"2026-08-03T13:04:39.020688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":"2409.02634","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-06-29T07:53:13.362380Z","title":"Loopy: Taming audio- driven portrait avatar with long-term motion dependency","venue":null,"work_id":"859b3e77-263d-470a-b684-a710acd16630","year":2024},"citing_paper":{"arxiv_id":"2604.08405","last_updated":"2026-07-30T09:16:54Z","snapshot_observed_at":"2026-08-15T03:54:46.243030Z","submitted_at":"2026-04-09T16:03:24Z","title":"SyncBreaker:Stage-Aware Multimodal Adversarial Attacks on Audio-Driven Talking Head Generation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-10T17:30:36.462567Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2604.08405"},"observation_digest":"sha256:6074bd11e196ea3ae0bb593320466a841ed37d79077fdb2990641949894e39f6","observation_id":"d7b9ac8b-1308-4b8d-83b4-956722220c35","resolution":{"observed_at":"2026-05-11T06:41:26.229243Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-02T16:38:16.164538Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.08405","last_updated":"2026-07-30T09:16:54Z","snapshot_observed_at":"2026-08-15T03:54:46.243030Z","submitted_at":"2026-04-09T16:03:24Z","title":"SyncBreaker:Stage-Aware Multimodal Adversarial Attacks on Audio-Driven Talking Head Generation","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T16:38:16.164538Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2604.08405"},"observation_digest":"sha256:4fc94c753bfd0452f2fedc0834a3c170966577e50c1b40f363271df059e74008","observation_id":"e3935a70-66bd-4e2a-be93-b594ff68fcf2","resolution":{"observed_at":"2026-08-02T16:38:16.164538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":"2409.02634","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-06-29T07:53:13.362380Z","title":"Loopy: Taming audio- driven portrait avatar with long-term motion dependency","venue":null,"work_id":"859b3e77-263d-470a-b684-a710acd16630","year":2024},"citing_paper":{"arxiv_id":"2604.11804","last_updated":"2026-04-17T08:08:09Z","snapshot_observed_at":"2026-08-06T16:53:42.723002Z","submitted_at":"2026-04-13T17:59:12Z","title":"OmniShow: Unifying Multimodal Conditions for Human-Object Interaction Video Generation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-10T15:09:02.727887Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2604.11804"},"observation_digest":"sha256:1a159be51f8288aaba6358a1ce4bbd435f9a24980b4c862d380fca3bea31499b","observation_id":"bd328091-e011-475a-81cf-d0acb6ef7d7f","resolution":{"observed_at":"2026-05-11T11:11:00.798707Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":"2409.02634","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-06-29T07:53:13.362380Z","title":"Loopy: Taming audio- driven portrait avatar with long-term motion dependency","venue":null,"work_id":"859b3e77-263d-470a-b684-a710acd16630","year":2024},"citing_paper":{"arxiv_id":"2605.02948","last_updated":"2026-05-11T03:04:55Z","snapshot_observed_at":"2026-08-21T17:16:36.989160Z","submitted_at":"2026-05-01T16:38:06Z","title":"AsymTalker: Identity-Consistent Long-Term Talking Head Generation via Asymmetric Distillation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-11T02:18:58.996355Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2605.02948"},"observation_digest":"sha256:6ab905a37cbaa4c462fd96e4feab281bda60777db618489ac76444dc18ef6184","observation_id":"fca01442-f7be-43d5-a571-76c5034eff7e","resolution":{"observed_at":"2026-05-11T03:45:57.587776Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":"2409.02634","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-06-29T07:53:13.362380Z","title":"Loopy: Taming audio- driven portrait avatar with long-term motion dependency","venue":null,"work_id":"859b3e77-263d-470a-b684-a710acd16630","year":2024},"citing_paper":{"arxiv_id":"2605.07478","last_updated":"2026-05-08T09:23:29Z","snapshot_observed_at":"2026-07-06T23:19:51.414344Z","submitted_at":"2026-05-08T09:23:29Z","title":"AudioFace: Language-Assisted Speech-Driven Facial Animation with Multimodal Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-11T01:51:29.385520Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2605.07478"},"observation_digest":"sha256:0d7e3333a86fb7ce4a4327151a5472cba73081d89bc7da750a5b688ecbb0b633","observation_id":"ea4b9af2-3aa3-45c9-a132-374eb18ec084","resolution":{"observed_at":"2026-05-11T04:20:55.250702Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":"2409.02634","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-06-29T07:53:13.362380Z","title":"Loopy: Taming audio- driven portrait avatar with long-term motion dependency","venue":null,"work_id":"859b3e77-263d-470a-b684-a710acd16630","year":2024},"citing_paper":{"arxiv_id":"2605.30230","last_updated":"2026-05-28T17:00:37Z","snapshot_observed_at":"2026-08-13T14:29:23.594750Z","submitted_at":"2026-05-28T17:00:37Z","title":"IP-Adapter Is All You Need: Towards Fine-Tuning-Free Diffusion-Based Talking Face Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-29T07:50:56.947671Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2605.30230"},"observation_digest":"sha256:3be2dcf12cc8b1d5a687e1f9d9645ea2485cf479a42939aa29ff8215b6b52777","observation_id":"c65b835d-a955-46ef-ab41-04cc87cc4e8a","resolution":{"observed_at":"2026-06-29T07:53:13.364202Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-06T18:10:19.891192Z","title":"arXiv preprint arXiv:2409.02634 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04722","last_updated":"2026-08-05T11:43:21Z","snapshot_observed_at":"2026-08-18T15:02:01.785358Z","submitted_at":"2026-08-05T11:43:21Z","title":"Multi-View Face and Gesture Animation with Dynamic Gaussians","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-06T18:10:19.891192Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2608.04722"},"observation_digest":"sha256:5747b3a7957726c84993d78c6ccfc348d216642ecfb6df034aec191d838d8218","observation_id":"1c5387fc-5e19-4a2a-a99f-d0651f23f26d","resolution":{"observed_at":"2026-08-06T18:10:19.891192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2409.02634/citation-record","integrity":"/paper/2409.02634/integrity","json":"/paper/2409.02634/citation-record.json","paper":"/paper/2409.02634"},"outbound":[],"paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T16:32:16.739621Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 45 inbound Pith citation observations for arXiv:2409.02634."}