{"as_of":"2026-08-18T07:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9c9a9419cea75597673d9c1e9c5cace8b5b08d6665fe6cbde74651b604380387","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:21:12.348163Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.12107/citation-record","integrity":"/paper/2608.12107/integrity","json":"/paper/2608.12107/citation-record.json","paper":"/paper/2608.12107"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.794773Z","title":"Sadtalker: Learningrealistic3dmotioncoefficientsforstylizedaudio-drivensingleimagetalkingfaceanimation","venue":null,"work_id":"ed05aec4-0060-423f-9ab3-6c15dd218254","year":2023},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.030393Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:3a37c97c300138b500f77283d9d59ed3820b6fa41e3f576b828635a5c31ec9e9","observation_id":"90cd8ea8-3005-468f-8ca2-699e73b4fdea","resolution":{"observed_at":"2026-08-16T00:21:13.799437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.780102Z","title":"Latentsync: Audio conditioned latent diffusion models for lip sync.arXiv e-prints, pages arXiv–2412, 2024","venue":null,"work_id":"f4727312-a674-4bcc-815e-532ea1e9b283","year":2024},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.036059Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:b093068fb65dc62359ab8ead40ea15eccd492b7902c35d6c9e3d40eb3beba2da","observation_id":"618a305f-6689-4f40-b2a8-f058bc22732b","resolution":{"observed_at":"2026-08-16T00:21:13.784914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17485","last_updated":"2024-08-08T03:48:38Z","snapshot_observed_at":"2026-08-16T14:14:55.263652Z","submitted_at":"2024-02-27T13:10:11Z","title":"EMO: Emote Portrait Alive -- Generating Expressive Portrait Videos with Audio2Video Diffusion Model under Weak Conditions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17485","snapshot_observed_at":"2026-08-16T00:21:12.041570Z","title":"Emo: Emote portrait alive: Generating expressive portrait videos with audio2video diffusion model under weak conditions.arXiv preprint arXiv:2402.17485, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.041570Z"},"links":{"cited_paper":"/paper/2402.17485","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:ad026aef30c4a0671f4f2dca7ff8b1c623342abbda883e7b0d8a2d134deaeb0f","observation_id":"7b6f2e13-f60a-4832-ad28-9fd1b8622004","resolution":{"observed_at":"2026-08-16T00:21:12.041570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14148","last_updated":"2026-04-15T17:59:40Z","snapshot_observed_at":"2026-08-16T18:58:56.056540Z","submitted_at":"2026-04-15T17:59:40Z","title":"Seedance 2.0: Advancing Video Generation for World Complexity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.14148","snapshot_observed_at":"2026-08-16T00:21:12.047702Z","title":"Seedance 2.0: Advancing video generation for world complexity.arXiv preprint arXiv:2604.14148, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.047702Z"},"links":{"cited_paper":"/paper/2604.14148","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:9a2368739841793f741c31433c83ec8f748de45a9a0ab64c80b129732a6e8196","observation_id":"fdad2762-73a8-4444-9ded-843be592acdb","resolution":{"observed_at":"2026-08-16T00:21:12.047702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-08-12T22:34:51.361078Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-16T00:21:12.055000Z","title":"Wan: Openandadvancedlarge-scalevideogenerativemodels.arXivpreprintarXiv:2503.20314, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.055000Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:4ab14e3a450ba196401c259d95c3701223366a1fc879511c0de2955b19274150","observation_id":"f26f6fed-c8e4-43e0-8430-9837f46bb40a","resolution":{"observed_at":"2026-08-16T00:21:12.055000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.03233","last_updated":"2026-01-06T18:24:41Z","snapshot_observed_at":"2026-08-13T15:06:04.699163Z","submitted_at":"2026-01-06T18:24:41Z","title":"LTX-2: Efficient Joint Audio-Visual Foundation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.03233","snapshot_observed_at":"2026-08-16T00:21:12.066046Z","title":"Ltx-2: Efficient joint audio-visual foundation model","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.066046Z"},"links":{"cited_paper":"/paper/2601.03233","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:c016919969d9b986dc0481d4df292441e6e6ed1c809386eaf611e0ba47ab17cc","observation_id":"ecf31078-0af0-41eb-9bcb-f416835758ec","resolution":{"observed_at":"2026-08-16T00:21:12.066046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:12.073048Z","title":"Many-for-many: Unify the training of multiple video and image generation and manipulation tasks.arXiv preprint arXiv:2506.01758, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.073048Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:f1a2638812ebab8aad844bc2645222af3609c8f1d3976bcdeab074a037b755ef","observation_id":"f9f675ff-4c71-42f0-952e-4d99f4517a21","resolution":{"observed_at":"2026-08-16T00:21:12.073048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:12.079436Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.079436Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:52c27f827674346099a260387e1fdb15ba38205d379680a3646e49d97a5802de","observation_id":"d62fafee-c74f-4e7f-80f3-9e3c92e771b9","resolution":{"observed_at":"2026-08-16T00:21:12.079436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:12.084992Z","title":"Arig: Autoregressive interactive head generation for real-time conversations","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.084992Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:93bace653dc5b18d8c38b2094ac80b8a78d797bb5396f3e675dffc380adcbd27","observation_id":"e62645fd-4876-41a8-a455-9d0ddbc6c3eb","resolution":{"observed_at":"2026-08-16T00:21:12.084992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.754828Z","title":"Ditto: Motion-space diffusion for controllable realtime talking head synthesis","venue":null,"work_id":"3653f00e-ca60-4640-a27c-25ec30386fc5","year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.090273Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:8fb9d736cecd5d46694d50a1510514bb833b372e920170587c944cde9812fd8e","observation_id":"39bc82e2-0472-416d-8b3f-9ad5572fa5b4","resolution":{"observed_at":"2026-08-16T00:21:13.759589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03099","last_updated":"2025-06-03T17:29:28Z","snapshot_observed_at":"2026-08-15T10:07:20.642503Z","submitted_at":"2025-06-03T17:29:28Z","title":"TalkingMachines: Real-Time Audio-Driven FaceTime-Style Video via Autoregressive Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.03099","snapshot_observed_at":"2026-08-16T00:21:12.095443Z","title":"Talkingmachines: Real-time audio-driven facetime-style video via autoregressive diffusion models.arXiv preprint arXiv:2506.03099, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.095443Z"},"links":{"cited_paper":"/paper/2506.03099","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:217d58f6514662ad103d3f454edd54c4a4dda3a50a18b0feb69c6d188a709cf6","observation_id":"8eb8e918-304f-4e40-8570-7394b01ae850","resolution":{"observed_at":"2026-08-16T00:21:12.095443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:12.100874Z","title":"Avatarforcing: One-step streaming talking avatars via local-future sliding-window denoising.arXiv preprint arXiv:2603.14331, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.100874Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:91150cbc2d5c480208ffddf23a379d170952439dc6ab958b93d9dc0a98630ea8","observation_id":"ad22e35a-f5ce-4676-acb2-d0bfa848c2fe","resolution":{"observed_at":"2026-08-16T00:21:12.100874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:12.105881Z","title":"From slow bidirectional to fast autoregressive video diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.105881Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:82ceeb06af7eee7490106ff5794e9d8e491631d1a63a37e9def151e52b7ecd2a","observation_id":"e30ab339-5b55-4a96-b8c5-5d40fa2a9c79","resolution":{"observed_at":"2026-08-16T00:21:12.105881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:12.110194Z","title":"Self forcing: Bridging the train-test gap in autoregressive video diffusion.Advances in Neural Information Processing Systems, 38:167283–167308, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.110194Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:3e9a58a8a9c98c848ae146bea090c72ec6cbb4df99b5ea7c0ed8185a489eb18d","observation_id":"764de3f2-471f-4c22-9da4-40c1d0adeb9d","resolution":{"observed_at":"2026-08-16T00:21:12.110194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:12.114842Z","title":"Streamavatar: Streaming diffusion models for real-time interactive human avatars.arXiv preprint arXiv:2512.22065, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.114842Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:f89eab0623a7e647a0fc24705ecab201a3982e9545267e0aedc5828e665e6d14","observation_id":"6fd224b0-3a27-4159-8068-740421c39671","resolution":{"observed_at":"2026-08-16T00:21:12.114842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.22622","last_updated":"2025-10-13T22:41:26Z","snapshot_observed_at":"2026-07-06T22:30:55.313733Z","submitted_at":"2025-09-26T17:48:24Z","title":"LongLive: Real-time Interactive Long Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.22622","snapshot_observed_at":"2026-08-16T00:21:12.119524Z","title":"Longlive: Real-time interactive long video generation.arXiv preprint arXiv:2509.22622, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.119524Z"},"links":{"cited_paper":"/paper/2509.22622","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:d38f49ecf73a4a6a77428de65be339adc4e8ca3f6b77697828044393787afd8c","observation_id":"b7c9e462-2470-45e9-a20f-dbe923b636a2","resolution":{"observed_at":"2026-08-16T00:21:12.119524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.714195Z","title":"Reward forcing: Efficient streaming video generation with rewarded distribution matching distillation","venue":null,"work_id":"67ff0ed4-e0cf-46f8-9b22-74dcc77ddb7e","year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.124098Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:c9072bfc2b0d83bb68e7e51af67f9c424564cf1ecef9b67bacb80f5fff690d8e","observation_id":"1aee4f68-01ae-4eca-ad98-b265ed3bc14e","resolution":{"observed_at":"2026-08-16T00:21:13.724164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:12.129120Z","title":"Stable video infinity: Infinite-length video generation with error recycling.arXiv preprint arXiv:2510.09212, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.129120Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:be34db4c0a9fc9d6b522ef1d2c49c5872bc9bec9219b17a8a701a18e4054f9d0","observation_id":"dc812a9b-08cc-46af-ad35-c90d6ad53e44","resolution":{"observed_at":"2026-08-16T00:21:12.129120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.02214","last_updated":"2026-06-01T14:32:37Z","snapshot_observed_at":"2026-08-17T22:01:08.736822Z","submitted_at":"2026-02-02T15:19:22Z","title":"Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.02214","snapshot_observed_at":"2026-08-16T00:21:12.133863Z","title":"Causal forcing: Autoregressive diffu- sion distillation done right for high-quality real-time interactive video generation.arXiv preprint arXiv:2602.02214, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.133863Z"},"links":{"cited_paper":"/paper/2602.02214","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:6e537557d41d5af75d68adb32db72af98aeb14ebd7f66ae7228c6f1e2f405864","observation_id":"c5036238-6655-409f-b957-2a8aac9fe464","resolution":{"observed_at":"2026-08-16T00:21:12.133863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.697986Z","title":"Infinity-rope: Action-controllable infinite video generation emerges from autoregressive self-rollout","venue":null,"work_id":"3432e06f-08c3-4ecd-b6d4-878f30ef6893","year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.139765Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:e09c3dd381a865f90741b4f8656c7eb830b52f0cd76bebaa56f59eade7e29546","observation_id":"d42b35fc-e772-4623-acb2-cb93084164b8","resolution":{"observed_at":"2026-08-16T00:21:13.703045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:12.144832Z","title":"Helios: Real real-time long video generation model.arXiv preprint arXiv:2603.04379, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.144832Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:5891becb47b315ba6a1e3f3fc9a2b2ac8c68eaef1f4294c780fa8f15ab4bc4e3","observation_id":"20bf3793-c4c4-4892-af18-b210139c2f30","resolution":{"observed_at":"2026-08-16T00:21:12.144832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18739","last_updated":"2026-05-19T17:46:12Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:57:03Z","title":"LongLive-2.0: An NVFP4 Parallel Infrastructure for Long Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.18739","snapshot_observed_at":"2026-08-16T00:21:12.149933Z","title":"Longlive-2.0: An nvfp4 parallel infrastructure for long video generation.arXiv preprint arXiv:2605.18739, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.149933Z"},"links":{"cited_paper":"/paper/2605.18739","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:0f655df275b9b1d17b9e8150f05586f780b010ca2447e6c1a934585ce643b7b8","observation_id":"e9eff270-f3c1-47d5-ac4f-304309c95a4a","resolution":{"observed_at":"2026-08-16T00:21:12.149933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.07823","last_updated":"2026-04-14T22:09:01Z","snapshot_observed_at":"2026-08-12T18:55:29.657974Z","submitted_at":"2026-04-09T05:26:09Z","title":"LPM 1.0: Video-based Character Performance Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.07823","snapshot_observed_at":"2026-08-16T00:21:12.155161Z","title":"Lpm 1.0: Video-based character performance model.arXiv preprint arXiv:2604.07823, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.155161Z"},"links":{"cited_paper":"/paper/2604.07823","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:b1fff09f8c9533d543d00b6c6d5e94dc3a4b04b504bd906f8fc7ca0d6898c57c","observation_id":"f36093aa-6eb9-4129-a7a4-3c65de403f76","resolution":{"observed_at":"2026-08-16T00:21:12.155161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:12.160212Z","title":"Soulx-flashtalk: Real-time infinite streaming of audio-driven avatars via self-correcting bidirectional distillation.arXiv preprint arXiv:2512.23379, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.160212Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:d9eff938aa68cd66cbf53cb6206ac5c2a2eb57728c5a0a0d9545c68e740be606","observation_id":"9e44b0d0-da37-4eee-b5c2-b1d572d05ea7","resolution":{"observed_at":"2026-08-16T00:21:12.160212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.02283","last_updated":"2025-10-02T17:55:42Z","snapshot_observed_at":"2026-08-13T04:00:21.942422Z","submitted_at":"2025-10-02T17:55:42Z","title":"Self-Forcing++: Towards Minute-Scale High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.02283","snapshot_observed_at":"2026-08-16T00:21:12.164936Z","title":"Self-forcing++: Towards minute-scale high-quality video generation.arXiv preprint arXiv:2510.02283, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.164936Z"},"links":{"cited_paper":"/paper/2510.02283","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:ff20a72dc02cf5843040c067a3e712ab06219a74d19ca4a56b086a030e189425","observation_id":"96efb50d-98b5-4749-b213-c292a111abba","resolution":{"observed_at":"2026-08-16T00:21:12.164936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14033","last_updated":"2025-08-19T17:55:23Z","snapshot_observed_at":"2026-08-18T04:45:00.241729Z","submitted_at":"2025-08-19T17:55:23Z","title":"InfiniteTalk: Audio-driven Video Generation for Sparse-Frame Video Dubbing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.14033","snapshot_observed_at":"2026-08-16T00:21:12.170183Z","title":"Infinitetalk: Audio-driven video generation for sparse-frame video dubbing.arXiv preprint arXiv:2508.14033, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.170183Z"},"links":{"cited_paper":"/paper/2508.14033","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:82724ba8e36a3a49591cbcb08faa2272d2d6866773fbdd00ace7563a778af007","observation_id":"7f8f4b10-de11-45d0-8722-507d9acc7dfd","resolution":{"observed_at":"2026-08-16T00:21:12.170183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.04677","last_updated":"2026-07-31T10:43:50Z","snapshot_observed_at":"2026-08-13T11:03:16.956715Z","submitted_at":"2025-12-04T11:11:24Z","title":"Live Avatar: Streaming Real-time Audio-Driven Avatar Generation with Infinite Length","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.04677","snapshot_observed_at":"2026-08-16T00:21:12.175287Z","title":"Live avatar: Streaming real-time audio-driven avatar generation with infinite length.arXiv preprint arXiv:2512.04677, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.175287Z"},"links":{"cited_paper":"/paper/2512.04677","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:18403e0d7fdd3a1e27e589d675457c1bd0a4b140c82b0a79109ed8ed3dc39e8c","observation_id":"86f23342-35e0-4206-9ea2-62d1a78b32b6","resolution":{"observed_at":"2026-08-16T00:21:12.175287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.682201Z","title":"Style transfer for 2d talking head generation","venue":null,"work_id":"9a28277f-d52c-4fc9-bcbf-c82eaa3aed98","year":2024},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.180388Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:47a24892a3cedd40bec327a085c35de2f01d87ec185baeccd6b697414f952bbe","observation_id":"a7c37c01-35c7-4189-aa1d-9d0e8f35c80a","resolution":{"observed_at":"2026-08-16T00:21:13.687449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.666922Z","title":"Disentangledandcontrollablefaceimagegeneration via 3d imitative-contrastive learning","venue":null,"work_id":"112dad55-f272-411d-8c93-bdc960ca3ac2","year":2020},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.184975Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:b8147936218061e625bcdb25ab4843963f8e3bd9d2c8863e4c5acf1dedbc3333","observation_id":"20795f95-83ad-41ad-8dfd-a348fa910f9b","resolution":{"observed_at":"2026-08-16T00:21:13.671952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:12.189441Z","title":"Capture, learning, and synthesis of 3d speaking styles","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.189441Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:a818caaa327b2629e6360b19ad3d5230a68e97c2cc9cff61c396c72fb5d88424","observation_id":"1e4d0bfc-b0b0-4729-a4e7-86fac01d7642","resolution":{"observed_at":"2026-08-16T00:21:12.189441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.639221Z","title":"A lip sync expert is all you need for speech to lip generation in the wild","venue":null,"work_id":"ccb239a0-96e8-4c4d-b3ab-223a05bfc122","year":2020},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.194118Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:fa1d308985af236658297503e1130daeac5e6b15d2092778b5c77380b681acf6","observation_id":"d2aaee70-5473-4139-8e8e-682d813f32b4","resolution":{"observed_at":"2026-08-16T00:21:13.645011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.621724Z","title":"Dreamavatar: Text-and-shape guided 3d human avatar generation via diffusion models","venue":null,"work_id":"4a397f7a-d6e8-4c52-8f9f-ba4ebd78a524","year":2024},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.198723Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:acd21c00a0efa3fdb03dce57de87b22caf72e0a0486b907ccd801b64419f101d","observation_id":"eb470aa7-d2f7-468e-8299-0bd0f347a809","resolution":{"observed_at":"2026-08-16T00:21:13.627224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.605415Z","title":"Latentavatar: Learninglatentexpressioncodeforexpressiveneuralheadavatar","venue":null,"work_id":"d1dde2b2-471f-408d-b691-c444b9f09f3a","year":2023},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.203513Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:3d4b63bc0a07c47a6c8b1448543cdf633c29a5b7f57e58ff8c48523604e28a09","observation_id":"1b572d5c-2d21-4821-ba3f-d7cd1d486aca","resolution":{"observed_at":"2026-08-16T00:21:13.610490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.588387Z","title":"Denoisingdiffusionprobabilisticmodels.Advancesinneuralinformation processing systems, 33:6840–6851, 2020","venue":null,"work_id":"827e64b7-4519-4109-8aca-03f06c9d36fe","year":2020},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.208581Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:6740f6dec71e6c5f80b9394bdd09a0e6f66046364c331d7c19663aa96dcc27cb","observation_id":"1f82974d-2bf1-4f9f-b5f5-360f2038fcbd","resolution":{"observed_at":"2026-08-16T00:21:13.593784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-16T02:30:42.660030Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-16T00:21:12.213693Z","title":"Flow matching for generative modeling.arXiv preprint arXiv:2210.02747, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.213693Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:8d6b0c513ba3fde53698393486ed482ad7f3b97605483b6b1d677d978b222030","observation_id":"0c0782c3-3df7-413e-8ce3-2a88e6fdced6","resolution":{"observed_at":"2026-08-16T00:21:12.213693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:12.218419Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.218419Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:49e204c16d3f475e8eb2ccd0d7f4c7082dfa1b5620876b867964fb52b5097ce8","observation_id":"5138590f-5e18-45a2-a2dc-a08aebe60401","resolution":{"observed_at":"2026-08-16T00:21:12.218419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.562300Z","title":"Difftalk: Crafting diffusion models for generalized audio-driven portraits animation","venue":null,"work_id":"1d8d00ce-74e9-4d5d-9fc9-6d1e62d4f8c1","year":1982},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.222740Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:247fd19d1f6937c8d8aa9fd378b1f589d555fb5eda2134e061b6c6b60c67f710","observation_id":"8fd17803-5805-4049-bec2-d69e2882cad5","resolution":{"observed_at":"2026-08-16T00:21:13.567513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08801","last_updated":"2024-06-16T07:10:41Z","snapshot_observed_at":"2026-08-16T13:43:29.827089Z","submitted_at":"2024-06-13T04:33:20Z","title":"Hallo: Hierarchical Audio-Driven Visual Synthesis for Portrait Image Animation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08801","snapshot_observed_at":"2026-08-16T00:21:12.227373Z","title":"Hallo: Hierarchical audio-driven visual synthesis for portrait image animation.arXiv preprint arXiv:2406.08801, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.227373Z"},"links":{"cited_paper":"/paper/2406.08801","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:916a43e06059fd970b884b00dda11a9a428b662f0bc49b491cd6c0f57a90ec98","observation_id":"17c45409-c629-412d-be9b-6d1f7be09bc5","resolution":{"observed_at":"2026-08-16T00:21:12.227373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17694","last_updated":"2024-03-26T13:35:02Z","snapshot_observed_at":"2026-08-16T14:06:16.545839Z","submitted_at":"2024-03-26T13:35:02Z","title":"AniPortrait: Audio-Driven Synthesis of Photorealistic Portrait Animation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17694","snapshot_observed_at":"2026-08-16T00:21:12.231872Z","title":"Aniportrait: Audio-driven synthesis of photorealistic portrait animation.arXiv preprint arXiv:2403.17694, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.231872Z"},"links":{"cited_paper":"/paper/2403.17694","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:a21e5352a1c2b1c7d9e1f728c559be8b236812d8a77efdfb35d652a3a9187ba4","observation_id":"1b2d76ed-79bb-4259-85b8-49a434c4dc5c","resolution":{"observed_at":"2026-08-16T00:21:12.231872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08136","last_updated":"2024-07-12T02:41:51Z","snapshot_observed_at":"2026-08-17T16:30:00.213972Z","submitted_at":"2024-07-11T02:26:51Z","title":"EchoMimic: Lifelike Audio-Driven Portrait Animations through Editable Landmark Conditions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08136","snapshot_observed_at":"2026-08-16T00:21:12.236636Z","title":"Echomimic: Lifelike audio-driven portrait animations through editable landmark conditioning.arXiv preprint arXiv:2407.08136, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.236636Z"},"links":{"cited_paper":"/paper/2407.08136","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:a5208d01528ed91f79efb8c97122f8c6ad48517c84687ccdfe23de8a772dc26a","observation_id":"9aca3269-b7df-4d30-9a35-692ee4781302","resolution":{"observed_at":"2026-08-16T00:21:12.236636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-08-15T16:15:04.223733Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.16776","snapshot_observed_at":"2026-08-16T00:21:12.241690Z","title":"Kling-omni technical report.arXiv preprint arXiv:2512.16776, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.241690Z"},"links":{"cited_paper":"/paper/2512.16776","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:0f9b2095396366c75eb4905765be15aefed2a6289bbe5bee8b27c7d3a7a795f6","observation_id":"5b7568ba-9217-44e8-88be-f4c2c46d83ce","resolution":{"observed_at":"2026-08-16T00:21:12.241690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.546272Z","title":"Video generation models as world simulators","venue":null,"work_id":"32f05f11-e284-4c29-83c7-ce1cb29dbab7","year":2024},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.247704Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:4a09ebccda5021a3acabfee6a4813f25733f7591f7ded63734d0ef05638b2763","observation_id":"c7a1b3da-b90e-4b8b-bc53-12ef7590362d","resolution":{"observed_at":"2026-08-16T00:21:13.551489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.530336Z","title":"Freeman, and Taesung Park","venue":null,"work_id":"66e3060a-fce9-44ca-88ec-73a3004eed98","year":2024},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.252293Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:ee87724b4233d75e9fbf69fe21d81cffb10135d331f0a3f53b720c3a1482dbb0","observation_id":"a5f19dca-31fa-47f0-920b-43afb5f6df00","resolution":{"observed_at":"2026-08-16T00:21:13.535426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14867","last_updated":"2024-05-24T17:08:32Z","snapshot_observed_at":"2026-08-17T13:58:43.125702Z","submitted_at":"2024-05-23T17:59:49Z","title":"Improved Distribution Matching Distillation for Fast Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14867","snapshot_observed_at":"2026-08-16T00:21:12.257149Z","title":"Freeman, and Taesung Park","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.257149Z"},"links":{"cited_paper":"/paper/2405.14867","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:6af646a73712048fb78a6a303890c71a4ba647032059174dbed7193cb4262363","observation_id":"d4754a20-ae4e-4f10-99f0-9dd07f957558","resolution":{"observed_at":"2026-08-16T00:21:12.257149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.514287Z","title":"Adversarial diffusion distillation","venue":null,"work_id":"4e63769d-29bb-458a-9f3c-8bea3204d27b","year":2024},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.262291Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:4e2053d24a9b2478f9db86ae199d459258de9cf4ddfdf3457210f3ab6da94f72","observation_id":"ed2c87ef-4e9a-44bb-b312-fd1dd2300fef","resolution":{"observed_at":"2026-08-16T00:21:13.519277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04378","last_updated":"2023-10-06T17:11:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-06T17:11:58Z","title":"Latent Consistency Models: Synthesizing High-Resolution Images with Few-Step Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04378","snapshot_observed_at":"2026-08-16T00:21:12.266993Z","title":"Latent consistency models: Synthesizing high-resolution images with few-step inference.arXiv preprint arXiv:2310.04378, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.266993Z"},"links":{"cited_paper":"/paper/2310.04378","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:108b86ae6e001ed85d10b6bc4d42039700ed25105f4fbb911c7d512eda4299ab","observation_id":"9317226e-16d5-4697-95ce-17057e92034b","resolution":{"observed_at":"2026-08-16T00:21:12.266993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.497858Z","title":"Phased consistency models","venue":null,"work_id":"245a0233-36d8-4049-ac47-7349bd2751fb","year":2024},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.272001Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:76919b14e344234181144f8de0c27359d123c5cedf757f060f8a1988d597b3f1","observation_id":"27550522-1b35-4bc6-848e-61eaf90c7e27","resolution":{"observed_at":"2026-08-16T00:21:13.502786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.03139","last_updated":"2026-05-19T12:34:41Z","snapshot_observed_at":"2026-08-14T18:45:39.954413Z","submitted_at":"2026-02-03T05:45:25Z","title":"Diversity-Preserved Distribution Matching Distillation for Fast Visual Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.03139","snapshot_observed_at":"2026-08-16T00:21:12.276476Z","title":"Diversity-preserveddistributionmatchingdistillationforfastvisual synthesis.arXiv preprint arXiv:2602.03139, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.276476Z"},"links":{"cited_paper":"/paper/2602.03139","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:e64982c039a47897ac056c186e22dfb31dcb667456c47debcd1601a631108323","observation_id":"9a423730-100a-4d15-bef0-c949c03d51b8","resolution":{"observed_at":"2026-08-16T00:21:12.276476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08009","last_updated":"2025-11-10T04:36:27Z","snapshot_observed_at":"2026-08-15T15:02:59.826496Z","submitted_at":"2025-06-09T17:59:55Z","title":"Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08009","snapshot_observed_at":"2026-08-16T00:21:12.281657Z","title":"Self forcing: Bridging the train-test gap in autoregressive video diffusion.arXiv preprint arXiv:2506.08009, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.281657Z"},"links":{"cited_paper":"/paper/2506.08009","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:9377d46cc9ad04d36a2726f4c449c21ef8fc35996fab1250a586f64597f886f4","observation_id":"3ac0be64-ce07-488f-b185-4f423d656b90","resolution":{"observed_at":"2026-08-16T00:21:12.281657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.10103","last_updated":"2026-04-28T08:33:18Z","snapshot_observed_at":"2026-08-18T01:13:11.751860Z","submitted_at":"2026-04-11T08:54:07Z","title":"Long-Horizon Streaming Video Generation via Hybrid Attention with Decoupled Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.10103","snapshot_observed_at":"2026-08-16T00:21:12.287157Z","title":"Long-horizon streaming video generation via hybrid attention with decoupled distillation.arXiv preprint arXiv:2604.10103, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.287157Z"},"links":{"cited_paper":"/paper/2604.10103","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:fc23f0f4c5b30c3679c4170ae6725634fd3dce1babf01205d4e07b8d7c8abd8c","observation_id":"38fc14af-b7b2-403b-8769-03738a8c4d4a","resolution":{"observed_at":"2026-08-16T00:21:12.287157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.25161","last_updated":"2025-09-29T17:57:14Z","snapshot_observed_at":"2026-08-09T09:15:39.740119Z","submitted_at":"2025-09-29T17:57:14Z","title":"Rolling Forcing: Autoregressive Long Video Diffusion in Real Time","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.25161","snapshot_observed_at":"2026-08-16T00:21:12.292341Z","title":"Rolling forcing: Autoregressive long video diffusion in real time.arXiv preprint arXiv:2509.25161, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.292341Z"},"links":{"cited_paper":"/paper/2509.25161","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:720b22f0e906933aa6f1b0d38ff1efe353da96abf497d945db76c45263d8e831","observation_id":"125da127-580f-4c48-9cb4-a5602e9cfad1","resolution":{"observed_at":"2026-08-16T00:21:12.292341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18866","last_updated":"2025-06-23T17:33:03Z","snapshot_observed_at":"2026-08-15T18:39:33.154486Z","submitted_at":"2025-06-23T17:33:03Z","title":"OmniAvatar: Efficient Audio-Driven Avatar Video Generation with Adaptive Body Animation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.18866","snapshot_observed_at":"2026-08-16T00:21:12.297641Z","title":"Omniavatar: Efficient audio-driven avatar video generation with adaptive body animation.arXiv preprint arXiv:2506.18866, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.297641Z"},"links":{"cited_paper":"/paper/2506.18866","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:22b979967b2751fc6540ac0e686960b2db0bc6f95926ab62243422b61a42e68d","observation_id":"0343a79b-8544-47a7-97d1-105b4e95489e","resolution":{"observed_at":"2026-08-16T00:21:12.297641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20156","last_updated":"2025-06-03T15:15:31Z","snapshot_observed_at":"2026-08-07T13:55:40.621856Z","submitted_at":"2025-05-26T15:57:27Z","title":"HunyuanVideo-Avatar: High-Fidelity Audio-Driven Human Animation for Multiple Characters","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20156","snapshot_observed_at":"2026-08-16T00:21:12.302668Z","title":"Hunyuanvideo-avatar: High-fidelity audio-driven human animation for multiple characters.arXiv preprint arXiv:2505.20156, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.302668Z"},"links":{"cited_paper":"/paper/2505.20156","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:e5f17ab4fb3bfd745a6a080f7671f4f90d52b22d19f4aaec662fa3a067b0d417","observation_id":"08990fbb-5c71-46f1-bfd7-354b05afb300","resolution":{"observed_at":"2026-08-16T00:21:12.302668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.481024Z","title":"Evaluating prerequisite qualities for learning end-to-end dialog systems, 2016","venue":null,"work_id":"09a60ea2-e51e-45a3-9176-0a6f6931c7eb","year":2016},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.307628Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:e4bf768fb31471972775763958ddc1ef4396453b3e0636270ba45e574da1e1e4","observation_id":"0152f6cf-3747-4f1c-b86b-5c67c7b6f478","resolution":{"observed_at":"2026-08-16T00:21:13.486572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.465476Z","title":null,"venue":null,"work_id":"b946115b-d393-424f-bad5-6932e40cf8bb","year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.312343Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:a8f489f5fbaddb89274ad27512fd104d53d33ff65be4dcc6b7d7634bc35e75b1","observation_id":"efa924e2-d089-488b-a4d6-8348cfc93c8e","resolution":{"observed_at":"2026-08-16T00:21:13.470285Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:12.316501Z","title":"Imagebind: One embedding space to bind them all","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.316501Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:861afb645178ed807d7916a533cfc874bcfe931df37a960f387c485ea0f82613","observation_id":"b8c68e1a-69f6-481a-8621-f2ff52c058ae","resolution":{"observed_at":"2026-08-16T00:21:12.316501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.438243Z","title":"Large- scale contrastive language-audio pretraining with feature fusion and keyword-to-caption augmentation","venue":null,"work_id":"c8065788-912c-4103-8bb7-6a139d5f6b35","year":2023},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.320678Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:f80dfc564979dc7cabd45718b347bde24f996b95db8568523d81d5a6b5d3b70b","observation_id":"09082a70-3b25-4f36-8902-db0ba61286fb","resolution":{"observed_at":"2026-08-16T00:21:13.443117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05236","last_updated":"2026-02-25T13:17:30Z","snapshot_observed_at":"2026-08-17T22:15:08.630152Z","submitted_at":"2025-03-07T08:36:05Z","title":"Unified Reward Model for Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05236","snapshot_observed_at":"2026-08-16T00:21:12.325127Z","title":"Unified reward model for multimodal understanding and generation.arXiv preprint arXiv:2503.05236, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.325127Z"},"links":{"cited_paper":"/paper/2503.05236","citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:ccaf2fedc740d48ef0df8869c401b06dc55f5483b0d9851f0599335d0bea15b1","observation_id":"3eebf83b-8724-4865-8117-9d00d1ef082d","resolution":{"observed_at":"2026-08-16T00:21:12.325127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.422383Z","title":"Gemini 3.5 flash","venue":null,"work_id":"ad9ecac3-1917-45bf-b20e-0d64d9c0183a","year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.329523Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:479b000805cb1ffac9775f3f9d10c8e7e407e0cc0d1f211d79fde4de7b8473d4","observation_id":"cdb83860-187a-47b5-b690-9d7ac1c4cd0b","resolution":{"observed_at":"2026-08-16T00:21:13.427426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.406124Z","title":"Lora: Low-rank adaptation of large language models.Iclr, 1(2):3, 2022","venue":null,"work_id":"3b4c7781-f913-43a4-afd0-900ebcc30492","year":2022},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.333634Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:7217163cbf6482277af1b781d2fc6924a7b1c54e7be6eb7a05c7e8b3e4612ef8","observation_id":"852ac723-d1cc-4591-9d32-879c5d6c9596","resolution":{"observed_at":"2026-08-16T00:21:13.411140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.388918Z","title":"Talkvid: A large-scale diversified dataset for audio-driven talking head synthesis","venue":null,"work_id":"c3335f9c-16c4-43a5-a54a-0faae22014b4","year":2026},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.338605Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:1fde5aff844f528927c9d6c97c028a31c191397522135f5d54a37d8995b37bbd","observation_id":"6ec32269-823b-431c-ab8e-67288dc46b4e","resolution":{"observed_at":"2026-08-16T00:21:13.394868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:12.343399Z","title":"Echomimicv2: Towards striking, simplified, and semi-body human animation.arXiv preprint arXiv:2411.10061, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.343399Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:12a406cd1b7474daf8298f6daac3916a8a69b68cdf6ff0ac5f93b0e7f1d20c01","observation_id":"b4d2fa8f-271a-4e50-ae96-76768cf8b6a7","resolution":{"observed_at":"2026-08-16T00:21:12.343399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:21:13.371617Z","title":"audio_visual_consistency","venue":null,"work_id":"0e81605f-cbd5-4b63-8c39-adef7446f5d3","year":2021},"citing_paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-16T00:21:12.348163Z"},"links":{"citing_paper":"/paper/2608.12107"},"observation_digest":"sha256:ed1e43337a7b941f4789a57d6fa72de6f65735a8fadd70944367e117ec772b03","observation_id":"e136beb3-fdc4-49eb-bcd6-a4b75e9685c3","resolution":{"observed_at":"2026-08-16T00:21:13.377783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.12107","last_updated":"2026-08-12T14:29:08Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T16:30:24.616765Z","submitted_at":"2026-08-12T14:29:08Z","title":"Avatar-Forever: Decoupled Parallel Training for High-Quality Real-Time Infinite Avatars"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":41,"verified_exact":0,"verified_fuzzy":22},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 0 inbound Pith citation observations for arXiv:2608.12107."}