{"as_of":"2026-08-07T18:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6603db651d61beffc6a4529a849a00e0cc80497f4b7781ce3dafdbba70b46570","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":21,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:02:27.124310Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T04:47:38.051126Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.00733","last_updated":"2025-03-13T08:23:27Z","snapshot_observed_at":"2026-07-06T19:59:37.692710Z","submitted_at":"2024-12-01T08:54:30Z","title":"Hallo3: Highly Dynamic and Realistic Portrait Image Animation with Video Diffusion Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00733","snapshot_observed_at":"2026-08-07T14:02:27.124310Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20156","last_updated":"2025-06-03T15:15:31Z","snapshot_observed_at":"2026-08-07T13:55:40.621856Z","submitted_at":"2025-05-26T15:57:27Z","title":"HunyuanVideo-Avatar: High-Fidelity Audio-Driven Human Animation for Multiple Characters","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:02:27.124310Z"},"links":{"cited_paper":"/paper/2412.00733","citing_paper":"/paper/2505.20156"},"observation_digest":"sha256:7adcc7219d7838131cce801ac70aa608eff057b42df91e3ccd80844d7d2a1ac6","observation_id":"ed5ff8a9-c3c7-4bfe-9597-dfb59813d059","resolution":{"observed_at":"2026-08-07T14:02:27.124310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00733","last_updated":"2025-03-13T08:23:27Z","snapshot_observed_at":"2026-07-06T19:59:37.692710Z","submitted_at":"2024-12-01T08:54:30Z","title":"Hallo3: Highly Dynamic and Realistic Portrait Image Animation with Video Diffusion Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00733","snapshot_observed_at":"2026-08-07T13:21:48.736504Z","title":"Hallo3: Highly dynamic and realistic portrait image animation with video diffusion transformer,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22141","last_updated":"2025-08-27T16:33:34Z","snapshot_observed_at":"2026-08-07T13:12:06.215978Z","submitted_at":"2025-05-28T09:04:00Z","title":"FaceEditTalker: Controllable Talking Head Generation with Facial Attribute Editing","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:48.736504Z"},"links":{"cited_paper":"/paper/2412.00733","citing_paper":"/paper/2505.22141"},"observation_digest":"sha256:a86f2ad8b30d85d38259b77b25c0cad57305f2c3c2d85f6c521a5fdbb95e9d7d","observation_id":"70d63217-d6c4-46e1-bdd2-99b5f5f11c18","resolution":{"observed_at":"2026-08-07T13:21:48.736504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00733","last_updated":"2025-03-13T08:23:27Z","snapshot_observed_at":"2026-07-06T19:59:37.692710Z","submitted_at":"2024-12-01T08:54:30Z","title":"Hallo3: Highly Dynamic and Realistic Portrait Image Animation with Video Diffusion Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00733","snapshot_observed_at":"2026-08-07T13:07:31.596042Z","title":"Hallo3: Highly dynamic and realistic portrait image animation with video diffusion transformer.arXiv preprint arXiv:2412.00733, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22647","last_updated":"2025-05-28T17:57:06Z","snapshot_observed_at":"2026-08-07T13:00:08.057385Z","submitted_at":"2025-05-28T17:57:06Z","title":"Let Them Talk: Audio-Driven Multi-Person Conversational Video Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:07:31.596042Z"},"links":{"cited_paper":"/paper/2412.00733","citing_paper":"/paper/2505.22647"},"observation_digest":"sha256:495736abd84da264099a1ff1a8a037d211a400261baa5e161c06eb77a185bf2a","observation_id":"126822ad-cdb2-4732-b1c0-b087d9131350","resolution":{"observed_at":"2026-08-07T13:07:31.596042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00733","last_updated":"2025-03-13T08:23:27Z","snapshot_observed_at":"2026-07-06T19:59:37.692710Z","submitted_at":"2024-12-01T08:54:30Z","title":"Hallo3: Highly Dynamic and Realistic Portrait Image Animation with Video Diffusion Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00733","snapshot_observed_at":"2026-08-07T12:01:05.049606Z","title":"Hallo3: Highly dynamic and realistic portrait image animation with diffusion transformer networks.arXiv preprint arXiv:2412.00733, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00830","last_updated":"2025-06-01T04:27:13Z","snapshot_observed_at":"2026-08-07T11:54:54.950430Z","submitted_at":"2025-06-01T04:27:13Z","title":"SkyReels-Audio: Omni Audio-Conditioned Talking Portraits in Video Diffusion Transformers","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:05.049606Z"},"links":{"cited_paper":"/paper/2412.00733","citing_paper":"/paper/2506.00830"},"observation_digest":"sha256:c29acc0e6a71729f805c22d6eef7bc23cc091b5abf7640d17c405bbdbc4c9429","observation_id":"c430a401-a2e7-4075-9517-77f260d9c4df","resolution":{"observed_at":"2026-08-07T12:01:05.049606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00733","last_updated":"2025-03-13T08:23:27Z","snapshot_observed_at":"2026-07-06T19:59:37.692710Z","submitted_at":"2024-12-01T08:54:30Z","title":"Hallo3: Highly Dynamic and Realistic Portrait Image Animation with Video Diffusion Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00733","snapshot_observed_at":"2026-08-07T11:13:55.731959Z","title":"Hallo3: Highly dynamic and realistic portrait image animation with video diffusion transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03099","last_updated":"2025-06-03T17:29:28Z","snapshot_observed_at":"2026-08-07T11:06:29.471810Z","submitted_at":"2025-06-03T17:29:28Z","title":"TalkingMachines: Real-Time Audio-Driven FaceTime-Style Video via Autoregressive Diffusion Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:13:55.731959Z"},"links":{"cited_paper":"/paper/2412.00733","citing_paper":"/paper/2506.03099"},"observation_digest":"sha256:87ccba08ee524a474e12e65cbafe2edb5889ddddc81ddaa1c3a56de12b2f97d9","observation_id":"788de9a0-d16f-45c6-8538-c159f581c7c2","resolution":{"observed_at":"2026-08-07T11:13:55.731959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00733","last_updated":"2025-03-13T08:23:27Z","snapshot_observed_at":"2026-07-06T19:59:37.692710Z","submitted_at":"2024-12-01T08:54:30Z","title":"Hallo3: Highly Dynamic and Realistic Portrait Image Animation with Video Diffusion Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00733","snapshot_observed_at":"2026-08-07T10:18:24.346992Z","title":"Hallo3: Highly dynamic and realistic portrait image animation with video diffusion transformer.arXiv preprint arXiv:2412.00733, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05806","last_updated":"2025-06-06T07:09:07Z","snapshot_observed_at":"2026-08-07T14:09:34.326340Z","submitted_at":"2025-06-06T07:09:07Z","title":"LLIA -- Enabling Low-Latency Interactive Avatars: Real-Time Audio-Driven Portrait Video Generation with Diffusion Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:24.346992Z"},"links":{"cited_paper":"/paper/2412.00733","citing_paper":"/paper/2506.05806"},"observation_digest":"sha256:46fea5c3348dd4feb6ac4a42c30dc421182d236acab7e5fbecaa9df104afa9d6","observation_id":"e92e6c34-72c1-457f-94e0-37c71a4b7bc5","resolution":{"observed_at":"2026-08-07T10:18:24.346992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00733","last_updated":"2025-03-13T08:23:27Z","snapshot_observed_at":"2026-07-06T19:59:37.692710Z","submitted_at":"2024-12-01T08:54:30Z","title":"Hallo3: Highly Dynamic and Realistic Portrait Image Animation with Video Diffusion Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00733","snapshot_observed_at":"2026-08-07T05:19:08.242965Z","title":"Cudeiro, T","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.08279","last_updated":"2025-06-09T22:56:02Z","snapshot_observed_at":"2026-08-07T05:12:30.339535Z","submitted_at":"2025-06-09T22:56:02Z","title":"Seeing Voices: Generating A-Roll Video from Audio with Mirage","version":1},"reference_index":2002,"source":"pdf_text","source_observed_at":"2026-08-07T05:19:08.242965Z"},"links":{"cited_paper":"/paper/2412.00733","citing_paper":"/paper/2506.08279"},"observation_digest":"sha256:47d7e9dacaa094cd3999749a845ce7b510e58c1f26f5c6b94e03aacaa6ac96bf","observation_id":"6ab8f872-6a90-4bdd-b6ee-a89e061ba897","resolution":{"observed_at":"2026-08-07T05:19:08.242965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00733","last_updated":"2025-03-13T08:23:27Z","snapshot_observed_at":"2026-07-06T19:59:37.692710Z","submitted_at":"2024-12-01T08:54:30Z","title":"Hallo3: Highly Dynamic and Realistic Portrait Image Animation with Video Diffusion Transformer","version":4},"cited_work":{"arxiv_id":"2412.00733","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.00733","snapshot_observed_at":"2026-07-03T04:47:38.051126Z","title":"Hallo3: Highly dynamic and realistic portrait image animation with diffusion transformer networks","venue":null,"work_id":"658a59da-ea60-45e4-b21d-bcb4587464b2","year":2025},"citing_paper":{"arxiv_id":"2506.23552","last_updated":"2026-05-15T04:47:28Z","snapshot_observed_at":"2026-07-06T21:49:33.849898Z","submitted_at":"2025-06-30T06:51:40Z","title":"JAM-Flow: Joint Audio-Motion Synthesis with Flow Matching","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-22T00:46:39.196042Z"},"links":{"cited_paper":"/paper/2412.00733","citing_paper":"/paper/2506.23552"},"observation_digest":"sha256:77af593b14da3b5c31579e22fd0e1c85e05c8426e76c514130a5220be26afdb8","observation_id":"a1c3c98c-3551-4b07-8025-db60c0ef2481","resolution":{"observed_at":"2026-05-22T00:50:51.030141Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00733","last_updated":"2025-03-13T08:23:27Z","snapshot_observed_at":"2026-07-06T19:59:37.692710Z","submitted_at":"2024-12-01T08:54:30Z","title":"Hallo3: Highly Dynamic and Realistic Portrait Image Animation with Video Diffusion Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00733","snapshot_observed_at":"2026-08-06T20:58:22.787467Z","title":"Hallo3: Highly dynamic and realistic portrait image an- imation with diffusion transformer networks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01390","last_updated":"2025-07-02T06:10:52Z","snapshot_observed_at":"2026-08-06T20:50:14.467156Z","submitted_at":"2025-07-02T06:10:52Z","title":"FixTalk: Taming Identity Leakage for High-Quality Talking Head Generation in Extreme Cases","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T20:58:22.787467Z"},"links":{"cited_paper":"/paper/2412.00733","citing_paper":"/paper/2507.01390"},"observation_digest":"sha256:5d67860ae58a9583535c30aefef47cce7caa874df530e9439b91fc36d56f49bd","observation_id":"02d17b77-7cb3-43cf-9141-75f12639f65e","resolution":{"observed_at":"2026-08-06T20:58:22.787467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00733","last_updated":"2025-03-13T08:23:27Z","snapshot_observed_at":"2026-07-06T19:59:37.692710Z","submitted_at":"2024-12-01T08:54:30Z","title":"Hallo3: Highly Dynamic and Realistic Portrait Image Animation with Video Diffusion Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00733","snapshot_observed_at":"2026-08-06T20:23:36.738210Z","title":"Hallo3: Highly dynamic and realistic portrait image anima- tion with diffusion transformer networks.arXiv preprint arXiv:2412.00733, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03256","last_updated":"2025-08-08T12:58:08Z","snapshot_observed_at":"2026-08-06T20:12:17.292984Z","submitted_at":"2025-07-04T02:25:10Z","title":"MoDA: Multi-modal Diffusion Architecture for Talking Head Generation","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T20:23:36.738210Z"},"links":{"cited_paper":"/paper/2412.00733","citing_paper":"/paper/2507.03256"},"observation_digest":"sha256:b8089aa20f49925d0338b45af74053820f5e02e95b083214a3654a933f6ec025","observation_id":"827a515c-bd40-4c02-88f5-187defd38238","resolution":{"observed_at":"2026-08-06T20:23:36.738210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00733","last_updated":"2025-03-13T08:23:27Z","snapshot_observed_at":"2026-07-06T19:59:37.692710Z","submitted_at":"2024-12-01T08:54:30Z","title":"Hallo3: Highly Dynamic and Realistic Portrait Image Animation with Video Diffusion Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00733","snapshot_observed_at":"2026-08-06T15:20:13.223768Z","title":"Hallo3: Highly dynamic and realistic portrait image animation with video diffusion transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18649","last_updated":"2025-07-22T01:02:29Z","snapshot_observed_at":"2026-08-06T15:15:16.595008Z","submitted_at":"2025-07-22T01:02:29Z","title":"Livatar-1: Real-Time Talking Heads Generation with Tailored Flow Matching","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T15:20:13.223768Z"},"links":{"cited_paper":"/paper/2412.00733","citing_paper":"/paper/2507.18649"},"observation_digest":"sha256:04616a96f26f82b8c8ce47ea32d5a2d31ce9b937839891a8b0939f016545c654","observation_id":"0d167413-f8a8-4448-a2ba-0bbd79f161a2","resolution":{"observed_at":"2026-08-06T15:20:13.223768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00733","last_updated":"2025-03-13T08:23:27Z","snapshot_observed_at":"2026-07-06T19:59:37.692710Z","submitted_at":"2024-12-01T08:54:30Z","title":"Hallo3: Highly Dynamic and Realistic Portrait Image Animation with Video Diffusion Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00733","snapshot_observed_at":"2026-08-06T13:07:28.276988Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20987","last_updated":"2025-07-29T04:13:25Z","snapshot_observed_at":"2026-08-07T10:51:48.454717Z","submitted_at":"2025-07-28T16:47:44Z","title":"JWB-DH-V1: Benchmark for Joint Whole-Body Talking Avatar and Speech Generation Version 1","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T13:07:28.276988Z"},"links":{"cited_paper":"/paper/2412.00733","citing_paper":"/paper/2507.20987"},"observation_digest":"sha256:9d3f2c24365e14e64d793c30d35b87ceab6f2f94d819cf0124b16344a21b7355","observation_id":"46495ded-d986-48ff-b43c-3b6fce0f7863","resolution":{"observed_at":"2026-08-06T13:07:28.276988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00733","last_updated":"2025-03-13T08:23:27Z","snapshot_observed_at":"2026-07-06T19:59:37.692710Z","submitted_at":"2024-12-01T08:54:30Z","title":"Hallo3: Highly Dynamic and Realistic Portrait Image Animation with Video Diffusion Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00733","snapshot_observed_at":"2026-08-05T21:24:05.723175Z","title":"Hallo3: Highly dynamic and realistic portrait image an- imation with diffusion transformer networks.arXiv preprint arXiv:2412.00733, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08891","last_updated":"2025-08-12T12:25:56Z","snapshot_observed_at":"2026-08-07T05:22:38.697912Z","submitted_at":"2025-08-12T12:25:56Z","title":"Preview WB-DH: Towards Whole Body Digital Human Bench for the Generation of Whole-body Talking Avatar Videos","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T21:24:05.723175Z"},"links":{"cited_paper":"/paper/2412.00733","citing_paper":"/paper/2508.08891"},"observation_digest":"sha256:5b7aa3a209bfac44ce27432051cf7d552f32df344bb6298a22997088762658b7","observation_id":"d160ab63-8d60-43af-b7dd-56f2ed06878c","resolution":{"observed_at":"2026-08-05T21:24:05.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00733","last_updated":"2025-03-13T08:23:27Z","snapshot_observed_at":"2026-07-06T19:59:37.692710Z","submitted_at":"2024-12-01T08:54:30Z","title":"Hallo3: Highly Dynamic and Realistic Portrait Image Animation with Video Diffusion Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00733","snapshot_observed_at":"2026-08-05T19:07:35.468621Z","title":"Hallo3: Highly dynamic and realistic portrait image animation with diffusion transformer networks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.13442","last_updated":"2025-08-19T01:55:25Z","snapshot_observed_at":"2026-08-05T19:07:24.374768Z","submitted_at":"2025-08-19T01:55:25Z","title":"EDTalk++: Full Disentanglement for Controllable Talking Head Synthesis","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T19:07:35.468621Z"},"links":{"cited_paper":"/paper/2412.00733","citing_paper":"/paper/2508.13442"},"observation_digest":"sha256:cdab7b9db7079257483d06e249423e958b980021a8c65e5ac6fe706452e28cca","observation_id":"386640b5-47f1-4cba-a1f2-9d32c87c48cf","resolution":{"observed_at":"2026-08-05T19:07:35.468621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00733","last_updated":"2025-03-13T08:23:27Z","snapshot_observed_at":"2026-07-06T19:59:37.692710Z","submitted_at":"2024-12-01T08:54:30Z","title":"Hallo3: Highly Dynamic and Realistic Portrait Image Animation with Video Diffusion Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00733","snapshot_observed_at":"2026-08-05T18:50:16.217430Z","title":"Hallo3: Highly dynamic and realistic portrait image animation with video diffusion transformer.arXiv preprint arXiv:2412.00733,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.14033","last_updated":"2025-08-19T17:55:23Z","snapshot_observed_at":"2026-08-05T18:50:15.388089Z","submitted_at":"2025-08-19T17:55:23Z","title":"InfiniteTalk: Audio-driven Video Generation for Sparse-Frame Video Dubbing","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-05T18:50:16.217430Z"},"links":{"cited_paper":"/paper/2412.00733","citing_paper":"/paper/2508.14033"},"observation_digest":"sha256:5c37fdec14f9f4f46108c0f9b96ab093685a01e1889c468764d2d8ede444a45a","observation_id":"3ba92e8b-0db8-49f0-99a5-6d3c0095b1eb","resolution":{"observed_at":"2026-08-05T18:50:16.217430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00733","last_updated":"2025-03-13T08:23:27Z","snapshot_observed_at":"2026-07-06T19:59:37.692710Z","submitted_at":"2024-12-01T08:54:30Z","title":"Hallo3: Highly Dynamic and Realistic Portrait Image Animation with Video Diffusion Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00733","snapshot_observed_at":"2026-08-05T16:01:30.743448Z","title":"Hallo3: Highly dynamic and realistic portrait image animation with video diffusion transformer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.19320","last_updated":"2025-08-28T09:15:43Z","snapshot_observed_at":"2026-08-05T16:01:30.244519Z","submitted_at":"2025-08-26T14:00:16Z","title":"MIDAS: Multimodal Interactive Digital-humAn Synthesis via Real-time Autoregressive Video Generation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T16:01:30.743448Z"},"links":{"cited_paper":"/paper/2412.00733","citing_paper":"/paper/2508.19320"},"observation_digest":"sha256:928e912b4dd7cd0675fe4c207622503e79dd4100a69027c426a8971ed67c1042","observation_id":"9079251d-3480-4c4e-a654-a288346b7d44","resolution":{"observed_at":"2026-08-05T16:01:30.743448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00733","last_updated":"2025-03-13T08:23:27Z","snapshot_observed_at":"2026-07-06T19:59:37.692710Z","submitted_at":"2024-12-01T08:54:30Z","title":"Hallo3: Highly Dynamic and Realistic Portrait Image Animation with Video Diffusion Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00733","snapshot_observed_at":"2026-08-05T15:19:37.110895Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20210","last_updated":"2025-08-27T18:36:30Z","snapshot_observed_at":"2026-08-05T15:19:21.410977Z","submitted_at":"2025-08-27T18:36:30Z","title":"InfinityHuman: Towards Long-Term Audio-Driven Human","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:37.110895Z"},"links":{"cited_paper":"/paper/2412.00733","citing_paper":"/paper/2508.20210"},"observation_digest":"sha256:a9f8560ba4a39b68832f7dedb50b790d358e25726639feab25d125a25dd92f35","observation_id":"c85cec5c-d3de-468e-b6cd-8fe99dcf3647","resolution":{"observed_at":"2026-08-05T15:19:37.110895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00733","last_updated":"2025-03-13T08:23:27Z","snapshot_observed_at":"2026-07-06T19:59:37.692710Z","submitted_at":"2024-12-01T08:54:30Z","title":"Hallo3: Highly Dynamic and Realistic Portrait Image Animation with Video Diffusion Transformer","version":4},"cited_work":{"arxiv_id":"2412.00733","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.00733","snapshot_observed_at":"2026-07-03T04:47:38.051126Z","title":"Hallo3: Highly dynamic and realistic portrait image animation with diffusion transformer networks","venue":null,"work_id":"658a59da-ea60-45e4-b21d-bcb4587464b2","year":2025},"citing_paper":{"arxiv_id":"2604.08405","last_updated":"2026-07-30T09:16:54Z","snapshot_observed_at":"2026-08-03T01:34:12.626353Z","submitted_at":"2026-04-09T16:03:24Z","title":"SyncBreaker:Stage-Aware Multimodal Adversarial Attacks on Audio-Driven Talking Head Generation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T17:30:36.462567Z"},"links":{"cited_paper":"/paper/2412.00733","citing_paper":"/paper/2604.08405"},"observation_digest":"sha256:9567bf01d0f1b9855bd469d4d21020e398902fcdf4a4ca0a88a1ac11aa6e4517","observation_id":"fe3aeb0e-de97-4d4d-9356-a6d32479a1b2","resolution":{"observed_at":"2026-05-11T06:41:27.217770Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00733","last_updated":"2025-03-13T08:23:27Z","snapshot_observed_at":"2026-07-06T19:59:37.692710Z","submitted_at":"2024-12-01T08:54:30Z","title":"Hallo3: Highly Dynamic and Realistic Portrait Image Animation with Video Diffusion Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00733","snapshot_observed_at":"2026-08-02T16:38:16.047826Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.08405","last_updated":"2026-07-30T09:16:54Z","snapshot_observed_at":"2026-08-03T01:34:12.626353Z","submitted_at":"2026-04-09T16:03:24Z","title":"SyncBreaker:Stage-Aware Multimodal Adversarial Attacks on Audio-Driven Talking Head Generation","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T16:38:16.047826Z"},"links":{"cited_paper":"/paper/2412.00733","citing_paper":"/paper/2604.08405"},"observation_digest":"sha256:638df7dbb9ad465c6a4c5e11dba4df82d3f392a45e40993ebb4909569ac7b311","observation_id":"d3e81ac7-1f87-4158-be19-1e92286e6a08","resolution":{"observed_at":"2026-08-02T16:38:16.047826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00733","last_updated":"2025-03-13T08:23:27Z","snapshot_observed_at":"2026-07-06T19:59:37.692710Z","submitted_at":"2024-12-01T08:54:30Z","title":"Hallo3: Highly Dynamic and Realistic Portrait Image Animation with Video Diffusion Transformer","version":4},"cited_work":{"arxiv_id":"2412.00733","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.00733","snapshot_observed_at":"2026-07-03T04:47:38.051126Z","title":"Hallo3: Highly dynamic and realistic portrait image animation with diffusion transformer networks","venue":null,"work_id":"658a59da-ea60-45e4-b21d-bcb4587464b2","year":2025},"citing_paper":{"arxiv_id":"2606.05896","last_updated":"2026-06-22T18:29:42Z","snapshot_observed_at":"2026-07-06T23:45:51.910263Z","submitted_at":"2026-06-04T09:03:43Z","title":"Resonant Minds: Closed-Loop Social Avatars with Theory of Mind","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T02:04:39.753443Z"},"links":{"cited_paper":"/paper/2412.00733","citing_paper":"/paper/2606.05896"},"observation_digest":"sha256:56df0b97df4fb2ab82c9c427d67654406f7ce9cc53e3c22b225edc8a1d0cb4e1","observation_id":"36be6018-cd74-4d97-ad99-7dd1b6af3e07","resolution":{"observed_at":"2026-07-02T12:36:56.234694Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00733","last_updated":"2025-03-13T08:23:27Z","snapshot_observed_at":"2026-07-06T19:59:37.692710Z","submitted_at":"2024-12-01T08:54:30Z","title":"Hallo3: Highly Dynamic and Realistic Portrait Image Animation with Video Diffusion Transformer","version":4},"cited_work":{"arxiv_id":"2412.00733","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.00733","snapshot_observed_at":"2026-07-03T04:47:38.051126Z","title":"Hallo3: Highly dynamic and realistic portrait image animation with diffusion transformer networks","venue":null,"work_id":"658a59da-ea60-45e4-b21d-bcb4587464b2","year":2025},"citing_paper":{"arxiv_id":"2606.11180","last_updated":"2026-06-09T17:56:36Z","snapshot_observed_at":"2026-08-05T12:57:25.376491Z","submitted_at":"2026-06-09T17:56:36Z","title":"Lip Forcing: Few-Step Autoregressive Diffusion for Real-time Lip Synchronization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-27T13:40:14.506288Z"},"links":{"cited_paper":"/paper/2412.00733","citing_paper":"/paper/2606.11180"},"observation_digest":"sha256:b9a9f35552962b2ae066218b1a572863ba0ad6dd81eaafa10f99b335423a2e38","observation_id":"c355550e-f74e-45b4-85b2-2d69bc87576e","resolution":{"observed_at":"2026-07-03T04:47:38.052617Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.00733/citation-record","integrity":"/paper/2412.00733/integrity","json":"/paper/2412.00733/citation-record.json","paper":"/paper/2412.00733"},"outbound":[],"paper":{"arxiv_id":"2412.00733","last_updated":"2025-03-13T08:23:27Z","latest_version":4,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T19:59:37.692710Z","submitted_at":"2024-12-01T08:54:30Z","title":"Hallo3: Highly Dynamic and Realistic Portrait Image Animation with Video Diffusion Transformer"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 21 inbound Pith citation observations for arXiv:2412.00733."}