{"as_of":"2026-08-05T12:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9a19050a1eb414614db6df06cf7734155e1d5bf5805e34ce692d02aa7df96758","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":20,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T17:26:50.715253Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T21:46:15.594455Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.07718","last_updated":"2024-10-14T13:35:17Z","snapshot_observed_at":"2026-08-05T03:23:39.587839Z","submitted_at":"2024-10-10T08:34:41Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","version":2},"cited_work":{"arxiv_id":"2410.07718","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07718","snapshot_observed_at":"2026-07-01T21:46:15.594455Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","venue":null,"work_id":"a36f46e1-e536-4499-b2bc-ed760196c9cf","year":2024},"citing_paper":{"arxiv_id":"2411.09209","last_updated":"2026-04-16T07:45:17Z","snapshot_observed_at":"2026-08-02T02:41:31.202365Z","submitted_at":"2024-11-14T06:13:05Z","title":"JoyVASA: Portrait and Animal Image Animation with Diffusion-Based Audio-Driven Facial Dynamics and Head Motion Generation","version":5},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-23T16:59:57.727035Z"},"links":{"cited_paper":"/paper/2410.07718","citing_paper":"/paper/2411.09209"},"observation_digest":"sha256:38318080440a30e64ec013593e5609cc78d67e46c406edce364e77417b0ef38a","observation_id":"af259182-f475-49fb-915f-2c93f8bd620b","resolution":{"observed_at":"2026-05-23T17:03:12.594476Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07718","last_updated":"2024-10-14T13:35:17Z","snapshot_observed_at":"2026-08-05T03:23:39.587839Z","submitted_at":"2024-10-10T08:34:41Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","version":2},"cited_work":{"arxiv_id":"2410.07718","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07718","snapshot_observed_at":"2026-07-01T21:46:15.594455Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","venue":null,"work_id":"a36f46e1-e536-4499-b2bc-ed760196c9cf","year":2024},"citing_paper":{"arxiv_id":"2411.16748","last_updated":"2026-05-08T09:16:59Z","snapshot_observed_at":"2026-08-04T02:06:42.093429Z","submitted_at":"2024-11-24T04:46:00Z","title":"Multimodal Diffusion Transformer with Memory Bank for Scalable Long-Duration Talking Video Generation","version":5},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-23T17:19:51.411937Z"},"links":{"cited_paper":"/paper/2410.07718","citing_paper":"/paper/2411.16748"},"observation_digest":"sha256:fb4e680d366368648a30ba83dbbe968beff8763702465776e467be1d8b605414","observation_id":"540aa358-8131-4303-a544-84b8682291ea","resolution":{"observed_at":"2026-05-23T17:23:15.413183Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07718","last_updated":"2024-10-14T13:35:17Z","snapshot_observed_at":"2026-08-05T03:23:39.587839Z","submitted_at":"2024-10-10T08:34:41Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","version":2},"cited_work":{"arxiv_id":"2410.07718","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07718","snapshot_observed_at":"2026-07-01T21:46:15.594455Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","venue":null,"work_id":"a36f46e1-e536-4499-b2bc-ed760196c9cf","year":2024},"citing_paper":{"arxiv_id":"2509.12052","last_updated":"2026-04-20T18:20:15Z","snapshot_observed_at":"2026-07-06T22:29:58.066459Z","submitted_at":"2025-09-15T15:34:02Z","title":"FluentAvatar: Flicker-Free Talking-Head Animation via Phoneme-Guided Autoregressive Modeling","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-18T16:42:25.803856Z"},"links":{"cited_paper":"/paper/2410.07718","citing_paper":"/paper/2509.12052"},"observation_digest":"sha256:73640286ad68e04e805701909cb72b10d69ffc0a7f99703429e37f166c827834","observation_id":"9609bc2f-afc8-4286-a2df-7655518844d9","resolution":{"observed_at":"2026-05-18T16:42:43.835012Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07718","last_updated":"2024-10-14T13:35:17Z","snapshot_observed_at":"2026-08-05T03:23:39.587839Z","submitted_at":"2024-10-10T08:34:41Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07718","snapshot_observed_at":"2026-08-03T16:30:32.718987Z","title":"Hallo2: Long-duration and high-resolution audio-driven portrait im- age animation.arXiv preprint arXiv:2410.07718, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.13247","last_updated":"2026-07-17T19:41:30Z","snapshot_observed_at":"2026-08-03T16:30:30.727629Z","submitted_at":"2025-12-15T11:59:01Z","title":"STARCaster: Spatio-Temporal AutoRegressive Video Diffusion for Identity- and View-Aware Talking Portraits","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T16:30:32.718987Z"},"links":{"cited_paper":"/paper/2410.07718","citing_paper":"/paper/2512.13247"},"observation_digest":"sha256:1ff651c051a2f66ea0c6d210a3c2c83de962408f6fec948bca8f8e9de4f12797","observation_id":"0b127765-b937-43a6-9ef4-c84c1a3a5510","resolution":{"observed_at":"2026-08-03T16:30:32.718987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07718","last_updated":"2024-10-14T13:35:17Z","snapshot_observed_at":"2026-08-05T03:23:39.587839Z","submitted_at":"2024-10-10T08:34:41Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","version":2},"cited_work":{"arxiv_id":"2410.07718","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07718","snapshot_observed_at":"2026-07-01T21:46:15.594455Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","venue":null,"work_id":"a36f46e1-e536-4499-b2bc-ed760196c9cf","year":2024},"citing_paper":{"arxiv_id":"2604.08405","last_updated":"2026-07-30T09:16:54Z","snapshot_observed_at":"2026-08-03T01:34:12.626353Z","submitted_at":"2026-04-09T16:03:24Z","title":"SyncBreaker:Stage-Aware Multimodal Adversarial Attacks on Audio-Driven Talking Head Generation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T17:30:36.462567Z"},"links":{"cited_paper":"/paper/2410.07718","citing_paper":"/paper/2604.08405"},"observation_digest":"sha256:4d43dc85514f61d2ab2411a16f916d8e2a7fdaedec0829ac20cf24ab31d2c80c","observation_id":"ae42507f-bdfc-4b0b-bbe1-d07c187da44e","resolution":{"observed_at":"2026-05-11T06:41:26.836265Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07718","last_updated":"2024-10-14T13:35:17Z","snapshot_observed_at":"2026-08-05T03:23:39.587839Z","submitted_at":"2024-10-10T08:34:41Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07718","snapshot_observed_at":"2026-08-02T16:38:16.042209Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.08405","last_updated":"2026-07-30T09:16:54Z","snapshot_observed_at":"2026-08-03T01:34:12.626353Z","submitted_at":"2026-04-09T16:03:24Z","title":"SyncBreaker:Stage-Aware Multimodal Adversarial Attacks on Audio-Driven Talking Head Generation","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T16:38:16.042209Z"},"links":{"cited_paper":"/paper/2410.07718","citing_paper":"/paper/2604.08405"},"observation_digest":"sha256:a394d7cd6a4d702f53c8a4466a2db6dc3a04da3b10dcc479e9678d46cdf509c7","observation_id":"a82d69aa-9a65-4f55-8e25-a7a934cdff73","resolution":{"observed_at":"2026-08-02T16:38:16.042209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07718","last_updated":"2024-10-14T13:35:17Z","snapshot_observed_at":"2026-08-05T03:23:39.587839Z","submitted_at":"2024-10-10T08:34:41Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","version":2},"cited_work":{"arxiv_id":"2410.07718","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07718","snapshot_observed_at":"2026-07-01T21:46:15.594455Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","venue":null,"work_id":"a36f46e1-e536-4499-b2bc-ed760196c9cf","year":2024},"citing_paper":{"arxiv_id":"2604.22865","last_updated":"2026-04-23T09:01:27Z","snapshot_observed_at":"2026-07-06T23:09:10.050398Z","submitted_at":"2026-04-23T09:01:27Z","title":"MeshLAM: Feed-Forward One-Shot Animatable Textured Mesh Avatar Reconstruction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-09T22:06:58.480052Z"},"links":{"cited_paper":"/paper/2410.07718","citing_paper":"/paper/2604.22865"},"observation_digest":"sha256:53d9a148bf40664000536e42746e424ac910710a97f6aa2a81b0cab3428c1aa1","observation_id":"811af94f-3d20-4d2a-83f4-1265b283c766","resolution":{"observed_at":"2026-05-11T14:16:28.578744Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07718","last_updated":"2024-10-14T13:35:17Z","snapshot_observed_at":"2026-08-05T03:23:39.587839Z","submitted_at":"2024-10-10T08:34:41Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","version":2},"cited_work":{"arxiv_id":"2410.07718","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07718","snapshot_observed_at":"2026-07-01T21:46:15.594455Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","venue":null,"work_id":"a36f46e1-e536-4499-b2bc-ed760196c9cf","year":2024},"citing_paper":{"arxiv_id":"2604.23325","last_updated":"2026-04-25T14:29:58Z","snapshot_observed_at":"2026-07-06T23:09:34.300163Z","submitted_at":"2026-04-25T14:29:58Z","title":"EAD-Net: Emotion-Aware Talking Head Generation with Spatial Refinement and Temporal Coherence","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-08T08:27:41.839123Z"},"links":{"cited_paper":"/paper/2410.07718","citing_paper":"/paper/2604.23325"},"observation_digest":"sha256:b0995fe1f9d126a074d3e557329417531e873458fa83dfb3003e063e90f9df32","observation_id":"c1750b6d-025e-4cae-9526-91bc8104f0bd","resolution":{"observed_at":"2026-05-11T20:36:11.198187Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07718","last_updated":"2024-10-14T13:35:17Z","snapshot_observed_at":"2026-08-05T03:23:39.587839Z","submitted_at":"2024-10-10T08:34:41Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","version":2},"cited_work":{"arxiv_id":"2410.07718","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07718","snapshot_observed_at":"2026-07-01T21:46:15.594455Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","venue":null,"work_id":"a36f46e1-e536-4499-b2bc-ed760196c9cf","year":2024},"citing_paper":{"arxiv_id":"2604.23586","last_updated":"2026-08-04T09:15:37Z","snapshot_observed_at":"2026-08-05T11:48:12.467021Z","submitted_at":"2026-04-26T07:48:47Z","title":"Talker-T2AV: Joint Talking Audio-Video Generation with Autoregressive Diffusion Modeling","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-08T06:44:36.000353Z"},"links":{"cited_paper":"/paper/2410.07718","citing_paper":"/paper/2604.23586"},"observation_digest":"sha256:2c85220110b3ceb1dbac4e7409d79baa21b25a828e178dc3c4272c7e3450034c","observation_id":"6e8726f5-ca6b-4469-bbdd-86eb19d08c1c","resolution":{"observed_at":"2026-05-11T21:06:14.180854Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07718","last_updated":"2024-10-14T13:35:17Z","snapshot_observed_at":"2026-08-05T03:23:39.587839Z","submitted_at":"2024-10-10T08:34:41Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","version":2},"cited_work":{"arxiv_id":"2410.07718","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07718","snapshot_observed_at":"2026-07-01T21:46:15.594455Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","venue":null,"work_id":"a36f46e1-e536-4499-b2bc-ed760196c9cf","year":2024},"citing_paper":{"arxiv_id":"2604.23632","last_updated":"2026-04-26T09:46:58Z","snapshot_observed_at":"2026-07-06T23:09:48.137856Z","submitted_at":"2026-04-26T09:46:58Z","title":"Hallo-Live: Real-Time Streaming Joint Audio-Video Avatar Generation with Asynchronous Dual-Stream and Human-Centric Preference Distillation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-08T06:56:19.795651Z"},"links":{"cited_paper":"/paper/2410.07718","citing_paper":"/paper/2604.23632"},"observation_digest":"sha256:78c7d967a1a549663aa696b198ea86624fbe86786f3083943a9c9bf4b354437f","observation_id":"b82dc350-6589-4fd9-ae47-fee333ec6da1","resolution":{"observed_at":"2026-05-11T21:06:12.812027Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07718","last_updated":"2024-10-14T13:35:17Z","snapshot_observed_at":"2026-08-05T03:23:39.587839Z","submitted_at":"2024-10-10T08:34:41Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","version":2},"cited_work":{"arxiv_id":"2410.07718","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07718","snapshot_observed_at":"2026-07-01T21:46:15.594455Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","venue":null,"work_id":"a36f46e1-e536-4499-b2bc-ed760196c9cf","year":2024},"citing_paper":{"arxiv_id":"2605.02948","last_updated":"2026-05-11T03:04:55Z","snapshot_observed_at":"2026-08-01T16:25:56.041910Z","submitted_at":"2026-05-01T16:38:06Z","title":"AsymTalker: Identity-Consistent Long-Term Talking Head Generation via Asymmetric Distillation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-09T20:19:39.565157Z"},"links":{"cited_paper":"/paper/2410.07718","citing_paper":"/paper/2605.02948"},"observation_digest":"sha256:6623badaeaf9d5ad8656a8a41174259e8391429311a4c8e6c74181cfc567542d","observation_id":"2fe91509-114e-4f7b-b718-75bea44c002c","resolution":{"observed_at":"2026-05-11T15:16:11.446098Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07718","last_updated":"2024-10-14T13:35:17Z","snapshot_observed_at":"2026-08-05T03:23:39.587839Z","submitted_at":"2024-10-10T08:34:41Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","version":2},"cited_work":{"arxiv_id":"2410.07718","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07718","snapshot_observed_at":"2026-07-01T21:46:15.594455Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","venue":null,"work_id":"a36f46e1-e536-4499-b2bc-ed760196c9cf","year":2024},"citing_paper":{"arxiv_id":"2605.02948","last_updated":"2026-05-11T03:04:55Z","snapshot_observed_at":"2026-08-01T16:25:56.041910Z","submitted_at":"2026-05-01T16:38:06Z","title":"AsymTalker: Identity-Consistent Long-Term Talking Head Generation via Asymmetric Distillation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-11T02:18:58.996355Z"},"links":{"cited_paper":"/paper/2410.07718","citing_paper":"/paper/2605.02948"},"observation_digest":"sha256:20f23ba803042ffed422c42ffa5c966b7e1ab9c38422a17e1fac9d99d6075dc4","observation_id":"df2841fd-a245-42a7-889f-8565b1735a39","resolution":{"observed_at":"2026-05-11T03:45:57.382344Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07718","last_updated":"2024-10-14T13:35:17Z","snapshot_observed_at":"2026-08-05T03:23:39.587839Z","submitted_at":"2024-10-10T08:34:41Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","version":2},"cited_work":{"arxiv_id":"2410.07718","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07718","snapshot_observed_at":"2026-07-01T21:46:15.594455Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","venue":null,"work_id":"a36f46e1-e536-4499-b2bc-ed760196c9cf","year":2024},"citing_paper":{"arxiv_id":"2605.17248","last_updated":"2026-05-17T04:10:55Z","snapshot_observed_at":"2026-08-02T22:41:54.302633Z","submitted_at":"2026-05-17T04:10:55Z","title":"Image-to-Video Diffusion: From Foundations to Open Frontiers","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-20T15:06:02.084336Z"},"links":{"cited_paper":"/paper/2410.07718","citing_paper":"/paper/2605.17248"},"observation_digest":"sha256:825196c1a7e4b1c1c3f76bd18f2784c8689e7286169ea017bb0c40197a06050a","observation_id":"ae3e1715-0ae4-4eb5-ae40-1be6464048d9","resolution":{"observed_at":"2026-05-20T15:08:24.973274Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07718","last_updated":"2024-10-14T13:35:17Z","snapshot_observed_at":"2026-08-05T03:23:39.587839Z","submitted_at":"2024-10-10T08:34:41Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","version":2},"cited_work":{"arxiv_id":"2410.07718","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07718","snapshot_observed_at":"2026-07-01T21:46:15.594455Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","venue":null,"work_id":"a36f46e1-e536-4499-b2bc-ed760196c9cf","year":2024},"citing_paper":{"arxiv_id":"2605.25488","last_updated":"2026-05-25T06:45:29Z","snapshot_observed_at":"2026-08-02T09:17:40.384654Z","submitted_at":"2026-05-25T06:45:29Z","title":"Test-Time Self-Adaptive Conditioning for Stable Audio-Driven Talking-Head Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T22:36:53.138354Z"},"links":{"cited_paper":"/paper/2410.07718","citing_paper":"/paper/2605.25488"},"observation_digest":"sha256:7f7b7c7ef703c1f2c2a9845707a2bf08a960ac61d68d57d41fd8a9910abb4d20","observation_id":"04324c47-4557-4776-a937-9738122cda53","resolution":{"observed_at":"2026-06-29T22:44:01.682150Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07718","last_updated":"2024-10-14T13:35:17Z","snapshot_observed_at":"2026-08-05T03:23:39.587839Z","submitted_at":"2024-10-10T08:34:41Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","version":2},"cited_work":{"arxiv_id":"2410.07718","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07718","snapshot_observed_at":"2026-07-01T21:46:15.594455Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","venue":null,"work_id":"a36f46e1-e536-4499-b2bc-ed760196c9cf","year":2024},"citing_paper":{"arxiv_id":"2606.01031","last_updated":"2026-05-31T05:44:42Z","snapshot_observed_at":"2026-07-06T23:41:39.172310Z","submitted_at":"2026-05-31T05:44:42Z","title":"Temporally-Aligned Evaluation for Audio-Driven Talking Head Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-28T16:19:55.048831Z"},"links":{"cited_paper":"/paper/2410.07718","citing_paper":"/paper/2606.01031"},"observation_digest":"sha256:699594884d73a9286ad6481e4546ee90845b9025426632eb128ad04dbfb8d77a","observation_id":"f94e1102-ae94-45f9-a924-002237519f39","resolution":{"observed_at":"2026-07-01T21:46:15.595923Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07718","last_updated":"2024-10-14T13:35:17Z","snapshot_observed_at":"2026-08-05T03:23:39.587839Z","submitted_at":"2024-10-10T08:34:41Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","version":2},"cited_work":{"arxiv_id":"2410.07718","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07718","snapshot_observed_at":"2026-07-01T21:46:15.594455Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","venue":null,"work_id":"a36f46e1-e536-4499-b2bc-ed760196c9cf","year":2024},"citing_paper":{"arxiv_id":"2606.30019","last_updated":"2026-06-29T09:23:53Z","snapshot_observed_at":"2026-08-02T07:09:08.026518Z","submitted_at":"2026-06-29T09:23:53Z","title":"OmniDance: Multimodal Driven Dance Video Generation with Large-scale Internet Data","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T06:35:58.943585Z"},"links":{"cited_paper":"/paper/2410.07718","citing_paper":"/paper/2606.30019"},"observation_digest":"sha256:a233593cc46d6f84fd6b44af0038c5db835dca71957871db44783492c4982bbe","observation_id":"5ebf10fb-1614-4105-a973-0a5927c1d4d1","resolution":{"observed_at":"2026-06-30T06:44:19.601000Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07718","last_updated":"2024-10-14T13:35:17Z","snapshot_observed_at":"2026-08-05T03:23:39.587839Z","submitted_at":"2024-10-10T08:34:41Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","version":2},"cited_work":{"arxiv_id":"2410.07718","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07718","snapshot_observed_at":"2026-07-01T21:46:15.594455Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","venue":null,"work_id":"a36f46e1-e536-4499-b2bc-ed760196c9cf","year":2024},"citing_paper":{"arxiv_id":"2606.31088","last_updated":"2026-07-29T10:27:50Z","snapshot_observed_at":"2026-08-02T09:27:54.270412Z","submitted_at":"2026-06-30T03:27:23Z","title":"Towards Flexible, Natural, Efficient Interaction for Conversational Talking Face Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-01T06:26:20.283349Z"},"links":{"cited_paper":"/paper/2410.07718","citing_paper":"/paper/2606.31088"},"observation_digest":"sha256:62d74e0cf9a314bfad023e0a09f8dc61c7183d4cf502dba311346761b8795bb4","observation_id":"0f139d01-4afd-452c-a170-dc951abaa70b","resolution":{"observed_at":"2026-07-01T09:35:40.322410Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07718","last_updated":"2024-10-14T13:35:17Z","snapshot_observed_at":"2026-08-05T03:23:39.587839Z","submitted_at":"2024-10-10T08:34:41Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07718","snapshot_observed_at":"2026-08-02T09:27:55.261808Z","title":"arXiv preprint arXiv:2410.07718 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.31088","last_updated":"2026-07-29T10:27:50Z","snapshot_observed_at":"2026-08-02T09:27:54.270412Z","submitted_at":"2026-06-30T03:27:23Z","title":"Towards Flexible, Natural, Efficient Interaction for Conversational Talking Face Generation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T09:27:55.261808Z"},"links":{"cited_paper":"/paper/2410.07718","citing_paper":"/paper/2606.31088"},"observation_digest":"sha256:53a3e31ac037e05c88e88229672530230627bcc36a67411953a24fc681a83927","observation_id":"e92832fa-9631-44af-a48d-dd43c8172355","resolution":{"observed_at":"2026-08-02T09:27:55.261808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07718","last_updated":"2024-10-14T13:35:17Z","snapshot_observed_at":"2026-08-05T03:23:39.587839Z","submitted_at":"2024-10-10T08:34:41Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07718","snapshot_observed_at":"2026-08-01T09:02:19.214740Z","title":"Hallo2: Long-duration and high-resolution audio-driven portrait image animation.arXiv preprint arXiv:2410.07718, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20922","last_updated":"2026-07-23T04:57:22Z","snapshot_observed_at":"2026-08-01T09:02:11.314743Z","submitted_at":"2026-07-23T04:57:22Z","title":"FA-LAM: Focus-Aware Large Avatar Model for One-Shot 4D Animatable Gaussian Head","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T09:02:19.214740Z"},"links":{"cited_paper":"/paper/2410.07718","citing_paper":"/paper/2607.20922"},"observation_digest":"sha256:6b30af60df42c95403648f9994bcae7118a9c1857bb2542f8d9decc8fdc005f6","observation_id":"73216a48-287c-4f7c-90d1-e3f5260b229a","resolution":{"observed_at":"2026-08-01T09:02:19.214740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07718","last_updated":"2024-10-14T13:35:17Z","snapshot_observed_at":"2026-08-05T03:23:39.587839Z","submitted_at":"2024-10-10T08:34:41Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07718","snapshot_observed_at":"2026-08-04T17:26:50.715253Z","title":"arXiv preprint arXiv:2410.07718 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01978","last_updated":"2026-08-03T09:41:59Z","snapshot_observed_at":"2026-08-05T11:39:57.879257Z","submitted_at":"2026-08-03T09:41:59Z","title":"Proxy Avatar Meets Low-Rank Caching: Real-Time One-Shot Emotion-Controllable Portrait Animation","version":1},"reference_index":109,"source":"arxiv_source","source_observed_at":"2026-08-04T17:26:50.715253Z"},"links":{"cited_paper":"/paper/2410.07718","citing_paper":"/paper/2608.01978"},"observation_digest":"sha256:d77bc35112aabb0466679a88a19ce18466215849bf1728c2985915de7a8078d7","observation_id":"3b449691-410d-4e27-a27a-9c37f1d6f9d1","resolution":{"observed_at":"2026-08-04T17:26:50.715253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2410.07718/citation-record","integrity":"/paper/2410.07718/integrity","json":"/paper/2410.07718/citation-record.json","paper":"/paper/2410.07718"},"outbound":[],"paper":{"arxiv_id":"2410.07718","last_updated":"2024-10-14T13:35:17Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-05T03:23:39.587839Z","submitted_at":"2024-10-10T08:34:41Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 20 inbound Pith citation observations for arXiv:2410.07718."}