{"as_of":"2026-08-22T01:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ee3c9c4fa34de192192b04d0543aec4707b1239e0f67753eb6bde4a3818e9551","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":15,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T18:47:48.969366Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-15T22:20:22.389622Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2409.01876","last_updated":"2025-04-05T05:31:38Z","snapshot_observed_at":"2026-08-19T21:16:46.905576Z","submitted_at":"2024-09-03T13:19:31Z","title":"CyberHost: Taming Audio-driven Avatar Diffusion Model with Region Codebook Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01876","snapshot_observed_at":"2026-08-11T06:04:29.441503Z","title":"Cyberhost: Taming audio- driven avatar diffusion model with region codebook atten- tion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16915","last_updated":"2025-04-04T06:07:56Z","snapshot_observed_at":"2026-08-13T21:37:31.598943Z","submitted_at":"2024-12-22T08:19:22Z","title":"FADA: Fast Diffusion Avatar Synthesis with Mixed-Supervised Multi-CFG Distillation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T06:04:29.441503Z"},"links":{"cited_paper":"/paper/2409.01876","citing_paper":"/paper/2412.16915"},"observation_digest":"sha256:19c7a6f56908597c4af2bf40b8d508f054638b0f91b5b8600f6a466dc75852f1","observation_id":"6d7f08c3-fe76-4136-905a-fa240c155c0a","resolution":{"observed_at":"2026-08-11T06:04:29.441503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01876","last_updated":"2025-04-05T05:31:38Z","snapshot_observed_at":"2026-08-19T21:16:46.905576Z","submitted_at":"2024-09-03T13:19:31Z","title":"CyberHost: Taming Audio-driven Avatar Diffusion Model with Region Codebook Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01876","snapshot_observed_at":"2026-08-10T20:25:06.057752Z","title":"Cyberhost: Taming audio- driven avatar diffusion model with region codebook atten- tion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08649","last_updated":"2025-01-15T08:24:35Z","snapshot_observed_at":"2026-08-18T10:26:05.917744Z","submitted_at":"2025-01-15T08:24:35Z","title":"Joint Learning of Depth and Appearance for Portrait Image Animation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:06.057752Z"},"links":{"cited_paper":"/paper/2409.01876","citing_paper":"/paper/2501.08649"},"observation_digest":"sha256:8d264ca6bafe7be1742a5f80af684e39fcd0442fa29e751bbbccf6e6ab91993c","observation_id":"82600da0-044b-4226-bcbf-aad73e472a8b","resolution":{"observed_at":"2026-08-10T20:25:06.057752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01876","last_updated":"2025-04-05T05:31:38Z","snapshot_observed_at":"2026-08-19T21:16:46.905576Z","submitted_at":"2024-09-03T13:19:31Z","title":"CyberHost: Taming Audio-driven Avatar Diffusion Model with Region Codebook Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01876","snapshot_observed_at":"2026-08-10T19:07:45.078919Z","title":"Cyberhost: Taming audio-driven avatar diffusion model with region codebook attention, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10687","last_updated":"2025-01-18T07:51:29Z","snapshot_observed_at":"2026-08-21T19:00:26.945663Z","submitted_at":"2025-01-18T07:51:29Z","title":"EMO2: End-Effector Guided Audio-Driven Avatar Video Generation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-10T19:07:45.078919Z"},"links":{"cited_paper":"/paper/2409.01876","citing_paper":"/paper/2501.10687"},"observation_digest":"sha256:fbcc0f891d19a856d071a4794602b70904e10ea07cb26a5c86793dac0f7f1c56","observation_id":"a1c41a43-2780-4aa2-8759-0477c9e9f580","resolution":{"observed_at":"2026-08-10T19:07:45.078919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01876","last_updated":"2025-04-05T05:31:38Z","snapshot_observed_at":"2026-08-19T21:16:46.905576Z","submitted_at":"2024-09-03T13:19:31Z","title":"CyberHost: Taming Audio-driven Avatar Diffusion Model with Region Codebook Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01876","snapshot_observed_at":"2026-08-08T21:16:16.518388Z","title":"Cyberhost: Taming audio- driven avatar diffusion model with region codebook atten- tion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04847","last_updated":"2025-08-04T07:36:34Z","snapshot_observed_at":"2026-08-15T05:59:56.592267Z","submitted_at":"2025-02-07T11:36:36Z","title":"HumanDiT: Pose-Guided Diffusion Transformer for Long-form Human Motion Video Generation","version":5},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T21:16:16.518388Z"},"links":{"cited_paper":"/paper/2409.01876","citing_paper":"/paper/2502.04847"},"observation_digest":"sha256:1c2306ae1193f09b1fd035fa62cc99b3f690c2a63b2fc415ed4431ee985ae2e0","observation_id":"95f0d104-63d7-4cfe-b340-b57b9e71ad3d","resolution":{"observed_at":"2026-08-08T21:16:16.518388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01876","last_updated":"2025-04-05T05:31:38Z","snapshot_observed_at":"2026-08-19T21:16:46.905576Z","submitted_at":"2024-09-03T13:19:31Z","title":"CyberHost: Taming Audio-driven Avatar Diffusion Model with Region Codebook Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01876","snapshot_observed_at":"2026-08-07T14:02:28.276147Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20156","last_updated":"2025-06-03T15:15:31Z","snapshot_observed_at":"2026-08-19T03:06:29.083756Z","submitted_at":"2025-05-26T15:57:27Z","title":"HunyuanVideo-Avatar: High-Fidelity Audio-Driven Human Animation for Multiple Characters","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:02:28.276147Z"},"links":{"cited_paper":"/paper/2409.01876","citing_paper":"/paper/2505.20156"},"observation_digest":"sha256:6660ae6d14ef430804e863cb6a74203e4437c585bfc67caac737d79360a4236a","observation_id":"e7535f10-8dfe-4ede-9af2-d9dcacc654a6","resolution":{"observed_at":"2026-08-07T14:02:28.276147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01876","last_updated":"2025-04-05T05:31:38Z","snapshot_observed_at":"2026-08-19T21:16:46.905576Z","submitted_at":"2024-09-03T13:19:31Z","title":"CyberHost: Taming Audio-driven Avatar Diffusion Model with Region Codebook Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01876","snapshot_observed_at":"2026-08-07T10:18:24.579865Z","title":"Cyberhost: Taming audio-driven avatar diffusion model with region codebook attention.arXiv preprint arXiv:2409.01876, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05806","last_updated":"2025-06-06T07:09:07Z","snapshot_observed_at":"2026-08-18T10:26:01.171354Z","submitted_at":"2025-06-06T07:09:07Z","title":"LLIA -- Enabling Low-Latency Interactive Avatars: Real-Time Audio-Driven Portrait Video Generation with Diffusion Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:24.579865Z"},"links":{"cited_paper":"/paper/2409.01876","citing_paper":"/paper/2506.05806"},"observation_digest":"sha256:2dbc3dc143098c2b281e7c9341a9b57710cb09f49f14763cb57c0d71c4025418","observation_id":"4a76ebc3-cbf2-4246-8763-529b4b596b24","resolution":{"observed_at":"2026-08-07T10:18:24.579865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01876","last_updated":"2025-04-05T05:31:38Z","snapshot_observed_at":"2026-08-19T21:16:46.905576Z","submitted_at":"2024-09-03T13:19:31Z","title":"CyberHost: Taming Audio-driven Avatar Diffusion Model with Region Codebook Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01876","snapshot_observed_at":"2026-08-07T05:07:15.069517Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08797","last_updated":"2026-07-24T09:02:20Z","snapshot_observed_at":"2026-08-20T23:43:22.344539Z","submitted_at":"2025-06-10T13:45:00Z","title":"HunyuanVideo-HOMA: Generic Human-Object Interaction in Multimodal Driven Human Animation","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T05:07:15.069517Z"},"links":{"cited_paper":"/paper/2409.01876","citing_paper":"/paper/2506.08797"},"observation_digest":"sha256:42f7953eb8be393d00469397a04cb4987b1a54a6445a175ae938acd115afb99d","observation_id":"cfd25029-0362-4163-8bca-e628478d122c","resolution":{"observed_at":"2026-08-07T05:07:15.069517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01876","last_updated":"2025-04-05T05:31:38Z","snapshot_observed_at":"2026-08-19T21:16:46.905576Z","submitted_at":"2024-09-03T13:19:31Z","title":"CyberHost: Taming Audio-driven Avatar Diffusion Model with Region Codebook Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01876","snapshot_observed_at":"2026-08-15T18:47:48.969366Z","title":"Lin, G.; Jiang, J.; Yang, J.; Zheng, Z.; and Liang, C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18866","last_updated":"2025-06-23T17:33:03Z","snapshot_observed_at":"2026-08-20T08:51:50.797362Z","submitted_at":"2025-06-23T17:33:03Z","title":"OmniAvatar: Efficient Audio-Driven Avatar Video Generation with Adaptive Body Animation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T18:47:48.969366Z"},"links":{"cited_paper":"/paper/2409.01876","citing_paper":"/paper/2506.18866"},"observation_digest":"sha256:72cc2e758e1205b653e2feeccb489b7003d655bfb2245054fb0739204bca16ba","observation_id":"bef286cd-91bc-46eb-a97f-07d4dd01e09e","resolution":{"observed_at":"2026-08-15T18:47:48.969366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01876","last_updated":"2025-04-05T05:31:38Z","snapshot_observed_at":"2026-08-19T21:16:46.905576Z","submitted_at":"2024-09-03T13:19:31Z","title":"CyberHost: Taming Audio-driven Avatar Diffusion Model with Region Codebook Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01876","snapshot_observed_at":"2026-08-06T20:58:25.954676Z","title":"Cyberhost: Taming audio- driven avatar diffusion model with region codebook atten- tion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01390","last_updated":"2025-07-02T06:10:52Z","snapshot_observed_at":"2026-08-14T07:12:00.142810Z","submitted_at":"2025-07-02T06:10:52Z","title":"FixTalk: Taming Identity Leakage for High-Quality Talking Head Generation in Extreme Cases","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T20:58:25.954676Z"},"links":{"cited_paper":"/paper/2409.01876","citing_paper":"/paper/2507.01390"},"observation_digest":"sha256:492973fd165b90dea2999477ca6fc5d53aae79a9120ca7308367e3e67ff1b126","observation_id":"116419c8-75ac-4a35-a5cc-d9c71e95eac8","resolution":{"observed_at":"2026-08-06T20:58:25.954676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01876","last_updated":"2025-04-05T05:31:38Z","snapshot_observed_at":"2026-08-19T21:16:46.905576Z","submitted_at":"2024-09-03T13:19:31Z","title":"CyberHost: Taming Audio-driven Avatar Diffusion Model with Region Codebook Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01876","snapshot_observed_at":"2026-08-05T19:07:35.849232Z","title":"Cyberhost: Taming audio-driven avatar diffusion model with region codebook attention,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.13442","last_updated":"2025-08-19T01:55:25Z","snapshot_observed_at":"2026-08-18T01:56:32.902193Z","submitted_at":"2025-08-19T01:55:25Z","title":"EDTalk++: Full Disentanglement for Controllable Talking Head Synthesis","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T19:07:35.849232Z"},"links":{"cited_paper":"/paper/2409.01876","citing_paper":"/paper/2508.13442"},"observation_digest":"sha256:f87681e115c996f027fd5e4fceca62e6f281bfa5f462e4fd8408196e230e8fcc","observation_id":"ef699690-c396-468d-82c0-b52ebe43f6e2","resolution":{"observed_at":"2026-08-05T19:07:35.849232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01876","last_updated":"2025-04-05T05:31:38Z","snapshot_observed_at":"2026-08-19T21:16:46.905576Z","submitted_at":"2024-09-03T13:19:31Z","title":"CyberHost: Taming Audio-driven Avatar Diffusion Model with Region Codebook Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01876","snapshot_observed_at":"2026-08-05T15:19:37.173088Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20210","last_updated":"2025-08-27T18:36:30Z","snapshot_observed_at":"2026-08-11T09:08:07.295323Z","submitted_at":"2025-08-27T18:36:30Z","title":"InfinityHuman: Towards Long-Term Audio-Driven Human","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:37.173088Z"},"links":{"cited_paper":"/paper/2409.01876","citing_paper":"/paper/2508.20210"},"observation_digest":"sha256:788b45e50260847534cafcd4b4d31f70355329f441c7fe71614a688aef619376","observation_id":"3022cb00-cc3f-403b-b724-35d80d10d2ff","resolution":{"observed_at":"2026-08-05T15:19:37.173088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01876","last_updated":"2025-04-05T05:31:38Z","snapshot_observed_at":"2026-08-19T21:16:46.905576Z","submitted_at":"2024-09-03T13:19:31Z","title":"CyberHost: Taming Audio-driven Avatar Diffusion Model with Region Codebook Attention","version":3},"cited_work":{"arxiv_id":"2409.01876","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.01876","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cyberhost: Taming audio-driven avatar diffu- sion model with region codebook attention","venue":null,"work_id":"4d5b3f61-dded-4eb3-a1a6-e3ba749f2d32","year":2024},"citing_paper":{"arxiv_id":"2602.13669","last_updated":"2026-04-22T07:41:44Z","snapshot_observed_at":"2026-08-11T04:55:53.338738Z","submitted_at":"2026-02-14T08:32:38Z","title":"EchoTorrent: Towards Swift, Sustained, and Streaming Multi-Modal Video Generation","version":5},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-15T22:20:16.320171Z"},"links":{"cited_paper":"/paper/2409.01876","citing_paper":"/paper/2602.13669"},"observation_digest":"sha256:ab0d644991eccbe96d5b243a1280434079b8397ca2ecc9ebec7b4e518997db98","observation_id":"494aa347-bf7a-4c9f-9295-dede8215a7ae","resolution":{"observed_at":"2026-05-15T22:20:22.393304Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01876","last_updated":"2025-04-05T05:31:38Z","snapshot_observed_at":"2026-08-19T21:16:46.905576Z","submitted_at":"2024-09-03T13:19:31Z","title":"CyberHost: Taming Audio-driven Avatar Diffusion Model with Region Codebook Attention","version":3},"cited_work":{"arxiv_id":"2409.01876","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.01876","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cyberhost: Taming audio-driven avatar diffu- sion model with region codebook attention","venue":null,"work_id":"4d5b3f61-dded-4eb3-a1a6-e3ba749f2d32","year":2024},"citing_paper":{"arxiv_id":"2604.19636","last_updated":"2026-04-21T16:25:43Z","snapshot_observed_at":"2026-08-15T00:39:55.994416Z","submitted_at":"2026-04-21T16:25:43Z","title":"CoInteract: Physically-Consistent Human-Object Interaction Video Synthesis via Spatially-Structured Co-Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-10T03:14:45.834520Z"},"links":{"cited_paper":"/paper/2409.01876","citing_paper":"/paper/2604.19636"},"observation_digest":"sha256:20a847c71dccef003209a0efbab20a6e6baf34ee58acc8c2e66a1d078b7c3713","observation_id":"ee7d7163-f085-4500-bac4-0b306139681c","resolution":{"observed_at":"2026-05-11T12:41:04.452982Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01876","last_updated":"2025-04-05T05:31:38Z","snapshot_observed_at":"2026-08-19T21:16:46.905576Z","submitted_at":"2024-09-03T13:19:31Z","title":"CyberHost: Taming Audio-driven Avatar Diffusion Model with Region Codebook Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01876","snapshot_observed_at":"2026-08-01T05:27:17.814966Z","title":"Cyberhost: Taming audio- driven avatar diffusion model with region codebook atten- tion.arXiv preprint arXiv:2409.01876, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22241","last_updated":"2026-07-30T03:34:42Z","snapshot_observed_at":"2026-08-15T05:30:04.018365Z","submitted_at":"2026-07-24T12:17:57Z","title":"AgentHOI: Multi-Agent Reasoning for Human-Object-Interaction Video Generation via Implicit Representation Alignment","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T05:27:17.814966Z"},"links":{"cited_paper":"/paper/2409.01876","citing_paper":"/paper/2607.22241"},"observation_digest":"sha256:9c81a460ae9ded08bf9192291af61b2baeaffac5c38c2e70ca75c19c19bd74cc","observation_id":"8ac299f8-45cc-4570-b2e1-bb876963de7d","resolution":{"observed_at":"2026-08-01T05:27:17.814966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01876","last_updated":"2025-04-05T05:31:38Z","snapshot_observed_at":"2026-08-19T21:16:46.905576Z","submitted_at":"2024-09-03T13:19:31Z","title":"CyberHost: Taming Audio-driven Avatar Diffusion Model with Region Codebook Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01876","snapshot_observed_at":"2026-08-06T18:10:19.841581Z","title":"arXiv preprint arXiv:2409.01876 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04722","last_updated":"2026-08-05T11:43:21Z","snapshot_observed_at":"2026-08-18T15:02:01.785358Z","submitted_at":"2026-08-05T11:43:21Z","title":"Multi-View Face and Gesture Animation with Dynamic Gaussians","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-06T18:10:19.841581Z"},"links":{"cited_paper":"/paper/2409.01876","citing_paper":"/paper/2608.04722"},"observation_digest":"sha256:66246fd56b6934514bc6beb494387b621eb5dac4a3a559879d1d7692460dc7a5","observation_id":"6396fe44-4f99-4e34-a201-139ff0df4eda","resolution":{"observed_at":"2026-08-06T18:10:19.841581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2409.01876/citation-record","integrity":"/paper/2409.01876/integrity","json":"/paper/2409.01876/citation-record.json","paper":"/paper/2409.01876"},"outbound":[],"paper":{"arxiv_id":"2409.01876","last_updated":"2025-04-05T05:31:38Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-19T21:16:46.905576Z","submitted_at":"2024-09-03T13:19:31Z","title":"CyberHost: Taming Audio-driven Avatar Diffusion Model with Region Codebook Attention"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 15 inbound Pith citation observations for arXiv:2409.01876."}