{"as_of":"2026-08-16T06:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ea93f53c04b661ce6d05289339f388a74f940db47adfd64d241c05d2535edd43","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T17:24:39.806529Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T22:46:51.954117Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-16T22:48:38.154699Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"cited_work":{"arxiv_id":"2508.12438","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.12438","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Training Status-Model Type-Annotation Type-Representation Format","venue":null,"work_id":"9d35d0b8-67de-44fd-9fd6-78e0b41c445d","year":2025},"citing_paper":{"arxiv_id":"2512.11321","last_updated":"2026-05-12T04:50:53Z","snapshot_observed_at":"2026-08-10T21:23:14.950037Z","submitted_at":"2025-12-12T06:45:02Z","title":"KeyframeFace: Language-Driven Facial Animation via Semantic Keyframes","version":4},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-16T22:46:51.954117Z"},"links":{"cited_paper":"/paper/2508.12438","citing_paper":"/paper/2512.11321"},"observation_digest":"sha256:63470921f5c165f3436fc82aa4f6eb527a646361891badeebe0fdcc5f9e7eca4","observation_id":"e78fe670-2602-45e0-9aea-0113f834cfb4","resolution":{"observed_at":"2026-05-16T22:48:38.156882Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.12438/citation-record","integrity":"/paper/2508.12438/integrity","json":"/paper/2508.12438/citation-record.json","paper":"/paper/2508.12438"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.617763Z","title":"https://www.metahuman.com/ en-US?lang=en-US","venue":null,"work_id":"da7621d1-bab2-4f78-860b-2394f640d8a6","year":2025},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.583922Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:ad64fbf483ca0ded5e06324b47c1a948f42c91758f804ad686616bbe09209e28","observation_id":"7c4be775-75c7-4c92-9413-bbc7aace2a3d","resolution":{"observed_at":"2026-08-15T17:24:40.623548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-15T17:24:39.589474Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.589474Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:50cb9730f60d5cf1b47fa7697ba621febf77aaf2fb068b36e96c0a64412f9053","observation_id":"aa661dc9-8640-4eed-9135-580e7a2cfca4","resolution":{"observed_at":"2026-08-15T17:24:39.589474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.599719Z","title":"Detecting deep-fake videos from phoneme- viseme mismatches","venue":null,"work_id":"e49e59e3-eb82-4fc3-a673-c04c747c687b","year":2020},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.594637Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:c7deb6fca3a1aca7d8aabda1c74bfe25890d4cb39546b96d28bb394e4c0624dc","observation_id":"20825932-18cd-4390-8ac8-13eda5feeb96","resolution":{"observed_at":"2026-08-15T17:24:40.606013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.581688Z","title":"Claude 3","venue":null,"work_id":"e4183cf0-58c0-45a0-980c-77a5f2b38cd1","year":2024},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.599927Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:4e8a77877c7e20e8e22301616a1d149270e88433f1d28668878a41657d1d02d6","observation_id":"1d6c3876-0886-4ede-b753-3223ba06207f","resolution":{"observed_at":"2026-08-15T17:24:40.586945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.565535Z","title":"ARKit — apple developer documen- tation","venue":null,"work_id":"6c79595f-ca5c-4fd2-9cfa-aed300959d81","year":2025},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.604734Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:c6e45e8274498ecfb3536af4699141f871178821594e235890c5ac7111e6ce4e","observation_id":"2be64196-176d-4fda-8b93-e7cc7b5fba57","resolution":{"observed_at":"2026-08-15T17:24:40.570524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.549193Z","title":"Live link face","venue":null,"work_id":"f717506e-131f-4fc8-a0bb-961616bf9a1e","year":2025},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.609601Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:0bf5aed025406efec10c813703fc2f18cbf9a693d37ed78e0f44e847b7511538","observation_id":"3f61061d-cb80-44f9-90c0-d35ec169e0b2","resolution":{"observed_at":"2026-08-15T17:24:40.554773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.533605Z","title":"A morphable model for the synthesis of 3d faces","venue":null,"work_id":"b3e6172d-8f37-467e-8959-ebba82b6e106","year":1999},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.614458Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:fdcec2f8c1fc6af4ffbeec14c243f4acd8aeeecc07c5c1d5df46410e7063df52","observation_id":"374a809f-e7f4-472c-bd72-801913f41794","resolution":{"observed_at":"2026-08-15T17:24:40.538599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:39.619850Z","title":"Align your latents: High-resolution video synthesis with la- tent diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.619850Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:7f9d64e0fbccd2e541d90dbb4447e6485ef6d9e1751af6e684cb009dbe74722f","observation_id":"5af7178e-41e2-40f2-b517-9bebed230943","resolution":{"observed_at":"2026-08-15T17:24:39.619850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.508835Z","title":null,"venue":null,"work_id":"34789e9d-8a8e-48ca-a1cc-a2d5bc0efbdf","year":2023},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.624323Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:e4a2316f4a6ea5bf375cf5f1d8d01e9cf4b5dd67d372197d4f776ca9c9bd40c2","observation_id":"32018ff8-76c6-45d0-a839-54a197da9292","resolution":{"observed_at":"2026-08-15T17:24:40.513642Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:39.628970Z","title":"Lan- guage models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.628970Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:4d9fa3c5e8abf2896417c93390fbb3221d12006445284640494505fe3473fcee","observation_id":"369448eb-595d-4565-adc7-08b15b6c1640","resolution":{"observed_at":"2026-08-15T17:24:39.628970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.479563Z","title":"4dfab: A large scale 4d database for facial ex- pression analysis and biometric applications","venue":null,"work_id":"74f3e174-6561-4fbf-938e-80052cd3c21c","year":2018},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.633417Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:e6f409ede5115cee5c7dfadd94012f75fc40172ce9c74609be08352f48090ffb","observation_id":"52ea2eb7-b419-44ee-91b9-05d35abb1344","resolution":{"observed_at":"2026-08-15T17:24:40.485282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.461950Z","title":"A facs valid 3d dynamic action unit database with applications to 3d dynamic morphable facial modeling","venue":null,"work_id":"9b311875-cf89-4976-b094-2ec95836fbe4","year":2011},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.637973Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:55befcdd18bfbe2cbfab8f398f81ba838d0cea8ef4d413e1ef57bb09b092f228","observation_id":"0d129c03-26f8-42d9-a373-acca0ff17a53","resolution":{"observed_at":"2026-08-15T17:24:40.467830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.444070Z","title":"Capture, learning, and synthesis of 3D speaking styles","venue":null,"work_id":"9384e24c-4af2-4348-971b-5fedad2318a9","year":2019},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.642685Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:5163c0d0ea66d904d564d7e950905874ce58ed59d74a0b170a5523af792e5dbc","observation_id":"02d36d20-d0ad-42ac-9422-e77fc94cd1f1","resolution":{"observed_at":"2026-08-15T17:24:40.449661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:39.647365Z","title":"3d morphable face models—past, present, and future","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.647365Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:6e9cc2e1b5846099f321b12593ef72fcc70f32b0cb26719d8092ba1d38e036d5","observation_id":"3f70d34e-c072-419e-89d8-50ada5c24bdc","resolution":{"observed_at":"2026-08-15T17:24:39.647365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:39.652048Z","title":"Facial action coding system","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.652048Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:0f74c3fa5fe4c5903d1b0427067f71aa5f2f3ed71cc21c12944a6da9134ba8d9","observation_id":"e02dee8a-af16-4078-aa2e-67245b602bee","resolution":{"observed_at":"2026-08-15T17:24:39.652048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.406600Z","title":"Faceformer: Speech-driven 3d facial anima- tion with transformers","venue":null,"work_id":"4d8db0cd-6797-4d3a-9c18-3b4eaa802c91","year":2022},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.656547Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:f0024b4d9b53cc31887a33faa5a1921f08ed2fbcc43dc799ec367c62ce343bdf","observation_id":"3a6e9e1a-ae54-423b-a784-99f5f21c1066","resolution":{"observed_at":"2026-08-15T17:24:40.411715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.385851Z","title":"Text-based editing of talking-head video","venue":null,"work_id":"f64d4d61-4ae6-478b-8714-66b1a80dd837","year":2019},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.660989Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:99be316eb930436fca73cb0e7d3b40ba1b8e20adc923d55f0c7114085110cee7","observation_id":"d5047f57-051e-4470-a494-db03972b66bd","resolution":{"observed_at":"2026-08-15T17:24:40.393140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:39.665528Z","title":"Bermano, Gal Chechik, and Daniel Cohen-Or","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.665528Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:1a5f15982fb1ff349fee6c508e2dac65401abb3be943353fd6998fe1a42e8af5","observation_id":"c9f61106-9ee8-4f94-87ad-71eee781bf28","resolution":{"observed_at":"2026-08-15T17:24:39.665528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.353138Z","title":"Gemini 2.5 technical overview","venue":null,"work_id":"b11cc1e5-9960-4290-88cb-cdd5e30a4e73","year":2025},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.669939Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:6fe8d5be7e45f2f1adb9c0699c992bcedaddf3d17c67c3d8a3b066dcc5bcd875","observation_id":"693c15f4-163c-411b-819c-9156cd7aa264","resolution":{"observed_at":"2026-08-15T17:24:40.360075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.336147Z","title":"Generating diverse and natural 3d human motions from text","venue":null,"work_id":"82cd511a-f37b-4be8-82e7-45186660a730","year":2022},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.674309Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:23f60b624e4907197de7e71c2fbff9c1c94093d00ea71602b2b3ef3bfc14e82b","observation_id":"ca274bbe-2834-45cf-805b-214549f14e57","resolution":{"observed_at":"2026-08-15T17:24:40.341526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.314160Z","title":"Momask: Generative masked model- ing of 3d human motions","venue":null,"work_id":"8ccdcb2b-b63e-426a-b67e-7215c4296f80","year":1900},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.678659Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:e948fe8e4e962ec5573495b295edd98a8de901c0808bf968d0efb25c19939718","observation_id":"caaadfcd-4fdb-4657-81d7-1f515865ee43","resolution":{"observed_at":"2026-08-15T17:24:40.323491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.11239","last_updated":"2020-12-16T21:15:05Z","snapshot_observed_at":"2026-08-10T05:21:27.485481Z","submitted_at":"2020-06-19T17:24:44Z","title":"Denoising Diffusion Probabilistic Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.11239","snapshot_observed_at":"2026-08-15T17:24:39.683536Z","title":"Denoising diffu- sion probabilistic models","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.683536Z"},"links":{"cited_paper":"/paper/2006.11239","citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:4c741c4cc59fa0ccb8da69f4dfdf43aca2e3f255174cbe0df0f42570c36010d5","observation_id":"36650dbc-11ae-4797-80e2-cc81076f2d10","resolution":{"observed_at":"2026-08-15T17:24:39.683536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.297290Z","title":"Let’s face it: Influence of facial expressions on social presence in collaborative virtual real- ity","venue":null,"work_id":"aa25bdad-ef62-4d67-8e05-5299eca19ee3","year":2023},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.688633Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:38d8e6f825cd23a14d26df177af88e6e4e682007c5eb3cff8981dccb7104d57f","observation_id":"e198a876-8840-46ab-a819-5bf594707c08","resolution":{"observed_at":"2026-08-15T17:24:40.302791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.278598Z","title":"Fakeout: Leveraging out-of-domain self- supervision for multi-modal video deepfake detection","venue":null,"work_id":"cb55add8-ecc6-477c-8138-9e311c62a172","year":2022},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.693111Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:9d39be25d0b0173842371c7e952db68cd4cac621c57e457039599af96b096594","observation_id":"3622d02a-b49e-4548-98db-65c2a9bb7df1","resolution":{"observed_at":"2026-08-15T17:24:40.284789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:39.697315Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.697315Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:1c1af06f1b79a88a81b98f3ed8820fd1bbc925c4808ee095ce6d6fec8d323d2f","observation_id":"4f3087ba-22bf-4398-a0b4-3cce0bc8cb6b","resolution":{"observed_at":"2026-08-15T17:24:39.697315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:39.701674Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.701674Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:89e89e95c5b751ff5146b86ad78aee5cfaa186afe4e93a650cff2e4592a56c0a","observation_id":"508f0bb2-b890-4859-9322-ed130f62568d","resolution":{"observed_at":"2026-08-15T17:24:39.701674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.235968Z","title":"Latte: La- tent diffusion transformer for video generation.Transactions on Machine Learning Research, 2025","venue":null,"work_id":"601c2dfd-2546-4bc1-aee3-247a1d539552","year":2025},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.706102Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:e369389cc3ecab1c5ed5fccfbe9ba2b456825e30e8ebb0ba43ae4151a5afeefa","observation_id":"6c6e128e-98dd-475d-a20d-7e3ffe67e123","resolution":{"observed_at":"2026-08-15T17:24:40.241356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.217417Z","title":"The uncanny valley","venue":null,"work_id":"045da3d2-be4b-40af-b6c6-583ae5228f6c","year":1970},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.710371Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:dad9d0315e0806d59cb454e410b9b8c5eb1033ddc50f6e75d721cf364467de95","observation_id":"00ab718e-1ea1-4db6-b7e7-f25a1590a902","resolution":{"observed_at":"2026-08-15T17:24:40.222817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.200100Z","title":"Emotalk: Speech-driven emotional disentanglement for 3d face anima- tion","venue":null,"work_id":"08c6d628-2fef-48a7-b709-167b8e94739a","year":2023},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.714752Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:10bf7ad0109739dcd6684a36baa8d2f6f3287e7f1e82ad2035b1aad0d536a679","observation_id":"048d5965-46d0-44b3-b1fa-ac19408d6d66","resolution":{"observed_at":"2026-08-15T17:24:40.205493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.180972Z","title":"Principi, S","venue":null,"work_id":"c43db2e1-26a5-4ab4-ac5b-44436e3e512c","year":null},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.719492Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:df9378ccce9b12f4ddd3f6b5b4daaf63716f869e9111b446fc2a8e9ebe12538e","observation_id":"d4af6ab0-bcc2-494d-9b56-99ef8ace2063","resolution":{"observed_at":"2026-08-15T17:24:40.186090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.163349Z","title":"Monkey see, monkey do: Harnessing self- attention in motion diffusion for zero-shot motion transfer","venue":null,"work_id":"cdc93921-65d9-4c92-aac3-5c694114b454","year":2024},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.723959Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:3e23ce4dd75e34f90ba612ebbb900b63cb1182b75ddd014ab2ee178692399d70","observation_id":"ed2d99c2-714c-4301-a906-16c0ac07daf0","resolution":{"observed_at":"2026-08-15T17:24:40.169541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.147049Z","title":null,"venue":null,"work_id":"a8674fc4-3a8f-4e38-9d6a-21dff8fd49a1","year":2018},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.728621Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:194735aac99b8bf8f5adf834c4000ad32ef02d7892fa16c8cfa4adc9dd77ceff","observation_id":"dd9eb7e4-0e5e-4fc6-bd55-839ad66dc8d2","resolution":{"observed_at":"2026-08-15T17:24:40.152003Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:39.733210Z","title":"High-resolution image syn- thesis with latent diffusion models, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.733210Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:1a7a3610ad6c04ba61e0bd950d9f2f503ad8e988ae75dcbe7b252f98b72775b7","observation_id":"09f52bc3-9065-4615-8a1e-d2c138dcf27b","resolution":{"observed_at":"2026-08-15T17:24:39.733210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.117216Z","title":"Deep image fingerprint: To- wards low budget synthetic image detection and model lin- eage analysis","venue":null,"work_id":"18626d2a-f645-447e-b036-766ffb612798","year":2024},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.737637Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:3ea3609b197ab2172583426a3e113ad1fb06a73487368e6a72de7e846e1e2fcf","observation_id":"2a2a5447-b8ac-459a-9b32-f4ebbe7d813d","resolution":{"observed_at":"2026-08-15T17:24:40.123044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01469","last_updated":"2023-05-31T06:17:10Z","snapshot_observed_at":"2026-08-15T07:00:23.337991Z","submitted_at":"2023-03-02T18:30:16Z","title":"Consistency Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01469","snapshot_observed_at":"2026-08-15T17:24:39.742030Z","title":"Consistency models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.742030Z"},"links":{"cited_paper":"/paper/2303.01469","citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:b856051630c192abfc090585d051969f77baaf5bed3e6238da00871302735abd","observation_id":"391a8c41-9ceb-43c3-9aff-263b8722f408","resolution":{"observed_at":"2026-08-15T17:24:39.742030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.100419Z","title":"Human motion diffu- sion model","venue":null,"work_id":"a13e61e6-effd-45e7-9be6-e375e037f63f","year":2023},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.747272Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:1609f82678dffe7e5299debfe819cd74cbb32b092975afa969cdfb2d4329fb2c","observation_id":"6a83f664-fb3c-468b-9c71-4ff05da3471e","resolution":{"observed_at":"2026-08-15T17:24:40.105496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.083433Z","title":"Imitator: Personalized speech-driven 3d facial animation","venue":null,"work_id":"d9df7f81-6de2-4b0c-a309-f9d8df339ece","year":2023},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.752203Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:5e1179f0b95d7f0925f9dffba9cf747bd3f4aa0c81cfd51eb7e945e53aa31fcb","observation_id":"b42c9264-7cdf-479b-81e9-ea8af356fe63","resolution":{"observed_at":"2026-08-15T17:24:40.088867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.066626Z","title":"Audio2head: Audio-driven one-shot talking-head generation with natural head motion","venue":null,"work_id":"ed3f33ba-1baa-4b16-be28-c5c0de7920bb","year":2021},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.757222Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:169aa0650e78d41dc17c88e77a02e36ac948c92086c53b64453b9d3b639ca5cf","observation_id":"9978eefb-6cd2-49a8-901a-52c3e707682f","resolution":{"observed_at":"2026-08-15T17:24:40.072129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09797","last_updated":"2023-12-13T11:34:54Z","snapshot_observed_at":"2026-08-13T12:22:53.183215Z","submitted_at":"2023-03-17T06:43:08Z","title":"MMFace4D: A Large-Scale Multi-Modal 4D Face Dataset for Audio-Driven 3D Face Animation","version":2},"cited_work":{"arxiv_id":"2303.09797","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.09797","snapshot_observed_at":"2026-08-15T17:24:39.866568Z","title":"MMFace4D: A Large-Scale Multi-Modal 4D Face Dataset for Audio-Driven 3D Face Animation","venue":"cs.CV","work_id":"f10c2126-1de0-4a6d-99db-a24b24cf66be","year":2023},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.761754Z"},"links":{"cited_paper":"/paper/2303.09797","citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:515f9e8bf9809a807ab7bed9157946615e431db5ee74a2814f75e0610897c4b2","observation_id":"120ddf16-4495-467a-a96d-20ca1e9d0c95","resolution":{"observed_at":"2026-08-15T17:24:39.873623Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.048264Z","title":"Mmhead: Towards fine-grained multi- modal 3d facial animation","venue":null,"work_id":"8678c58f-4ad5-43c1-b5c2-6ab30c229ab7","year":null},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.766623Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:cb520a38e20edd0d4637e1779ab66c435200e76df030537f2e05a066ac03a469","observation_id":"16d24a38-982a-4ab4-8b33-106b79efc7e5","resolution":{"observed_at":"2026-08-15T17:24:40.053833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:39.771514Z","title":"Codetalker: Speech-driven 3d facial animation with discrete motion prior","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.771514Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:80b0329b8aba841a47b6f3e461a633ec2f8195c775baef951075ffd180bc6135","observation_id":"e51d1a18-c180-498f-80e9-05603c01c091","resolution":{"observed_at":"2026-08-15T17:24:39.771514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.020508Z","title":"Iterative text-based editing of talking-heads using neural retargeting","venue":null,"work_id":"385c6620-8b07-464b-8272-8b8b3e7a5dbb","year":2021},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.776286Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:712760d99210339c3ef65429fad1447474240c7bd84d9e13f66bd06eb7b16c0c","observation_id":"9c36d58a-4cd8-467e-87f3-3fb8874a7c86","resolution":{"observed_at":"2026-08-15T17:24:40.026251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.002740Z","title":"Generating holistic 3d human motion from speech","venue":null,"work_id":"54c61109-0edb-4b47-a5c8-09780e0780bd","year":2023},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.781815Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:f4be45b4724bcb9d7b945220b099f503dd0019427f536e3a3dbae72c8048b644","observation_id":"934a02f3-fdd7-4834-bb9a-a2574501e0db","resolution":{"observed_at":"2026-08-15T17:24:40.007911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.13578","last_updated":"2023-12-21T05:03:18Z","snapshot_observed_at":"2026-08-16T00:31:12.512685Z","submitted_at":"2023-12-21T05:03:18Z","title":"DREAM-Talk: Diffusion-based Realistic Emotional Audio-driven Method for Single Image Talking Face Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.13578","snapshot_observed_at":"2026-08-15T17:24:39.787022Z","title":"Dream-talk: Diffusion-based realistic emotional audio-driven method for single image talking face generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.787022Z"},"links":{"cited_paper":"/paper/2312.13578","citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:d3a8184daea05abcea486dd394f54a80856d00d6ecadb33f86b7c67ceedf32e6","observation_id":"43657689-dab9-45c3-aa1f-461a25f744a8","resolution":{"observed_at":"2026-08-15T17:24:39.787022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:39.986819Z","title":"Towards ai-driven sign language generation with non- manual markers","venue":null,"work_id":"3c087bb4-5019-4694-9d40-90fb60604483","year":2025},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.792270Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:405b6131ac9b2ef87aa7c6854a5bef53fda3b138076986f3cb317494049fdfc3","observation_id":"1f74a76f-1c51-40b0-9141-5a40245a91c5","resolution":{"observed_at":"2026-08-15T17:24:39.991830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:39.970231Z","title":"T2m-gpt: Generating human motion from textual de- scriptions with discrete representations","venue":null,"work_id":"156faba9-4e0b-4794-b116-21bfec0c2a09","year":2023},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.797351Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:1b940dfcca122e1a28cdad379f40925e5bf57120ba9c60eb3bfc8cce272326ea","observation_id":"943d152b-292c-43df-bdf8-6763f4395b1a","resolution":{"observed_at":"2026-08-15T17:24:39.975332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:39.952224Z","title":"Cohn, Shaun Cana- van, Michael Reale, Andy Horowitz, and Peng Liu","venue":null,"work_id":"a579f3ba-0624-4361-8422-365a638fe3c3","year":2013},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.801831Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:202f99b260ea5ea16c88f6d92cb94ec463a89d6782155319d3858c81217d7e3d","observation_id":"3bc1c2b3-e65d-4b42-80ef-112c32500db7","resolution":{"observed_at":"2026-08-15T17:24:39.957835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:39.935181Z","title":"Multimodal spontaneous emotion corpus for human behavior analysis","venue":null,"work_id":"d119376d-2cd5-4fac-a04a-2371e4ae6834","year":2016},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.806529Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:f2d66387349fb0acf8d4193a03b605082c6b36336ea07f07e839f0aa03c4be0a","observation_id":"994cef7d-fc61-4854-8fb7-8e2a2c7b2d9c","resolution":{"observed_at":"2026-08-15T17:24:39.940831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","latest_version":1,"primary_category":"cs.GR","snapshot_observed_at":"2026-08-15T17:19:38.871790Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":1,"verified_fuzzy":32},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 1 inbound Pith citation observation for arXiv:2508.12438."}