{"as_of":"2026-08-19T13:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:273994962c3f62d728a735192dfdc01c2fb32f775bbe5453b01a73c1a5555810","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T04:14:50.968563Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.01746/citation-record","integrity":"/paper/2505.01746/integrity","json":"/paper/2505.01746/citation-record.json","paper":"/paper/2505.01746"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:14:51.178867Z","title":"Style transfer for co-speech gesture animation: A multi-speaker conditional-mixture approach","venue":null,"work_id":"5ce5e1f1-8c1f-4fb1-96ef-7a9210de1351","year":2020},"citing_paper":{"arxiv_id":"2505.01746","last_updated":"2025-05-03T08:51:19Z","snapshot_observed_at":"2026-08-19T03:40:33.954849Z","submitted_at":"2025-05-03T08:51:19Z","title":"Co$^{3}$Gesture: Towards Coherent Concurrent Co-speech 3D Gesture Generation with Interactive Diffusion","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T04:14:50.910118Z"},"links":{"citing_paper":"/paper/2505.01746"},"observation_digest":"sha256:27825649efacb3cf3eeb9eb4054ea4ab13b61a5ed157d8fb8a0bdc4b8a55fb88","observation_id":"1d1185b4-7b7e-4cc5-a354-db54cf3f9f87","resolution":{"observed_at":"2026-08-16T04:14:51.182659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:14:51.139576Z","title":"The genea challenge 2023: A large-scale evaluation of gesture generation models in monadic and dyadic settings","venue":null,"work_id":"83e92774-d43f-478c-bc74-e487017e3846","year":2023},"citing_paper":{"arxiv_id":"2505.01746","last_updated":"2025-05-03T08:51:19Z","snapshot_observed_at":"2026-08-19T03:40:33.954849Z","submitted_at":"2025-05-03T08:51:19Z","title":"Co$^{3}$Gesture: Towards Coherent Concurrent Co-speech 3D Gesture Generation with Interactive Diffusion","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T04:14:50.925954Z"},"links":{"citing_paper":"/paper/2505.01746"},"observation_digest":"sha256:c674bd9b68608c2444ffbfed8d9cd80fe959700c09b040be0046492cd9e36f0c","observation_id":"fadd2ae3-1a55-4516-9fe1-b002f5832ef3","resolution":{"observed_at":"2026-08-16T04:14:51.143260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:14:51.128101Z","title":"Gesture controllers","venue":null,"work_id":"eb139a36-2f03-45c0-ad53-48013c8d4731","year":2010},"citing_paper":{"arxiv_id":"2505.01746","last_updated":"2025-05-03T08:51:19Z","snapshot_observed_at":"2026-08-19T03:40:33.954849Z","submitted_at":"2025-05-03T08:51:19Z","title":"Co$^{3}$Gesture: Towards Coherent Concurrent Co-speech 3D Gesture Generation with Interactive Diffusion","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T04:14:50.930150Z"},"links":{"citing_paper":"/paper/2505.01746"},"observation_digest":"sha256:f52c6dfcce3a44ad227526c15628165a1dbb6d76a898d97b625fa34005b84967","observation_id":"63b94378-b1f3-4303-816f-ab0c8e74c46f","resolution":{"observed_at":"2026-08-16T04:14:51.131367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:14:51.104860Z","title":"Montreal forced aligner: Trainable text-speech alignment using kaldi","venue":null,"work_id":"ff1f99ec-0f6a-4835-8bb2-31a8c05028b4","year":2017},"citing_paper":{"arxiv_id":"2505.01746","last_updated":"2025-05-03T08:51:19Z","snapshot_observed_at":"2026-08-19T03:40:33.954849Z","submitted_at":"2025-05-03T08:51:19Z","title":"Co$^{3}$Gesture: Towards Coherent Concurrent Co-speech 3D Gesture Generation with Interactive Diffusion","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T04:14:50.940078Z"},"links":{"citing_paper":"/paper/2505.01746"},"observation_digest":"sha256:bfc7c798181491ee667ad75ec2704fdd6482581e320986005623670ccff57c7c","observation_id":"e5492f55-4775-429d-8903-8bcc30ad9b70","resolution":{"observed_at":"2026-08-16T04:14:51.109386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16874","last_updated":"2025-04-25T09:26:36Z","snapshot_observed_at":"2026-07-06T18:20:22.759333Z","submitted_at":"2024-05-27T06:47:14Z","title":"CoCoGesture: Toward Coherent Co-speech 3D Gesture Generation in the Wild","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16874","snapshot_observed_at":"2026-08-16T04:14:50.945893Z","title":"Emotiongesture: Audio- driven diverse emotional co-speech 3d gesture generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.01746","last_updated":"2025-05-03T08:51:19Z","snapshot_observed_at":"2026-08-19T03:40:33.954849Z","submitted_at":"2025-05-03T08:51:19Z","title":"Co$^{3}$Gesture: Towards Coherent Concurrent Co-speech 3D Gesture Generation with Interactive Diffusion","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T04:14:50.945893Z"},"links":{"cited_paper":"/paper/2405.16874","citing_paper":"/paper/2505.01746"},"observation_digest":"sha256:be8aa0e30e5ff1d915363fdb0cef30f90ad23fb2f126db212c536e97a27216ee","observation_id":"59c0ae9e-3f28-41c9-b293-eafeeec51142","resolution":{"observed_at":"2026-08-16T04:14:50.945893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.15001","last_updated":"2022-08-31T17:58:54Z","snapshot_observed_at":"2026-08-16T16:35:36.335456Z","submitted_at":"2022-08-31T17:58:54Z","title":"MotionDiffuse: Text-Driven Human Motion Generation with Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.15001","snapshot_observed_at":"2026-08-16T04:14:50.955939Z","title":"Pymaf-x: Towards well-aligned full-body model regression from monocular images","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.01746","last_updated":"2025-05-03T08:51:19Z","snapshot_observed_at":"2026-08-19T03:40:33.954849Z","submitted_at":"2025-05-03T08:51:19Z","title":"Co$^{3}$Gesture: Towards Coherent Concurrent Co-speech 3D Gesture Generation with Interactive Diffusion","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T04:14:50.955939Z"},"links":{"cited_paper":"/paper/2208.15001","citing_paper":"/paper/2505.01746"},"observation_digest":"sha256:0bae8916336099c375f5c5b80d2cdd19988a8f93179fad71ec8e845c2d9ec2ae","observation_id":"542bc9f3-d96f-4de1-85d4-d7965cf0482a","resolution":{"observed_at":"2026-08-16T04:14:50.955939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:14:51.068760Z","title":null,"venue":null,"work_id":"8737e6f5-d6e6-45d3-b1d8-87f810aeb3fa","year":2025},"citing_paper":{"arxiv_id":"2505.01746","last_updated":"2025-05-03T08:51:19Z","snapshot_observed_at":"2026-08-19T03:40:33.954849Z","submitted_at":"2025-05-03T08:51:19Z","title":"Co$^{3}$Gesture: Towards Coherent Concurrent Co-speech 3D Gesture Generation with Interactive Diffusion","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T04:14:50.959341Z"},"links":{"citing_paper":"/paper/2505.01746"},"observation_digest":"sha256:68e2cf7c51d0001b5d79aabd48f7097cd65c1e9738570ed85a234801e2d39671","observation_id":"437d6244-2501-4eb7-b2ac-17a5805e3073","resolution":{"observed_at":"2026-08-16T04:14:51.072370Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:14:51.057937Z","title":"They are then processed using automated methods to extract both audio and motion information","venue":null,"work_id":"8241b8e4-b491-42e4-83d8-495b9813d076","year":2023},"citing_paper":{"arxiv_id":"2505.01746","last_updated":"2025-05-03T08:51:19Z","snapshot_observed_at":"2026-08-19T03:40:33.954849Z","submitted_at":"2025-05-03T08:51:19Z","title":"Co$^{3}$Gesture: Towards Coherent Concurrent Co-speech 3D Gesture Generation with Interactive Diffusion","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T04:14:50.962185Z"},"links":{"citing_paper":"/paper/2505.01746"},"observation_digest":"sha256:e7ea80483dfb05c45927baf6277d8eba3c0c5a3c94a317cf5de2b8c7127e1c73","observation_id":"7a4c3f1c-a0fd-441d-90f4-7cb345104221","resolution":{"observed_at":"2026-08-16T04:14:51.061522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:14:51.046601Z","title":"Due to the strict keyword selection in raw video crawling, our dataset rarely contains two speakers standing or walking around","venue":null,"work_id":"c84f8ffb-fc8f-49a0-badf-95e547e505fb","year":2019},"citing_paper":{"arxiv_id":"2505.01746","last_updated":"2025-05-03T08:51:19Z","snapshot_observed_at":"2026-08-19T03:40:33.954849Z","submitted_at":"2025-05-03T08:51:19Z","title":"Co$^{3}$Gesture: Towards Coherent Concurrent Co-speech 3D Gesture Generation with Interactive Diffusion","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T04:14:50.965433Z"},"links":{"citing_paper":"/paper/2505.01746"},"observation_digest":"sha256:b19a30275cdceada6041c554da89452f6c8f33244d61908e1b4c78e3dfa46165","observation_id":"e78d77d6-f7bd-42dd-bced-d0d1d69dd853","resolution":{"observed_at":"2026-08-16T04:14:51.050724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:14:51.032974Z","title":"Meanwhile, our method displays a much lower standard deviation than InterX and InterGen","venue":null,"work_id":"73e467de-2bfa-402b-96b1-c3ade3041df8","year":2025},"citing_paper":{"arxiv_id":"2505.01746","last_updated":"2025-05-03T08:51:19Z","snapshot_observed_at":"2026-08-19T03:40:33.954849Z","submitted_at":"2025-05-03T08:51:19Z","title":"Co$^{3}$Gesture: Towards Coherent Concurrent Co-speech 3D Gesture Generation with Interactive Diffusion","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T04:14:50.968563Z"},"links":{"citing_paper":"/paper/2505.01746"},"observation_digest":"sha256:4172fcf5875d9e92f5c4a2f6601a23a8005556bc62c97906f3ed553b01c0de0f","observation_id":"77cfc049-5c37-4b59-98f8-bb052028d8e2","resolution":{"observed_at":"2026-08-16T04:14:51.037920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.08171","last_updated":"2020-08-18T22:29:40Z","snapshot_observed_at":"2026-08-19T08:25:09.100071Z","submitted_at":"2020-08-18T22:29:40Z","title":"Learning to Generate Diverse Dance Motions with Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.08171","snapshot_observed_at":"2026-08-16T04:14:50.933480Z","title":"Learning to generate diverse dance motions with transformer","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2505.01746","last_updated":"2025-05-03T08:51:19Z","snapshot_observed_at":"2026-08-19T03:40:33.954849Z","submitted_at":"2025-05-03T08:51:19Z","title":"Co$^{3}$Gesture: Towards Coherent Concurrent Co-speech 3D Gesture Generation with Interactive Diffusion","version":1},"reference_index":2010,"source":"pdf_text","source_observed_at":"2026-08-16T04:14:50.933480Z"},"links":{"cited_paper":"/paper/2008.08171","citing_paper":"/paper/2505.01746"},"observation_digest":"sha256:0b771023d7b95ca422635051afab26ebe5a33a0bea55a796071bb069bc184847","observation_id":"4760762d-83f2-4e32-bc81-37d19cff6283","resolution":{"observed_at":"2026-08-16T04:14:50.933480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:14:51.116788Z","title":"Understanding embodied reference with touch-line transformer","venue":null,"work_id":"c132dc5f-3206-458d-b803-3781004ca5ba","year":2025},"citing_paper":{"arxiv_id":"2505.01746","last_updated":"2025-05-03T08:51:19Z","snapshot_observed_at":"2026-08-19T03:40:33.954849Z","submitted_at":"2025-05-03T08:51:19Z","title":"Co$^{3}$Gesture: Towards Coherent Concurrent Co-speech 3D Gesture Generation with Interactive Diffusion","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-16T04:14:50.936901Z"},"links":{"citing_paper":"/paper/2505.01746"},"observation_digest":"sha256:9079d09ad84d88ac0d69adca8f05f4af0ab1685115b9d59d71d38caa6e0239ee","observation_id":"48b2a685-0913-463c-8c0a-16652ca573f0","resolution":{"observed_at":"2026-08-16T04:14:51.120353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:14:51.160774Z","title":"Pyannote","venue":null,"work_id":"9f981d65-1b03-4ab6-b09f-d932c10074f5","year":2020},"citing_paper":{"arxiv_id":"2505.01746","last_updated":"2025-05-03T08:51:19Z","snapshot_observed_at":"2026-08-19T03:40:33.954849Z","submitted_at":"2025-05-03T08:51:19Z","title":"Co$^{3}$Gesture: Towards Coherent Concurrent Co-speech 3D Gesture Generation with Interactive Diffusion","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-16T04:14:50.917816Z"},"links":{"citing_paper":"/paper/2505.01746"},"observation_digest":"sha256:7dfb75f78006b27e81d03a19b8af67884d71ff2680e838d1275948b2d30e7d71","observation_id":"0a684c7c-47a9-45e8-be4b-324be00d72e2","resolution":{"observed_at":"2026-08-16T04:14:51.164489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:14:50.913998Z","title":"Whisperx: Time-accurate speech transcription of long-form audio","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.01746","last_updated":"2025-05-03T08:51:19Z","snapshot_observed_at":"2026-08-19T03:40:33.954849Z","submitted_at":"2025-05-03T08:51:19Z","title":"Co$^{3}$Gesture: Towards Coherent Concurrent Co-speech 3D Gesture Generation with Interactive Diffusion","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-16T04:14:50.913998Z"},"links":{"citing_paper":"/paper/2505.01746"},"observation_digest":"sha256:625db4b95485114e16e9409bb5255db9dcf78e0f4f92ab73635dd3797845e229","observation_id":"a08e4497-bc55-46a0-b620-87f7c7ca4ca2","resolution":{"observed_at":"2026-08-16T04:14:50.913998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:14:51.091650Z","title":"Generative agents: Interactive simulacra of human behavior","venue":null,"work_id":"7b6e4022-1d8a-40a6-8158-a8350034b6ea","year":2025},"citing_paper":{"arxiv_id":"2505.01746","last_updated":"2025-05-03T08:51:19Z","snapshot_observed_at":"2026-08-19T03:40:33.954849Z","submitted_at":"2025-05-03T08:51:19Z","title":"Co$^{3}$Gesture: Towards Coherent Concurrent Co-speech 3D Gesture Generation with Interactive Diffusion","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-16T04:14:50.942891Z"},"links":{"citing_paper":"/paper/2505.01746"},"observation_digest":"sha256:c1324d7b72efc13584c34ae163d32b021513f88720203eedc1b8683b18192463","observation_id":"d585e588-b83a-4bb6-a22b-ad4762936c79","resolution":{"observed_at":"2026-08-16T04:14:51.095730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-16T04:14:50.949196Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.01746","last_updated":"2025-05-03T08:51:19Z","snapshot_observed_at":"2026-08-19T03:40:33.954849Z","submitted_at":"2025-05-03T08:51:19Z","title":"Co$^{3}$Gesture: Towards Coherent Concurrent Co-speech 3D Gesture Generation with Interactive Diffusion","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-16T04:14:50.949196Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2505.01746"},"observation_digest":"sha256:e54b9af475aefc3792a6e744cd25e49f0866bc0d1a369063ef9a3b221df3c075","observation_id":"5bc23898-1dab-435d-9385-f0fe161120f9","resolution":{"observed_at":"2026-08-16T04:14:50.949196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:14:51.150306Z","title":"Alpacafarm: A simulation framework for methods that learn from human feedback","venue":null,"work_id":"27790853-7a70-4162-9ec3-1b94f6bb6735","year":2025},"citing_paper":{"arxiv_id":"2505.01746","last_updated":"2025-05-03T08:51:19Z","snapshot_observed_at":"2026-08-19T03:40:33.954849Z","submitted_at":"2025-05-03T08:51:19Z","title":"Co$^{3}$Gesture: Towards Coherent Concurrent Co-speech 3D Gesture Generation with Interactive Diffusion","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-16T04:14:50.921058Z"},"links":{"citing_paper":"/paper/2505.01746"},"observation_digest":"sha256:c0c3dbf86af558558c367119664b7e1d3134b409fbf94e25b4681479e23d0e07","observation_id":"0bb5b99d-1708-4ee2-99f0-e9937d56f5f4","resolution":{"observed_at":"2026-08-16T04:14:51.153929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:14:51.079831Z","title":"Diffusestylegesture: stylized audio-driven co-speech gesture generation with diffusion models","venue":null,"work_id":"a974d49b-3c42-4b0f-b093-7a199414bc86","year":2025},"citing_paper":{"arxiv_id":"2505.01746","last_updated":"2025-05-03T08:51:19Z","snapshot_observed_at":"2026-08-19T03:40:33.954849Z","submitted_at":"2025-05-03T08:51:19Z","title":"Co$^{3}$Gesture: Towards Coherent Concurrent Co-speech 3D Gesture Generation with Interactive Diffusion","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-16T04:14:50.952774Z"},"links":{"citing_paper":"/paper/2505.01746"},"observation_digest":"sha256:39f011211215e4eb7e5484b50d3360f379c6aa5094c2480bc2dec0506c89dc83","observation_id":"4773e41b-6694-41f5-9460-5fd2b8caa360","resolution":{"observed_at":"2026-08-16T04:14:51.083665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.01746","last_updated":"2025-05-03T08:51:19Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-19T03:40:33.954849Z","submitted_at":"2025-05-03T08:51:19Z","title":"Co$^{3}$Gesture: Towards Coherent Concurrent Co-speech 3D Gesture Generation with Interactive Diffusion"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":0,"verified_fuzzy":12},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 0 inbound Pith citation observations for arXiv:2505.01746."}