{"as_of":"2026-08-18T09:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ea7e816fe32015a52ff06db3e6148b854ce693bcf16dc81a40962dd74fc3d5d7","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T17:58:10.803277Z","state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.19359/citation-record","integrity":"/paper/2507.19359/integrity","json":"/paper/2507.19359/citation-record.json","paper":"/paper/2507.19359"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.973027Z","title":"Low-resource adaptation for personalized co-speech gesture generation","venue":null,"work_id":"75a70d0e-491f-41e0-bdc8-bb8a292def98","year":2022},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.464014Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:f9a90238503daa841c4cc447fb23deaca5f61a98d5abe0ecd67f34b519793abb","observation_id":"2a369914-0187-4864-98ee-d518b843b712","resolution":{"observed_at":"2026-08-15T17:58:11.978522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.954736Z","title":"Continual learning for personalized co-speech gesture generation","venue":null,"work_id":"45182c91-e2d6-43bf-81d0-d3d1d99547bb","year":2023},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.470750Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:73c8dc073492e1d47d4da9808ca1b2709b8e40538881dcdac25b3f1f56f0a266","observation_id":"5457dfed-6409-4d3d-9c77-85298f2dc914","resolution":{"observed_at":"2026-08-15T17:58:11.960158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.934809Z","title":"Style-controllable speech-driven gesture synthesis using normalising flows","venue":null,"work_id":"783cdb38-a2fa-4206-a20b-60eb7ece5c3c","year":2020},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.476122Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:aadee3566e85e2913949bdce1e27cea458a092110068ceb91bbee330bf335c95","observation_id":"e7646036-b0ba-452e-85a7-73f58a081788","resolution":{"observed_at":"2026-08-15T17:58:11.942564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.916228Z","title":"Listen, denoise, action! audio- driven motion synthesis with diffusion models","venue":null,"work_id":"ff3ef169-c448-442a-8e79-63cdb7a98f5e","year":2023},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.482307Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:9f1fd6b2317960563c9717c4f4cbccc59db52da7c1a13a162ae5325119429c31","observation_id":"c1fdb6c8-8a30-45a9-a9c4-01bcf7c97132","resolution":{"observed_at":"2026-08-15T17:58:11.922392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.890062Z","title":"Rhythmic gesticulator: Rhythm-aware co-speech gesture synthesis with hierarchical neural em- beddings","venue":null,"work_id":"82012488-d168-426d-a2dd-3417ce58f227","year":2022},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.487888Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:c00be94b3cb0410aa877775bfc824e79320e0199e3232c3d23e8ed08c39fe62f","observation_id":"8bfc8bb7-ec6b-410b-9053-672dc46a4cea","resolution":{"observed_at":"2026-08-15T17:58:11.899289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.869415Z","title":"Gesturedif- fuclip: Gesture diffusion model with clip latents","venue":null,"work_id":"d3c05d25-915b-48a4-9fd9-bd6cc87add4c","year":2023},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.493705Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:6c0e82f024d439faa7c6156f90807c670f5f40a32941383ee026af8c1a8620c2","observation_id":"ab987e37-8eff-4508-aa7e-e20bae2e95f7","resolution":{"observed_at":"2026-08-15T17:58:11.875091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.02901","last_updated":"2018-06-07T20:57:22Z","snapshot_observed_at":"2026-08-14T19:06:15.685742Z","submitted_at":"2018-06-07T20:57:22Z","title":"Probabilistic FastText for Multi-Sense Word Embeddings","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.02901","snapshot_observed_at":"2026-08-15T17:58:10.500414Z","title":"Probabilistic fasttext for multi-sense word embeddings","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.500414Z"},"links":{"cited_paper":"/paper/1806.02901","citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:aed160fcc73bcdf711d1f54428b6670ccc1d14a304c4a32794b21a077815223a","observation_id":"94e9c36c-e4f0-41ff-8a54-ac23ea392734","resolution":{"observed_at":"2026-08-15T17:58:10.500414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.845770Z","title":"Enriching word vectors with subword information","venue":null,"work_id":"84b2fcfb-ec85-486e-94de-f0a5533ba9f6","year":2017},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.506359Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:707a3742ab3b4d0c2dac634e58c86a46b4541c7d83876071a608137526ce4f2a","observation_id":"88566ee7-fe0f-43ca-a0de-3fd8913cd186","resolution":{"observed_at":"2026-08-15T17:58:11.853752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.823133Z","title":"Realtime multi-person 2d pose estimation using part affinity fields","venue":null,"work_id":"b453d05e-fce2-4ca7-8cab-cf534a3e46a9","year":2017},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.512123Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:911b812fc2ecdd0f8cca28e9a88600b504b19f58a8cb8116fd99495a3bd46e58","observation_id":"5cf0e808-1768-47e1-8c7d-4b3d7c6dca23","resolution":{"observed_at":"2026-08-15T17:58:11.828785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.806639Z","title":"Diffsheg: A diffusion-based approach for real-time speech-driven holistic 3d expres- sion and gesture generation","venue":null,"work_id":"9f447e54-1365-4160-b72c-e5281433baf9","year":2024},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.518555Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:1f0d01667a572150bc85b1cf9b7ac552c9abace327cb359367e5896699736953","observation_id":"fd74e80b-f75e-48c0-aabd-82e88a65ae08","resolution":{"observed_at":"2026-08-15T17:58:11.811894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.788284Z","title":"Emotional speech-driven 3d body animation via disen- tangled latent diffusion","venue":null,"work_id":"bf304676-c005-45d3-a3c2-646bf2857966","year":1942},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.524635Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:182488b4fda9c4347dd3af05b8ae538de522de2ee04fc616f1d5ffe028d66e6e","observation_id":"80f96e32-7842-4549-96fe-32f8a6f0c444","resolution":{"observed_at":"2026-08-15T17:58:11.795182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.767788Z","title":"Ad- versarial gesture generation with realistic gesture phas- ing","venue":null,"work_id":"1a52f368-f31e-42f2-a7fb-570cc2bd3f16","year":2020},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.530964Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:b1eb0ef79257da0002b8bee742fa99e2f2330f6c437aa8b7b39344effed3a074","observation_id":"5cbc59ad-8620-4aaf-8b6d-1a57ab31e08b","resolution":{"observed_at":"2026-08-15T17:58:11.774747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.744460Z","title":"Learning co-speech gesture representations in dialogue through contrastive learning: An intrinsic evaluation","venue":null,"work_id":"257ae6cc-f1a1-4fda-92aa-6ae68d92f38e","year":null},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.536833Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:a63c95ed5b78f727e485b9d38cf0e950cab18cae0c24decd3fcfc9981a7fc2f9","observation_id":"6ec8beb7-3664-4251-862f-8fa7967d9515","resolution":{"observed_at":"2026-08-15T17:58:11.751168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.724633Z","title":"I see what you mean: Co-speech ges- tures for reference resolution in multimodal dialogue","venue":null,"work_id":"754d83ba-2339-43b1-85f7-a43d009ac956","year":2025},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.542416Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:9f3a608a764e1549437bc9a61167b6d1afaa33a7055f5d88dcbaf84e685fac74","observation_id":"0462ef3e-370e-430f-8cd0-27163ed3b5be","resolution":{"observed_at":"2026-08-15T17:58:11.730723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.706738Z","title":"Generating diverse and natu- ral 3d human motions from text","venue":null,"work_id":"356cdf6d-2ebe-4457-a97f-0ea9779ff3d8","year":2022},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.547421Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:d4746031c4b2957a91380a390025ac1edb56d537ddfbbeca249299c5a4266ed1","observation_id":"b01c32f6-47b7-4b71-a9b0-d6c28032f172","resolution":{"observed_at":"2026-08-15T17:58:11.712533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.687979Z","title":"Tm2t: Stochastic and tokenized modeling for the recip- rocal generation of 3d human motions and texts","venue":null,"work_id":"43dc3b5f-a151-438f-95c0-740a6fbe043d","year":2022},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.555658Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:3476556907d988ac65268543aa5ef0f11138dd73c4578803ba0e3f214f06d1c0","observation_id":"fb4b91c1-ab5d-4b05-b117-5b4ca7acdf3b","resolution":{"observed_at":"2026-08-15T17:58:11.693687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.670650Z","title":"A motion matching-based framework for controllable gesture synthesis from speech","venue":null,"work_id":"f9e749a8-6969-4843-80d4-aa78f0859983","year":2022},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.561784Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:d4533a1f8a1502852d0678e63e7c0ed8078c8f801075a64f46ce1d396b2c21eb","observation_id":"addd1381-b6b9-4a1e-9cc8-7053f404b510","resolution":{"observed_at":"2026-08-15T17:58:11.676393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:10.567367Z","title":"Moglow: Probabilistic and controllable motion synthesis using normalising flows","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.567367Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:1f05723ab7f22f565306bb74b9b9e0aecac3642ce8b75f646caf577af4b353f7","observation_id":"2f6af49f-cfe9-4110-94fb-b6128bde25a0","resolution":{"observed_at":"2026-08-15T17:58:10.567367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.639749Z","title":"Multimodal lan- guage processing in human communication","venue":null,"work_id":"8c51b8bf-8927-4e26-92bf-1427cc9d8978","year":2019},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.573762Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:517ab3ba710ffb5f778216fe0fa915c5db92da2aa5472da883e0c72c2202c1af","observation_id":"e918b296-5546-4274-9935-04ae64c7514c","resolution":{"observed_at":"2026-08-15T17:58:11.644964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.621284Z","title":"Hubert: Self-supervised speech repre- sentation learning by masked prediction of hidden units","venue":null,"work_id":"78d27dd8-c664-469e-bbc9-0ac92b708de4","year":2021},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.579069Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:20c024e22c40a8cd3a1367c70ae43327fa1d842ffd0370bc2cbc4b98f2d76c39","observation_id":"e4146ade-7975-44de-aa2f-31bbb7fc22dc","resolution":{"observed_at":"2026-08-15T17:58:11.627735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.603705Z","title":"Gesture units, gesture phrases and speech","venue":null,"work_id":"2dd64607-14dd-4b05-af75-8c611cb72aa5","year":2004},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.584471Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:9f418a483f285756a6f6100833f9ad985ce3b4aefbd4e7fe785250820c20d960","observation_id":"6c52d0c9-5e73-436c-b98c-407a1c1b034d","resolution":{"observed_at":"2026-08-15T17:58:11.608962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.586928Z","title":"Gesticulator: A framework for semantically-aware speech-driven gesture generation","venue":null,"work_id":"43c595df-404e-4c54-9c40-07014aaaaa06","year":2020},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.589553Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:66d993e3b44aee010586e10eb997c06d776bf3027c87651bdefd6e657e22f1fa","observation_id":"c026dc28-04f2-4622-b924-19220748c1b3","resolution":{"observed_at":"2026-08-15T17:58:11.592239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.567100Z","title":"Danceformer: Music conditioned 3d dance generation with parametric motion transformer","venue":null,"work_id":"c02352d0-f53f-4687-83c3-260f14575671","year":2022},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.595042Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:20948ed115018de7d66eb09ca183ddbfc3e76c706055507c24182106ca1284ae","observation_id":"97c4ef38-f28b-4b04-a39c-1a96f9e9373d","resolution":{"observed_at":"2026-08-15T17:58:11.575266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.549861Z","title":"Audio2gestures: Gen- erating diverse gestures from speech audio with condi- tional variational autoencoders","venue":null,"work_id":"90b73113-7697-45cf-b6b0-f5327fe3b68d","year":2021},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.601122Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:71b3f545dc7cf2e10b26af860ca305e4570b10cf07efb170b45eb778b523ba1a","observation_id":"f2f3dc36-2673-4da8-a0cd-c47ec2a4ea88","resolution":{"observed_at":"2026-08-15T17:58:11.555279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.529993Z","title":"Ai choreographer: Music conditioned 3d dance generation with aist++","venue":null,"work_id":"0cc69dcd-ea4c-4c78-9000-fdf980b8d287","year":2021},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.606397Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:0995b180fcb2f04cd221e9fa5a0b85791c21a5bb24ff571ce7a96c5111d3b7fe","observation_id":"e5d98716-a61d-4a6a-92c2-402b399f3a29","resolution":{"observed_at":"2026-08-15T17:58:11.537429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.507516Z","title":"Seeg: Semantic energized co-speech gesture generation","venue":null,"work_id":"2099a8f8-d908-471a-9b51-52b100dfecee","year":2022},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.612059Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:edf5e2b63057ec741d677d71796848ed3b7ef566b038fa5807d7daf836ffb7cf","observation_id":"1859d201-ee9b-42c0-8442-6871cacac9e4","resolution":{"observed_at":"2026-08-15T17:58:11.514193Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.487734Z","title":"Beat: A large-scale semantic and emotional multi-modal dataset for conversational gestures synthesis","venue":null,"work_id":"31c104f2-ce32-4e21-8b09-668b85ff0604","year":2022},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.617841Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:1619d726676d45bc50ce8569b2ab1f2cbf7c7e449c072ba4d0cbe886e8e0c623","observation_id":"63723e77-5e9b-4643-9449-9c8f39cae7b7","resolution":{"observed_at":"2026-08-15T17:58:11.493945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.464217Z","title":"Emage: To- wards unified holistic co-speech gesture generation via expressive masked audio gesture modeling","venue":null,"work_id":"fb31efe9-f2ad-46de-91ec-f12b5c719f6c","year":2024},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.623866Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:45de2d152e1373a06bffc666b1e6923452771a31f0a9e20244fa01c164cfdde0","observation_id":"e1af1a41-b178-4235-bf36-c50901ac28a7","resolution":{"observed_at":"2026-08-15T17:58:11.471095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08849","last_updated":"2023-08-17T08:15:51Z","snapshot_observed_at":"2026-08-16T15:07:53.405696Z","submitted_at":"2023-08-17T08:15:51Z","title":"A Survey on Deep Multi-modal Learning for Body Language Recognition and Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08849","snapshot_observed_at":"2026-08-15T17:58:10.629664Z","title":"A survey on deep multi-modal learn- ing for body language recognition and generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.629664Z"},"links":{"cited_paper":"/paper/2308.08849","citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:86c480287c72d15bed8fe7a577fa14d85e489080f3b0bb2ad9af74b53c25bf61","observation_id":"3e79e1f4-e4b6-4c70-96ca-70fef823aebe","resolution":{"observed_at":"2026-08-15T17:58:10.629664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.447012Z","title":"Human gesture recognition with a flow- based model for human robot interaction","venue":null,"work_id":"76c46893-c35f-4e5b-8fbb-9a1feaae72e6","year":2023},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.637240Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:b740a6764171f9c56b0424f3ae237df22e20af105a70d13ca3bf9bb7600cc741","observation_id":"b1a42bd8-8968-4654-b16d-612e8948511d","resolution":{"observed_at":"2026-08-15T17:58:11.452611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18898","last_updated":"2026-08-15T03:16:14Z","snapshot_observed_at":"2026-08-18T09:11:57.753911Z","submitted_at":"2025-01-31T05:34:59Z","title":"GestureLSM: Latent Shortcut based Co-Speech Gesture Generation with Spatial-Temporal Modeling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18898","snapshot_observed_at":"2026-08-15T17:58:10.642697Z","title":"Gesturelsm: Latent shortcut based co-speech gesture generation with spatial-temporal mod- eling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.642697Z"},"links":{"cited_paper":"/paper/2501.18898","citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:00ce95bc6f96329e3c25c1b2a467cf3cba3c6cb87772471fd125b969d4d31de1","observation_id":"5e91daf3-6612-44c1-9665-b28a190c8489","resolution":{"observed_at":"2026-08-15T17:58:10.642697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.425264Z","title":"Audio-driven co-speech gesture video generation","venue":null,"work_id":"4067cdc3-3de5-466d-a9be-2106288f75d7","year":2022},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.649300Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:c487444b029f5de12ccf9cd24372e569ed0cbb1525d4f94f9a57c13784a8c858","observation_id":"d5d1c9b4-d8e5-4d3b-b904-a876b3f87a33","resolution":{"observed_at":"2026-08-15T17:58:11.431276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.406231Z","title":"Learning hierarchical cross-modal associa- tion for co-speech gesture generation","venue":null,"work_id":"1a49d494-76ab-4c9c-8774-9b2f23ef29a7","year":2022},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.654514Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:9ffd18e139d185ee9e684ff516ab120969b98e4845f52e32d4f84793351073b1","observation_id":"41f809e5-4bb7-4437-b1d7-653c7fd6735f","resolution":{"observed_at":"2026-08-15T17:58:11.412218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.387660Z","title":"Towards variable and coordinated holistic co-speech motion generation","venue":null,"work_id":"8fd51b00-e114-45aa-adc4-7a7f390b05cf","year":2024},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.659509Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:3884bcd0ec7267a5286103db71ef71aa4cb5edd7efd0037895eeb1cb115bff35","observation_id":"87005c43-eed6-4748-bd01-3a20151ea9b9","resolution":{"observed_at":"2026-08-15T17:58:11.392979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.367226Z","title":"Hand and mind","venue":null,"work_id":"fc8a2d15-2aa3-4b32-9523-449e693872e2","year":1992},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.664810Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:a291ff51922b31e4a88fb04a1b27c88d01cc1fa0beba4a6410b16a3c3f4ab606","observation_id":"4f06c41b-699f-4fc2-955a-ade00a863d27","resolution":{"observed_at":"2026-08-15T17:58:11.373974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.347885Z","title":"Convofusion: Multi-modal conversational diffusion for co-speech gesture synthesis","venue":null,"work_id":"2ee2abb0-9996-4d1f-81c6-3261f6b9426a","year":2024},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.670321Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:cb7a81268e75775f5610c3fe61f755747b15652d5d39a8e08a1e3d7b2723c392","observation_id":"487beccf-5f39-4888-b5c1-1dc4b8f6fad0","resolution":{"observed_at":"2026-08-15T17:58:11.353990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06786","last_updated":"2025-04-04T07:48:19Z","snapshot_observed_at":"2026-08-17T04:56:26.794091Z","submitted_at":"2024-12-09T18:59:46Z","title":"Retrieving Semantics from the Deep: an RAG Solution for Gesture Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06786","snapshot_observed_at":"2026-08-15T17:58:10.675454Z","title":"Retrieving se- mantics from the deep: an rag solution for gesture syn- thesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.675454Z"},"links":{"cited_paper":"/paper/2412.06786","citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:43d87a8a0440b501f1242c32b91a9db925c49e9453cd64e7f6917a3d943e495f","observation_id":"b411826f-470f-4d9f-8202-386eced30e1d","resolution":{"observed_at":"2026-08-15T17:58:10.675454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.326029Z","title":"From audio to photoreal embodiment: Synthe- sizing humans in conversations","venue":null,"work_id":"46c624cc-2d9d-48dc-b3f9-a423c983cc7c","year":2024},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.680733Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:d19cef22f445e768ce45b104f933a513f27ba272a68c0567f59c4ba142c03436","observation_id":"c18250c2-8866-497d-a9bd-95386bdc026f","resolution":{"observed_at":"2026-08-15T17:58:11.334874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15032","last_updated":"2025-05-30T15:03:44Z","snapshot_observed_at":"2026-08-17T03:58:29.482468Z","submitted_at":"2024-12-19T16:44:01Z","title":"DCTdiff: Intriguing Properties of Image Generative Modeling in the DCT Space","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15032","snapshot_observed_at":"2026-08-15T17:58:10.685667Z","title":"Dctdiff: Intriguing proper- ties of image generative modeling in the dct space.arXiv preprint arXiv:2412.15032, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.685667Z"},"links":{"cited_paper":"/paper/2412.15032","citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:fee85191df0fb33e2c59349bfaeb399854c5c974150eda5d16cdb423331bb54f","observation_id":"e88d1ab4-2573-4245-a5ab-c4fce6e7b9b3","resolution":{"observed_at":"2026-08-15T17:58:10.685667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.303219Z","title":"A com- prehensive review of data-driven co-speech gesture gen- eration","venue":null,"work_id":"81e1fe4a-8fbd-4f3a-81f0-bf2b597c4a7a","year":2023},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.691493Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:b8166274645f11d21677042351d9137178684f96e88225a20b64ee1682d3678b","observation_id":"7383a860-25bc-4815-a8e6-bafee2ce15f5","resolution":{"observed_at":"2026-08-15T17:58:11.310383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.278743Z","title":"Hearing and seeing meaning in speech and gesture: Insights from brain and behaviour","venue":null,"work_id":"bb926f9d-ae13-4b2c-8a3d-374ea6c927c1","year":2014},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.698400Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:861c9c1ee8801456fbd4ea2dce54e0bcd4a617d5e8907e669e10c0e506b4e370","observation_id":"f8aa5d44-0b04-4fc0-8fc6-c0ddf206c1a6","resolution":{"observed_at":"2026-08-15T17:58:11.284370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.260424Z","title":"Bodyformer: Semantics-guided 3d body gesture synthe- sis with transformer","venue":null,"work_id":"0e2c7cf2-87ae-4f93-9b84-fd5df52e0bfd","year":2023},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.703991Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:ade287c0f7e6e8e4b6a270fa4b85bae237369f3748e0fd8f19100194e3c440bf","observation_id":"94b68f22-5e8d-4e95-b43f-68146d7a46f0","resolution":{"observed_at":"2026-08-15T17:58:11.266701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.242734Z","title":"Expressive body capture: 3d hands, face, and body from a single image","venue":null,"work_id":"9513ac22-0171-4656-9bb1-df69c5111674","year":2019},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.709402Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:f5c2168802bcc9fc6737d5f6939cd71577f2e6c6c073a5a7f542433d075bf6e0","observation_id":"35202fb1-4ff7-49b8-b3b5-4faa959ec217","resolution":{"observed_at":"2026-08-15T17:58:11.247742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.225336Z","title":"Weakly-supervised emotion transition learning for diverse 3d co-speech gesture gen- eration","venue":null,"work_id":"a3e4d31e-59b0-4f42-bf1c-9db0b130dd76","year":2024},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.714964Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:d83389d79e122e2ef48de14f1f257b169a52050f95b5f00b9f736698f38b746b","observation_id":"2fbc9fa5-6cde-4070-83f9-666baf205acc","resolution":{"observed_at":"2026-08-15T17:58:11.231582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.209381Z","title":"Co- speech gesture synthesis by reinforcement learning with contrastive pre-trained rewards","venue":null,"work_id":"0660f653-dba7-4b26-851a-590be3b12178","year":2023},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.720089Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:82cee091a3af97ae6e2a0eca8a99f691676f5c13107c2ffcafd4d2b3b0f8f1af","observation_id":"3cfa6d47-4c23-4b02-9a70-37a219192fa8","resolution":{"observed_at":"2026-08-15T17:58:11.214404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.192703Z","title":"Motionclip: Exposing human mo- tion generation to clip space","venue":null,"work_id":"af30d17e-11fb-4f62-ad0b-372f0fe50427","year":2022},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.725430Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:488969d41d5ea7d2c4dbea0002138bb6c681b69bbe8895460e49fae48aaec066","observation_id":"26f59969-8eb0-4db0-8d0e-85b107a50ba1","resolution":{"observed_at":"2026-08-15T17:58:11.198056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.175751Z","title":"Human mo- tion diffusion model","venue":null,"work_id":"a1bb022f-eb33-4dd2-b413-430d0d5b2db3","year":2022},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.731077Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:3de13ae0a44ad736b65454f028bbf95de3493efe76c226426e6efc0e03892008","observation_id":"5a4778a1-63df-4c90-956d-0724c13c0dfb","resolution":{"observed_at":"2026-08-15T17:58:11.181326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.157795Z","title":"Neural dis- crete representation learning","venue":null,"work_id":"f287e054-cfcd-408a-aeb7-90268647811f","year":2017},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.736803Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:97166f77c40beb04db7d22fc31dc812f79153ea3ad706739e4cec679ca37daa6","observation_id":"5ce1873c-8004-4224-86f5-1001e2dacb45","resolution":{"observed_at":"2026-08-15T17:58:11.163899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.138913Z","title":"Augmented co-speech gesture generation: Including form and meaning features to guide learning-based gesture synthesis","venue":null,"work_id":"6a540fda-54ee-4afe-813e-4cc92883aa3a","year":2023},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.744751Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:e7d4b68baf9cb195798ffc09c4edc595cbbbf1aed0dc66cc2d93f19e77508741","observation_id":"3577dac7-e6c7-4f0a-b6d3-fc49f6dd8cd1","resolution":{"observed_at":"2026-08-15T17:58:11.146181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.04919","last_updated":"2023-05-08T17:54:58Z","snapshot_observed_at":"2026-08-16T22:15:33.695681Z","submitted_at":"2023-05-08T17:54:58Z","title":"DiffuseStyleGesture: Stylized Audio-Driven Co-Speech Gesture Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.04919","snapshot_observed_at":"2026-08-15T17:58:10.750171Z","title":"Diffusestylegesture: Stylized audio-driven co- speech gesture generation with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.750171Z"},"links":{"cited_paper":"/paper/2305.04919","citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:c9941e5b63c0dea3e91b0fb3a93d239fa126df7c71e75c6f592d85f7dfb53777","observation_id":"c6bd66ce-285e-4c4b-93c4-2ac292c4543f","resolution":{"observed_at":"2026-08-15T17:58:10.750171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.119321Z","title":"Qpgesture: Quantization-based and phase-guided mo- tion matching for natural speech-driven gesture gener- ation","venue":null,"work_id":"89db87b7-f4bb-4348-a6fa-4cb0fb6da269","year":2023},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.756455Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:50039a4e5066061ee66804ddc6cc1803a6c62a87f34bd1329eb79cb64bb158db","observation_id":"96139976-0213-4646-8765-753212772a96","resolution":{"observed_at":"2026-08-15T17:58:11.124883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.098537Z","title":"Audio-driven stylized gesture generation with flow- based model","venue":null,"work_id":"403c72b7-365a-4bb4-8701-b73dd75a7b97","year":2022},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.763496Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:ca82561dee166f9c230783a70c81ff4b4f3ec2dc8127c461d730e9e5b074eb7b","observation_id":"1e9ac3a9-2807-4c75-a82a-837aa08e7fc5","resolution":{"observed_at":"2026-08-15T17:58:11.106645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.075327Z","title":"Generating holistic 3d human motion from speech","venue":null,"work_id":"92e13bd0-03ff-4eec-8efc-21dd2b7abe43","year":2023},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.771499Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:93b902cde9b16c7cc7f912fe7691b01339424e13bed3e9bf00fc8b0dabc50645","observation_id":"e93a48d9-221e-4878-8c88-4bac1dfcb41a","resolution":{"observed_at":"2026-08-15T17:58:11.080714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.055308Z","title":"Generating holistic 3d human motion from speech","venue":null,"work_id":"4d034ff1-4393-4ca0-a1eb-dbe2362954e7","year":2023},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.776489Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:4a3d0ec092d314b11423733a67300e1e0a86bb659155c44e7f28ad88518fd790","observation_id":"063dd7b3-3c6d-4fe4-857b-b9aaae4ee39c","resolution":{"observed_at":"2026-08-15T17:58:11.060915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.032846Z","title":"Speech gesture generation from the trimodal context of text, au- dio, and speaker identity.ACM Transactions on Graphics (TOG), 39(6):1–16, 2020","venue":null,"work_id":"084bfcb4-e816-4f3c-acc4-b37ca48b7e68","year":2020},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.782378Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:8a5e7a3323151af30010f93a3b549795d9a2b6731514055ada5174b00886c0fd","observation_id":"ed1d6621-7d32-4833-95de-1a93bec97f47","resolution":{"observed_at":"2026-08-15T17:58:11.038719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15472","last_updated":"2025-08-03T07:16:03Z","snapshot_observed_at":"2026-08-16T08:54:26.447403Z","submitted_at":"2024-11-23T06:50:11Z","title":"KinMo: Kinematic-aware Human Motion Understanding and Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15472","snapshot_observed_at":"2026-08-15T17:58:10.787476Z","title":"Kinmo: Kinematic-aware human motion understanding and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.787476Z"},"links":{"cited_paper":"/paper/2411.15472","citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:8dc69cbb3ce8a2813b9968b7899b6aa819a1b623cc1aeb031c0d75ce4b963600","observation_id":"cf017540-659c-45d3-a98a-072f73df7a45","resolution":{"observed_at":"2026-08-15T17:58:10.787476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:11.012159Z","title":"Semantic gesticulator: Semantics-aware co-speech gesture synthe- sis","venue":null,"work_id":"bcdfa4a7-e0b0-49e9-9c17-3caa4c8eda93","year":null},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.793178Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:17472711f20570c2863addd266e1814e73c87a0884018954672d30e624182045","observation_id":"e239708d-84e9-4dd9-91d2-d2b33f01222c","resolution":{"observed_at":"2026-08-15T17:58:11.017920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:10.994475Z","title":"Livelyspeaker: Towards semantic-aware co-speech gesture generation","venue":null,"work_id":"6feb0210-56ed-4bf5-8aca-494f65629d0e","year":2023},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.798218Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:0e48fc6b6021fc15d8a335ed600b5dc71d9da889e6edfdc543884da9d3c24c51","observation_id":"e2d67e0e-60e4-421e-9917-c72c6c669777","resolution":{"observed_at":"2026-08-15T17:58:10.999963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:58:10.973572Z","title":"Taming diffusion models for audio- driven co-speech gesture generation","venue":null,"work_id":"3366d33f-4f48-47b9-b65a-fe4fa8812a47","year":2023},"citing_paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T17:58:10.803277Z"},"links":{"citing_paper":"/paper/2507.19359"},"observation_digest":"sha256:ee84da89d4d83cad18cf79db1ebdaccba7419e068b4603f8daf34b8b15e27f1f","observation_id":"61770172-1db9-4db1-b6de-c788e0b5e8f9","resolution":{"observed_at":"2026-08-15T17:58:10.981260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.19359","last_updated":"2025-07-25T15:10:15Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T07:34:43.974632Z","submitted_at":"2025-07-25T15:10:15Z","title":"SemGes: Semantics-aware Co-Speech Gesture Generation using Semantic Coherence and Relevance Learning"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":0,"verified_fuzzy":51},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 0 inbound Pith citation observations for arXiv:2507.19359."}