{"as_of":"2026-08-09T09:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:410029c421066274dc1cfe5052f5df69ae203db0eed9f7186dc59deb8bc88fed","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T10:22:30.431160Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.03874/citation-record","integrity":"/paper/2606.03874/integrity","json":"/paper/2606.03874/citation-record.json","paper":"/paper/2606.03874"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":"Seamless interaction: Dyadic audiovisual motion modeling and large-scale dataset","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:1894f9d2cd3261fbd84a44712077552239746f6bd9a6d2cfe5ccd3e5fa782612","observation_id":"18061b35-d0f7-49ad-9bc6-e3076adef614","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":"Ready-to-react: Online reaction policy for two-character interaction generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:8316a630ecd533af5dcd0f4dbd551ffb8e400a0e2d40147effcffb9f13d11ba1","observation_id":"9cea0b2e-bb60-4348-a6cf-058068bf89a8","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":"Seeing what matters: Generalizable ai-generated video detection with forensic-oriented augmentation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:4ac0d552bf3f8123935eae647644efee6aa09f2cb741b69bd4fc2ec8ad753d19","observation_id":"3db1d344-d83f-4f7c-bf84-aa5169f50f25","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00037","last_updated":"2024-10-02T09:11:45Z","snapshot_observed_at":"2026-07-30T10:21:14.474746Z","submitted_at":"2024-09-17T17:55:39Z","title":"Moshi: a speech-text foundation model for real-time dialogue","version":2},"cited_work":{"arxiv_id":"2410.00037","doi":"10.1121/1.1906946","metadata_source":"pith","pith_arxiv_id":"2410.00037","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Moshi: a speech-text foundation model for real-time dialogue","venue":"eess.AS","work_id":"3104332b-d279-44c8-aaa7-3d5a13c01832","year":2024},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"cited_paper":"/paper/2410.00037","citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:6c063e81a6af7d8861e87299f87caba9525655729d504ee2ac380e468b9bbf34","observation_id":"18230585-b551-45d6-8ccf-09ee978ba7da","resolution":{"observed_at":"2026-07-02T03:06:29.693425Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.11094","last_updated":"2022-07-22T14:07:46Z","snapshot_observed_at":"2026-08-06T05:31:42.749956Z","submitted_at":"2022-07-22T14:07:46Z","title":"Visual Speech-Aware Perceptual 3D Facial Expression Reconstruction from Videos","version":1},"cited_work":{"arxiv_id":"2207.11094","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2207.11094","snapshot_observed_at":"2026-07-02T03:06:29.711882Z","title":"arXiv:2207.11094 (2022)","venue":null,"work_id":"53a020ef-1d4c-4e58-822f-934e380c9537","year":2022},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"cited_paper":"/paper/2207.11094","citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:7ae8fb348356896dc6d961be4dc0869546f54bff150f42da6b9ed8c50af48160","observation_id":"0fbcb927-5585-4cf7-979f-60690a381644","resolution":{"observed_at":"2026-07-02T03:06:29.714335Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":"Remos: 3d motion-conditioned reaction synthesis for two-person interactions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:f523bd0d5b15a6d7233d94252699274a25f566e3e44a6af8b894d3ec84a36d10","observation_id":"720d73c8-fbc0-4f48-9ba9-b2e2e6a319db","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":"Hu- mans in 4d: Reconstructing and tracking humans with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:4c06b487f731144329915252220dfbe08065895782ad2381030a535036559dc7","observation_id":"aa212b94-068d-4c98-a6b7-d7e107e97148","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":"Learning speech-driven 3d conversational gestures from video","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:f11b9f921e344f9fbe5f5ef1006447e19fc559e0a1f33f94b89792b3299b6455","observation_id":"f8b9031d-02af-430e-8fe6-9978f446223f","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":"Motiongpt: Human motion as a foreign language.Advances in Neural Information Processing Systems, 36:20067–20079, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:adf36d18848abc0c7106b19c7480b635f7319c69949b5edb0af20d327bfa77d7","observation_id":"d4d64729-6a84-4223-8811-bca61e491d72","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":"Arflow: Human action-reaction flow matching with physical guidance.ArXiv, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:a213ec724dc5944f711ad289f733bb72721ebeca3e9a374f42ec7bcfbdbcfefd","observation_id":"c470f62f-e255-4c59-a164-64cc365b5fde","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":"Panoptic studio: A massively multiview system for social interaction","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:1396e627955038cbb37e76c4dd95559141613a7eae670a8f6ebc0a29408d714a","observation_id":"1e16a13d-1752-4ad1-b883-90423cee7735","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":"Ross, and Angjoo Kanazawa","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:9a09eaae2b394ba6a0390968af939a2be1e5a1a9578abe6cc8c5da5a5e83337d","observation_id":"52b2a1b8-32ba-46e6-80f1-19f051afb0bd","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:0e18554a62971267d9388f0821b84a87b0a0e05e999df458735db48556755a4a","observation_id":"23d6d17b-ce74-4a5e-9dfe-ab14c100049a","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":"Intergen: Diffusion-based multi- human motion generation under complex interactions.International Journal of Computer Vision, 132(9): 3463–3483, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:43c388adca5963dff45af17eafda3d73587a6140d5289fcefdfcbfc31313ec70","observation_id":"06868296-cce9-4df5-a8c8-517f4caf3c87","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":"Beat: A large-scale semantic and emotional multi-modal dataset for conversational gestures synthesis","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:b18bd63d01a9b964ef6ec744eca5d06519de1a7be1c5810e4c40be54b26b38e6","observation_id":"a7c5805b-dfc0-43ce-950d-d322192cdef5","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":"Emage: Towards unified holistic co-speech gesture generation via expressive masked audio gesture modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:ec142c260eef590d55a066f14ce8fb0f8f1ea074ef41779da28625e098c29eea","observation_id":"d376f2ed-f409-4a8a-9e5a-7f0ee1e27f6f","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18898","last_updated":"2025-08-03T07:25:09Z","snapshot_observed_at":"2026-07-06T20:28:47.519113Z","submitted_at":"2025-01-31T05:34:59Z","title":"GestureLSM: Latent Shortcut based Co-Speech Gesture Generation with Spatial-Temporal Modeling","version":3},"cited_work":{"arxiv_id":"2501.18898","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.18898","snapshot_observed_at":"2026-07-02T03:06:29.692095Z","title":"arXiv preprint arXiv:2501.18898 , year=","venue":null,"work_id":"ad325c60-8037-4d7d-83df-0981f98b980f","year":2025},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"cited_paper":"/paper/2501.18898","citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:a40e9de16b57ebf140d8448e61777ae35360c9a73f53b5cc6b71b337fce80065","observation_id":"7afbf16e-15e8-4d16-a9d1-74406252815a","resolution":{"observed_at":"2026-07-02T03:06:29.694605Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":"1711.05101","doi":"10.1137/1.9781611972825.47","metadata_source":"pith","pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Decoupled Weight Decay Regularization","venue":"cs.LG","work_id":"07ef7360-d385-4033-83f7-8384a6325204","year":2017},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:e24b3f7d2dd9f7faa86a3844d0a7a80d451139298036dc96f4eed856e4abc99c","observation_id":"c079c2d9-7209-461b-a268-326e04645b04","resolution":{"observed_at":"2026-07-02T03:06:29.700791Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":"Posegpt: Quantization-based 3d human motion generation and forecasting","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:56428dd7a8d18f28b68b982d47279a942a618165fd5c4dbe3cc3b864a7ca13e4","observation_id":"61330f59-3fa8-4a0c-8331-4640252310f6","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04440","last_updated":"2024-09-06T17:59:01Z","snapshot_observed_at":"2026-08-08T17:02:01.548702Z","submitted_at":"2024-09-06T17:59:01Z","title":"Synergy and Synchrony in Couple Dances","version":1},"cited_work":{"arxiv_id":"2409.04440","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.04440","snapshot_observed_at":"2026-07-02T03:06:29.695213Z","title":"Synergy and synchrony in couple dances","venue":null,"work_id":"a5f2c592-c56f-4f4a-a1bc-8c089ba1bfb3","year":2024},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"cited_paper":"/paper/2409.04440","citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:e7d24021709159af7678a7bd5e599f0bd53af7365761b588fe5be14aa1d744cf","observation_id":"98c575b1-104b-4ffe-97c2-7784947d8b23","resolution":{"observed_at":"2026-07-02T03:06:29.697236Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":"Retrieving semantics from the deep: an rag solution for gesture synthesis","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:e23859196b6ffcf3cfa0eb6bac892e80a6869d93b65a5483090b5b66e05ef708","observation_id":"30e296e7-13b5-485e-a91e-031f237fdb60","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":"Hamza Mughal, Rishabh Dabral, Vera Demberg, and Christian Theobalt","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:718a59a8b8f7e3f7ed986e8e3303c2e55406b02626bae1c75940b626823a57bf","observation_id":"5ff79c8f-d2f0-48c0-b7fc-bd7784d872c2","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":"Learning to listen: Modeling non-deterministic dyadic facial motion.CVPR, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:741b8bf6f36bb37835a8c88b60d25428a1d14951b2a8556f4df0bf58cfa46c27","observation_id":"d40fad8d-fc1d-4731-9408-5bb1e861c1de","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":"From audio to photoreal embodiment: Synthesizing humans in conversations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:4f8b48e9d2059cc34f07d9446d30188193190b42db22ff79a479e000398538a4","observation_id":"f9582365-f147-49be-a8e1-7d907ba80f3d","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.18432","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T03:06:29.702192Z","title":"Sarah: Spatially aware real-time agentic humans, 2026","venue":null,"work_id":"bd2a3870-941f-4de3-aff3-4a832b153f4d","year":2026},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:dbe8148c241da7b148bb0bbe5a8c7775d14208f36844dcc453fd4de926bb5504","observation_id":"882f426e-b15f-4ad4-b6ff-302ad4d3288e","resolution":{"observed_at":"2026-07-02T03:06:29.706044Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:463c5fea55c27b4edc81a8a9fe0670095d0819d806d9def6d73ec9247afda326","observation_id":"3e568def-5cb4-4648-9599-457c4378957e","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":"Reconstructing hands in 3D with transformers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:1e32dcf31a8e40e5678f373110054d8688d4922ff412488dbbd86d3223b409f6","observation_id":"a0f7e56a-7877-4eec-a67e-81761c17d206","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":"Dyadit: A multi-modal diffusion transformer for socially favorable dyadic gesture generation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:dbf092afe35197289b3d892d38c4ccb9613f70b5a273db81fd60fc01a0964d03","observation_id":"cd5ca7d9-cfc3-463f-9fa2-e45f93dbfe73","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":"Dualtalk: Dual-speaker interaction for 3d talking head conversations","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:e1fb90cfcf0d286068f50fe45852039de9727e0aa8daaa1eccce5994ca553af4","observation_id":"f49868f6-d4cf-4b09-b82f-45bf4d719954","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.06053","doi":"10.48550/arxiv.2602.06053","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Personaplex: V oice and role control for full duplex conversational speech models","venue":"Open MIND","work_id":"f9ff1418-0d52-48ae-b0a2-8de74df0fcfb","year":2026},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:0b2c01dd11b598ce3d2b2bccdf0f6021509ea0ef6a32278c132faf3ee47ea5dc","observation_id":"178315bd-eb4a-4801-9a6f-8b30ad6cbb61","resolution":{"observed_at":"2026-07-02T03:06:29.710472Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":"Glu variants improve transformer, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:d2f323622936f4db0f82adc811fb35e73d08ea461378a57c3586d1e685d372d1","observation_id":"089288cc-1f19-4f54-addd-8c2a3b53fa2b","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":"Roformer: Enhanced transformer with rotary position embedding.Neurocomput., 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:a027033cbdd332b51436409a6f99181fe1a235533a2aa0a98b7c1c7bf8bcae5c","observation_id":"3f742870-3791-4645-96f4-13136fe64ea6","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":"Motionclip: Exposing human motion generation to clip space","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:992f51431a6b073883d532c7b03ad82083b1dc1107348b1ccbb5cce7f51ea0e0","observation_id":"12d9d8ec-ba55-4a29-95e2-2204afa417be","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":"Intercontrol: Zero-shot human interaction generation by controlling every joint.Advances in Neural Information Processing Systems, 37:105397– 105424, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:73ef618c38a7bbaea7dda25cfc0b43591ebc63c27f6ad2a557511da875c2ab26","observation_id":"2fd276c7-25b6-4b37-89c3-593ee4d9041b","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":"Regennet: Towards human action-reaction synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:49c72eedf18aed9ad57138d2f7efe872b60543a10786951762c4e2cf69920cbb","observation_id":"229eafb9-5b79-4b3a-82c2-e76e9b2107a1","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":"Generating holistic 3D human motion from speech","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:3ce3d7573f14ccc6d63cacc1b9c626fb34f422b285411f506aa64109c286d896","observation_id":"1ed4bf9d-6e60-4cf7-bd66-17da83802846","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":"Speech gesture generation from the trimodal context of text, audio, and speaker identity.ACM TOG, page 1–16, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:dacb34529414f29d012c8e16ed689e220686caad487c37dcd61a67e65e373660","observation_id":"be923bc0-b48b-48c9-8ede-9d6ef8f0770b","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":"T2m-gpt: Generating human motion from textual descriptions with discrete representations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:9cb617ece21babe3b10722f6d64504fdd4b33b6ebac1ce224b44cd49ebe9fe83","observation_id":"3960897a-8c28-4cd6-a678-9b91178fdbeb","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":"Vibes: A conversational agent with behaviorally-intelligent 3d virtual body","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:059bacae2646837d466a2c4de23fc0c787adc2e88a3abd27bc2e0bfe358716de","observation_id":"cf0ca0e2-aaa9-476a-8913-959eda40b0c7","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":"On the continuity of rotation representa- tions in neural networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:126103f4c8236e332b4291359d80b6b4ebeaee9e2295bf72767723eb5ecdaff2","observation_id":"8010b447-ac2c-4f13-92b6-722caf813ce5","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:22:30.431160Z","title":"<system> You enjoy having a good conversation. <system>","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-28T10:22:30.431160Z"},"links":{"citing_paper":"/paper/2606.03874"},"observation_digest":"sha256:a55610b88e804344e403b7955bf1421b7e92973d796a4ae605a343929f405be0","observation_id":"97fee3ca-f20b-466c-992c-84c5b6a08eb6","resolution":{"observed_at":"2026-06-28T10:22:30.431160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.03874","last_updated":"2026-06-02T16:42:56Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T19:57:46.440518Z","submitted_at":"2026-06-02T16:42:56Z","title":"DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":34,"verified_exact":6,"verified_fuzzy":0},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 0 inbound Pith citation observations for arXiv:2606.03874."}