{"as_of":"2026-08-13T12:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:045dc2c565eed1aaa555be726d8b76ef650bab3fe9dafe12204996853d7790be","coverage":[{"denominator":78,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":78,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T23:34:10.895977Z","state":"measured"},{"denominator":79,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":79,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:16:44.323653Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T12:16:44.447784Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"cited_work":{"arxiv_id":"2412.02419","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.02419","snapshot_observed_at":"2026-08-07T12:16:44.447784Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","venue":"cs.SD","work_id":"2ad3bd39-d7e0-40ab-a5fa-db66f7a41ed2","year":2024},"citing_paper":{"arxiv_id":"2506.00173","last_updated":"2025-05-30T19:24:43Z","snapshot_observed_at":"2026-08-08T03:24:16.395495Z","submitted_at":"2025-05-30T19:24:43Z","title":"MotionPersona: Characteristics-aware Locomotion Control","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:16:44.323653Z"},"links":{"cited_paper":"/paper/2412.02419","citing_paper":"/paper/2506.00173"},"observation_digest":"sha256:58a0e3da52227c48f2df64e345cccf75836d67f64dd8b52c768cefddadd5e031","observation_id":"72db793a-a47a-4f04-b638-14853299fecc","resolution":{"observed_at":"2026-08-07T12:16:44.518506Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.02419/citation-record","integrity":"/paper/2412.02419/integrity","json":"/paper/2412.02419/citation-record.json","paper":"/paper/2412.02419"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.787090Z","title":"Style transfer for co-speech gesture animation: A multi-speaker conditional-mixture approach","venue":null,"work_id":"ed16075f-21b3-4af9-addc-0ab68c079bbf","year":null},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.605320Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:7fe58fc4c970e21968d664d0dd530ae53a13250bcbe5b2907184ef7e88f43f8b","observation_id":"3ca2d14f-68e6-416e-8beb-072713cd51e4","resolution":{"observed_at":"2026-08-11T23:34:11.790910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.776375Z","title":"Style-controllable speech-driven gesture synthesis using normalising flows","venue":null,"work_id":"c831168d-bbfa-4a93-a4f8-2d50204470b7","year":2020},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.609753Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:45e08aa26f274fc317cd9197f8523ad216db871746d17ecf2b6d4663ee0bcb0a","observation_id":"5915c4ce-a3a8-4a78-9186-f1c5c2c6e941","resolution":{"observed_at":"2026-08-11T23:34:11.780191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.765975Z","title":"Listen, denoise, action! audio-driven motion synthesis with diffusion models","venue":null,"work_id":"5095465d-211f-4601-9484-6f0e75132290","year":2023},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.613798Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:0c76424cd29ea1a1a391f1255d6443982e037783d28f09c3fbb18a90a1be3bdb","observation_id":"23fa6aa1-13a1-4474-81cc-37bca8c711a9","resolution":{"observed_at":"2026-08-11T23:34:11.769829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.755188Z","title":"Rhythmic gesticulator: Rhythm-aware co-speech gesture synthesis with hierarchical neural embeddings","venue":null,"work_id":"6b5eaea4-530c-4f28-8fbd-31033ae8b969","year":2022},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.618075Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:24662fb875a9d235086de890262adead0b22aa522bb4d43158f711e85f2428b2","observation_id":"56da8f1c-79f6-436a-be1c-d6fb598e5c18","resolution":{"observed_at":"2026-08-11T23:34:11.758838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.743948Z","title":"Gesturediffuclip: Gesture diffusion model with clip latents.ACM Transactions on Graphics (TOG), 42(4):1–18, 2023","venue":null,"work_id":"8749b77f-aba7-4bf6-b936-98f7ca2362ad","year":2023},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.622171Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:8a9dd697dcfa35232be4a4dd4965a6968b313a9c8c1bfc8a2ef72dd46958ec5d","observation_id":"20fae4cf-0e19-4bf7-a8e5-5b3370613036","resolution":{"observed_at":"2026-08-11T23:34:11.747711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.732559Z","title":"Gesturediffuclip: Gesture diffusion model with clip latents.ACM Transactions on Graphics (TOG), 42(4):1–18, 2023","venue":null,"work_id":"c4e7053e-b4ab-482f-8469-dacc1ad17525","year":2023},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.626457Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:addc3dfdb75055f3cba8d8407a4747891d6f9b2844059b6f02a3299c01a9db02","observation_id":"8cb414e2-3ad3-4685-80cf-eba842005ca4","resolution":{"observed_at":"2026-08-11T23:34:11.736630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.721101Z","title":"Speech2affectivegestures: Synthesizing co-speech ges- tures with generative adversarial affective expression learning","venue":null,"work_id":"710b9b26-c57e-4c32-b9c5-661d85371a43","year":2027},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.630449Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:a047cf1330363b33ffd323ae73576eb668ef470e04d1fef0dae38c9792b42039","observation_id":"b397dc9e-a53d-4c1d-9d7f-a9140d0dd09e","resolution":{"observed_at":"2026-08-11T23:34:11.725245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.708244Z","title":"Digital life project: Autonomous 3d characters with social intelligence","venue":null,"work_id":"be17b523-010a-49a7-8dd5-1272412b42fa","year":2024},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.634808Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:4583816c634bee6ca950b9292520fea84e62e6ab82cd6fbf9d69229c29cd2920","observation_id":"6431bad8-6118-4472-876a-11ca2642cacd","resolution":{"observed_at":"2026-08-11T23:34:11.711947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.695706Z","title":"Speech-gesture mismatches: Evidence for one underlying representation of linguistic and nonlinguistic information","venue":null,"work_id":"f81e897a-864a-4c21-a3ea-a3081d3913a6","year":1999},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.638849Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:f3e3c28dbabdda1042ccef3a5902206a267286ea53f06aead92878e782714717","observation_id":"7e103cd7-d7ae-428b-84aa-57f58c0f276f","resolution":{"observed_at":"2026-08-11T23:34:11.700250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.682881Z","title":"Beat: the behavior expression animation toolkit","venue":null,"work_id":"5a44be5e-c382-46cd-9369-8e2dedd800b9","year":2001},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.642619Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:16850c3ed4034efbdcca95952e7e30f38dc1d5a85bb69f9e4453bf8d56b2da0d","observation_id":"cfb72b07-3375-4e42-8bd1-870df924531b","resolution":{"observed_at":"2026-08-11T23:34:11.687482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.670792Z","title":"Taming diffusion probabilistic mod- els for character control","venue":null,"work_id":"b0176c6d-a63e-4334-b7fb-5f8ea5a33a14","year":2024},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.646002Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:4cba62901802d296405d8baf81fb02aa85bc57d16ed361b63a466d352669cd17","observation_id":"85d61874-e5c6-4922-96d3-b600001ea7ed","resolution":{"observed_at":"2026-08-11T23:34:11.674539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.659131Z","title":"Executing your commands via motion diffusion in latent space","venue":null,"work_id":"e070a019-f21b-413a-b310-8f89c2327479","year":2023},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.649538Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:663b655001e679c86f4a88955b70df5641989f938201cc83fffb12c9faf78678","observation_id":"02990db2-beda-4498-86b3-5acf292fe63c","resolution":{"observed_at":"2026-08-11T23:34:11.662865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.647231Z","title":"Black, and Timo Bolkart","venue":null,"work_id":"9d479167-ae75-42bb-a505-b5679f8edcdd","year":1942},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.652577Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:416b720c0dc71b5c10aed1c2751a23bf9222e284827921092eef236af043538f","observation_id":"3999d157-0ad4-48c8-8792-b022fbee905e","resolution":{"observed_at":"2026-08-11T23:34:11.651114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.634727Z","title":"The interplay between gesture and speech in the production of referring expressions: Investigating the tradeoff hypothesis","venue":null,"work_id":"6722e6dd-be9a-45f0-882c-2d7eeaaf4e8a","year":2012},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.655939Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:9b92cb8b9be55985570ca8e8e9c94d8723d3e6c09098ab677e78fed5c65370f0","observation_id":"d942fe81-7f19-4eeb-8422-60fc06bfc535","resolution":{"observed_at":"2026-08-11T23:34:11.639164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:10.658853Z","title":"Diffusion-based co-speech gesture genera- tion using joint text and audio representation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.658853Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:c77c35dadd0e54b21e231176637de1275f9be5ec45f61503c52b76b92879e3f0","observation_id":"8d99c66d-a64f-4890-9654-6d40300cbef8","resolution":{"observed_at":"2026-08-11T23:34:10.658853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-11T23:34:10.662380Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.662380Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:b622e79eedc7d7227dc20c81902dd924e6afb29d9008d27341946643503b19a8","observation_id":"3abea151-4294-4c25-b01d-f7eaf2b334c2","resolution":{"observed_at":"2026-08-11T23:34:10.662380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.614272Z","title":"Freemotion: A unified framework for number- free text-to-motion synthesis","venue":null,"work_id":"eccb6ea5-7e3f-41a0-981f-4914e617b453","year":2024},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.666246Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:c68f07b78c512afdb8688df134a8158a53ec2264169f752fc5e6b06d732f730c","observation_id":"d96f74c4-816d-45e0-8b73-21673e297df5","resolution":{"observed_at":"2026-08-11T23:34:11.618609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.602794Z","title":"Troje, and Marc-Andr ´e Carbonneau","venue":null,"work_id":"6f985c40-cf26-4666-9c5a-db785c933578","year":2023},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.669724Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:d2822a913110ffc27d72eb0d9285fad0cdc74979a958ff2d9797389adbd36e78","observation_id":"1a8b866c-d5e1-4e38-bcd5-f656c1de7739","resolution":{"observed_at":"2026-08-11T23:34:11.606790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.590830Z","title":"Remos: 3d motion- conditioned reaction synthesis for two-person interactions","venue":null,"work_id":"35b4f9e9-c69b-4303-a80c-ce0eb72c3687","year":2024},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.673292Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:74e2e0447ce5e9e88caf06043b8b23c9d12fd67760c4da0e29d43e2739168346","observation_id":"41df565f-9d18-483f-93ee-3c04dfccf4db","resolution":{"observed_at":"2026-08-11T23:34:11.595162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.578782Z","title":"Interaction mix and match: Synthesizing close interaction using condi- tional hierarchical gan with multi-hot class embedding","venue":null,"work_id":"8a738541-665e-448a-8929-115982044191","year":2022},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.677265Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:b36046eaea8ed433dcac2bdd15cc1e075a5bf13e80342fb7431fc60ee9cc171f","observation_id":"be8d6683-299f-4191-ad28-cc5dbb6023c7","resolution":{"observed_at":"2026-08-11T23:34:11.582801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.567506Z","title":"Learning speech-driven 3d conversational gestures from video","venue":null,"work_id":"5e092d16-4400-4d5a-85f1-5498f9b92235","year":2021},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.680789Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:2b7359237c4175258a3371344596a44409ed34c639d4b3ce11eacdeeeebb44fc","observation_id":"f65e4349-e081-4312-bacb-6d623a6315ab","resolution":{"observed_at":"2026-08-11T23:34:11.571181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.554872Z","title":"Evaluation of speech-to-gesture generation using bi-directional lstm network","venue":null,"work_id":"056aaa97-541c-42c5-8a1c-e3ccd620ee97","year":2018},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.684444Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:036492bea50dc38ba810514b9d2d739fc50a44e6546f5dd395b6acadd16bc28d","observation_id":"439a4759-23c4-4b32-8f36-fc848410ef8a","resolution":{"observed_at":"2026-08-11T23:34:11.558985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.543780Z","title":"Moglow: Probabilistic and controllable motion synthesis using normalising flows","venue":null,"work_id":"cfc6fd8b-79b7-414c-b33b-5e4a8c1deb44","year":2020},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.687870Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:12653d6ee45575579fc114c837522644fe57fe7700eab1e966707d2bb9b8b2d4","observation_id":"6316e41f-a6d5-4520-957f-96fb48617ede","resolution":{"observed_at":"2026-08-11T23:34:11.547685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.530431Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":"76213dc6-683a-480d-96a1-cb0392d7c076","year":2020},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.691524Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:a824d147d3fa785c137db74b511360df7720de0671aa360f6ddd9f438f8c384e","observation_id":"6880d816-5fdb-4531-a03d-3c4ebe8d07d4","resolution":{"observed_at":"2026-08-11T23:34:11.536260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.519223Z","title":"Dead blending, 2023","venue":null,"work_id":"2a255969-8a97-4fa7-82a2-9588b2752144","year":2023},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.695463Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:0ed750788128a35d7b525f61906f18fecfce01fdc5bbce020684d1671a8489a8","observation_id":"3d47a550-f56b-4174-abb6-ac35337d1631","resolution":{"observed_at":"2026-08-11T23:34:11.522980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.508288Z","title":"Phase- functioned neural networks for character control","venue":null,"work_id":"a01b784d-ceae-494e-85b9-b65ce3b67fac","year":2017},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.698968Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:6ee1e5a4124352e30206e048ce5cae62e7fcf48940f20f45655e4dd162b19fa7","observation_id":"cc08d7be-1e85-419d-9115-5f77e7e8c519","resolution":{"observed_at":"2026-08-11T23:34:11.511947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.496507Z","title":"Example- based control of human motion","venue":null,"work_id":"a6c21f0d-6bbb-4d4d-8b9e-86296a443694","year":2004},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.702423Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:951a3dcaab00758e5b2c0ace6bde2be1ddd7aecaa0c7787f383afa07ca3817e8","observation_id":"2b0e30cf-8f77-4624-a3e6-e99e4ea8d345","resolution":{"observed_at":"2026-08-11T23:34:11.500817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.485597Z","title":"Robot behavior toolkit: generating effective social behaviors for robots","venue":null,"work_id":"e722462a-9684-4435-bd70-e18268898aca","year":2012},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.706354Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:716b91bcb0de6c556467ae568aa90fcdd6980f7b2f7593e913072878d4019d18","observation_id":"d1972587-0b70-413a-a0b4-cd858bc3d2e3","resolution":{"observed_at":"2026-08-11T23:34:11.489364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.474716Z","title":"Interact: Capture and modelling of realistic, ex- pressive and interactive activities between two persons in daily scenarios","venue":null,"work_id":"7587752c-9aff-4167-af3c-ffbd562d9851","year":2024},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.710164Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:ec4698c6583d0459b70f612e97b59433d6b33ae6d07d0080ec839dcf1cdd6127","observation_id":"e76a4e53-20ee-4230-b662-17e640e00c88","resolution":{"observed_at":"2026-08-11T23:34:11.478397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.463640Z","title":"Intermask: 3d human interaction generation via collaborative masked modelling, 2024","venue":null,"work_id":"e7fe0375-d854-4e5b-9b9e-f614a8cf6f53","year":2024},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.713926Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:111f6e048eaeee4ac6f5350329451269985b4a594bca24f1eb1d1f272679c97d","observation_id":"5975b0a1-b9a4-4922-b180-6af8b50f6144","resolution":{"observed_at":"2026-08-11T23:34:11.467350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.453417Z","title":"Synchronized multi-character motion editing","venue":null,"work_id":"934c68c8-0126-44f1-826c-e7fe38caa990","year":2009},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.717512Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:6d7aeda4531f9834cafaeb9a2268393f057f2abb2f2abad2a3e502084c29d9e3","observation_id":"6a1026dd-d786-468d-ba8d-5105a70365b1","resolution":{"observed_at":"2026-08-11T23:34:11.456925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.442809Z","title":"Tiling motion patches","venue":null,"work_id":"fa23547c-db0d-4b99-a1cb-4ef45ed9bb16","year":2012},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.721459Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:3578c00174d6a4fdd4bb41c620e83ee51e5ee59cfd99efc8f0a32f6510aaaeed","observation_id":"b151996e-cce2-4bae-b3c5-f427d7b187d9","resolution":{"observed_at":"2026-08-11T23:34:11.446327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.432122Z","title":"Towards a common framework for multimodal generation: The behavior markup language","venue":null,"work_id":"2ddc1003-ec88-4fd0-9549-ec4af502e513","year":2006},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.725418Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:1b59bb263218e4b297abfde44e9f3b86936a26e0a3c3604166cbc3e1ae636b59","observation_id":"f4c80f5a-1a47-4127-ae36-802a4891f356","resolution":{"observed_at":"2026-08-11T23:34:11.435790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.421054Z","title":"Gesticulator: A framework for semantically-aware speech-driven gesture generation","venue":null,"work_id":"d52f3f60-c8ad-4123-8a81-54efc42e3efa","year":2020},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.729119Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:aa560d885f61f08072cdd1c2a04bf12c711cec372066e8733d509d2e6dd4f53e","observation_id":"3ee368d6-8506-447a-8370-2ed9a34fc80c","resolution":{"observed_at":"2026-08-11T23:34:11.424954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.410011Z","title":"The genea challenge 2023: A large- scale evaluation of gesture generation models in monadic and dyadic settings","venue":null,"work_id":"4da27603-d46b-4801-94e2-e46c6711bbb5","year":2023},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.733295Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:11022c1602d29e4d73c8e6c90118041264933a198da545cb8f1573dd9ab3acbd","observation_id":"fe930589-3c4b-4eac-8d7d-633d2cfbad82","resolution":{"observed_at":"2026-08-11T23:34:11.413976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.398455Z","title":"Evaluating gesture generation in a large-scale open challenge: The genea challenge 2022","venue":null,"work_id":"36ad69fc-201d-40b0-ab07-94eb84d7dce6","year":2022},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.737923Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:6c067044e9c986d9a06ca0ffb16127337ce3b1074d401e09092350625fe739ba","observation_id":"db9a7417-ebc6-4442-8197-e2d8f5ffe4ba","resolution":{"observed_at":"2026-08-11T23:34:11.402783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.387486Z","title":"Cross-conditioned recurrent networks for long- term synthesis of inter-person human motion interactions","venue":null,"work_id":"0a3289c6-08b5-4481-9628-0a0327c805f3","year":2020},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.742001Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:1d4bdab2ccd967f494e3d7e9ff41889ec986a349a21d30dcbd89f70c040f4bca","observation_id":"07d536e3-ea5a-4b05-81ed-b0a8cc5e7334","resolution":{"observed_at":"2026-08-11T23:34:11.391368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.376410Z","title":"Two-character motion analysis and synthesis","venue":null,"work_id":"91ac2dc1-e0a8-496f-937d-e382e70f6b88","year":2008},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.745937Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:95b01409bd5f22b42f3cc83aa618e5ca8c9a123fe12fb079f9f6f5132baff25d","observation_id":"34fd5287-c8b0-4620-ad91-b95e190c0122","resolution":{"observed_at":"2026-08-11T23:34:11.380112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.365362Z","title":"Motion patches: building blocks for virtual environments annotated with motion data","venue":null,"work_id":"2e615ce8-385d-4253-9edc-6e8982dd3836","year":2006},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.749738Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:437cfc0ec47445ff32cae0f6a47b9e62fcc06f54b01a68fa59af7c00f1f7b3a2","observation_id":"88e21c0f-5319-46d7-a528-85150a04f76f","resolution":{"observed_at":"2026-08-11T23:34:11.369173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.354256Z","title":"Gesture controllers","venue":null,"work_id":"cbb62e06-3a71-4c62-aafb-c37e76f80e7f","year":2010},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.753522Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:e600c4b189b2140ac073bf5a3cc881fbbf15afce1799c7b13846fc47238bc2d1","observation_id":"eeb58929-60ac-4dcb-bb5f-cb6f417baeec","resolution":{"observed_at":"2026-08-11T23:34:11.358230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.342949Z","title":"Audio2gestures: Generating diverse gestures from speech audio with conditional varia- tional autoencoders","venue":null,"work_id":"a386b5c5-c0c9-47b0-a759-43c30887965e","year":2021},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.757026Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:43f771ad4509390524c18c679a711266b2e9441dea55c4c1dcca2c50cbf5fede","observation_id":"ce76ea1f-9bcb-4a30-83b7-e9f25ee0032a","resolution":{"observed_at":"2026-08-11T23:34:11.346673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.331767Z","title":"Ai choreographer: Music conditioned 3d dance generation with aist++","venue":null,"work_id":"34a2805f-b2f2-4123-a2cd-59c46b8b0842","year":2021},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.760840Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:0fe2f7a02dd8147ea05b74014a3c35bf9fb3ea67a5cd568a69fec92fc4a646f9","observation_id":"33e9020d-0cf5-4ca8-b632-16a7e2524a53","resolution":{"observed_at":"2026-08-11T23:34:11.335671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.319696Z","title":"Intergen: Diffusion-based multi-human motion genera- tion under complex interactions","venue":null,"work_id":"ba8d08f3-ab94-441a-849b-78512552777b","year":2024},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.764298Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:54ccfeb135e27db15448d5e4de74030b79f33c0955f2dc887dc0114743200083","observation_id":"66f12494-a44e-4e61-aecc-0c913f74421f","resolution":{"observed_at":"2026-08-11T23:34:11.323941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.307917Z","title":"Com- position of complex optimal multi-character motions","venue":null,"work_id":"32093166-9a28-496b-a9ff-c195aab941bc","year":2006},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.768474Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:b8974c3473b85332bc68142602525b5f0aab2f391804be8766edb9de8d7eb225","observation_id":"b7ec29bf-bd6c-4ff3-87d4-1650789ade19","resolution":{"observed_at":"2026-08-11T23:34:11.311617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.05297","last_updated":"2022-09-20T05:44:29Z","snapshot_observed_at":"2026-07-06T12:46:23.306134Z","submitted_at":"2022-03-10T11:19:52Z","title":"BEAT: A Large-Scale Semantic and Emotional Multi-Modal Dataset for Conversational Gestures Synthesis","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.05297","snapshot_observed_at":"2026-08-11T23:34:10.771875Z","title":"Beat: A large-scale semantic and emotional multi-modal dataset for conversational gestures synthesis","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.771875Z"},"links":{"cited_paper":"/paper/2203.05297","citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:5e77e9a4452a088b23293ddfea50e06834cbab6f077f7a39d2373b6fb4a72772","observation_id":"ec01dcc6-bd0c-4b0d-a6d3-caf1a887e39e","resolution":{"observed_at":"2026-08-11T23:34:10.771875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.297199Z","title":null,"venue":null,"work_id":"c8c99b33-69b0-4a02-9b7f-96e806a5a287","year":2024},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.775706Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:a38b4425bcd30b7755a54688249867f31937e991964b4e4052cd5492ea379f6e","observation_id":"2ed6c7a3-56e8-4729-b2b3-af2a888a2c7c","resolution":{"observed_at":"2026-08-11T23:34:11.300739Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.285664Z","title":null,"venue":null,"work_id":"eab1a6d3-6fc5-40fd-9f4b-8c8666229304","year":2024},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.778805Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:2d963ea054649efdce3f546ea70293f7a6e1144b56f1b6e985363c81dbbcea7f","observation_id":"896ea1c6-8479-480e-8f25-f37af429c758","resolution":{"observed_at":"2026-08-11T23:34:11.289500Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.273539Z","title":"Learning hierarchical cross-modal association for co- speech gesture generation","venue":null,"work_id":"73da5bc9-c2c5-410f-820c-e539dbdcbfff","year":2022},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.782159Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:52a73981729a59f826a188bdd44e9542ddc482a403997de2439146aadf61c707","observation_id":"492e9b10-72f3-4075-9c87-15620a75b76e","resolution":{"observed_at":"2026-08-11T23:34:11.278004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.261072Z","title":"librosa: Audio and music signal analysis in python","venue":null,"work_id":"6bf4516e-a076-4639-82b6-4211b98d4d5d","year":2015},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.785431Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:4c65538de3ff97549f7a70be423978e7b1959486f6ab2ba4c94bbf331d29fdac","observation_id":"87d76ea7-3213-4a20-9f4d-760622c75bc4","resolution":{"observed_at":"2026-08-11T23:34:11.265161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:10.788440Z","title":"Gan-based reactive motion synthesis with class-aware discriminators for human–human interaction","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.788440Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:9038a561467a4e16922b5f333acd3866d48f63112bdd2b6857db6d50314ba35f","observation_id":"841a0d39-cf2a-4aa3-b837-0cdeb2fc7b2f","resolution":{"observed_at":"2026-08-11T23:34:10.788440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.242043Z","title":"Gesture modeling and animation based on a proba- bilistic re-creation of speaker style","venue":null,"work_id":"6a4a4080-75a3-414a-bbb0-9e531dee6208","year":2008},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.793221Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:fd2ca7a9c1f3f16a9e67b17afd380ac6ba3f5b387c7d2fbd23d520c6e60d8597","observation_id":"3d7bf52f-16fe-4278-9957-e82fc9ed806d","resolution":{"observed_at":"2026-08-11T23:34:11.246159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.229449Z","title":"From audio to photoreal embodiment: Synthesizing humans in conversations","venue":null,"work_id":"a8c9ee43-9a7c-4c49-81ef-241099406559","year":2024},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.797880Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:28aabebe0decbfd995bb66528ccdf17fa7dd45f903f6e2dcb42ec1678b687227","observation_id":"dbacaf9f-79b6-4c46-8db8-274cf3022c59","resolution":{"observed_at":"2026-08-11T23:34:11.234149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.217579Z","title":"Glide: Towards photorealis- tic image generation and editing with text-guided diffusion models","venue":null,"work_id":"650fc25e-483d-4f6c-ae89-173309ff6745","year":2022},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.801777Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:69201e9594ba3124ce56e3b1709b1d55964d16e63838b2d7228d8b311da1cbe8","observation_id":"6b842028-841c-4509-abbd-437d226e06e3","resolution":{"observed_at":"2026-08-11T23:34:11.221478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.205723Z","title":"A comprehensive re- view of data-driven co-speech gesture generation","venue":null,"work_id":"3336e41d-5b2b-48f5-9d0d-3bc458307267","year":2023},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.805434Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:bd2f0e1ecdbc21abd69752fecf7d04f03befae8baadc840229b0e048fd2005aa","observation_id":"2cb3c7b4-ee91-49dd-a6fa-dd0cbacbb2e0","resolution":{"observed_at":"2026-08-11T23:34:11.209841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.194052Z","title":"Librispeech: An asr corpus based on public do- main audio books","venue":null,"work_id":"b0669ba3-2c1a-4236-96fe-db6b52c8dca3","year":2015},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.809497Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:7b6403e60a44bdb2fc2216ecda7b0459c1682016f072e621b60f01a4f43e3f2f","observation_id":"a6cdc883-08ad-40df-8e89-2e719926fbe7","resolution":{"observed_at":"2026-08-11T23:34:11.197919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.182596Z","title":"Bodyformer: Semantics-guided 3d body gesture synthesis with transformer","venue":null,"work_id":"418dc014-b54f-4a25-927c-a630e1e3b80f","year":2023},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.813195Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:f6393ffa6fbc7dd693cb81ee560e2f03cb6608d30b711fcebcae0c5997edc21b","observation_id":"96373b2b-9d16-4261-be07-a9b8a5389ead","resolution":{"observed_at":"2026-08-11T23:34:11.186332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.171406Z","title":"Do people use lan- guage production to make predictions during comprehen- sion? Trends in cognitive sciences , 11(3):105–110, 2007","venue":null,"work_id":"88820800-36ef-4234-a099-aad55354498c","year":2007},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.817013Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:c42ba95f30aae1429c8dd6835c3f381cff4c38944ab7b96d21fea85cfa709ac6","observation_id":"06947c17-cb57-4ad1-a79e-9497e1f20f13","resolution":{"observed_at":"2026-08-11T23:34:11.175473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:10.820676Z","title":"Hierarchical text-conditional image gener- ation with clip latents, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.820676Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:74d17bb8b7163c2366edc1591246cd566d478ff24b925241d1d3a1ad66160b39","observation_id":"9608dfc9-9723-4269-bd87-dc81c22c86ef","resolution":{"observed_at":"2026-08-11T23:34:10.820676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:10.824254Z","title":"Human motion diffusion as a generative prior","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.824254Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:b0098527f186e4e2ca321b369bc6d4c496e0e5ee428720e065bb83404f173c66","observation_id":"320c13ba-d1ba-42b0-9e1f-905dc283375d","resolution":{"observed_at":"2026-08-11T23:34:10.824254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.147118Z","title":"Interaction patches for multi-character animation","venue":null,"work_id":"dd81f9ee-0934-485e-9070-b4ceddb98422","year":null},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.828174Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:70bcbd8c5c8134400d5c68f8531cb361ee3979304d990162de08c28b3a3ff3dc","observation_id":"f186f572-c4df-4ef5-9c3c-59cd0b75dff6","resolution":{"observed_at":"2026-08-11T23:34:11.150778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.137017Z","title":"Duolando: Follower gpt with off-policy reinforcement learn- ing for dance accompaniment","venue":null,"work_id":"a141708c-0cde-45d6-92d3-4f13091fd8df","year":2024},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.831698Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:eb7784288f5cc66a48e409f556e918153bdbb436a86c4d9aa09450380bcb101c","observation_id":"0730844b-9f8c-4d86-bf71-2a7a2509860e","resolution":{"observed_at":"2026-08-11T23:34:11.140373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.126639Z","title":"Local motion phases for learning multi-contact charac- ter movements","venue":null,"work_id":"9ac2405e-d895-4ad1-93ec-f5c28c1036b4","year":2020},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.835159Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:eaddf349f7be4751e35ed4feb934c86e186c16bd29fb534f55b454b47ba7c4ac","observation_id":"025536bc-6071-4b24-b77e-2d7cd30f4927","resolution":{"observed_at":"2026-08-11T23:34:11.130124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.115304Z","title":"Local motion phases for learning multi-contact charac- ter movements","venue":null,"work_id":"6861ea57-6bcf-4cb7-ad59-fbb90c280dbf","year":2020},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.838922Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:9a34f7f51c0630069f7ec32169acbf48c0b76b975c4e9e21876ab4b4c536a144","observation_id":"032f199d-881a-410c-a726-83cede472aae","resolution":{"observed_at":"2026-08-11T23:34:11.118915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:10.842737Z","title":"Human motion diffu- sion model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.842737Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:d4e35280459523e042390b5a8acf1a85ea67a468aefddd2865ff895566ad442c","observation_id":"1f82c318-2fb5-4e16-8299-1414a0979751","resolution":{"observed_at":"2026-08-11T23:34:10.842737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:10.846546Z","title":"Attention is all you need","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.846546Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:9b4c1455a1d62d722e8948d4c830d00266b48a1b3e32efe7671b06823a622820","observation_id":"8480fd60-50da-43cc-9e08-ab52fbfc4716","resolution":{"observed_at":"2026-08-11T23:34:10.846546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.089829Z","title":"Gesture and speech in interaction: An overview, 2014","venue":null,"work_id":"51513d15-a796-4a16-963c-24592b5858cf","year":2014},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.850351Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:ba0be85e038909c0725141fabcf13768c71c4f856f6421afbeeab07829deb972","observation_id":"9904a46b-a906-44db-bb81-bda659acea85","resolution":{"observed_at":"2026-08-11T23:34:11.093731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.078915Z","title":"Generating and ranking diverse multi-character interactions","venue":null,"work_id":"1ad61208-b9cd-4629-a289-d6773d978464","year":2014},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.854232Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:fcf54c18c199d87bbf6b35bde01510cab1014e95b33b3418611b4159bcb0ffb1","observation_id":"0cfc6845-f777-4876-9fc4-187caeb14324","resolution":{"observed_at":"2026-08-11T23:34:11.082699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.066185Z","title":"Eggesture: Entropy-guided vector quantized variational autoencoder for co-speech gesture generation","venue":null,"work_id":"082234ca-01bf-4e07-920e-39e958613ad6","year":2024},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.858168Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:c7214458c87cf6b9219c7d36d18956094b413577017eb146eb6f1c148454f0dc","observation_id":"04ebfbf7-9c3e-4e2b-9f7b-4cad06788d4e","resolution":{"observed_at":"2026-08-11T23:34:11.070716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.054175Z","title":"Speech ges- ture generation from the trimodal context of text, audio, and speaker identity","venue":null,"work_id":"831fad48-806d-475c-8fd6-dc83953c9605","year":2020},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.861661Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:ec330d68301e575db1e308018abe471f0e51bae42a5b5c9ba9aa57a96313ea34","observation_id":"1857373f-ab58-4012-b90b-9c575ef60273","resolution":{"observed_at":"2026-08-11T23:34:11.058176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.15001","last_updated":"2022-08-31T17:58:54Z","snapshot_observed_at":"2026-08-09T16:31:06.714132Z","submitted_at":"2022-08-31T17:58:54Z","title":"MotionDiffuse: Text-Driven Human Motion Generation with Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.15001","snapshot_observed_at":"2026-08-11T23:34:10.865334Z","title":"Motiondif- fuse: Text-driven human motion generation with diffusion model","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.865334Z"},"links":{"cited_paper":"/paper/2208.15001","citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:1432bb3ac61b310a306ffbb9ba905ad9260755940424e42531162ab9e2212305","observation_id":"6c8e1412-677c-4b5e-a378-08917eb488c0","resolution":{"observed_at":"2026-08-11T23:34:10.865334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.042397Z","title":"Speechtokenizer: Unified speech tokenizer for speech language models, 2023","venue":null,"work_id":"62f9d391-6b47-4f67-b73a-cb86db0e519a","year":2023},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.869270Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:7c1bab29bd3500db619157c2b0726482f7326ac101525320c32dae36c0c3675c","observation_id":"b08a51bb-227b-4d0a-a766-a8bb1b413897","resolution":{"observed_at":"2026-08-11T23:34:11.046810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02256","last_updated":"2024-11-23T16:09:58Z","snapshot_observed_at":"2026-08-13T05:10:08.739049Z","submitted_at":"2023-12-04T18:58:38Z","title":"EMDM: Efficient Motion Diffusion Model for Fast and High-Quality Motion Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02256","snapshot_observed_at":"2026-08-11T23:34:10.872691Z","title":"Emdm: Efficient mo- tion diffusion model for fast, high-quality motion generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.872691Z"},"links":{"cited_paper":"/paper/2312.02256","citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:369a7011790947a95bbc719c4c70e3073c3652e0474af06a03efc1d949ed0a53","observation_id":"e9b5eec0-f331-46e2-bc64-4fc7626ba157","resolution":{"observed_at":"2026-08-11T23:34:10.872691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.029991Z","title":null,"venue":null,"work_id":"4b3832d4-196b-4320-a0d5-d5653ee6c8b6","year":null},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.877279Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:7535d73d1a30e67993c1b84fb2a2dbc52d98dd53a2235a3cc03beb7976300475","observation_id":"bed212dd-405f-48ee-b3e1-43f298d8d68e","resolution":{"observed_at":"2026-08-11T23:34:11.034625Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.017658Z","title":null,"venue":null,"work_id":"bb529faf-90b3-4326-b6eb-037f660db0c2","year":null},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.880990Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:675ed0e69038331af89475bafef7ebfc60d5e2aa5e0ce2751eb651fb8aca647c","observation_id":"537878f9-1104-4be0-ac14-303447a336c2","resolution":{"observed_at":"2026-08-11T23:34:11.021563Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:11.001220Z","title":null,"venue":null,"work_id":"ea1cbbb4-0a81-4719-88c4-f12cc6db1552","year":null},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.884500Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:5d9ba77020a5158c79e501ae90a71a20d4035daa577563175642a41fb42f4ac6","observation_id":"adbe8dce-c156-489a-9358-81100f6ab823","resolution":{"observed_at":"2026-08-11T23:34:11.005552Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:10.989871Z","title":null,"venue":null,"work_id":"352850b0-cad0-40b7-bfb8-148078fd4df3","year":null},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.888908Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:58d2f200eeea46e8093295b3e77a0f69c704a679647b0d18915fd5b99eb8425a","observation_id":"180a1b52-9edf-4be0-af4c-74965d9361a1","resolution":{"observed_at":"2026-08-11T23:34:10.993214Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:10.978558Z","title":null,"venue":null,"work_id":"bfbf3f19-df0a-4676-a647-90f8cb127cc4","year":null},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.892402Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:cc9e911c4df9b9f06208612713d36403fd41752cf03c65507e63c4d43c065da2","observation_id":"53797734-b0a1-43f3-9f72-245a532149a3","resolution":{"observed_at":"2026-08-11T23:34:10.982324Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:34:10.966651Z","title":null,"venue":null,"work_id":"25d68618-71f6-4c19-8017-04d259afabb2","year":null},"citing_paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-11T23:34:10.895977Z"},"links":{"citing_paper":"/paper/2412.02419"},"observation_digest":"sha256:79560a8465a069b3b000156746631468bc26500418d4f6d23587c1f50b6ef50f","observation_id":"a563ca93-52e9-4dc4-90a4-6e4250b80133","resolution":{"observed_at":"2026-08-11T23:34:10.970852Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.02419","last_updated":"2024-12-03T12:31:44Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-13T07:28:14.591764Z","submitted_at":"2024-12-03T12:31:44Z","title":"It Takes Two: Real-time Co-Speech Two-person's Interaction Generation via Reactive Auto-regressive Diffusion Model"},"reference_resolution":{"displayed":78,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":60},"total_outbound_references":78},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 78 of 78 outbound references and 1 inbound Pith citation observation for arXiv:2412.02419."}