Pith. sign in

Paper Citation Record · LEDGER

M3-DuplexBench: A Multi-Turn, Multilingual, Multidomain Benchmark for Full-Duplex Spoken Dialogue Models

As of 8 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2607.29125.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2607.29125 v1

Coverage vector

measured 29 of 29 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-03T13:16:11.681586Z

measured 29 of 29 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-08T06:32:00.761636+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

29 of 29 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved29
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 8f8e313c-7afa-4e63-a0a4-9cf84afddd07 · outbound

This paper cites From turn-taking to synchronous dialogue: A survey of full-duplex spoken language models,.

M3-DuplexBench: A Multi-Turn, Multilingual, Multidomain Benchmark for Full-Duplex Spoken Dialogue Models From turn-taking to synchronous dialogue: A survey of full-duplex spoken language models,

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-03T13:16:08.796391Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:16:08.796391Z digest=sha256:cb87756b4381e8a1c1bc73d4b89b54040a1ad71a0595e4767d0d6e0fbe85d4c1

Observation 34e635bd-91cd-4e6d-9c2a-ef27582cce22 · outbound

This paper cites Turn-taking in conversational systems and human-robot interaction: A review,.

M3-DuplexBench: A Multi-Turn, Multilingual, Multidomain Benchmark for Full-Duplex Spoken Dialogue Models Turn-taking in conversational systems and human-robot interaction: A review,

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-03T13:16:08.905461Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:16:08.905461Z digest=sha256:2ecb621e8486fbf07e010bd5b7a2d4ebeb465e4660a85cbaba1824783f4d714e

Observation facccac1-90bd-4ef5-9ce6-45541ac18583 · outbound

This paper cites Generative spoken dialogue language modeling,.

M3-DuplexBench: A Multi-Turn, Multilingual, Multidomain Benchmark for Full-Duplex Spoken Dialogue Models Generative spoken dialogue language modeling,

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-03T13:16:09.024239Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:16:09.024239Z digest=sha256:9d2ccc1c3a2449b3c30d96ded53ac300527d0ba36450f526c84ca25df398822a

Observation 63d6ab26-1521-4dab-b932-ea341e55a2e5 · outbound

This paper cites Efficient and Direct Duplex Modeling for Speech-to-Speech Language Model,.

M3-DuplexBench: A Multi-Turn, Multilingual, Multidomain Benchmark for Full-Duplex Spoken Dialogue Models Efficient and Direct Duplex Modeling for Speech-to-Speech Language Model,

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-03T13:16:09.110907Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:16:09.110907Z digest=sha256:2cf0b244bbe527927c5a3c5cb25131ef93e8d68782969d5a38bc9abeee67e4b9

Observation 883c87ec-07c8-4de7-928a-3142ca0de4ca · outbound

This paper cites Talking turns: Benchmarking audio foundation models on turn-taking dynamics,.

M3-DuplexBench: A Multi-Turn, Multilingual, Multidomain Benchmark for Full-Duplex Spoken Dialogue Models Talking turns: Benchmarking audio foundation models on turn-taking dynamics,

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-03T13:16:09.277474Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:16:09.277474Z digest=sha256:ab633c2fad06b476aba47486f5b623e3bcd6261b54c4d00c5d7e45f31a4ceb83

Observation 264f748a-f22e-4759-90fd-f494174048c4 · outbound

This paper cites Full-duplex-bench: A benchmark to evaluate full-duplex spoken dialogue models on turn-taking capabilities,.

M3-DuplexBench: A Multi-Turn, Multilingual, Multidomain Benchmark for Full-Duplex Spoken Dialogue Models Full-duplex-bench: A benchmark to evaluate full-duplex spoken dialogue models on turn-taking capabilities,

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-03T13:16:09.444000Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:16:09.444000Z digest=sha256:15596331c412d12b2f5f35cb7959c450d0bcbb83d9b25e6b344874bc42fdd481

Observation 5d71ddac-1b28-49c0-9b6b-f8f31f92c581 · outbound

This paper cites Full-duplex-bench v1.5: Evaluating overlap handling for full-duplex speech models,.

M3-DuplexBench: A Multi-Turn, Multilingual, Multidomain Benchmark for Full-Duplex Spoken Dialogue Models Full-duplex-bench v1.5: Evaluating overlap handling for full-duplex speech models,

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-03T13:16:09.553253Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:16:09.553253Z digest=sha256:f79fc85151d3b23bf771d5ca807b1ab6b5070e437de4bc21b9fe9ef44b0a9587

Observation e0466355-7a60-4ddf-a11d-57fe2ca36303 · outbound

This paper cites Full-duplex-bench-v2: A multi-turn evaluation framework for duplex dialogue systems with an automated examiner,.

M3-DuplexBench: A Multi-Turn, Multilingual, Multidomain Benchmark for Full-Duplex Spoken Dialogue Models Full-duplex-bench-v2: A multi-turn evaluation framework for duplex dialogue systems with an automated examiner,

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-03T13:16:09.621941Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:16:09.621941Z digest=sha256:456c62d70bc5bc7bfa53224d748ccc0d2b3811830b777fa4f4ae8c72e1c3b647

Observation d514405e-4b01-4339-b06b-e5be04933ff3 · outbound

This paper cites MTR-DuplexBench: Towards a comprehensive evaluation of multi-round conversations for full-duplex speech language models,.

M3-DuplexBench: A Multi-Turn, Multilingual, Multidomain Benchmark for Full-Duplex Spoken Dialogue Models MTR-DuplexBench: Towards a comprehensive evaluation of multi-round conversations for full-duplex speech language models,

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-03T13:16:09.713495Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:16:09.713495Z digest=sha256:44ca4feb856953af0bb01b8eb274bd2aeb3e841c939385954dd116aa5dc3b4e2

Observation 45e39c7a-d75f-4222-b790-4653faf0e72d · outbound

This paper cites Towards a japanese full-duplex spoken dialogue system,.

M3-DuplexBench: A Multi-Turn, Multilingual, Multidomain Benchmark for Full-Duplex Spoken Dialogue Models Towards a japanese full-duplex spoken dialogue system,

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-03T13:16:09.794008Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:16:09.794008Z digest=sha256:f114c14e9dddde5cf4e139ce190d707bc3e14911d2eccb94e66c22a33436c621

Observation 6c7c749d-4195-43f2-9132-43358c397ee6 · outbound

This paper cites Effects of dialogue corpora properties on fine-tuning a moshi-based spoken dialogue model,.

M3-DuplexBench: A Multi-Turn, Multilingual, Multidomain Benchmark for Full-Duplex Spoken Dialogue Models Effects of dialogue corpora properties on fine-tuning a moshi-based spoken dialogue model,

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-03T13:16:09.843559Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:16:09.843559Z digest=sha256:0df0f15c28d19cd04628cf8fce67db209d6f1de7ec1896124a9aeb2e46af878b

Observation 5608f1a0-7c36-4ba4-8a63-5f174ab88850 · outbound

This paper cites The ICASSP 2026 HumDial challenge: Benchmarking human-like spoken dialogue systems in the LLM era,.

M3-DuplexBench: A Multi-Turn, Multilingual, Multidomain Benchmark for Full-Duplex Spoken Dialogue Models The ICASSP 2026 HumDial challenge: Benchmarking human-like spoken dialogue systems in the LLM era,

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-03T13:16:09.925563Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:16:09.925563Z digest=sha256:7446d41e6b53b8afd09662dd48d9fb9d1b2c899b4fa9be5cd97f2e8162faa8be

Observation 15a7cf94-cace-43f2-aa43-63563ac82ed1 · outbound

This paper cites FD-Bench: A Full-Duplex Benchmarking Pipeline Designed for Full Duplex Spoken Dialogue Systems,.

M3-DuplexBench: A Multi-Turn, Multilingual, Multidomain Benchmark for Full-Duplex Spoken Dialogue Models FD-Bench: A Full-Duplex Benchmarking Pipeline Designed for Full Duplex Spoken Dialogue Systems,

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-03T13:16:10.010235Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:16:10.010235Z digest=sha256:db8d1b6d07b3f0bba02f73d597f000666ff022cb56b3d74f2a459f9f865d7941

Observation ae72628b-9c75-42eb-8d4a-73a760e7e2d2 · outbound

This paper cites SoulX-duplug: Plug-and-play streaming state prediction module for realtime full-duplex speech conversation,.

M3-DuplexBench: A Multi-Turn, Multilingual, Multidomain Benchmark for Full-Duplex Spoken Dialogue Models SoulX-duplug: Plug-and-play streaming state prediction module for realtime full-duplex speech conversation,

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-03T13:16:10.112665Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:16:10.112665Z digest=sha256:140dfd5f1352e9a4071367be0e30a0991f5bcad6a0df069be626e5a3c03f0f3d

Observation 2224aac8-a9e6-4296-81c7-fa78e94d74ae · outbound

This paper cites The candor corpus: Insights from a large multimodal dataset of naturalistic conversation,.

M3-DuplexBench: A Multi-Turn, Multilingual, Multidomain Benchmark for Full-Duplex Spoken Dialogue Models The candor corpus: Insights from a large multimodal dataset of naturalistic conversation,

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-03T13:16:10.227811Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:16:10.227811Z digest=sha256:ea839f7e2506de768bdb5eb67c8b9e7ed21bc157baf0c83ed452121717bae7b0

Observation 00383747-04a3-4b3a-87f5-fbb565bf05a3 · outbound

This paper cites Japanese duplex conversation training dataset,.

M3-DuplexBench: A Multi-Turn, Multilingual, Multidomain Benchmark for Full-Duplex Spoken Dialogue Models Japanese duplex conversation training dataset,

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-03T13:16:10.280411Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:16:10.280411Z digest=sha256:859c4eabbe2f4c58d1e2b3e1aba5434f96d50433392ecd3eb3abe06a698d70ea

Observation 97d74b58-7075-49c7-a349-36b6ec16fb35 · outbound

This paper cites TopiOCQA: Open-domain conversational question answering with topic switching,.

M3-DuplexBench: A Multi-Turn, Multilingual, Multidomain Benchmark for Full-Duplex Spoken Dialogue Models TopiOCQA: Open-domain conversational question answering with topic switching,

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-03T13:16:10.307804Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:16:10.307804Z digest=sha256:c4d93ef99aa60dc8a18c7d5494d4c806794c3609eb71a4d939e772a2ad9bdc2a

Observation e2bebeb0-0243-4568-956b-3523e92ef81e · outbound

This paper cites DiaSynth: Synthetic dialogue generation framework for low resource dialogue ap- plications,.

M3-DuplexBench: A Multi-Turn, Multilingual, Multidomain Benchmark for Full-Duplex Spoken Dialogue Models DiaSynth: Synthetic dialogue generation framework for low resource dialogue ap- plications,

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-03T13:16:10.426421Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:16:10.426421Z digest=sha256:ddc6a6ee048b0f29e4e61a2906482cd4bbe152a23b4bae9aa99ef4e3f0d39153

Observation 77621781-cb2f-4656-aad4-87948c4a1cfe · outbound

This paper cites SpeechDialogueFactory: A Framework for Natural Speech Dialogue Generation,.

M3-DuplexBench: A Multi-Turn, Multilingual, Multidomain Benchmark for Full-Duplex Spoken Dialogue Models SpeechDialogueFactory: A Framework for Natural Speech Dialogue Generation,

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-03T13:16:10.585016Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:16:10.585016Z digest=sha256:d9a7172513734ae118313ab65e7bf843fa4877e1b4d756f9adb493d12ff6b4db

Observation c80b46cc-c9c5-402e-b34b-790b1a79e66b · outbound

This paper cites Behavior-SD: Behaviorally aware spoken dialogue generation with large language models,.

M3-DuplexBench: A Multi-Turn, Multilingual, Multidomain Benchmark for Full-Duplex Spoken Dialogue Models Behavior-SD: Behaviorally aware spoken dialogue generation with large language models,

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-03T13:16:10.715680Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:16:10.715680Z digest=sha256:fbc66dcfa29beeba7eb0781f5a332595b9a85c8ffa30dc70bcd8e6129b50016b

Observation 2c4ba526-7ce0-4359-b870-ef7983705d2a · outbound

This paper cites Gemma 4 31b,.

M3-DuplexBench: A Multi-Turn, Multilingual, Multidomain Benchmark for Full-Duplex Spoken Dialogue Models Gemma 4 31b,

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-03T13:16:10.809105Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:16:10.809105Z digest=sha256:43de2957dd8ce67d1df534dd998d4f2b81667d91ac829e32c15a07112c0328a9

Observation ce19a3be-1a9c-4204-ba60-54bf98f7905e · outbound

This paper cites CosyVoice 2: Scalable Streaming Speech Synthesis with Large Language Models.

M3-DuplexBench: A Multi-Turn, Multilingual, Multidomain Benchmark for Full-Duplex Spoken Dialogue Models CosyVoice 2: Scalable Streaming Speech Synthesis with Large Language Models

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-03T13:16:10.913379Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:16:10.913379Z digest=sha256:8abda51d3ebdca0c864c42d345053f8daba9a97f6786c3fa7c61b8fd9193cb12

Observation 4a634a0c-0fbf-48bd-ac03-21f7799465fb · outbound

This paper cites Robust Speech Recognition via Large-Scale Weak Supervision.

M3-DuplexBench: A Multi-Turn, Multilingual, Multidomain Benchmark for Full-Duplex Spoken Dialogue Models Robust Speech Recognition via Large-Scale Weak Supervision

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-03T13:16:11.024485Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:16:11.024485Z digest=sha256:da286b7e0b38a0ddcdf3edf041922caf2d64e977c5bb9bab774e80e4254d57a9

Observation d2816b7d-6bae-48c0-930b-4a6dcdfe61a1 · outbound

This paper cites faster-whisper: Faster whisper transcription with ctrans- late2,.

M3-DuplexBench: A Multi-Turn, Multilingual, Multidomain Benchmark for Full-Duplex Spoken Dialogue Models faster-whisper: Faster whisper transcription with ctrans- late2,

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-03T13:16:11.152025Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:16:11.152025Z digest=sha256:8977955365fa0a9abc0c2a7af623003befbe4eb4912b0f8cea1917b8217bc708

Observation 1e098d26-33ce-46c0-8d48-c4d35e44f919 · outbound

This paper cites Montreal Forced Aligner: Trainable Text-Speech Alignment Using Kaldi,.

M3-DuplexBench: A Multi-Turn, Multilingual, Multidomain Benchmark for Full-Duplex Spoken Dialogue Models Montreal Forced Aligner: Trainable Text-Speech Alignment Using Kaldi,

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-03T13:16:11.256072Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:16:11.256072Z digest=sha256:5867518c0dc173c414f789411f960d25073314e82050daa627d353036a1fdd64

Observation 71535aca-db61-48ca-a2e1-11e9c75f59c5 · outbound

This paper cites GPT-5 nano Model,.

M3-DuplexBench: A Multi-Turn, Multilingual, Multidomain Benchmark for Full-Duplex Spoken Dialogue Models GPT-5 nano Model,

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-03T13:16:11.306508Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:16:11.306508Z digest=sha256:b4983d8c8a6686a9c214eb7f1d98935fcac90fcb4004535bf162ad16d2fc91ef

Observation f8b17d0b-2f27-4366-b396-ce17535c1107 · outbound

This paper cites Moshi: a speech-text foundation model for real-time dialogue.

M3-DuplexBench: A Multi-Turn, Multilingual, Multidomain Benchmark for Full-Duplex Spoken Dialogue Models Moshi: a speech-text foundation model for real-time dialogue

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-03T13:16:11.443550Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:16:11.443550Z digest=sha256:e2e1aeea60ac63e480da5330e340993e3282d5fc8f8bbb2ba25df20a642a15a0

Observation b26e331d-2228-47ad-a1d3-b11dd57b5500 · outbound

This paper cites Freeze-Omni: A Smart and Low Latency Speech-to-speech Dialogue Model with Frozen LLM.

M3-DuplexBench: A Multi-Turn, Multilingual, Multidomain Benchmark for Full-Duplex Spoken Dialogue Models Freeze-Omni: A Smart and Low Latency Speech-to-speech Dialogue Model with Frozen LLM

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-03T13:16:11.540208Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:16:11.540208Z digest=sha256:dc64b3c634614e42b16c78c564db4c36f203d29e5b7b4065a8b07fba087dabee

Observation 78fa95bd-d1a4-452b-a6e9-065d51382d03 · outbound

This paper cites PersonaPlex: V oice and role control for full duplex conversational speech models,.

M3-DuplexBench: A Multi-Turn, Multilingual, Multidomain Benchmark for Full-Duplex Spoken Dialogue Models PersonaPlex: V oice and role control for full duplex conversational speech models,

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-03T13:16:11.681586Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:16:11.681586Z digest=sha256:448d4beba1564b5c1d6308d22e97d0980a7f3fbbecf2c45a413b48740498688b

Pith citing papers

No inbound Pith citation observations are available.