{"as_of":"2026-08-08T10:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3bb1a1bb94b67a7291885163dcc81e54261f877cff03e364cb5006542deffd95","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:14:23.914587Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:14:20.520863Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T11:14:24.572962Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"cited_work":{"arxiv_id":"2506.02979","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.02979","snapshot_observed_at":"2026-08-07T11:14:24.572962Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","venue":"cs.CL","work_id":"10cf5322-bdbf-410c-aa07-ca2560862c2b","year":2025},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:20.520863Z"},"links":{"cited_paper":"/paper/2506.02979","citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:8c3a406c72289b8ebf8ee0306377f50f1737331880f08b76ca1936f9b85d382b","observation_id":"6a05c0aa-af54-4ca8-b4e4-7017eedef961","resolution":{"observed_at":"2026-08-07T11:14:24.638923Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.02979/citation-record","integrity":"/paper/2506.02979/integrity","json":"/paper/2506.02979/citation-record.json","paper":"/paper/2506.02979"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:14:29.739197Z","title":"In dialogue, full-duplex refers to having simultaneous bidirectional features such as speech overlaps and backchannels","venue":null,"work_id":"8f88bb20-a134-4ec1-a7ac-0dba4063484e","year":null},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:20.447581Z"},"links":{"citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:c9cef6cc9faf17c82357fb6cbd26e9c6e1831a99693d19d7e6f190e9706e8694","observation_id":"945dadec-7c1f-48e1-ad99-06df27a8a6ad","resolution":{"observed_at":"2026-08-07T11:14:29.817773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"cited_work":{"arxiv_id":"2506.02979","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.02979","snapshot_observed_at":"2026-08-07T11:14:24.572962Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","venue":"cs.CL","work_id":"10cf5322-bdbf-410c-aa07-ca2560862c2b","year":2025},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:20.520863Z"},"links":{"cited_paper":"/paper/2506.02979","citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:8c3a406c72289b8ebf8ee0306377f50f1737331880f08b76ca1936f9b85d382b","observation_id":"6a05c0aa-af54-4ca8-b4e4-7017eedef961","resolution":{"observed_at":"2026-08-07T11:14:24.638923Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:14:29.600483Z","title":"J-Moshi","venue":null,"work_id":"884f1e3b-b61a-4418-ae68-46e73fa472a4","year":null},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:20.639139Z"},"links":{"citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:81f977454e37cc4bfa757ef47332ca2f6636aac0e5846dbc3848bf38f4f677c9","observation_id":"ecfd1d6c-e295-4631-9e53-8a2844d5072c","resolution":{"observed_at":"2026-08-07T11:14:29.667371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:14:29.458112Z","title":"This task involves generating a continuation from a few seconds of spoken dialogue prompt","venue":null,"work_id":"a7c54b80-78cb-4f38-80bf-190e689474e5","year":null},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:20.762622Z"},"links":{"citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:82ebdc1e584187085f0eabe917a6e3582b1fd5feafe63ced4a59d34f8cda0f51","observation_id":"e20579ad-727e-4342-a1b3-74478a604345","resolution":{"observed_at":"2026-08-07T11:14:29.545178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:14:29.123542Z","title":null,"venue":null,"work_id":"3b003b12-ae3e-4851-bbe0-83985bbbd77b","year":null},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:20.978164Z"},"links":{"citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:29b3a31c965318c2d6a647060a49aeb3f5507aa33a8d92f8888d6bb98ddec9a0","observation_id":"62a97d97-2c82-4937-bc68-30cdb2d13e05","resolution":{"observed_at":"2026-08-07T11:14:29.234522Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:14:28.933517Z","title":null,"venue":null,"work_id":"acb05cfa-3ade-4ac5-890f-611cffdf6524","year":null},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:21.042378Z"},"links":{"citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:4433c7223350026ed963c8f22bffeb53c546e465374808d4349bf9218226654f","observation_id":"6cd89e50-6910-48ac-8b5b-6e9661a63c2f","resolution":{"observed_at":"2026-08-07T11:14:29.034273Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:14:28.772986Z","title":"We used the computational resources of the supercomputer “Flow” at the Information Technology Center, Nagoya University","venue":null,"work_id":"0151fdae-c044-42c9-98f4-ccf36e1e29f2","year":null},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:21.152672Z"},"links":{"citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:d847256951c2f571e2eb453c3dce262c74b3b050f7bb26350f8b56675d571bda","observation_id":"a9ac502d-6f44-4963-86b1-c69f537abb03","resolution":{"observed_at":"2026-08-07T11:14:28.864140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17799","last_updated":"2025-01-03T06:15:58Z","snapshot_observed_at":"2026-07-06T19:38:26.783620Z","submitted_at":"2024-10-23T11:58:58Z","title":"OmniFlatten: An End-to-end GPT Model for Seamless Voice Conversation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.17799","snapshot_observed_at":"2026-08-07T11:14:22.105456Z","title":"Omniflatten: An end-to-end gpt model for seamless voice conversation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:22.105456Z"},"links":{"cited_paper":"/paper/2410.17799","citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:58a26981b6af4f773411aecbb201b22285b1052723f6e0293489cd402deb5661","observation_id":"ed9ba575-ae16-4a2c-983b-45aea7512050","resolution":{"observed_at":"2026-08-07T11:14:22.105456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:14:28.588655Z","title":"Generative Spoken Dialogue Language Modeling,","venue":null,"work_id":"479bcc00-df85-4138-b448-07d068baf674","year":2023},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:21.288875Z"},"links":{"citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:34095efc3d05b480e6142e384888cdc330ada562841e1898d4bd89d0d037581f","observation_id":"0fb514f5-e472-49f9-9168-19d7bf78b897","resolution":{"observed_at":"2026-08-07T11:14:28.655421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:14:28.375890Z","title":"A Full-duplex Speech Dialogue Scheme Based On Large Language Model,","venue":null,"work_id":"659a2349-9197-4836-9e6d-859be139d469","year":2024},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:21.394485Z"},"links":{"citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:3a786a6b4d17bc5cee1ce50745386930253bb9b01180f3767eda214917c71bd0","observation_id":"8ef5701e-1629-463a-be8c-23f843b43977","resolution":{"observed_at":"2026-08-07T11:14:28.448830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02622","last_updated":"2024-08-05T16:47:22Z","snapshot_observed_at":"2026-08-06T01:09:51.135247Z","submitted_at":"2024-08-05T16:47:22Z","title":"Language Model Can Listen While Speaking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02622","snapshot_observed_at":"2026-08-07T11:14:21.543096Z","title":"Language Model Can Listen While Speaking,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:21.543096Z"},"links":{"cited_paper":"/paper/2408.02622","citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:011db2f91305c11c5af7341add831047f762824ec2be85ffe31cec1d9b4a9136","observation_id":"55676e28-45e8-4cf7-b2d0-689fce2729b4","resolution":{"observed_at":"2026-08-07T11:14:21.543096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:14:28.207805Z","title":"SpeechGPT: Empowering Large Language Models with Intrinsic Cross-Modal Conversational Abilities,","venue":null,"work_id":"6b80d386-d100-47ed-9d37-977ed8b539b8","year":2023},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:21.723369Z"},"links":{"citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:d3bdcc330a5e652537fac935f7857da26ad3258512c861962e10d645e1c73634","observation_id":"c9fc2963-f7a5-4133-b084-d2c25131767b","resolution":{"observed_at":"2026-08-07T11:14:28.268794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:14:27.997971Z","title":"LLaMA-Omni: Seamless Speech Interaction with Large Language Models,","venue":null,"work_id":"9c48508e-9e38-4f57-ad40-0fcfa7af019c","year":2025},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:21.834516Z"},"links":{"citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:8566f739b1ae34f0411c30f74b465fa2b6f4828a6fee8c7b2fc363f04e9a62ec","observation_id":"a70c02d6-f348-4e46-9d54-a2c983fa9a3c","resolution":{"observed_at":"2026-08-07T11:14:28.101726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00037","last_updated":"2024-10-02T09:11:45Z","snapshot_observed_at":"2026-07-30T10:21:14.474746Z","submitted_at":"2024-09-17T17:55:39Z","title":"Moshi: a speech-text foundation model for real-time dialogue","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00037","snapshot_observed_at":"2026-08-07T11:14:21.952258Z","title":"Moshi: a speech-text foundation model for real-time dialogue,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:21.952258Z"},"links":{"cited_paper":"/paper/2410.00037","citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:cf0efa4fb6c87073c95d81e37795284bc83a1c8124d2e598d200b0b065544235","observation_id":"c6407896-5222-4585-9dbb-0a6e55143475","resolution":{"observed_at":"2026-08-07T11:14:21.952258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:14:27.808206Z","title":"Beyond Turn-Based Interfaces: Synchronous LLMs as Full- Duplex Dialogue Agents,","venue":null,"work_id":"7b92ec1d-23cf-4995-a8dd-39601ecbbf7a","year":2024},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:22.035260Z"},"links":{"citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:affc1b917778df37faea0fb7576d265a36099b352089033a7fd509d82ad3a808","observation_id":"f8e8142b-a560-465e-90a2-f193bfa0dcc7","resolution":{"observed_at":"2026-08-07T11:14:27.900413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:14:26.917644Z","title":"Robust Speech Recognition via Large-Scale Weak Supervision,","venue":null,"work_id":"44e94ff0-be6a-4f76-b57f-54972f262c32","year":2023},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:22.786513Z"},"links":{"citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:32568357fdca0cd8cecf5cae15327c550f92a5618d960fbed4b9892fd3a07d3a","observation_id":"be48e93d-93b0-402d-8ab1-96d6344c8469","resolution":{"observed_at":"2026-08-07T11:14:26.966331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18138","last_updated":"2024-11-27T08:38:57Z","snapshot_observed_at":"2026-07-06T19:57:51.125083Z","submitted_at":"2024-11-27T08:38:57Z","title":"SALMONN-omni: A Codec-free LLM for Full-duplex Speech Understanding and Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18138","snapshot_observed_at":"2026-08-07T11:14:22.210619Z","title":"SALMONN-omni: A Codec- free LLM for Full-duplex Speech Understanding and Generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:22.210619Z"},"links":{"cited_paper":"/paper/2411.18138","citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:10746b8c7cf03483ea16629a1eeb8a3a0d00710aebdc6e62aa12a01ffdeb6f0f","observation_id":"6e861987-f2ae-4204-b6b4-0ec7dc9e9d5c","resolution":{"observed_at":"2026-08-07T11:14:22.210619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:14:22.280144Z","title":"J-CHAT: Japanese Large-scale Spoken Dialogue Corpus for Spoken Dialogue Language Modeling,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:22.280144Z"},"links":{"citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:ec92a98507183431411ddd356a6a0c27a10e75bedea648e0563fbbafb91b19fd","observation_id":"7df9061e-2d21-4b83-bc99-28472ba5b96d","resolution":{"observed_at":"2026-08-07T11:14:22.280144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:14:27.627179Z","title":"Simultaneous talk—from the perspective of floor management of English and Japanese speakers,","venue":null,"work_id":"db45933f-d898-4d8a-b888-530e1b5c96bc","year":1988},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:22.358528Z"},"links":{"citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:dc5f14bfdf30e0bfbb0715724f5ef0169140a6af2c1d8199c944c71ad1621901","observation_id":"3b6743d4-5203-45a9-808a-85c7d3a681e7","resolution":{"observed_at":"2026-08-07T11:14:27.704271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:14:29.298750Z","title":"We also used the orig- inal 20-second audio (Ground-truth) as upper bound","venue":null,"work_id":"cd1268b3-4285-433f-b879-2166e50106e8","year":null},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:20.859317Z"},"links":{"citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:eb561dbed546efb154ee735096ced7d551241ea63975f3508c40a0f9bafcd1b5","observation_id":"671ec425-5996-4f19-97d8-051e49a3a4a7","resolution":{"observed_at":"2026-08-07T11:14:29.398490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:14:27.311712Z","title":"Are you listening? cultural influences on the use of supportive verbal feedback in conversation,","venue":null,"work_id":"52411ac7-eb1a-494a-a47c-15451da154a1","year":1998},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:22.448133Z"},"links":{"citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:b57d8b628eb565456c50d2b6bcad16d39a7e92962eaabccefdd15b5771403cbb","observation_id":"0b11d57e-2094-42bd-a7c9-c3edd5fd077b","resolution":{"observed_at":"2026-08-07T11:14:27.396326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:14:27.101583Z","title":"High Fidelity Neural Audio Compression,","venue":null,"work_id":"74b6063d-46d7-434e-9911-30752b49d53b","year":2023},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:22.538529Z"},"links":{"citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:353389f0a5df97a9738ebd5cc61c0af951c6c5ddde5446974ab8683953d1f3eb","observation_id":"f4b7e3de-6091-4897-9322-56460ac5473e","resolution":{"observed_at":"2026-08-07T11:14:27.205563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.02095","last_updated":"2020-10-01T17:26:35Z","snapshot_observed_at":"2026-07-06T09:52:52.148226Z","submitted_at":"2020-09-04T10:22:43Z","title":"SEANet: A Multi-modal Speech Enhancement Network","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.02095","snapshot_observed_at":"2026-08-07T11:14:22.624798Z","title":"SEANet: A multi-modal speech enhancement network,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:22.624798Z"},"links":{"cited_paper":"/paper/2009.02095","citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:2feba1f3ee4f27037996a65895c096b03b9378d52fdb8b782ce907d117b5c2ff","observation_id":"cf7875aa-9d48-4676-8a8e-4e36c61f7bc3","resolution":{"observed_at":"2026-08-07T11:14:22.624798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:14:22.706242Z","title":"Soundstream: An end-to-end neural audio codec,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:22.706242Z"},"links":{"citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:8c8ab36e60ff25dc8f06dec4fc22a1f364d53b4f6d7ce4318e50861f1b46f911","observation_id":"fb92a9f1-2b05-47bc-ac52-9bf334ff60a9","resolution":{"observed_at":"2026-08-07T11:14:22.706242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:14:26.768601Z","title":"SentencePiece: A simple and language independent subword tokenizer and detokenizer for Neural Text Processing,","venue":null,"work_id":"88974589-6907-47ee-be13-114d4d6ad7e3","year":2018},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:22.862543Z"},"links":{"citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:2c90b84901398fc4b5a662d737c117c89c4d3046038aeb089d674e2b397202a9","observation_id":"4733b224-cb0f-45ba-a6d1-c3135ee27986","resolution":{"observed_at":"2026-08-07T11:14:26.806013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:14:26.596398Z","title":"pyannote.audio 2.1 speaker diarization pipeline: prin- ciple, benchmark, and recipe,","venue":null,"work_id":"62dd10d6-95de-429b-a1e9-8c38e894fd6e","year":2023},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:22.966245Z"},"links":{"citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:4f52642edd6a2a5c27a45f9a9a7a6f41eeb1e0969b909748d3a62e6931d6f0a3","observation_id":"84127f69-a001-43da-8e4a-5868ecf318f8","resolution":{"observed_at":"2026-08-07T11:14:26.666700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.00747","last_updated":"2023-07-11T17:07:19Z","snapshot_observed_at":"2026-08-07T11:26:26.674534Z","submitted_at":"2023-03-01T18:59:13Z","title":"WhisperX: Time-Accurate Speech Transcription of Long-Form Audio","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.00747","snapshot_observed_at":"2026-08-07T11:14:23.053189Z","title":"WhisperX: Time- Accurate Speech Transcription of Long-Form Audio,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:23.053189Z"},"links":{"cited_paper":"/paper/2303.00747","citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:930fb52f61aec130008f7ca3bb739b13d42da77ced2e08a7fd05f1465307f5bc","observation_id":"70198f94-01ca-45a1-842c-ff957c104ac8","resolution":{"observed_at":"2026-08-07T11:14:23.053189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:14:26.397141Z","title":"ZeRO: memory optimizations toward training trillion parameter models,","venue":null,"work_id":"53f40cb5-1b02-4617-999a-1cfc33c3ff37","year":2020},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:23.121950Z"},"links":{"citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:e693bf0bde52af1cdaab20d5c433067af867a852139515cb6aa38a70514094c9","observation_id":"0f16e577-3702-4589-a3a3-ff9ac8fdcc78","resolution":{"observed_at":"2026-08-07T11:14:26.483150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:14:26.112727Z","title":"Decoupled Weight Decay Regularization,","venue":null,"work_id":"c57880d9-8cec-465c-92f9-7aab557a374e","year":2019},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:23.237953Z"},"links":{"citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:622217d6f87afb97c8091c17bb06487f41699d1570866ef86d5f04b28ad9da98","observation_id":"3aa9a3ac-e962-44f2-865f-b7ec5fdf60d9","resolution":{"observed_at":"2026-08-07T11:14:26.272345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T11:14:23.311814Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:23.311814Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:1ecf97692ba9e03a9b183c786d5223fe1a196d57071673602fcc34300f05eae7","observation_id":"7ee7b120-8615-4a26-8743-6f00dbea1742","resolution":{"observed_at":"2026-08-07T11:14:23.311814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:14:25.892084Z","title":"CALLHOME Japanese Speech LDC96S37,","venue":null,"work_id":"45920caf-0ef4-45c7-9208-7587fc8736e3","year":1996},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:23.448715Z"},"links":{"citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:d94fcb4299deaa8b4e1d1c39696d2fb706af8de5a13c04d30114f9d3e61e447b","observation_id":"4d0a3d98-e209-4ae4-8576-452b699cedc2","resolution":{"observed_at":"2026-08-07T11:14:25.956108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:14:25.646856Z","title":"Corpus of Spontaneous Japanese: Its design and evaluation,","venue":null,"work_id":"7850deaa-669d-4a84-bd2e-538faa89e62d","year":2003},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:23.552979Z"},"links":{"citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:1420857d47ab33888d769f8aefa4b1609f354ffe678b526b170d653ce1d0d7c4","observation_id":"93ed47e5-6afe-4157-92e6-caf11799089f","resolution":{"observed_at":"2026-08-07T11:14:25.766483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:14:25.429630Z","title":"Travel agency task dialogue corpus: A multimodal dataset with age-diverse speakers,","venue":null,"work_id":"90164fa9-03cc-468b-a1fd-dcbfc5f560bf","year":2024},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:23.611858Z"},"links":{"citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:ef8fdee15de9453518689bbc0b962877310490f8b6f7accaa26e14a88ac0e59d","observation_id":"ecc3321c-7c27-46a5-bfb7-8c3000b63a63","resolution":{"observed_at":"2026-08-07T11:14:25.524567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:14:25.213526Z","title":"Empirical Analysis of Training Strategies of Transformer-Based Japanese Chit-Chat Systems,","venue":null,"work_id":"b4aa1afe-5c8e-4894-9994-147cadb2f0a4","year":2022},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:23.708363Z"},"links":{"citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:77d389970e08716d94f8cc0cb85b01af18808881671b2b2dd1b7260c1fefb7be","observation_id":"a8aad29a-52cd-4338-b26b-8ee00b223d74","resolution":{"observed_at":"2026-08-07T11:14:25.299817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:14:24.949357Z","title":"Construction of a Japanese Daily Dialogue Corpus,","venue":null,"work_id":"5362eae0-deb3-4a64-abf5-a1c69c124f23","year":2023},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:23.806320Z"},"links":{"citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:3700a86da4fea7e1333105508ae4c25b83fd8aece1509fdca0df6e973a3abeea","observation_id":"d1540721-7fa8-4697-aac3-1c187a6062bb","resolution":{"observed_at":"2026-08-07T11:14:25.036571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:14:24.750836Z","title":"RealPersonaChat: A realistic persona chat cor- pus with interlocutors’ own personalities,","venue":null,"work_id":"2f7ca859-6e0d-482e-9b90-45bccf65df5d","year":2023},"citing_paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:23.914587Z"},"links":{"citing_paper":"/paper/2506.02979"},"observation_digest":"sha256:db148b93188f2906f2cf41b774c745dc1276731ec90b99bdd58bb982784a2aa8","observation_id":"fd3e3ef9-4476-4be8-8531-6287f8f12b0e","resolution":{"observed_at":"2026-08-07T11:14:24.860118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.02979","last_updated":"2025-06-03T15:16:50Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T11:27:13.045145Z","submitted_at":"2025-06-03T15:16:50Z","title":"Towards a Japanese Full-duplex Spoken Dialogue System"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":1,"verified_fuzzy":24},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 1 inbound Pith citation observation for arXiv:2506.02979."}