{"as_of":"2026-08-06T03:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d53af6b3a5bfb4cf41ecdc4455b2ee8d6db0ac11b72f501133c832697774e123","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T07:58:46.309937Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T07:58:44.264951Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T11:27:03.113506Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.08208","last_updated":"2026-07-16T03:28:30Z","snapshot_observed_at":"2026-08-03T21:19:13.432923Z","submitted_at":"2026-07-09T08:07:34Z","title":"Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech","version":2},"cited_work":{"arxiv_id":"2607.08208","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.08208","snapshot_observed_at":"2026-07-10T11:27:03.113506Z","title":"Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech","venue":"cs.CL","work_id":"dd7552d2-fd16-4966-9f75-3fd1d52611b1","year":2026},"citing_paper":{"arxiv_id":"2607.08208","last_updated":"2026-07-16T03:28:30Z","snapshot_observed_at":"2026-08-03T21:19:13.432923Z","submitted_at":"2026-07-09T08:07:34Z","title":"Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-10T11:18:43.887987Z"},"links":{"cited_paper":"/paper/2607.08208","citing_paper":"/paper/2607.08208"},"observation_digest":"sha256:45ff599a2e59194eeee65e4542b116b2a5edaf3f136073cb11e63d4e69472cf4","observation_id":"aa2bdd89-4804-41a1-8062-d5a3f514844f","resolution":{"observed_at":"2026-07-10T11:27:03.114980Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2607.08208","last_updated":"2026-07-16T03:28:30Z","snapshot_observed_at":"2026-08-03T21:19:13.432923Z","submitted_at":"2026-07-09T08:07:34Z","title":"Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.08208","snapshot_observed_at":"2026-08-02T07:58:44.264951Z","title":"The pipeline contains three functional parts: speaker diariza tion, au- dio segmentation and multilingual ASR, and text normalizat ion with evaluation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.08208","last_updated":"2026-07-16T03:28:30Z","snapshot_observed_at":"2026-08-03T21:19:13.432923Z","submitted_at":"2026-07-09T08:07:34Z","title":"Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T07:58:44.264951Z"},"links":{"cited_paper":"/paper/2607.08208","citing_paper":"/paper/2607.08208"},"observation_digest":"sha256:b497d21037a05abd8408a8b6f449a7e4f77c42b9879c0570ba4f68ddb7e1b0c1","observation_id":"8161203d-0b70-4716-9f6e-d849836c8a1f","resolution":{"observed_at":"2026-08-02T07:58:44.264951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.08208/citation-record","integrity":"/paper/2607.08208/integrity","json":"/paper/2607.08208/citation-record.json","paper":"/paper/2607.08208"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:58:44.131574Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.08208","last_updated":"2026-07-16T03:28:30Z","snapshot_observed_at":"2026-08-03T21:19:13.432923Z","submitted_at":"2026-07-09T08:07:34Z","title":"Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T07:58:44.131574Z"},"links":{"citing_paper":"/paper/2607.08208"},"observation_digest":"sha256:e78c7270fdac2fd78e2b40a77dd5d72479e162e2f6c82c4c0765e36d4b117c7d","observation_id":"fded2eec-07c4-4316-a856-cc8c46580382","resolution":{"observed_at":"2026-08-02T07:58:44.131574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.08208","last_updated":"2026-07-16T03:28:30Z","snapshot_observed_at":"2026-08-03T21:19:13.432923Z","submitted_at":"2026-07-09T08:07:34Z","title":"Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.08208","snapshot_observed_at":"2026-08-02T07:58:44.264951Z","title":"The pipeline contains three functional parts: speaker diariza tion, au- dio segmentation and multilingual ASR, and text normalizat ion with evaluation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.08208","last_updated":"2026-07-16T03:28:30Z","snapshot_observed_at":"2026-08-03T21:19:13.432923Z","submitted_at":"2026-07-09T08:07:34Z","title":"Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T07:58:44.264951Z"},"links":{"cited_paper":"/paper/2607.08208","citing_paper":"/paper/2607.08208"},"observation_digest":"sha256:b497d21037a05abd8408a8b6f449a7e4f77c42b9879c0570ba4f68ddb7e1b0c1","observation_id":"8161203d-0b70-4716-9f6e-d849836c8a1f","resolution":{"observed_at":"2026-08-02T07:58:44.264951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:58:44.542145Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.08208","last_updated":"2026-07-16T03:28:30Z","snapshot_observed_at":"2026-08-03T21:19:13.432923Z","submitted_at":"2026-07-09T08:07:34Z","title":"Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T07:58:44.542145Z"},"links":{"citing_paper":"/paper/2607.08208"},"observation_digest":"sha256:8e11b04296bfd7f03c6e4d0afabcc443b9d0c74a4ddb3a43b019a730c3ebab70","observation_id":"c68b220e-a2a9-4513-a3bb-d9020cc0d7b3","resolution":{"observed_at":"2026-08-02T07:58:44.542145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:58:44.627851Z","title":"Results We report tcpMER on the ofﬁcial development set under the challenge evaluation protocol","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08208","last_updated":"2026-07-16T03:28:30Z","snapshot_observed_at":"2026-08-03T21:19:13.432923Z","submitted_at":"2026-07-09T08:07:34Z","title":"Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T07:58:44.627851Z"},"links":{"citing_paper":"/paper/2607.08208"},"observation_digest":"sha256:44f8fffe30636adc80ae8a4e55a22070294be09e89161ac01d96d53997bb7831","observation_id":"d6edf0d3-4ad9-46a1-9f0e-2908ef48519a","resolution":{"observed_at":"2026-08-02T07:58:44.627851Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:58:44.778098Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.08208","last_updated":"2026-07-16T03:28:30Z","snapshot_observed_at":"2026-08-03T21:19:13.432923Z","submitted_at":"2026-07-09T08:07:34Z","title":"Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T07:58:44.778098Z"},"links":{"citing_paper":"/paper/2607.08208"},"observation_digest":"sha256:95c2ef9290c3011d8927a842e3a8db06b5c8861ee1c6c11861b10a60b319cceb","observation_id":"c9db0794-ac89-4531-8eb5-c5c702d1035a","resolution":{"observed_at":"2026-08-02T07:58:44.778098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:58:45.289632Z","title":"CAM++: A fast and efﬁcient network for speaker veriﬁcation using context- aware masking,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08208","last_updated":"2026-07-16T03:28:30Z","snapshot_observed_at":"2026-08-03T21:19:13.432923Z","submitted_at":"2026-07-09T08:07:34Z","title":"Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T07:58:45.289632Z"},"links":{"citing_paper":"/paper/2607.08208"},"observation_digest":"sha256:53b6b8d0529bdbf725723652e3437434417c4cb4b8ab58adce875d9a647733cd","observation_id":"df35a74d-f323-42ac-b869-774bc1e614c0","resolution":{"observed_at":"2026-08-02T07:58:45.289632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:58:44.840013Z","title":"The Multilingual Conversational Speech Language Model Challenge 2026,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.08208","last_updated":"2026-07-16T03:28:30Z","snapshot_observed_at":"2026-08-03T21:19:13.432923Z","submitted_at":"2026-07-09T08:07:34Z","title":"Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T07:58:44.840013Z"},"links":{"citing_paper":"/paper/2607.08208"},"observation_digest":"sha256:2d3cff9d86ebce849e837f5cc1309708a44da1dc17b7c34b9db7fcea0f166543","observation_id":"c6db03d5-3f94-4950-9d35-df6e9908b11a","resolution":{"observed_at":"2026-08-02T07:58:44.840013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19971","last_updated":"2024-12-27T02:48:43Z","snapshot_observed_at":"2026-08-04T04:27:26.323473Z","submitted_at":"2024-03-29T04:42:12Z","title":"3D-Speaker-Toolkit: An Open-Source Toolkit for Multimodal Speaker Verification and Diarization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19971","snapshot_observed_at":"2026-08-02T07:58:44.903621Z","title":"3D-Speaker- Toolkit: An open-source toolkit for multimodal speaker ver iﬁca- tion and diarization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08208","last_updated":"2026-07-16T03:28:30Z","snapshot_observed_at":"2026-08-03T21:19:13.432923Z","submitted_at":"2026-07-09T08:07:34Z","title":"Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T07:58:44.903621Z"},"links":{"cited_paper":"/paper/2403.19971","citing_paper":"/paper/2607.08208"},"observation_digest":"sha256:65cf642030b8be45d6ceb3b038630625f9b2f71cbc28ad0ed28ff3b0302150e5","observation_id":"9af1a9c2-8bd1-4fc6-bfc2-d5924373d95f","resolution":{"observed_at":"2026-08-02T07:58:44.903621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.21337","last_updated":"2026-01-30T02:58:48Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T06:58:13Z","title":"Qwen3-ASR Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.21337","snapshot_observed_at":"2026-08-02T07:58:44.975601Z","title":"Qwen3-ASR technical report,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.08208","last_updated":"2026-07-16T03:28:30Z","snapshot_observed_at":"2026-08-03T21:19:13.432923Z","submitted_at":"2026-07-09T08:07:34Z","title":"Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T07:58:44.975601Z"},"links":{"cited_paper":"/paper/2601.21337","citing_paper":"/paper/2607.08208"},"observation_digest":"sha256:025c343a7eef773a2af64b5491048930465960301a001340388373559cbe56ea","observation_id":"cf01055c-1076-4e51-a70f-500d2e137149","resolution":{"observed_at":"2026-08-02T07:58:44.975601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:58:45.089965Z","title":"LoRA: Low-rank adaptation of large lan- guage models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.08208","last_updated":"2026-07-16T03:28:30Z","snapshot_observed_at":"2026-08-03T21:19:13.432923Z","submitted_at":"2026-07-09T08:07:34Z","title":"Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T07:58:45.089965Z"},"links":{"citing_paper":"/paper/2607.08208"},"observation_digest":"sha256:8dd212376e3db9ae50fe69c91ec4cd1b6e92e199df25446e10bf59f52f6b9c97","observation_id":"edcd502e-1dec-4d28-b177-6b5e7151e9ae","resolution":{"observed_at":"2026-08-02T07:58:45.089965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.00688","last_updated":"2026-04-21T12:14:57Z","snapshot_observed_at":"2026-07-06T22:51:26.754746Z","submitted_at":"2026-04-01T09:45:51Z","title":"OmniVoice: Towards Omnilingual Zero-Shot Text-to-Speech with Diffusion Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.00688","snapshot_observed_at":"2026-08-02T07:58:45.196375Z","title":"OmniV oice: Towards om- nilingual zero-shot text-to-speech with diffusion langua ge mod- els,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.08208","last_updated":"2026-07-16T03:28:30Z","snapshot_observed_at":"2026-08-03T21:19:13.432923Z","submitted_at":"2026-07-09T08:07:34Z","title":"Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T07:58:45.196375Z"},"links":{"cited_paper":"/paper/2604.00688","citing_paper":"/paper/2607.08208"},"observation_digest":"sha256:0d2165c82d86d28006ed8b9c5360de14c90171b8d49146414714d66435de00b6","observation_id":"93f2b8d1-5990-485c-a4c5-0209a5e5cade","resolution":{"observed_at":"2026-08-02T07:58:45.196375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-02T07:58:45.800078Z","title":"Qwen2 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08208","last_updated":"2026-07-16T03:28:30Z","snapshot_observed_at":"2026-08-03T21:19:13.432923Z","submitted_at":"2026-07-09T08:07:34Z","title":"Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T07:58:45.800078Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2607.08208"},"observation_digest":"sha256:532c3a411bf6ac980b232ce17a9468cf736228f005c959e9a9f532d85974ac9b","observation_id":"66c3ecb8-5e90-44bd-a55d-813cc94bf4c9","resolution":{"observed_at":"2026-08-02T07:58:45.800078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:58:45.364558Z","title":"Wespeaker: A research and production oriented speaker embedding learning toolkit,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08208","last_updated":"2026-07-16T03:28:30Z","snapshot_observed_at":"2026-08-03T21:19:13.432923Z","submitted_at":"2026-07-09T08:07:34Z","title":"Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T07:58:45.364558Z"},"links":{"citing_paper":"/paper/2607.08208"},"observation_digest":"sha256:ebb438fc2c5dd45e0071e00769be82f34d7f76da380daf99441ba2f1ec9ef3fb","observation_id":"8be3eb15-efb7-4740-8c55-637d18241dfd","resolution":{"observed_at":"2026-08-02T07:58:45.364558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11013","last_updated":"2023-05-18T14:45:09Z","snapshot_observed_at":"2026-07-06T15:29:16.851803Z","submitted_at":"2023-05-18T14:45:09Z","title":"FunASR: A Fundamental End-to-End Speech Recognition Toolkit","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11013","snapshot_observed_at":"2026-08-02T07:58:45.439616Z","title":"FunASR: A fundamental end-to- end speech recognition toolkit,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08208","last_updated":"2026-07-16T03:28:30Z","snapshot_observed_at":"2026-08-03T21:19:13.432923Z","submitted_at":"2026-07-09T08:07:34Z","title":"Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T07:58:45.439616Z"},"links":{"cited_paper":"/paper/2305.11013","citing_paper":"/paper/2607.08208"},"observation_digest":"sha256:5d697f3b00171175933f8dfcab576bc235b7cad6d8167fadb89f1008e2d7fba9","observation_id":"ce05492e-c9bd-43a6-9817-f50342cdc1cf","resolution":{"observed_at":"2026-08-02T07:58:45.439616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:58:45.543605Z","title":"End-to-end neural speaker diarization wi th permutation-free objectives,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.08208","last_updated":"2026-07-16T03:28:30Z","snapshot_observed_at":"2026-08-03T21:19:13.432923Z","submitted_at":"2026-07-09T08:07:34Z","title":"Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T07:58:45.543605Z"},"links":{"citing_paper":"/paper/2607.08208"},"observation_digest":"sha256:83ff67ae3d6c5f5d913fbea198093dacd42c00de6dc85209519f7f882a71bcde","observation_id":"3a401a48-f967-4a9e-a381-2bc1258c2b57","resolution":{"observed_at":"2026-08-02T07:58:45.543605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16482","last_updated":"2024-05-06T07:09:31Z","snapshot_observed_at":"2026-08-04T09:08:49.438433Z","submitted_at":"2023-09-28T14:45:46Z","title":"Meeting Recognition with Continuous Speech Separation and Transcription-Supported Diarization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16482","snapshot_observed_at":"2026-08-02T07:58:45.639512Z","title":"Meeting recognition w ith continuous speech separation and transcription-supported diariza- tion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08208","last_updated":"2026-07-16T03:28:30Z","snapshot_observed_at":"2026-08-03T21:19:13.432923Z","submitted_at":"2026-07-09T08:07:34Z","title":"Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T07:58:45.639512Z"},"links":{"cited_paper":"/paper/2309.16482","citing_paper":"/paper/2607.08208"},"observation_digest":"sha256:5dbd123e442ca419fc59de442bee278b713d3d06740303f653174f9aaf4d1f09","observation_id":"eaf470b6-f2aa-45a6-b64c-20b9559e00c7","resolution":{"observed_at":"2026-08-02T07:58:45.639512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10759","last_updated":"2024-07-15T14:38:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T14:38:09Z","title":"Qwen2-Audio Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10759","snapshot_observed_at":"2026-08-02T07:58:45.720042Z","title":"Qwen2-Audio technical re - port,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08208","last_updated":"2026-07-16T03:28:30Z","snapshot_observed_at":"2026-08-03T21:19:13.432923Z","submitted_at":"2026-07-09T08:07:34Z","title":"Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T07:58:45.720042Z"},"links":{"cited_paper":"/paper/2407.10759","citing_paper":"/paper/2607.08208"},"observation_digest":"sha256:e352e9bc13aea224af8141b6314d103e2f3d91006d2a021482f3510dd08258d0","observation_id":"c2daa77f-831f-4024-a663-491f40f2f9c6","resolution":{"observed_at":"2026-08-02T07:58:45.720042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:58:46.242944Z","title":"MLC-SLM 2026 Task 1 Ofﬁcial Baseline,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.08208","last_updated":"2026-07-16T03:28:30Z","snapshot_observed_at":"2026-08-03T21:19:13.432923Z","submitted_at":"2026-07-09T08:07:34Z","title":"Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T07:58:46.242944Z"},"links":{"citing_paper":"/paper/2607.08208"},"observation_digest":"sha256:35e7e2f49c1c51e1f3520ffd9a6f88d88350e2cc9270003261aaa52ad845d48d","observation_id":"532afe60-3232-4a4d-a2c8-ff349994c466","resolution":{"observed_at":"2026-08-02T07:58:46.242944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-02T07:58:45.861775Z","title":"Qwen3 technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08208","last_updated":"2026-07-16T03:28:30Z","snapshot_observed_at":"2026-08-03T21:19:13.432923Z","submitted_at":"2026-07-09T08:07:34Z","title":"Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T07:58:45.861775Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.08208"},"observation_digest":"sha256:561085f5d1cfdf289465bbcc591d634639034cf6480735aab12eb4a1b8f39b7c","observation_id":"f3d53b7f-afaa-4d7c-9f41-230e869ef81a","resolution":{"observed_at":"2026-08-02T07:58:45.861775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-02T07:58:45.944028Z","title":"DeepSeekMath: Pushing the limits of mathematical reasoning in open language model s,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08208","last_updated":"2026-07-16T03:28:30Z","snapshot_observed_at":"2026-08-03T21:19:13.432923Z","submitted_at":"2026-07-09T08:07:34Z","title":"Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T07:58:45.944028Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2607.08208"},"observation_digest":"sha256:c1ed3882a08a289f26f23ec757e2a696548b5188dfdc9b2fae6cbae132df37f5","observation_id":"f83daf3a-d9bc-498e-b43e-06621c67cbd7","resolution":{"observed_at":"2026-08-02T07:58:45.944028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.00291","last_updated":"2022-04-01T08:53:44Z","snapshot_observed_at":"2026-07-06T12:55:38.555576Z","submitted_at":"2022-04-01T08:53:44Z","title":"Text-To-Speech Data Augmentation for Low Resource Speech Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.00291","snapshot_observed_at":"2026-08-02T07:58:46.014698Z","title":"Text-to-speech data augmentation for lo w resource speech recognition,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.08208","last_updated":"2026-07-16T03:28:30Z","snapshot_observed_at":"2026-08-03T21:19:13.432923Z","submitted_at":"2026-07-09T08:07:34Z","title":"Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T07:58:46.014698Z"},"links":{"cited_paper":"/paper/2204.00291","citing_paper":"/paper/2607.08208"},"observation_digest":"sha256:a6c0569b73dd4414ae18d4b8b9efe2aef488c97b0aa8d075499e1202f9df5ef0","observation_id":"d16ca9d0-7c86-485b-93a6-dfe7b2e9d3f9","resolution":{"observed_at":"2026-08-02T07:58:46.014698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:58:46.096612Z","title":"Frustratingly easy data augm entation for low-resource ASR,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08208","last_updated":"2026-07-16T03:28:30Z","snapshot_observed_at":"2026-08-03T21:19:13.432923Z","submitted_at":"2026-07-09T08:07:34Z","title":"Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T07:58:46.096612Z"},"links":{"citing_paper":"/paper/2607.08208"},"observation_digest":"sha256:9aaf93147be3e823a0942752ca2e7e352b6b19c8f990eea1f1bc775561e758dc","observation_id":"48237d62-48c4-412b-8ffb-2b930abca383","resolution":{"observed_at":"2026-08-02T07:58:46.096612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:58:46.158672Z","title":"Com - mon V oice: A massively-multilingual speech corpus,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.08208","last_updated":"2026-07-16T03:28:30Z","snapshot_observed_at":"2026-08-03T21:19:13.432923Z","submitted_at":"2026-07-09T08:07:34Z","title":"Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T07:58:46.158672Z"},"links":{"citing_paper":"/paper/2607.08208"},"observation_digest":"sha256:4059d3cfda908e9189827d092ae80a87590353b3bd654c687fc2c5797b5cbf00","observation_id":"6d2db645-cff6-4c48-a707-e684b9f5b298","resolution":{"observed_at":"2026-08-02T07:58:46.158672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.09554","last_updated":"2025-01-18T13:32:02Z","snapshot_observed_at":"2026-08-05T03:55:55.874386Z","submitted_at":"2024-09-14T23:33:38Z","title":"ASR Error Correction using Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.09554","snapshot_observed_at":"2026-08-02T07:58:46.309937Z","title":"ASR er- ror correction using large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08208","last_updated":"2026-07-16T03:28:30Z","snapshot_observed_at":"2026-08-03T21:19:13.432923Z","submitted_at":"2026-07-09T08:07:34Z","title":"Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T07:58:46.309937Z"},"links":{"cited_paper":"/paper/2409.09554","citing_paper":"/paper/2607.08208"},"observation_digest":"sha256:29f711c03b53b813e953a76be29bc0a8b6333c631bc6e8fdd14ed8741c15daf4","observation_id":"2cafc791-2511-4daa-94c0-ad32b6c6fa7d","resolution":{"observed_at":"2026-08-02T07:58:46.309937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:58:44.429289Z","title":"This stage serves as the ﬁnal ASR reﬁnement after supervised ﬁne-tuning and LoRA adaptation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08208","last_updated":"2026-07-16T03:28:30Z","snapshot_observed_at":"2026-08-03T21:19:13.432923Z","submitted_at":"2026-07-09T08:07:34Z","title":"Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech","version":2},"reference_index":512,"source":"pdf_text","source_observed_at":"2026-08-02T07:58:44.429289Z"},"links":{"citing_paper":"/paper/2607.08208"},"observation_digest":"sha256:aa5f6af8b93d44495b9c470a48643c399f78ff4a24de1cf85dd9cc292b82a25b","observation_id":"9461faf4-fcc8-4b7b-98fd-5956fe7bc688","resolution":{"observed_at":"2026-08-02T07:58:44.429289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.08208","last_updated":"2026-07-16T03:28:30Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-03T21:19:13.432923Z","submitted_at":"2026-07-09T08:07:34Z","title":"Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 2 inbound Pith citation observations for arXiv:2607.08208."}