{"as_of":"2026-08-09T16:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:324ab95ef8124087715fb6839d815f69fab3134c224bbba89a8f750492864d83","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:45:27.070910Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:45:23.192060Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T14:45:27.557256Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"cited_work":{"arxiv_id":"2507.18051","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.18051","snapshot_observed_at":"2026-08-06T14:45:27.557256Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","venue":"cs.SD","work_id":"33aade1d-7503-48d0-be33-0e19b149eb8c","year":2025},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:23.192060Z"},"links":{"cited_paper":"/paper/2507.18051","citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:9ff7304ad3ae48dbca88ed980aadb108bf6c5e48e433d1c3bcdb913bdb5c2c05","observation_id":"0dfb4d47-140b-46b2-a8ed-8deb1a2b1db9","resolution":{"observed_at":"2026-08-06T14:45:27.629575Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.18051/citation-record","integrity":"/paper/2507.18051/integrity","json":"/paper/2507.18051/citation-record.json","paper":"/paper/2507.18051"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:33.139056Z","title":"Recently, there has been growing interest in combining LLMs with audio encoders, en- abling the models to process and understand audio modali- ties [6, 7, 8, 9, 10, 11]","venue":null,"work_id":"2a052e9d-cd3d-475c-80de-513fc4e2c144","year":2025},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:23.093860Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:60aa990daffb8862a992119ffeda91658c6f5a4889db849c5973fefe72bddb84","observation_id":"5109d340-43e8-4c8e-9ffe-06374adade8b","resolution":{"observed_at":"2026-08-06T14:45:33.177289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"cited_work":{"arxiv_id":"2507.18051","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.18051","snapshot_observed_at":"2026-08-06T14:45:27.557256Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","venue":"cs.SD","work_id":"33aade1d-7503-48d0-be33-0e19b149eb8c","year":2025},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:23.192060Z"},"links":{"cited_paper":"/paper/2507.18051","citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:9ff7304ad3ae48dbca88ed980aadb108bf6c5e48e433d1c3bcdb913bdb5c2c05","observation_id":"0dfb4d47-140b-46b2-a8ed-8deb1a2b1db9","resolution":{"observed_at":"2026-08-06T14:45:27.629575Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:33.095953Z","title":"Datasets We use a large corpus to train our model, totaling 180k hours, as shown in Table 1","venue":null,"work_id":"1d12ec99-f674-4c96-a986-37a318f0bc40","year":null},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:23.265352Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:93107e1411148d0cfc7ac20f23563a0e18ff70da3168f6c7b82f2e187f87af26","observation_id":"5d775110-1ef9-4a06-950a-1414e79b7f4f","resolution":{"observed_at":"2026-08-06T14:45:33.105266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:32.726089Z","title":null,"venue":null,"work_id":"d1542fcc-3ec1-4d86-9d2d-b262646f2e18","year":2025},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:23.471799Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:1d1ca6c47020bfdf1d97859e643a83d5c5d143ad405408515dc7e900c31e03d2","observation_id":"7bd1b50e-1044-4c5a-bf71-354710cda3e1","resolution":{"observed_at":"2026-08-06T14:45:32.846122Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T14:45:24.021390Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:24.021390Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:9ea7b786517cd0b8ad22419978ec35b09002256b1c92c7aef41ef37de1dc3c5e","observation_id":"fffbe01d-97e6-4919-bffa-b2f568792835","resolution":{"observed_at":"2026-08-06T14:45:24.021390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:32.475605Z","title":"Introducing chatgpt,","venue":null,"work_id":"abb48200-5a4d-4e51-9564-96f5c6fcc8ff","year":2022},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:23.601187Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:b60a69517c5cd7f761c63f6bcd8f95f2e0adf7790361ce88b63532dbce67bafb","observation_id":"cfc1d010-c7d2-4b1a-a87b-482318edd8d6","resolution":{"observed_at":"2026-08-06T14:45:32.581263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.11276","last_updated":"2023-08-22T08:43:33Z","snapshot_observed_at":"2026-07-06T16:08:56.878185Z","submitted_at":"2023-08-22T08:43:33Z","title":"Music Understanding LLaMA: Advancing Text-to-Music Generation with Question Answering and Captioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.11276","snapshot_observed_at":"2026-08-06T14:45:23.708169Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:23.708169Z"},"links":{"cited_paper":"/paper/2308.11276","citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:7c0d3bd7a6206fb0141b59aba3e197aae1870c7c035b1c9962851aaf97bf9ec9","observation_id":"52bb2a9c-25da-45f6-b483-6ca5e705639b","resolution":{"observed_at":"2026-08-06T14:45:23.708169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:23.778593Z","title":"Lan- guage models are few-shot learners,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:23.778593Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:fb0d835ec350e1a93c497462773d3f83cc5b36b31d71f899808b24688d76ecb7","observation_id":"28041e31-5707-4627-afd5-1fa157c5d4f5","resolution":{"observed_at":"2026-08-06T14:45:23.778593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10403","last_updated":"2023-09-13T20:35:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:46:53Z","title":"PaLM 2 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10403","snapshot_observed_at":"2026-08-06T14:45:23.908071Z","title":"Palm 2 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:23.908071Z"},"links":{"cited_paper":"/paper/2305.10403","citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:1c7a8631db9e5bfeedaa4c2a9e8891195a293498288925fbfe2f67f4ea4cefe3","observation_id":"e65baf4f-a4aa-43b8-8ff1-79d3209d714b","resolution":{"observed_at":"2026-08-06T14:45:23.908071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10759","last_updated":"2024-07-15T14:38:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T14:38:09Z","title":"Qwen2-Audio Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10759","snapshot_observed_at":"2026-08-06T14:45:24.551512Z","title":"Qwen2-audio technical re- port,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:24.551512Z"},"links":{"cited_paper":"/paper/2407.10759","citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:d9067984efbe24fda66ecc4dd564ba23ab5cdc4be365896f4a22efbe668c120e","observation_id":"15bf3a22-e640-42a6-ac35-a7cebfa1ddc7","resolution":{"observed_at":"2026-08-06T14:45:24.551512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:32.356407Z","title":"Listen, think, and understand,","venue":null,"work_id":"d477bf81-3257-4dde-9134-4f8ac3af6250","year":2024},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:24.133093Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:71b877c952787133b6aa9b13316aa1db5c4510ea27f113cd683a6bae305c2350","observation_id":"06463cb4-f5b1-4d7c-ac65-6b8cf78fd1f2","resolution":{"observed_at":"2026-08-06T14:45:32.390503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:32.045004Z","title":"SALMONN: towards generic hearing abilities for large language models,","venue":null,"work_id":"b55717db-e5ff-49c8-98fe-07b64e0636ee","year":2024},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:24.248748Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:d3538043fbdbc954fe7ac7524a4dacdfb3030ddb3db5b56f6dd460fec11c9fca","observation_id":"17bbea26-8b35-4c54-a625-422d306902df","resolution":{"observed_at":"2026-08-06T14:45:32.181787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07919","last_updated":"2023-12-21T10:20:42Z","snapshot_observed_at":"2026-08-07T10:17:55.688598Z","submitted_at":"2023-11-14T05:34:50Z","title":"Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07919","snapshot_observed_at":"2026-08-06T14:45:24.360453Z","title":"Qwen-audio: Advancing universal audio understand- ing via unified large-scale audio-language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:24.360453Z"},"links":{"cited_paper":"/paper/2311.07919","citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:064541cede27bf5f0befb0c14dbf2217d8c3ec3607c488cd850996aeb74ab8b5","observation_id":"3f8dff7b-4211-432a-912a-6a0aecb86f02","resolution":{"observed_at":"2026-08-06T14:45:24.360453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:31.787639Z","title":"Wavllm: Towards robust and adaptive speech large language model,","venue":null,"work_id":"0280ad98-7e61-4f45-a8d6-ff8dc7a21790","year":2024},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:24.472799Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:9a9797cf8051f7faa18d340194a1c63dc926cb03ab984dbd291b8c299e7f5a34","observation_id":"0f621295-184c-4542-8607-9fd292aec52c","resolution":{"observed_at":"2026-08-06T14:45:31.923638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04675","last_updated":"2024-07-10T09:01:17Z","snapshot_observed_at":"2026-07-06T18:42:05.670928Z","submitted_at":"2024-07-05T17:38:03Z","title":"Seed-ASR: Understanding Diverse Speech and Contexts with LLM-based Speech Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04675","snapshot_observed_at":"2026-08-06T14:45:25.066761Z","title":"Seed-asr: Understanding diverse speech and contexts with llm-based speech recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:25.066761Z"},"links":{"cited_paper":"/paper/2407.04675","citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:8b19b7f0d47aa9f4357edf85fbb760061d03fa022d5adfcc3d9f84928c1bafa3","observation_id":"28c0212d-65f8-4799-9caa-4ca13afb055e","resolution":{"observed_at":"2026-08-06T14:45:25.066761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:31.479604Z","title":"E- chat: Emotion-sensitive spoken dialogue system with large lan- guage models,","venue":null,"work_id":"62628677-4a42-4710-8b79-abfea9a205ab","year":2024},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:24.655324Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:69df5beaf19cd0298ee51591c961b1af62654acd270ccb739da7c9d0f195ea1a","observation_id":"32579c91-6bec-4326-8dde-a4a24d216c10","resolution":{"observed_at":"2026-08-06T14:45:31.615396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:31.290095Z","title":"Prompt- ing large language models with speech recognition abilities,","venue":null,"work_id":"5c9176f7-e109-420d-aab6-a04b3199fb0f","year":2024},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:24.767415Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:6945be217f4fbf72e0864a6063eda2d937c7909caf178d94ce767b82550fdc66","observation_id":"daebb02b-03d7-4ea6-9408-6390ab429414","resolution":{"observed_at":"2026-08-06T14:45:31.366251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:31.103043Z","title":"On decoder-only architecture for speech-to-text and large language model integration,","venue":null,"work_id":"d616c01c-f162-43e5-aff7-ac7b00a4086d","year":2023},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:24.870280Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:7f3fbac979378485f7434d62df0e9b1dd04580ec70ed354e412b7426b650abcd","observation_id":"abfbe24e-4e76-4fe2-a6df-5aaf152ba1b2","resolution":{"observed_at":"2026-08-06T14:45:31.173055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08846","last_updated":"2024-02-13T23:25:04Z","snapshot_observed_at":"2026-08-06T09:11:01.697195Z","submitted_at":"2024-02-13T23:25:04Z","title":"An Embarrassingly Simple Approach for LLM with Strong ASR Capacity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08846","snapshot_observed_at":"2026-08-06T14:45:24.973672Z","title":"An embarrassingly simple approach for llm with strong asr capacity,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:24.973672Z"},"links":{"cited_paper":"/paper/2402.08846","citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:a5b7f211d6095ad26baf715955b599562a1a2c65df8aa71b31f208fb4c1a1dd1","observation_id":"67cee1df-1eb8-46de-a7c2-5a0a038666a7","resolution":{"observed_at":"2026-08-06T14:45:24.973672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:29.814405Z","title":"Attention is all you need,","venue":null,"work_id":"2f001fa9-6d55-4d38-b35d-231162b20ba5","year":2017},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:25.520001Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:eb78b965d0ecda6eee10bc3db230f4d2176961e2080026bb65f980dd6b9dd9b3","observation_id":"a8e10e73-6a3c-4b70-9f59-31dcc66b6264","resolution":{"observed_at":"2026-08-06T14:45:29.861719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:30.743000Z","title":"Robust speech recognition via large-scale weak su- pervision,","venue":null,"work_id":"2c83af7f-9dc2-4390-9d8d-5c2116a96b09","year":2023},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:25.158657Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:a33ef1945c09c925746c76b71916178f9a6daf98039db74b5f63e89aad1aa845","observation_id":"c2a40359-1de6-4ed0-8891-c5c29938ee7e","resolution":{"observed_at":"2026-08-06T14:45:30.924050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11214","last_updated":"2024-09-17T14:10:57Z","snapshot_observed_at":"2026-08-06T11:40:45.270611Z","submitted_at":"2024-09-17T14:10:57Z","title":"Ideal-LLM: Integrating Dual Encoders and Language-Adapted LLM for Multilingual Speech-to-Text","version":1},"cited_work":{"arxiv_id":"2409.11214","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.11214","snapshot_observed_at":"2026-08-06T14:45:27.373120Z","title":"Ideal-LLM: Integrating Dual Encoders and Language-Adapted LLM for Multilingual Speech-to-Text","venue":"eess.AS","work_id":"8dd4605a-c157-4dfe-96ff-1bdee9f51b34","year":2024},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:25.234732Z"},"links":{"cited_paper":"/paper/2409.11214","citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:fb1de7ecb2261d2a634f94a65cd81f6f34a34b96ae76adcad0f1ba2a907abb62","observation_id":"1740bf53-f428-4acf-b6c7-4002450b954c","resolution":{"observed_at":"2026-08-06T14:45:27.419040Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:30.378394Z","title":"Scaling speech technology to 1, 000+ languages,","venue":null,"work_id":"3fdb8ce0-b9d6-4265-89c6-de2c1856e328","year":2024},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:25.328275Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:8c007dc4fb7ae8c41ae62ae8afc26dc40342dd8ece672f144a7634115ce79b04","observation_id":"8583cb70-0878-4e89-850c-cdb15dd14945","resolution":{"observed_at":"2026-08-06T14:45:30.544635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:29.961554Z","title":"Lora: Low-rank adaptation of large lan- guage models,","venue":null,"work_id":"d5e31a8b-4aef-4244-939f-728833a91f62","year":2022},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:25.421157Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:9a2d6dea7216accb367aa75723cfc8bfa5557f2ec67f90fe13e7bc764cfd083e","observation_id":"e3ecebeb-1db4-43b7-94fd-4fa84352cb52","resolution":{"observed_at":"2026-08-06T14:45:30.146746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11546","last_updated":"2025-05-27T04:49:35Z","snapshot_observed_at":"2026-08-04T06:10:50.996064Z","submitted_at":"2024-06-17T13:44:20Z","title":"GigaSpeech 2: An Evolving, Large-Scale and Multi-domain ASR Corpus for Low-Resource Languages with Automated Crawling, Transcription and Refinement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11546","snapshot_observed_at":"2026-08-06T14:45:25.987528Z","title":"Gigaspeech 2: An evolving, large-scale and multi-domain asr corpus for low-resource languages with au- tomated crawling, transcription and refinement,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:25.987528Z"},"links":{"cited_paper":"/paper/2406.11546","citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:0195a26284c877478f32c4b80b3c239cb51d81fcee974fec0159d3144280631e","observation_id":"e90c6ac7-541e-4607-a8ff-36897dca7c6f","resolution":{"observed_at":"2026-08-06T14:45:25.987528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-06T14:45:25.579054Z","title":"Qwen3 technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:25.579054Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:fb54ab0ef427d9e52f2d5a7b2d363f6f1ccd4ca09311c0993e0c541b48e7905b","observation_id":"f3bb7416-d714-480e-ad6e-3285b8bcc404","resolution":{"observed_at":"2026-08-06T14:45:25.579054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:29.693970Z","title":"MSR- 86K: an evolving, multilingual corpus with 86, 300 hours of tran- scribed audio for speech recognition research,","venue":null,"work_id":"4278fe67-a28d-4ee7-8211-eaded0e37660","year":2024},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:25.676361Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:52220ddf38655e461cf396271857deb8ba1e0128f9dde41042a82e88272fd1a3","observation_id":"bbbea1d3-daa5-4663-98ef-63919ef87493","resolution":{"observed_at":"2026-08-06T14:45:29.777252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:29.487482Z","title":"Com- mon voice: A massively-multilingual speech corpus,","venue":null,"work_id":"248b51dc-b0d6-4aa0-92e2-04d18b07bf78","year":2020},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:25.771272Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:aef11bebff513adefa58e437ab38701d940a5d0eda5c2d5a14b6de2f36152444","observation_id":"82786020-78f8-4738-83ba-96ad4d5467aa","resolution":{"observed_at":"2026-08-06T14:45:29.592363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:29.170837Z","title":"MLS: A large-scale multilingual dataset for speech research,","venue":null,"work_id":"061fdef6-d22a-4cef-9771-1cf9c1281feb","year":2020},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:25.894675Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:49c44737b49b3c3d8e69f8fe534ba5194ccee775c60e9abef2aa7a3dca1dc714","observation_id":"9b9625b0-a0b5-41b2-822e-862b2cef0243","resolution":{"observed_at":"2026-08-06T14:45:29.369100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:28.395991Z","title":"The fisher corpus: a resource for the next generations of speech-to-text,","venue":null,"work_id":"2166b921-e1b3-4483-a791-f05c17367180","year":2004},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:26.556919Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:1c2913b373ad60dbb73588111d743de44e21d53dc7d91c39bfcf080a632142ed","observation_id":"89298056-c8c7-4a4e-887a-00ebc84249df","resolution":{"observed_at":"2026-08-06T14:45:28.503271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:28.905674Z","title":"Emilia: An extensive, multilingual, and diverse speech dataset for large-scale speech generation,","venue":null,"work_id":"de6e4ff0-aa66-48d4-abbb-88fc3914f43b","year":2024},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:26.112013Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:5707da994cb0f83f4501537cd082b9cbe1518095630fa8c3b6d8b6b16d342489","observation_id":"3aeb822d-7a4b-4a68-b6f2-775f3e162188","resolution":{"observed_at":"2026-08-06T14:45:29.012624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:32.888348Z","title":"The average WER is reduced by 3.6% compared to the original baseline","venue":null,"work_id":"1079e354-27e0-46bb-a8bb-1bfabcada544","year":null},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:23.366324Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:66ab2442a3a072eba007a0e28683ddddbd54511f58b3037b1d6fc58b9833ef23","observation_id":"c9f30bf0-4c0f-404a-94c5-ca55bd764167","resolution":{"observed_at":"2026-08-06T14:45:32.945762Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:28.688316Z","title":"Opendatalab: Empowering general artificial intelligence with open datasets,","venue":null,"work_id":"85d96053-cba3-44d6-a6d8-d6f99488059b","year":null},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:26.204777Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:03776d6a114a01eae48fc6650421a604f25734b60fbaa19f8c211c3e8c9fd296","observation_id":"dcf92287-9c04-4773-97b2-d191d4ce13fd","resolution":{"observed_at":"2026-08-06T14:45:28.813061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:28.652361Z","title":"Lib- rispeech: An ASR corpus based on public domain audio books,","venue":null,"work_id":"9bec4a43-4a47-4a5d-ace0-b0df4f5c551b","year":2015},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:26.395403Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:a63fa1d546d9a21d07ad62e0f1c4ba5251cd4a7412ab22594d36385f14e80841","observation_id":"75539b25-e724-4fb9-b893-1e75bff383f9","resolution":{"observed_at":"2026-08-06T14:45:28.661767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.06909","last_updated":"2021-06-13T04:09:16Z","snapshot_observed_at":"2026-08-09T08:32:43.969496Z","submitted_at":"2021-06-13T04:09:16Z","title":"GigaSpeech: An Evolving, Multi-domain ASR Corpus with 10,000 Hours of Transcribed Audio","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.06909","snapshot_observed_at":"2026-08-06T14:45:26.487908Z","title":"Gigaspeech: An evolving, multi-domain asr corpus with 10,000 hours of transcribed audio,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:26.487908Z"},"links":{"cited_paper":"/paper/2106.06909","citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:fdf8a1afc4e8f3f7277f0d17fd924d4693c9c98b585781b7ed7bca64b1d16c4f","observation_id":"d5156ee4-8fc9-44d8-9f7d-ac6a252ac9bb","resolution":{"observed_at":"2026-08-06T14:45:26.487908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12654","last_updated":"2024-08-27T02:22:00Z","snapshot_observed_at":"2026-07-06T17:32:36.489908Z","submitted_at":"2024-02-20T02:04:38Z","title":"OWSM-CTC: An Open Encoder-Only Speech Foundation Model for Speech Recognition, Translation, and Language Identification","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12654","snapshot_observed_at":"2026-08-06T14:45:27.070910Z","title":"Owsm-ctc: An open encoder-only speech foundation model for speech recog- nition, translation, and language identification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:27.070910Z"},"links":{"cited_paper":"/paper/2402.12654","citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:2b06b2f5793d4adc159c2b10e4bf2b0b4d01cae11ac665dd7f3d26f330aa4e50","observation_id":"63ac38bd-0606-47c4-8841-5fc2e2247696","resolution":{"observed_at":"2026-08-06T14:45:27.070910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:28.190742Z","title":"Reazonspeech: A free and massive cor- pus for japanese asr,","venue":null,"work_id":"383effb8-12fd-450f-a72d-cdb43e3fc915","year":2016},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:26.636811Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:5c6027baf830afde24e257470309b5488597cb3f1af7879cd733fe88837ffa05","observation_id":"3259b15b-c866-40ff-a0c8-597a8cdd2385","resolution":{"observed_at":"2026-08-06T14:45:28.255794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:28.040068Z","title":"Construction of a large-scale japanese asr corpus on tv recordings,","venue":null,"work_id":"f364ba52-6828-4eba-b75d-cbb0e7dd8ade","year":2021},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:26.732456Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:60d7cea7536d92ef47c41adb914009aa1d35ff5b62d6972f4cb2f75d984d1b02","observation_id":"5cde0366-8bd5-4531-b737-3502dc8d79e1","resolution":{"observed_at":"2026-08-06T14:45:28.099032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.10161","last_updated":"2021-06-18T14:55:02Z","snapshot_observed_at":"2026-08-03T20:31:57.136333Z","submitted_at":"2021-06-18T14:55:02Z","title":"Golos: Russian Dataset for Speech Research","version":1},"cited_work":{"arxiv_id":"2106.10161","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.10161","snapshot_observed_at":"2026-08-06T14:45:27.186399Z","title":"Golos: Russian Dataset for Speech Research","venue":"eess.AS","work_id":"341fc63a-1e99-463f-824a-5e6a2f6f7de8","year":2021},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:26.849514Z"},"links":{"cited_paper":"/paper/2106.10161","citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:4f86d2bb5980a56a22326104cc47ccdcb27f0c5d47754303d37521f86468444a","observation_id":"2d5b036b-fd34-4bee-90ba-3b2ce05fe765","resolution":{"observed_at":"2026-08-06T14:45:27.229289Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:27.845132Z","title":"Ksponspeech: Korean spontaneous speech corpus for automatic speech recog- nition,","venue":null,"work_id":"4ae99a10-0f6c-4769-b802-fac54efbeed1","year":2020},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:26.944483Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:b46a63a8ded7758902906b8e363c1fa32a3da12ef0bcc1ee66e093fa40df0b33","observation_id":"b6ef063f-f903-4c64-ae0f-cc53f4397866","resolution":{"observed_at":"2026-08-06T14:45:27.943351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:27.707003Z","title":"Unsupervised cross-lingual representation learning for speech recognition,","venue":null,"work_id":"81cd9b7f-a37e-4b12-af37-ae17c4aefca1","year":2021},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:27.014884Z"},"links":{"citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:d4e7ff0656ad9f90ad1a96416a7bc3549f1dfda4a55cee70d82e992f256d6f1a","observation_id":"860f4c4f-497a-479d-bef6-e2ccefbae6ad","resolution":{"observed_at":"2026-08-06T14:45:27.769815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13773","last_updated":"2024-06-04T10:42:01Z","snapshot_observed_at":"2026-08-09T00:47:38.174816Z","submitted_at":"2024-06-04T10:42:01Z","title":"OpenDataLab: Empowering General Artificial Intelligence with Open Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13773","snapshot_observed_at":"2026-08-06T14:45:26.301812Z","title":"Available: https://arxiv.org/abs/2407.13773","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:26.301812Z"},"links":{"cited_paper":"/paper/2407.13773","citing_paper":"/paper/2507.18051"},"observation_digest":"sha256:8614ff98227311cde5aa8e12e1b06ebfb9f81c842d0429499d22136c8d45a049","observation_id":"c535d169-99fa-47cc-926f-bb5f0e7e7c2a","resolution":{"observed_at":"2026-08-06T14:45:26.301812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.18051","last_updated":"2025-07-24T02:56:29Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-09T12:15:47.159957Z","submitted_at":"2025-07-24T02:56:29Z","title":"The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":2,"verified_fuzzy":24},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 1 inbound Pith citation observation for arXiv:2507.18051."}