{"as_of":"2026-08-09T02:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4b29473ae288f8f3ee5677ae958fad2b1ce7356bc1425d002689553b41b93240","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:40:51.670696Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:40:47.825821Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T00:40:51.796962Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"cited_work":{"arxiv_id":"2506.13300","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.13300","snapshot_observed_at":"2026-08-07T00:40:51.796962Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","venue":"cs.CL","work_id":"347da9d7-10b8-474b-b25a-f6c0a01be080","year":2025},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:47.825821Z"},"links":{"cited_paper":"/paper/2506.13300","citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:f579513c2ad8eac0c3601e5ff1c9117c44fd4a4d376b6d4dd892e48286bcd726","observation_id":"3fe8fc93-b57f-4451-8ce0-36f2fd646a8c","resolution":{"observed_at":"2026-08-07T00:40:51.853914Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.13300/citation-record","integrity":"/paper/2506.13300/integrity","json":"/paper/2506.13300/citation-record.json","paper":"/paper/2506.13300"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:59.361427Z","title":"The English subset contains approximately 500 hours of recordings from diverse regions, including British, American, Australian, In- dian, and Philippine English","venue":null,"work_id":"475563dd-063c-42d3-997e-e44f5b4435b3","year":null},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:47.739229Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:20462d5f71bad85ec23f2fafca65a92f30b36b61ef1828b493ed0778c5d4ee91","observation_id":"0988bf3b-5ecb-4609-93aa-97c0222e0e26","resolution":{"observed_at":"2026-08-07T00:40:59.435633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"cited_work":{"arxiv_id":"2506.13300","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.13300","snapshot_observed_at":"2026-08-07T00:40:51.796962Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","venue":"cs.CL","work_id":"347da9d7-10b8-474b-b25a-f6c0a01be080","year":2025},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:47.825821Z"},"links":{"cited_paper":"/paper/2506.13300","citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:f579513c2ad8eac0c3601e5ff1c9117c44fd4a4d376b6d4dd892e48286bcd726","observation_id":"3fe8fc93-b57f-4451-8ce0-36f2fd646a8c","resolution":{"observed_at":"2026-08-07T00:40:51.853914Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:59.183711Z","title":null,"venue":null,"work_id":"e28041ca-2284-4eb7-9f54-7802475ed78b","year":2000},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:47.911019Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:fa9be5580f200ae35276dfcd0df88563720f520ba722638122265336f917bb3d","observation_id":"8da66008-3889-4ceb-888d-b73954a21795","resolution":{"observed_at":"2026-08-07T00:40:59.274267Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:59.025754Z","title":null,"venue":null,"work_id":"16beaac5-ce59-4c9f-a126-1f673928a910","year":null},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:47.984858Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:1eeb078bd2a9f3173d2b8db24f38030186d58f1aa275b5da181ce6d381543754","observation_id":"15b178ee-9bc3-4c79-8389-7bc1bcb4c0b3","resolution":{"observed_at":"2026-08-07T00:40:59.096412Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:58.811336Z","title":null,"venue":null,"work_id":"7cfe014f-7ce4-49a9-8a8d-29335108f80c","year":null},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:48.065949Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:7512c8052306896769dcf9bdb13ba5d499931c332c35ebec5af4507a780929bc","observation_id":"25dff974-c290-47a6-bc1e-a81ac18f305a","resolution":{"observed_at":"2026-08-07T00:40:58.923256Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:58.458372Z","title":"Our approach achieves substantial improvements over the official challenge baselines","venue":null,"work_id":"75d067a8-a982-4305-bc7e-c93c4df835c8","year":null},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:48.233758Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:3cf7b057a381ea28141e28b52488fcb817d7f3709db7ba129b42be984b9db64b","observation_id":"fbaeffe3-38e6-434b-a597-a19d7571b8d6","resolution":{"observed_at":"2026-08-07T00:40:58.563114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:56.915447Z","title":"Instruction fine-tuning: Does prompt loss matter?","venue":null,"work_id":"891a060b-ac35-4c43-bfca-ff4a1c0f1b23","year":2024},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:48.951213Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:1ba2190fd7308d0c61e7d45c304d7bd50a5d36951e6e4dbb3a4dc279bad54957","observation_id":"32926180-4cfc-4b2b-9c52-c25959fca66f","resolution":{"observed_at":"2026-08-07T00:40:57.079554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:58.284756Z","title":"Mlc-slm-baseline,","venue":null,"work_id":"2c850d94-ba9a-4e9a-ade7-11b3e1eaedb4","year":2025},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:48.317209Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:5beaa2524cef46b10112b52cfbd4a44b2e09ca3cb6977fc63e5dd548263f0ef8","observation_id":"35c8c82b-3638-444c-8dd6-f3403fcdc84e","resolution":{"observed_at":"2026-08-07T00:40:58.355942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:58.093887Z","title":"An embarrassingly simple ap- proach for llm with strong asr capacity,","venue":null,"work_id":"284a005e-5989-4d92-a5bd-067c42cc2680","year":2024},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:48.413321Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:1bdecd2455342314f352b738353f0baee9b46b347dc79572652585d755cc2ca7","observation_id":"d5945955-3b31-472b-9cb3-547f17d737b2","resolution":{"observed_at":"2026-08-07T00:40:58.189054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:57.808218Z","title":"Wavlm: Large-scale self-supervised pre-training for full stack speech processing,","venue":null,"work_id":"9d9bffe6-a62d-47e8-b804-95df2fe2a031","year":2022},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:48.510663Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:d4bf3292fee881a1a7186ddd84311d4b818246957099834b5b039d7ed7e7ea67","observation_id":"6d1f69f6-7e6d-4105-954a-a18f77960cd0","resolution":{"observed_at":"2026-08-07T00:40:57.960106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:57.460391Z","title":"Hubert: Self-supervised speech represen- tation learning by masked prediction of hidden units,","venue":null,"work_id":"700e8cff-a2c1-4a52-b6cf-dfc18a6c3155","year":2021},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:48.628294Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:2dec514ac7f6c9a0c3a4cafa97a98414cc684d629d47f37af1a3e9caf2da76b0","observation_id":"ac59bc0f-c477-4ca8-a1f7-bc99a0e20c47","resolution":{"observed_at":"2026-08-07T00:40:57.623425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:48.717270Z","title":"Robust speech recognition via large-scale weak su- pervision,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:48.717270Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:e86e2ae963d0a18a2c1a4bba44dd0930586f3d0c6ff3d0f570072c636ceda928","observation_id":"51ad9776-b3ee-4154-bc70-e107836eaae7","resolution":{"observed_at":"2026-08-07T00:40:48.717270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:57.180096Z","title":null,"venue":null,"work_id":"f4144b08-ca92-4a71-a58b-ca5400e5cea6","year":null},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:48.839146Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:c32b033a551741a5738ff370c14deff80d0d5a569411c52bd1d20e782b5b4f44","observation_id":"36bec901-32c6-40f4-9772-d5a4e51934f3","resolution":{"observed_at":"2026-08-07T00:40:57.275837Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:49.676520Z","title":"A study on data augmentation of reverberant speech for robust speech recognition,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:49.676520Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:74203af70a9e8d059e952dfdfd311de858e80659e6916cf442e77f65588a1d53","observation_id":"448cb8dc-4cc3-4ce1-90c5-9f29368dc1ea","resolution":{"observed_at":"2026-08-07T00:40:49.676520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:56.745079Z","title":"Understanding r1-zero-like training: A critical perspec- tive,","venue":null,"work_id":"3b9584f2-8406-49c6-b2de-ae8f0e7ebe02","year":2025},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:49.044218Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:d69b1d1fd2ce4d921ab485066186f5d64ef88b1c73cabbf2cc10cd637fdf5032","observation_id":"d5e09c64-522f-48ad-8dd0-22c3b74c9917","resolution":{"observed_at":"2026-08-07T00:40:56.803266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:56.465819Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models,","venue":null,"work_id":"e29a5bbf-05b2-47eb-b120-37e60ada4932","year":2024},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:49.158768Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:91ac7b6695ff01c956ded3892c93f1a0e61504f4aedb165273660371c3ed9b24","observation_id":"c71ad94d-1934-4fd9-9022-2182fe6b625d","resolution":{"observed_at":"2026-08-07T00:40:56.609437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:56.204112Z","title":"Cn-celeb: multi-genre speaker recogni- tion,","venue":null,"work_id":"9b6f0466-4aa1-44ca-a13c-240f03e7dd6f","year":2020},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:49.243866Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:c3dc332961fe7a2f5f874e3d2571b09043714754cadc144226144952e0f385aa","observation_id":"914ede12-f1f8-46ab-bfca-eefa3d51e079","resolution":{"observed_at":"2026-08-07T00:40:56.319280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:55.945558Z","title":"V oxblink: A large scale speaker verification dataset on camera,","venue":null,"work_id":"01323fda-ea3b-4152-9c79-a0390f08821b","year":2023},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:49.401485Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:ae35c6285d3a8df88d225bfea0a8287cc83a5570ffb009ba1feb2a75916d6067","observation_id":"ab8750e0-8d84-4239-8275-06440d2df614","resolution":{"observed_at":"2026-08-07T00:40:56.079815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:55.652326Z","title":"V oxblink2: A 100k+ speaker recognition corpus and the open- set speaker-identification benchmark,","venue":null,"work_id":"5e3f3434-d73a-4ce2-9cc7-7248a4255b2d","year":2024},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:49.498163Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:9f6aab38be5f04e8a46dce06409d102820b987c5a70e91c6266984ca73b3cd1c","observation_id":"86254e6a-17f1-45b4-9525-4b309301e6ba","resolution":{"observed_at":"2026-08-07T00:40:55.784963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:55.427335Z","title":"Wespeaker: A research and production oriented speaker embedding learning toolkit,","venue":null,"work_id":"e2a98deb-55a5-4e0c-b3d4-b16eaf066e72","year":2023},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:49.564810Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:e28517399af570c76277df755458035220965af9eaba8f415ca29e0ed2e68de2","observation_id":"71328a65-d61b-47cd-b233-ed993cdab8d5","resolution":{"observed_at":"2026-08-07T00:40:55.530995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:50.385187Z","title":"Qwen2.5 technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:50.385187Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:12f859971ac0c4222c7bad0216b543e875328c42506986bfd3d12f9d49d6a94f","observation_id":"8bbda074-6281-4540-9ee1-cc38927ef1e6","resolution":{"observed_at":"2026-08-07T00:40:50.385187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1510.08484","last_updated":"2015-10-28T20:59:04Z","snapshot_observed_at":"2026-07-06T04:34:36.474437Z","submitted_at":"2015-10-28T20:59:04Z","title":"MUSAN: A Music, Speech, and Noise Corpus","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1510.08484","snapshot_observed_at":"2026-08-07T00:40:49.758472Z","title":"MUSAN: A Music, Speech, and Noise Corpus,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:49.758472Z"},"links":{"cited_paper":"/paper/1510.08484","citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:ef75fc6df9b0b76b6e30e2846f57d3bd1a68936c1b8316db1602496902ea3f62","observation_id":"a06c87fd-a0c2-49b8-8c96-8f126f1f1ce8","resolution":{"observed_at":"2026-08-07T00:40:49.758472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:55.062617Z","title":"We speech transcript, llm based speech recog- nition/transcript in 300 lines of code,","venue":null,"work_id":"3e123342-ec83-41f0-be6d-d17efe53328c","year":2024},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:49.896817Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:61c69307ebbccb63741160d8b79f1250c3676ebae28b12276c3903c98315664c","observation_id":"8163074c-7e0d-4425-b6ff-2abab8bea33f","resolution":{"observed_at":"2026-08-07T00:40:55.229748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:54.789194Z","title":"Transform- ers: State-of-the-art natural language processing,","venue":null,"work_id":"ffcb6b80-4704-4885-babd-7dd71cd17b36","year":2020},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:49.995311Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:8a437504c2787d99e7f16f0449740165d3cefedb14e6ddb7ffde8bed4867d737","observation_id":"fc6ae9e1-d6c2-4625-8e2e-acf2106ad1d0","resolution":{"observed_at":"2026-08-07T00:40:54.917888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:54.506532Z","title":"Accelerate: Training and in- ference at scale made simple, efficient and adaptable","venue":null,"work_id":"c4b03368-f8ea-4672-ae84-cd13e5d6ddfe","year":2022},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:50.103440Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:7f9a7539a7984e8b11f2d52a9c0e3ca59c68c96a6bb67e7f6a47167c416e26f5","observation_id":"ff866774-cd21-45ab-9701-1d02530f4f96","resolution":{"observed_at":"2026-08-07T00:40:54.645166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:54.184887Z","title":"Peft: State-of-the-art parameter-efficient fine-tuning methods,","venue":null,"work_id":"7e20c856-5049-4a90-8b2a-849ec332deee","year":2022},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:50.192369Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:8e5df1490adffecaf7b9e2537e39998da4b3c6f82ba59a890fa0f729e35f99ea","observation_id":"eecffd14-2fda-47ba-97aa-cccc869c0602","resolution":{"observed_at":"2026-08-07T00:40:54.350973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:53.819435Z","title":"Trl: Trans- former reinforcement learning,","venue":null,"work_id":"a45a5048-86e7-4c46-916b-54ef356b994f","year":2020},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:50.287442Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:641aca59408e6bdffa6287d7b26fbc565597ecfe853604b80e1816f993cbd334","observation_id":"1d57ade6-664e-407c-9f6a-b9ed2488fb21","resolution":{"observed_at":"2026-08-07T00:40:54.007307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:52.729843Z","title":"Reasoning language models: A blueprint,","venue":null,"work_id":"0aeceea0-c0e1-43bb-9c12-f75bcd98aa4d","year":2025},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:51.019487Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:0f1baaa7f2e3185256a5d07c42c975bcab84b3c53a804a0e5ccf3ce5e29a265e","observation_id":"2c141f99-89ae-42d3-9ee1-6933053e8254","resolution":{"observed_at":"2026-08-07T00:40:52.777380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:53.502642Z","title":"Unified language-vision pretraining in llm with dynamic discrete visual tokenization,","venue":null,"work_id":"7518b4e7-d3cd-4068-b5fa-1ec54b4ac9f7","year":2024},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:50.474646Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:ec97b7aaa10d052b91f065260d6d0320601a601fe00dd95106a428a6de01f1ba","observation_id":"f0c98e6e-b284-4d66-9c8a-b252a50f1cf6","resolution":{"observed_at":"2026-08-07T00:40:53.661057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:53.292505Z","title":"Lora: Low-rank adaptation of large lan- guage models,","venue":null,"work_id":"7bf124e3-1265-457a-951e-fbfeeb72ec39","year":2021},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:50.587307Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:4e9e5e12946ddc73473312eb269a4dec14b497e751bdbc8262ba98c28169901d","observation_id":"8940571d-7737-47a7-8d36-5c6332b3ae81","resolution":{"observed_at":"2026-08-07T00:40:53.360936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:53.228584Z","title":"S 2r: Teaching llms to self-verify and self- correct via reinforcement learning,","venue":null,"work_id":"ac13ec06-2597-4e2d-97ff-df6537407479","year":2025},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:50.668664Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:6400d8a54901331c3938dfbe48b0619b84741c8ca0cf1847125343f09604c289","observation_id":"c97bda16-1539-47ab-b024-ee83e4bdf758","resolution":{"observed_at":"2026-08-07T00:40:53.233747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:53.081951Z","title":"Training language mod- els to self-correct via reinforcement learning,","venue":null,"work_id":"96705846-6465-42be-b45c-03397e3f7e6d","year":2024},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:50.788647Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:514f6e7dc95328dbaae3384a4f7176fad97b6eb3e5e2794d2d9b49651bf4b140","observation_id":"cd466234-d65c-4d8d-99bf-fd7ff216bb3d","resolution":{"observed_at":"2026-08-07T00:40:53.119234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:52.967000Z","title":"Instruction tuning with loss over instructions,","venue":null,"work_id":"705f7676-9b6b-4d61-9310-5c1462864c28","year":2024},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:50.871988Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:41b5fe68e4eedc3ca0abc5896bf71f55238c5544902e1ec77d09895093ec18d1","observation_id":"9ee05ce6-0caf-4413-800f-569671e82ce5","resolution":{"observed_at":"2026-08-07T00:40:53.019189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:52.838679Z","title":"Glore: When, where, and how to improve llm reasoning via global and local refinements,","venue":null,"work_id":"3d1a06b3-3001-487d-b9eb-4d23fb351210","year":2024},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:50.964775Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:699e98214a3de7933e8eb5b5b564090cf71dfbfc79992aed6aafa12adc9208c0","observation_id":"9ea18f16-97ec-4f29-af9d-664dde917b8f","resolution":{"observed_at":"2026-08-07T00:40:52.896463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:58.629467Z","title":"The ResNet-101 model was specifically trained on a diverse corpus comprising CnCeleb1, CnCeleb2 [10], V oxBlink [11], and V oxBlink2 [12] datasets","venue":null,"work_id":"3c1d7cfd-c2ae-4c83-b5fe-99ad5b0bc6ad","year":null},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:48.144192Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:42cbb647302378387e145d999942f6bbe347e27dae858c27c5b61c03e5ad3a75","observation_id":"f2590b15-c4d6-4a18-9c7f-6dd372cac0c5","resolution":{"observed_at":"2026-08-07T00:40:58.690558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:52.607044Z","title":"Gec-rag: Improving generative error correction via retrieval-augmented generation for automatic speech recognition systems,","venue":null,"work_id":"a3c29f3a-30eb-4082-aacd-981a57995fa9","year":2025},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:51.106091Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:0f91f22aadd00d58e1d02a44002057c9f501e2cacf7f4f1f6a6dedba0f1deaeb","observation_id":"d36e8083-3e76-49dd-b79f-e959c6673943","resolution":{"observed_at":"2026-08-07T00:40:52.649409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:52.468920Z","title":"3d-speaker-toolkit: An open source toolkit for multi-modal speaker verification and diarization,","venue":null,"work_id":"b8098204-db19-4b08-b252-5b3048638d1c","year":2025},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:51.182507Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:edd494ff59f0e82b10547b6fa51cdd75941c2eae7c4922570a0f1f3d96e13a68","observation_id":"5d7e8350-6e46-426c-84ad-f32cf232a793","resolution":{"observed_at":"2026-08-07T00:40:52.531472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:52.345387Z","title":"Deep-fsmn for large vo- cabulary continuous speech recognition,","venue":null,"work_id":"1fe89dbd-2d4c-42bc-9501-b5f416c6e9ad","year":2018},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:51.297451Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:9541dbcb25410437bb136584bbffdf704d4a99126d14c96669715eafe3530723","observation_id":"ebb2b8ea-9031-40ac-91d9-a4a5dd17f2c8","resolution":{"observed_at":"2026-08-07T00:40:52.386857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:51.365489Z","title":"Advancing speaker embedding learning: Wespeaker toolkit for research and produc- tion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:51.365489Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:aac6adfe63f9600992d9ef1985672a39e5364d4c191722738e2814d3a08534f7","observation_id":"e593e5f9-29b1-4e71-88c9-720b7f7a2542","resolution":{"observed_at":"2026-08-07T00:40:51.365489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:52.216091Z","title":"A spectral clustering approach to speaker diarization","venue":null,"work_id":"e4fa35db-a7cb-4f79-b501-dc6e9be3dd71","year":2006},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:51.443802Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:21f2933ad81ad27e333fc70501b8d422262dcd216fcf0101db5dcceca534b0a0","observation_id":"89c2d929-b961-44d9-961e-177e77807c0d","resolution":{"observed_at":"2026-08-07T00:40:52.271335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:52.106149Z","title":"An enhanced res2net with local and global feature fusion for speaker verification,","venue":null,"work_id":"664b2e7a-1b74-438b-8980-b3b6dd457c72","year":2023},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:51.508068Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:d05a314839a3871c633fad49860862ba974e4282b0667f70cfa052b21f60476a","observation_id":"fbc0e57e-aef3-421b-97b6-5f6fb3fb163b","resolution":{"observed_at":"2026-08-07T00:40:52.156205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.00332","last_updated":"2023-06-16T09:07:11Z","snapshot_observed_at":"2026-08-05T18:44:00.793642Z","submitted_at":"2023-03-01T08:50:31Z","title":"CAM++: A Fast and Efficient Network for Speaker Verification Using Context-Aware Masking","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.00332","snapshot_observed_at":"2026-08-07T00:40:51.583965Z","title":"Cam++: A fast and efficient network for speaker verification using context- aware masking,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:51.583965Z"},"links":{"cited_paper":"/paper/2303.00332","citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:dd180c2021e030b76b98fdcbe148cb660515563eadebf1585af47371531621d8","observation_id":"23f45442-877c-47ea-b01a-055032f9d6d4","resolution":{"observed_at":"2026-08-07T00:40:51.583965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:40:51.954151Z","title":"Modelscope: bring the notion of model-as-a-service to life","venue":null,"work_id":"03f1001d-06f5-467a-94c2-1b62bfad5752","year":2023},"citing_paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T00:40:51.670696Z"},"links":{"citing_paper":"/paper/2506.13300"},"observation_digest":"sha256:ccf6b1f5c5a91a5332259cb87a0e81a7f8d6314eb3a428cee39c1f448b96e054","observation_id":"23099b38-c337-4580-9a37-8505f6e3576c","resolution":{"observed_at":"2026-08-07T00:40:52.022804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.13300","last_updated":"2025-06-18T06:57:58Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T00:34:30.814768Z","submitted_at":"2025-06-16T09:42:05Z","title":"Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":32},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 1 inbound Pith citation observation for arXiv:2506.13300."}