{"as_of":"2026-08-08T09:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:786a46846cc0514c4714c327df9565f661e467c8a8befc7955e5401b1a116a20","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:58:39.430678Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:58:36.497364Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T13:58:39.905074Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"cited_work":{"arxiv_id":"2505.20477","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.20477","snapshot_observed_at":"2026-08-07T13:58:39.905074Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","venue":"eess.AS","work_id":"4e72d6c6-40a8-45bd-99ce-45aa517e4d2e","year":2025},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:36.497364Z"},"links":{"cited_paper":"/paper/2505.20477","citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:c5aa308014f25e10ea9df650dc92a192f6bfa9e003568477ca94ddeffd3f085f","observation_id":"c3c5ab76-7f16-40e9-9505-94ffbcf48f05","resolution":{"observed_at":"2026-08-07T13:58:39.989618Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.20477/citation-record","integrity":"/paper/2505.20477/integrity","json":"/paper/2505.20477/citation-record.json","paper":"/paper/2505.20477"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"cited_work":{"arxiv_id":"2505.20477","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.20477","snapshot_observed_at":"2026-08-07T13:58:39.905074Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","venue":"eess.AS","work_id":"4e72d6c6-40a8-45bd-99ce-45aa517e4d2e","year":2025},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:36.497364Z"},"links":{"cited_paper":"/paper/2505.20477","citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:c5aa308014f25e10ea9df650dc92a192f6bfa9e003568477ca94ddeffd3f085f","observation_id":"c3c5ab76-7f16-40e9-9505-94ffbcf48f05","resolution":{"observed_at":"2026-08-07T13:58:39.989618Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:44.275061Z","title":null,"venue":null,"work_id":"acf7b4eb-2083-469a-b117-7bbcae6b5442","year":null},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:36.567876Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:b582cb897c519a0f9fb1d92c1f5edaa243657451635ba1148a2495b6a3a4d60e","observation_id":"5cf83cec-96ec-4530-ad6c-0e736d380ced","resolution":{"observed_at":"2026-08-07T13:58:44.379234Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:44.131466Z","title":"Model Merging Model merging strategies have demonstrated performance im- provements in out-of-distribution predictions for vision models","venue":null,"work_id":"bd637a77-28a1-4e5f-b0ef-a931433677c2","year":null},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:36.661695Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:a01bb64cd932ba58885cfcade81a4e35debfaeee102ebbe129521ad580432279","observation_id":"fcdd9eb7-6779-4755-9af2-80d78d563085","resolution":{"observed_at":"2026-08-07T13:58:44.198113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:43.622515Z","title":"As shown in Fig- ure 1, MAST outperformed standard fine-tuning, demonstrat- ing the benefits of weight averaging along a single optimization 2https://github.com/openai/whisper path","venue":null,"work_id":"c562cce0-5fed-426f-abef-3d9f805a7303","year":null},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:36.899160Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:13e6d42f93c6b130a0f83b4e6df901a0ab20497fd635fb7d7594e08719aae1f0","observation_id":"1573dd1d-ad04-4fd0-8a97-77af9b78e9ef","resolution":{"observed_at":"2026-08-07T13:58:43.695280Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:43.427524Z","title":"Our findings demonstrate that model merg- ing, particularly selective merging across multiple trajectories, significantly improves WER compared to traditional fine-tuning methods","venue":null,"work_id":"f7635fe4-0abb-4620-9ec1-08df6dcc5594","year":null},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:36.971864Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:59ef6aafd1a3ad9563cd056791b89bb21795eeea2ee307f6171329164c4cada7","observation_id":"4ec3c2cb-b1c3-4994-9470-90fcdcf346be","resolution":{"observed_at":"2026-08-07T13:58:43.516661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10507","last_updated":"2024-06-15T05:13:19Z","snapshot_observed_at":"2026-07-06T18:31:21.929350Z","submitted_at":"2024-06-15T05:13:19Z","title":"Benchmarking Children's ASR with Supervised and Self-supervised Speech Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10507","snapshot_observed_at":"2026-08-07T13:58:37.410101Z","title":"Benchmarking children’s asr with supervised and self-supervised speech foundation mod- els,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:37.410101Z"},"links":{"cited_paper":"/paper/2406.10507","citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:c7b13c1aef0330745bb0b6b5418ee12cd003f2000393983e9fa4ff2b34643191","observation_id":"fc42ede6-a46f-490a-9fd8-cc22338b4c4e","resolution":{"observed_at":"2026-08-07T13:58:37.410101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:42.641839Z","title":"Whisper-at: Noise-robust automatic speech recognizers are also strong general audio event taggers,","venue":null,"work_id":"f2d9fc01-6a76-4ef9-b03b-f30c55ed2fdd","year":2023},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:37.438829Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:1081c6ddfe8940a9a2b61c50d7eb18212488da671f94c06e99232bc73fc26545","observation_id":"b1c7351d-7109-4664-a81a-e8321c7da146","resolution":{"observed_at":"2026-08-07T13:58:42.734222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:43.238809Z","title":"Data determines distributional robustness in contrastive language image pre-training (clip),","venue":null,"work_id":"45936def-39bd-4cc4-82fc-8a94e3f4361b","year":2022},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:37.075058Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:828f94e452bed2f0ef35636874afb559854b318edb417d14f60b43bf2d29aa36","observation_id":"dce8a5d4-4827-4209-b163-dc06c704b91b","resolution":{"observed_at":"2026-08-07T13:58:43.316824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:37.144885Z","title":"Hubert: Self-supervised speech represen- tation learning by masked prediction of hidden units,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:37.144885Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:a95b19eb121279ea8cfc134e9245c6e1d21000ea775aeca35bac1aea7897d9de","observation_id":"fe33aea0-abce-4830-8250-0e4e86223637","resolution":{"observed_at":"2026-08-07T13:58:37.144885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:37.207220Z","title":"Wavlm: Large-scale self- supervised pre-training for full stack speech processing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:37.207220Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:a67a7509d3f4ad4a6774b2797135a3a23a4576ef3fc1807c77694b0c6070d30f","observation_id":"3dabfa7a-8353-49ce-8a09-c264d92a9e39","resolution":{"observed_at":"2026-08-07T13:58:37.207220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:42.994855Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representa- tions,","venue":null,"work_id":"f00b2cfa-8c61-4667-906c-1334e652f058","year":2020},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:37.306068Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:bcb56df258e30615cb2adcc67e7168ea96b974427db01742a5c8d4f34d2a2ce3","observation_id":"435120b0-1928-4941-9f93-941e2e7c066a","resolution":{"observed_at":"2026-08-07T13:58:43.087943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:42.825874Z","title":"Towards better domain adaptation for self-supervised models: A case study of child asr,","venue":null,"work_id":"6b3574ed-3040-44f7-acfa-1c888090cf9f","year":2022},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:37.354201Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:2ed6baee0d76bd5dfdfb2f808f1ed2399b9b18a935f0acc767ccc2b35e9ff226","observation_id":"3ab48af0-e95a-49cb-b69c-427e562d3d49","resolution":{"observed_at":"2026-08-07T13:58:42.913107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:37.917347Z","title":"Robust speech recognition via large-scale weak supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:37.917347Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:2ac72e26316b957e26db388f7cc367ba807691ae6f2b5ca20914b02c8c2d1916","observation_id":"39fb60f9-26e2-4a09-8881-264595132dd8","resolution":{"observed_at":"2026-08-07T13:58:37.917347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:41.876948Z","title":"Community-supported shared infrastructure in support of speech accessibility,","venue":null,"work_id":"ad4f9391-1b8f-4e73-8b95-d5ed49d07b95","year":2024},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:37.974990Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:b25e352ea614d1b62b391aaabcd927f649b491b81674238fd02d7e7c2ddf7887","observation_id":"20a0ec55-7ccf-4fed-a867-bdddf0573317","resolution":{"observed_at":"2026-08-07T13:58:41.935950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:42.463540Z","title":"Improving domain generalization in speech emotion recognition with whisper,","venue":null,"work_id":"eba0b203-11f8-4e65-8e91-48ef1c4cb194","year":2024},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:37.522217Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:aae14d579b094e4e7b7b0ef0d833b741322c9896b9483a448b0fe7a2bedb65cc","observation_id":"4a5df618-7d47-4f7f-9fcc-4a9847e82add","resolution":{"observed_at":"2026-08-07T13:58:42.525659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:42.320027Z","title":"Trans- ferring speech-generic and depression-specific knowledge for alzheimer’s disease detection,","venue":null,"work_id":"d78c6397-d951-408c-a141-82a9696c7201","year":2023},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:37.576369Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:ef03b0d1771790765c96c338f89cfa59c68da58dff759f5f955960e31e7ce971","observation_id":"082a6d5a-bdb4-4ad2-a31b-34c262e0502d","resolution":{"observed_at":"2026-08-07T13:58:42.379795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:42.150143Z","title":"Automated speech analysis for risk detection of depression, anxiety, insomnia, and fatigue: Algorithm development and validation study,","venue":null,"work_id":"fd8bbdae-82b5-42a4-be7b-912c87aa3200","year":2024},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:37.695059Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:bf793619ee313c66572314c7feb42ed441fb942ecb02beecbcbec56abd19264c","observation_id":"8dedef92-abff-4ff7-9286-1a3ea4ad7bcc","resolution":{"observed_at":"2026-08-07T13:58:42.218147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:37.759356Z","title":"To- wards inclusive automatic speech recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:37.759356Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:b08f98cfeb05c7885cce610173a566dc48066ac731a23c14924fb13e0a0b1a0d","observation_id":"c8f51eef-a3a4-417b-bf2a-948aac0ad2cb","resolution":{"observed_at":"2026-08-07T13:58:37.759356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:41.998099Z","title":"Disordered speech data collection: Lessons learned at 1 million utterances from project euphonia","venue":null,"work_id":"170002c7-c7e1-4780-99e0-36ff3d3b2ac8","year":2021},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:37.843403Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:b0699574aaf73bc312a9dc02574a181a946ef4ba8fbf528df6d70745b1e5771d","observation_id":"3549fa43-c635-492f-a681-20d0b89989b3","resolution":{"observed_at":"2026-08-07T13:58:42.055757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:43.945213Z","title":"Thus, we now explore various model merging approaches to enhance Whisper","venue":null,"work_id":"9b8cc093-dee7-44e6-a050-1f4774e9d3f4","year":null},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:36.717299Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:77b27a1a69d5ad43bf911647b49689e24f2655269d946533089b04d23c082537","observation_id":"a32b1857-fffa-4ec6-9ccf-913267e79696","resolution":{"observed_at":"2026-08-07T13:58:44.052819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:41.019159Z","title":"Diverse weight averaging for out-of- distribution generalization,","venue":null,"work_id":"94e4078b-b475-4bfd-9acc-942786341ed0","year":2022},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:38.493252Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:a2d139864f4ebbfd3070759a64df56467f9bdb7621ed6b6037c4818c0aad2695","observation_id":"f914957f-384a-484d-94ef-228ecfa66489","resolution":{"observed_at":"2026-08-07T13:58:41.066050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:41.752791Z","title":"Investigating self- supervised pretraining frameworks for pathological speech recog- nition,","venue":null,"work_id":"d75a3fa3-5155-40fe-b52a-750b1ad6839e","year":2022},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:38.079429Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:4a7cec710d4b9b70c51356179937a15bc4c5e4b537f9e9c94580259f7c9539dd","observation_id":"316514ea-6a16-4833-b552-1d197e604fe3","resolution":{"observed_at":"2026-08-07T13:58:41.813776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:41.599976Z","title":"Training data augmentation for dysarthric automatic speech recognition by text- to-dysarthric-speech synthesis,","venue":null,"work_id":"97bcb5a1-1d18-48df-87ff-4d81e6d21846","year":2024},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:38.139593Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:6a6cec15e816348dfb00e5429965d6007df14dfe82e4c36ec9ae2859654c455e","observation_id":"ae5ecf29-93e1-4713-9058-0e10f8adb8cb","resolution":{"observed_at":"2026-08-07T13:58:41.664938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:41.481293Z","title":"Fine-tuning strategies for dutch dysarthric speech recog- nition: Evaluating the impact of healthy, disease-specific, and speaker-specific data,","venue":null,"work_id":"3e1b9248-a20f-4872-a19c-075f457f75b1","year":2024},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:38.245518Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:36e85514161ac49851135d9ffba0aab36a84572f43737bc1ca00332a4b626a29","observation_id":"21cf4fe9-946c-4846-b966-0bc9ab268720","resolution":{"observed_at":"2026-08-07T13:58:41.519735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:41.377272Z","title":"Averaging weights leads to wider optima and better generaliza- tion,","venue":null,"work_id":"29cc47f0-7c6a-4bb9-bff7-d15c3b6140a6","year":2018},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:38.321252Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:63692a5943c1797520e523560b9e7e19fa571ff524c395f6df1847628eb28af3","observation_id":"a7d2189e-6303-4696-9da0-2b533972ff46","resolution":{"observed_at":"2026-08-07T13:58:41.417391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:41.253028Z","title":"Model soups: averaging weights of multi- ple fine-tuned models improves accuracy without increasing in- ference time,","venue":null,"work_id":"a6954fb9-b290-447d-9af1-4cb6ebe68793","year":2022},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:38.370206Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:29e7ab67f947f2cf2620836fc2ee2773eac5577da9c54bd07432e36659dfd769","observation_id":"6697eb9e-7655-4aa1-94fb-c0b1f67f9d1c","resolution":{"observed_at":"2026-08-07T13:58:41.314620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:43.782741Z","title":"Formally, we denote by θ0,","venue":null,"work_id":"56605f83-8a42-4cc4-9aa8-e779f06065dd","year":null},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:36.820148Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:4f1273804a0ca5ef1759f99993a3f4069e0bc8d9f5d818cff6cdab5a4b595d6b","observation_id":"ccd85e6d-a933-46ef-a96c-349166498234","resolution":{"observed_at":"2026-08-07T13:58:43.872697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:41.136887Z","title":"Robust fine-tuning of zero-shot models,","venue":null,"work_id":"cad996c9-db03-4334-8f83-bfe1c75ab6bd","year":2022},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:38.451492Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:b18eb7268dd739225c25819e8028315d2a8990fba0ce3246caf7a83995691509","observation_id":"7388b8d9-45eb-44cf-abf3-51e8de034a20","resolution":{"observed_at":"2026-08-07T13:58:41.194739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:40.886214Z","title":"Learning and trans- ferring mid-level image representations using convolutional neu- ral networks,","venue":null,"work_id":"1f94f04d-54dd-430a-8273-d35cbaeac642","year":2014},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:38.570910Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:984e2bf3292b53a3411d04716b1865bd670ae2105221cc10b4d96478e5c35ae1","observation_id":"d9e4af42-5814-4392-9277-64ca6392fc38","resolution":{"observed_at":"2026-08-07T13:58:40.943665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08468","last_updated":"2025-01-14T22:27:48Z","snapshot_observed_at":"2026-07-06T20:21:09.148018Z","submitted_at":"2025-01-14T22:27:48Z","title":"Selective Attention Merging for low resource tasks: A case study of Child ASR","version":1},"cited_work":{"arxiv_id":"2501.08468","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.08468","snapshot_observed_at":"2026-08-07T13:58:39.737897Z","title":"Selective Attention Merging for low resource tasks: A case study of Child ASR","venue":"cs.CL","work_id":"90369fdc-2a1a-4f20-ae88-9910420e8819","year":2025},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:38.663685Z"},"links":{"cited_paper":"/paper/2501.08468","citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:a8f23ead5be9894b43377ba310b5079bdbbde868ca1733f03068b4387a2cda70","observation_id":"044900b1-b444-4a00-82d4-efa4f58ba43f","resolution":{"observed_at":"2026-08-07T13:58:39.789031Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09675","last_updated":"2020-02-24T18:59:28Z","snapshot_observed_at":"2026-07-29T15:42:51.774083Z","submitted_at":"2019-04-21T23:08:53Z","title":"BERTScore: Evaluating Text Generation with BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09675","snapshot_observed_at":"2026-08-07T13:58:38.742997Z","title":"Bertscore: Evaluating text generation with bert,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:38.742997Z"},"links":{"cited_paper":"/paper/1904.09675","citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:4d510963dd2efdb2c3dcb6be34dbf280f10275788794d06155fce133e3df9875","observation_id":"32570c40-316a-42a7-8510-420e90eb36cf","resolution":{"observed_at":"2026-08-07T13:58:38.742997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07316","last_updated":"2023-12-26T04:11:04Z","snapshot_observed_at":"2026-07-06T13:42:01.051477Z","submitted_at":"2022-08-15T16:30:14Z","title":"MENLI: Robust Evaluation Metrics from Natural Language Inference","version":5},"cited_work":{"arxiv_id":"2208.07316","doi":null,"metadata_source":"pith","pith_arxiv_id":"2208.07316","snapshot_observed_at":"2026-08-07T13:58:39.557255Z","title":"MENLI: Robust Evaluation Metrics from Natural Language Inference","venue":"cs.CL","work_id":"cb60c609-469d-4723-b835-dee1bdcecc51","year":2022},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:38.816627Z"},"links":{"cited_paper":"/paper/2208.07316","citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:7f5fb6801cfd515807e10e0f2ecd7df54e556f65850d0a36c84134cf9b899ec8","observation_id":"48751630-1b99-4aa2-b8b2-d8884e2d7c98","resolution":{"observed_at":"2026-08-07T13:58:39.621087Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:40.743780Z","title":"Rewarded soups: towards pareto- optimal alignment by interpolating weights fine-tuned on diverse rewards,","venue":null,"work_id":"1c1a9d7b-2f6d-4766-8d26-e9591bb46bff","year":2024},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:38.919290Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:5ca0d5e0ccdd21de9e43e7c0f7dea71a0e4dbcbf1b18d4d37bf4de332f0ae5d9","observation_id":"dece3421-27a0-4901-885d-861f27f79ab0","resolution":{"observed_at":"2026-08-07T13:58:40.811493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:40.608218Z","title":"Robust speech recognition via large-scale weak su- pervision,","venue":null,"work_id":"b70af9c3-1214-4b72-b7ba-ac24e387139f","year":2022},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:39.010318Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:6dff1b09ada2253421102fbb9163c944c4fc9a93df32a84acbb76051ef00fa4f","observation_id":"25949168-de5b-4f7b-881b-239fe20cfa5e","resolution":{"observed_at":"2026-08-07T13:58:40.664162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:40.482576Z","title":"Transform- ers: State-of-the-art natural language processing,","venue":null,"work_id":"2a0ac1fe-8c27-44cf-be28-0b57dfc97041","year":2020},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:39.100530Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:95ec8d2ccdf3aee754391039dd488bd87279e929992047db924d7866cf8e47aa","observation_id":"3605959a-d8da-46f0-a06a-91f207a4cfe3","resolution":{"observed_at":"2026-08-07T13:58:40.533854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:40.366020Z","title":"Specaugment on large scale datasets,","venue":null,"work_id":"d140a6bc-9234-4eea-a8b7-b5c0991b268e","year":2020},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:39.148366Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:084b39c2da95f3c9925cfaba3032e02f581f39750ed36afa4f4ec0817b39af47","observation_id":"d1915e1b-4e45-4c48-b092-df32f1ea8b83","resolution":{"observed_at":"2026-08-07T13:58:40.408297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:40.192112Z","title":"Linear mode connectivity and the lottery ticket hypothesis,","venue":null,"work_id":"bec4717f-8b9a-4ff7-a43a-b0880d4903b5","year":2020},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:39.230783Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:32789fd2a73a54391254d74e49dd214d7f81eeeb52698865d7dc9fbf954e7e12","observation_id":"feffd138-e991-4ac4-b5d2-65c66bae5469","resolution":{"observed_at":"2026-08-07T13:58:40.295870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.06296","last_updated":"2022-07-05T11:40:49Z","snapshot_observed_at":"2026-08-06T06:25:19.456607Z","submitted_at":"2021-10-12T19:28:48Z","title":"The Role of Permutation Invariance in Linear Mode Connectivity of Neural Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.06296","snapshot_observed_at":"2026-08-07T13:58:39.275719Z","title":"The role of permutation invariance in linear mode connectivity of neural networks,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:39.275719Z"},"links":{"cited_paper":"/paper/2110.06296","citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:a455ac559a6b9eb2ba32547a0d14f47aff4f505b43f8e094b7f6f345e308c4bc","observation_id":"87b304ce-43b7-41b0-adc3-bca2fa89fdeb","resolution":{"observed_at":"2026-08-07T13:58:39.275719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03617","last_updated":"2024-10-04T17:17:19Z","snapshot_observed_at":"2026-07-06T19:27:52.298292Z","submitted_at":"2024-10-04T17:17:19Z","title":"What Matters for Model Merging at Scale?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03617","snapshot_observed_at":"2026-08-07T13:58:39.345675Z","title":"What matters for model merging at scale?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:39.345675Z"},"links":{"cited_paper":"/paper/2410.03617","citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:86817214eb230adc901568e9a180c99dce61da897316c1c0baa10cf9140ebe56","observation_id":"2fa57d73-72ca-406a-b633-d38e7d24b9b8","resolution":{"observed_at":"2026-08-07T13:58:39.345675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:58:40.066944Z","title":"Arcee’s MergeKit: A toolkit for merging large language mod- els,","venue":null,"work_id":"4349bf52-4d45-40b2-b96f-f43c18adc472","year":2024},"citing_paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T13:58:39.430678Z"},"links":{"citing_paper":"/paper/2505.20477"},"observation_digest":"sha256:61b584419f370a86a98f53e1dd3c7a54eaca773a1ba53badf41fbfa1f1c323ec","observation_id":"4f6bd1dc-eda1-47ee-8725-ee4b19342d2e","resolution":{"observed_at":"2026-08-07T13:58:40.116603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.20477","last_updated":"2025-05-26T19:21:42Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-07T13:51:45.164647Z","submitted_at":"2025-05-26T19:21:42Z","title":"Robust fine-tuning of speech recognition models via model merging: application to disordered speech"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":3,"verified_fuzzy":27},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 1 inbound Pith citation observation for arXiv:2505.20477."}