{"as_of":"2026-08-07T06:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:664b590ea928e6e41196f8a6ddd90763a5cb6c198e810ec4090a2f74f730a87c","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T01:05:46.447560Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T01:05:43.913842Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T01:05:46.601121Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"cited_work":{"arxiv_id":"2508.10009","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10009","snapshot_observed_at":"2026-08-06T01:05:46.601121Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","venue":"cs.CL","work_id":"9135e8a7-caac-45ee-a4bd-79d8430a1be0","year":2025},"citing_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T01:05:43.913842Z"},"links":{"cited_paper":"/paper/2508.10009","citing_paper":"/paper/2508.10009"},"observation_digest":"sha256:bcbfd64ddad60c5ba4094f44b91b90de144a72fbe9ba54834675db785b9aed9b","observation_id":"586c0fd9-9f91-47e6-b24d-e0a6ec76ebec","resolution":{"observed_at":"2026-08-06T01:05:46.690100Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.10009/citation-record","integrity":"/paper/2508.10009/integrity","json":"/paper/2508.10009/citation-record.json","paper":"/paper/2508.10009"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"cited_work":{"arxiv_id":"2508.10009","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.10009","snapshot_observed_at":"2026-08-06T01:05:46.601121Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","venue":"cs.CL","work_id":"9135e8a7-caac-45ee-a4bd-79d8430a1be0","year":2025},"citing_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T01:05:43.913842Z"},"links":{"cited_paper":"/paper/2508.10009","citing_paper":"/paper/2508.10009"},"observation_digest":"sha256:bcbfd64ddad60c5ba4094f44b91b90de144a72fbe9ba54834675db785b9aed9b","observation_id":"586c0fd9-9f91-47e6-b24d-e0a6ec76ebec","resolution":{"observed_at":"2026-08-06T01:05:46.690100Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:05:50.363980Z","title":"Further details are presented in the following subsections","venue":null,"work_id":"a69746be-20c0-4230-a2c3-6df1d36b08f5","year":null},"citing_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T01:05:43.958842Z"},"links":{"citing_paper":"/paper/2508.10009"},"observation_digest":"sha256:fc6a29b0df2d2ae2dc4b41c398a8c7101a0d5b93c6336580e4a123eebc9209ff","observation_id":"fbb2e7e8-46e7-41d7-b8d2-f8a1c289cea2","resolution":{"observed_at":"2026-08-06T01:05:50.422775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:05:50.238410Z","title":"Datasets 3.1.1","venue":null,"work_id":"731f3427-3851-4b83-8ad3-1ea514fa81c9","year":null},"citing_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T01:05:44.019470Z"},"links":{"citing_paper":"/paper/2508.10009"},"observation_digest":"sha256:4a8626b6e4810a2e30a3a55f2eb3c80a2c7fa5016fe73bdfa78172d1500a275d","observation_id":"e6ec2d64-78eb-446e-a424-3b027d711362","resolution":{"observed_at":"2026-08-06T01:05:50.305824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:05:49.946843Z","title":"Decoder S-MoE To validate the effectiveness of S-MoE applied to the decoder blocks, we conducted experiments on two tasks: Korean-to- English (ko2en) ST and Korean ASR (ko-ASR)","venue":null,"work_id":"edfbb1db-54c7-4a08-9b63-34cb297f5a05","year":null},"citing_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T01:05:44.179893Z"},"links":{"citing_paper":"/paper/2508.10009"},"observation_digest":"sha256:130a2dd3bf836c4ae2130361cdd0fced01be53aa389e34e7f3327229ca4eecc1","observation_id":"0aeff68f-136c-4610-8c23-4e739c4276f6","resolution":{"observed_at":"2026-08-06T01:05:50.012876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:05:49.589231Z","title":"By us- ing guiding tokens instead of dynamic gating functions, S-MoE ensures efficient training and inference while improving per- formance across various tasks","venue":null,"work_id":"e89906b2-e7aa-4cd8-a5f2-26c24d58a9a7","year":null},"citing_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T01:05:44.304450Z"},"links":{"citing_paper":"/paper/2508.10009"},"observation_digest":"sha256:a029633ccdc46463834eb2d99b2145a0468e164031bd61df33cf739ed4712363","observation_id":"8aa07d1d-aefc-43ca-bda8-c453b431af92","resolution":{"observed_at":"2026-08-06T01:05:49.696543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:05:49.271138Z","title":"Sources of degradation of speech recognition in the telephone network,","venue":null,"work_id":"7258e59f-e74c-4680-a010-cf3adc6a76b2","year":1994},"citing_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T01:05:44.870745Z"},"links":{"citing_paper":"/paper/2508.10009"},"observation_digest":"sha256:bd188861c6529078bb3f9d533aef11623cdaeed9b5d077aece7ded281631829c","observation_id":"d9e30dc1-fdae-407f-aa2d-6e8400a5ed5a","resolution":{"observed_at":"2026-08-06T01:05:49.372762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:05:49.140370Z","title":"Training wideband acoustic mod- els using mixed-bandwidth training data for speech recognition,","venue":null,"work_id":"e57bbf2a-9f1d-4d6f-9c43-2895d81c6498","year":2006},"citing_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T01:05:44.974020Z"},"links":{"citing_paper":"/paper/2508.10009"},"observation_digest":"sha256:b2b1f6150b112b06988de9ce598b50f850c043d6df55ef79c447781bd0f2eb57","observation_id":"52a8f881-d60d-4db8-ad6b-d52e9d955011","resolution":{"observed_at":"2026-08-06T01:05:49.194971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.09796","last_updated":"2020-09-10T19:31:04Z","snapshot_observed_at":"2026-07-06T09:57:23.086479Z","submitted_at":"2020-09-10T19:31:04Z","title":"Multi-Task Learning with Deep Neural Networks: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.09796","snapshot_observed_at":"2026-08-06T01:05:44.392830Z","title":"Multi-task learning with deep neural networks: A survey,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T01:05:44.392830Z"},"links":{"cited_paper":"/paper/2009.09796","citing_paper":"/paper/2508.10009"},"observation_digest":"sha256:c87cbaec2ab21ae0d26c945b97fe1652416a18b95af3b63294a1cfef6c41d089","observation_id":"ad7de39c-ef70-43ce-85c2-34c2e3cdf340","resolution":{"observed_at":"2026-08-06T01:05:44.392830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05098","last_updated":"2017-06-15T21:38:12Z","snapshot_observed_at":"2026-08-04T14:30:44.904839Z","submitted_at":"2017-06-15T21:38:12Z","title":"An Overview of Multi-Task Learning in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05098","snapshot_observed_at":"2026-08-06T01:05:44.487656Z","title":"An overview of multi-task learning in deep neural net- works,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T01:05:44.487656Z"},"links":{"cited_paper":"/paper/1706.05098","citing_paper":"/paper/2508.10009"},"observation_digest":"sha256:4c417373b7e608f2935c9a8bc6b7989a9391a739214e737e0a860b3477668772","observation_id":"8b4dfa92-13ca-4b43-b161-c2d33b5e5357","resolution":{"observed_at":"2026-08-06T01:05:44.487656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:05:49.445786Z","title":"A survey on multi-task learning ieee transactions on knowledge and data engineering,","venue":null,"work_id":"02802804-b2a3-4431-b20e-84709a1ee8ef","year":2021},"citing_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T01:05:44.579694Z"},"links":{"citing_paper":"/paper/2508.10009"},"observation_digest":"sha256:5d6c453d908ca66a89b4cf289cfa46ce334c7ae82817e5035e250ade48eea7c8","observation_id":"3df0ff5c-f5c7-4ec8-9e47-2ad73d12ec50","resolution":{"observed_at":"2026-08-06T01:05:49.508010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.07689","last_updated":"2022-04-16T00:56:12Z","snapshot_observed_at":"2026-08-06T20:30:25.020976Z","submitted_at":"2022-04-16T00:56:12Z","title":"Sparsely Activated Mixture-of-Experts are Robust Multi-Task Learners","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.07689","snapshot_observed_at":"2026-08-06T01:05:44.679323Z","title":"Sparsely activated mixture-of-experts are robust multi-task learners,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T01:05:44.679323Z"},"links":{"cited_paper":"/paper/2204.07689","citing_paper":"/paper/2508.10009"},"observation_digest":"sha256:f10ac6b4799ad6ea3c7adba3f918045a9ed697287db8aee6a99aa90d019eb14d","observation_id":"13ecb848-b814-4af7-853b-f9a0e5895d14","resolution":{"observed_at":"2026-08-06T01:05:44.679323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.06538","last_updated":"2017-01-23T18:10:00Z","snapshot_observed_at":"2026-07-06T05:27:13.416519Z","submitted_at":"2017-01-23T18:10:00Z","title":"Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.06538","snapshot_observed_at":"2026-08-06T01:05:44.775645Z","title":"Outrageously large neural networks: The sparsely-gated mixture-of-experts layer,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T01:05:44.775645Z"},"links":{"cited_paper":"/paper/1701.06538","citing_paper":"/paper/2508.10009"},"observation_digest":"sha256:74f33da68abf856a6934462921fc2d6f246fe1dd5cc26a58f1807fa70073dbed","observation_id":"b14f26aa-863c-4f9f-8fb7-d577a9f976d5","resolution":{"observed_at":"2026-08-06T01:05:44.775645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:05:47.948496Z","title":"[Online]","venue":null,"work_id":"a8f7a88b-d274-4100-a97d-bc8559e93aae","year":2020},"citing_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T01:05:45.460528Z"},"links":{"citing_paper":"/paper/2508.10009"},"observation_digest":"sha256:43c54d80e1b974a046d59c8b2c2552a3d45cef29c7c00444ebfe3ef0d7aca44c","observation_id":"acd40c53-6442-45f1-b63d-2d5296943386","resolution":{"observed_at":"2026-08-06T01:05:48.012664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:05:47.778205Z","title":"[Online]","venue":null,"work_id":"f436f8d3-89cf-4582-bc19-58d06cd278eb","year":2022},"citing_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T01:05:45.556818Z"},"links":{"citing_paper":"/paper/2508.10009"},"observation_digest":"sha256:052da603aaf15a4c1040710d2c312f9f68569fb4b0c5ff3c829f16fc91777bab","observation_id":"1ffa1fea-0693-407b-934a-1c9022565ecd","resolution":{"observed_at":"2026-08-06T01:05:47.877416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:05:48.974625Z","title":"[Online]","venue":null,"work_id":"25273d15-5a7b-42fe-a7bc-63888f0af054","year":2022},"citing_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T01:05:45.073418Z"},"links":{"citing_paper":"/paper/2508.10009"},"observation_digest":"sha256:9a451ddf06ebc2b59c2a359247e0739cff8677af81fda1171a1eff6b0aaf716d","observation_id":"eaeb04fd-c4b1-4509-9e5f-27669a752e2d","resolution":{"observed_at":"2026-08-06T01:05:49.060196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:05:48.757364Z","title":"[Online]","venue":null,"work_id":"c98c873b-665e-44c0-a686-021e72a894eb","year":2021},"citing_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T01:05:45.170383Z"},"links":{"citing_paper":"/paper/2508.10009"},"observation_digest":"sha256:6b3e5026b97b0943bd21659edb07669484baba81fc8e552b61d4eb551685576d","observation_id":"bed821b7-7dc2-48d8-8567-32de69b8f85a","resolution":{"observed_at":"2026-08-06T01:05:48.848835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:05:48.518044Z","title":"[Online]","venue":null,"work_id":"4a1520de-e4d7-4ede-89b9-16ee2da0da01","year":2018},"citing_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T01:05:45.264475Z"},"links":{"citing_paper":"/paper/2508.10009"},"observation_digest":"sha256:ee7ce2b11514c9e643a439eaed5903a0a0e3303c7cf233576ed6816a0c1866b2","observation_id":"f46f5ba2-6f3d-4384-b665-a628fc6e8ef8","resolution":{"observed_at":"2026-08-06T01:05:48.642320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:05:48.304732Z","title":"[Online]","venue":null,"work_id":"4c23a9f6-00a7-4ed7-be3e-17a9fe45980a","year":2021},"citing_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T01:05:45.321574Z"},"links":{"citing_paper":"/paper/2508.10009"},"observation_digest":"sha256:7beccaa9af5210a0a981e184e41b4b6101667be9dcb0bbbb3987c455e771a3e6","observation_id":"d5367c58-a785-4998-84df-386c5f577384","resolution":{"observed_at":"2026-08-06T01:05:48.440198Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:05:48.062483Z","title":"[Online]","venue":null,"work_id":"e096be50-f116-40f0-aada-0476fcf338c0","year":2022},"citing_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T01:05:45.394744Z"},"links":{"citing_paper":"/paper/2508.10009"},"observation_digest":"sha256:cf94a5c64d7ba98c24f9851b8be3691de7d66144c73017376fffed7e80595374","observation_id":"db6ba20b-e15a-44fb-8a18-ec018b8b582e","resolution":{"observed_at":"2026-08-06T01:05:48.164816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:05:46.944251Z","title":"Pulse code modulation (pcm) of voice fre- quencies,","venue":null,"work_id":"be243061-2235-4d22-8619-e3b38370decf","year":1988},"citing_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T01:05:46.071817Z"},"links":{"citing_paper":"/paper/2508.10009"},"observation_digest":"sha256:26aa7acb2b09d4637ebb06cfbd0efcb6956c2c6649f2f5180d00ae7484664e56","observation_id":"072708d6-4e41-4654-a0ed-d3ab503c465a","resolution":{"observed_at":"2026-08-06T01:05:46.982149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:05:50.097219Z","title":"Our in-house test sets consist of 1,000 samples of male and female speech from daily conversations, with refer- ence translations curated by professional translators","venue":null,"work_id":"b464c3d1-db46-4410-969f-c0ea84be9b3e","year":2048},"citing_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T01:05:44.122596Z"},"links":{"citing_paper":"/paper/2508.10009"},"observation_digest":"sha256:9c39a1ff133f7edd5cf03e6b66dc2cae6dbb6ab103af7ce69cf9d767d4ba676f","observation_id":"33a791ee-bc8a-4d32-8f6d-292134b25192","resolution":{"observed_at":"2026-08-06T01:05:50.162275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:05:47.546438Z","title":"[Online]","venue":null,"work_id":"200ee500-2b10-4ca3-ac97-142d7dd5123a","year":2022},"citing_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T01:05:45.618663Z"},"links":{"citing_paper":"/paper/2508.10009"},"observation_digest":"sha256:0ad64b06a73dda5855bc2e04c94f0bc0ff691d9bb78209cf849b44d1a202cab4","observation_id":"aa6474cd-aa62-4796-975f-820f642c40e4","resolution":{"observed_at":"2026-08-06T01:05:47.654187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:05:47.391104Z","title":"[Online]","venue":null,"work_id":"0c77fc28-fbe4-4050-9a23-abbfef53948a","year":2021},"citing_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T01:05:45.683072Z"},"links":{"citing_paper":"/paper/2508.10009"},"observation_digest":"sha256:a490ddc351903ccab7b4fde135d86272c01541d3b9fb37f2bf6455aa2872fa6f","observation_id":"a1f6a03c-ea88-490c-be24-e1e607f20541","resolution":{"observed_at":"2026-08-06T01:05:47.474698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:05:49.781782Z","title":"Whisper is a widely used mul- tilingual speech model trained with diverse language pairs","venue":null,"work_id":"7842dfd8-8dc9-4574-a468-59bd0a51509d","year":null},"citing_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T01:05:44.239321Z"},"links":{"citing_paper":"/paper/2508.10009"},"observation_digest":"sha256:c96ce3ff1827bcb35903632a29be40b2b8bbb4745e25fe1a7048e947f117766e","observation_id":"38a3220f-17f0-4c27-8d6f-3a9caec67139","resolution":{"observed_at":"2026-08-06T01:05:49.880492Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:05:47.198996Z","title":"[Online]","venue":null,"work_id":"2446631d-1459-4344-8b40-4d6b85b1735c","year":2021},"citing_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T01:05:45.783547Z"},"links":{"citing_paper":"/paper/2508.10009"},"observation_digest":"sha256:93cb93ebe619ea4a1176e6314713ea7bbb96813f482e00ac9066d598d44bab67","observation_id":"49206302-ec76-4c0c-8fc2-e0053d1bb54b","resolution":{"observed_at":"2026-08-06T01:05:47.280919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:05:47.067287Z","title":"[Online]","venue":null,"work_id":"9c4375f1-b783-46b7-8a2a-20e39da04106","year":2022},"citing_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T01:05:45.863666Z"},"links":{"citing_paper":"/paper/2508.10009"},"observation_digest":"sha256:86b2df0d74be8cef2722eeac65264d310b66dbf3d463bb80fcbfc4bb0fef9cfc","observation_id":"c4cad7bc-fb68-44ec-99b9-fde756a834a2","resolution":{"observed_at":"2026-08-06T01:05:47.116778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:05:45.952971Z","title":"The adaptive multirate wideband speech codec (amr-wb),","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T01:05:45.952971Z"},"links":{"citing_paper":"/paper/2508.10009"},"observation_digest":"sha256:423d29929945bf8fdc3aef5e9de5ca0b53505665a3f66c0c76dbe9501b12e53b","observation_id":"e2fefd12-a43e-47c1-9e49-927204004dd2","resolution":{"observed_at":"2026-08-06T01:05:45.952971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:05:46.175496Z","title":"Fleurs: Few-shot learning evaluation of universal representations of speech,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T01:05:46.175496Z"},"links":{"citing_paper":"/paper/2508.10009"},"observation_digest":"sha256:9c45806a2c70de6f8293ef1e2ebddec38ec6fe6842fd89cbb6a9531107eff4a4","observation_id":"ad761f03-d506-4a96-bd8f-686fc5e454ef","resolution":{"observed_at":"2026-08-06T01:05:46.175496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:05:46.789354Z","title":"Attention is all you need,","venue":null,"work_id":"1f3d24f6-c76b-486f-a973-bb7aa3188ec5","year":2017},"citing_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T01:05:46.281915Z"},"links":{"citing_paper":"/paper/2508.10009"},"observation_digest":"sha256:3fe7fd2548bf164791b91a2967d9db2cba3e1b8bc390396aecbd2af1972545e2","observation_id":"29b34952-b47b-4dee-9584-9a971a3bf21d","resolution":{"observed_at":"2026-08-06T01:05:46.876936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:05:46.369512Z","title":"Bleu: a method for automatic evaluation of machine translation,","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T01:05:46.369512Z"},"links":{"citing_paper":"/paper/2508.10009"},"observation_digest":"sha256:c8f730464d02b60c4f941409653d913ba4ef145d6572689e4db2b5f9e87c1f97","observation_id":"bd80abc3-b9aa-49ce-9548-76222386d705","resolution":{"observed_at":"2026-08-06T01:05:46.369512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:05:46.447560Z","title":"Robust speech recognition via large-scale weak supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T01:05:46.447560Z"},"links":{"citing_paper":"/paper/2508.10009"},"observation_digest":"sha256:01fbd51c5e6b4aa6a296eada34c7ee3158d0cdc89d04cd2bfb9225b5ade9f224","observation_id":"2be105f0-24c8-4d44-b516-90f8e82b548b","resolution":{"observed_at":"2026-08-06T01:05:46.447560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.10009","last_updated":"2025-08-05T23:56:11Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T01:05:43.555415Z","submitted_at":"2025-08-05T23:56:11Z","title":"Beyond Hard Sharing: Efficient Multi-Task Speech-to-Text Modeling with Supervised Mixture of Experts"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":8,"verified_exact":0,"verified_fuzzy":21},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 1 inbound Pith citation observation for arXiv:2508.10009."}