{"as_of":"2026-08-07T19:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d9ff411fc2245b6df7c557cb3d9e3cc938b5e8217b687dfecaa5072901d891b3","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:54:02.600982Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:53:56.912097Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T02:49:24.371678Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09448","snapshot_observed_at":"2026-08-07T04:53:56.912097Z","title":"These models are trained on mas- sive datasets, allowing them to generalize well across multiple domains and achieve high recognition accuracy","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:56.912097Z"},"links":{"cited_paper":"/paper/2506.09448","citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:623aa6e3c3166e4018eb74ac4ae95023caa045e9282e06aca0cc2c2cbe6f745d","observation_id":"59881a6c-55b3-489f-83f4-52933688c0a6","resolution":{"observed_at":"2026-08-07T04:53:56.912097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"cited_work":{"arxiv_id":"2506.09448","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.09448","snapshot_observed_at":"2026-07-04T02:49:24.371678Z","title":"Owsm- biasing: Contextualizing open whisper-style speech models for asr with dynamic vocabulary,","venue":null,"work_id":"af979b6e-b461-4776-be2d-bc0965ea07ba","year":2025},"citing_paper":{"arxiv_id":"2606.19157","last_updated":"2026-06-24T04:32:31Z","snapshot_observed_at":"2026-07-06T23:54:27.624372Z","submitted_at":"2026-06-17T14:59:37Z","title":"IndicContextEval: A Benchmark for Evaluating Context Utilisation in Audio Large Language Models Across 8 Indic Languages","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-26T19:14:26.452851Z"},"links":{"cited_paper":"/paper/2506.09448","citing_paper":"/paper/2606.19157"},"observation_digest":"sha256:a8c64b3bff7d697e71ac86fb6deb37667bd78c651c24f1011828f158425742ac","observation_id":"30b23701-2ee9-4692-bb78-16ef1438cc55","resolution":{"observed_at":"2026-07-04T02:49:24.373156Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.09448/citation-record","integrity":"/paper/2506.09448/integrity","json":"/paper/2506.09448/citation-record.json","paper":"/paper/2506.09448"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09448","snapshot_observed_at":"2026-08-07T04:53:56.912097Z","title":"These models are trained on mas- sive datasets, allowing them to generalize well across multiple domains and achieve high recognition accuracy","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:56.912097Z"},"links":{"cited_paper":"/paper/2506.09448","citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:623aa6e3c3166e4018eb74ac4ae95023caa045e9282e06aca0cc2c2cbe6f745d","observation_id":"59881a6c-55b3-489f-83f4-52933688c0a6","resolution":{"observed_at":"2026-08-07T04:53:56.912097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:12.897157Z","title":null,"venue":null,"work_id":"7b531dbe-898a-4fa1-9935-0d8d9617b87a","year":null},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:56.999349Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:64dcac068ae4f2d8b71c746bba065ffe15eab139b0c6c351e9ecdc4799b89184","observation_id":"ab025761-f535-4e25-930f-77b30ac6510c","resolution":{"observed_at":"2026-08-07T04:54:13.042152Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:12.609579Z","title":"all”, “ig","venue":null,"work_id":"2fe7d239-6f12-402e-b71a-592dc96cc475","year":null},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:57.117525Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:086d4568c33b9e9cdb6d46486d766788fe2cd20278fce2f4f6fac790d2e811a3","observation_id":"370cefc1-66d0-4671-8372-5328ff287ba1","resolution":{"observed_at":"2026-08-07T04:54:12.778202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:12.383419Z","title":"We train the embed- ding and output layers of OWSM with vocabulary sizeKof 5,000","venue":null,"work_id":"bbba05ec-251c-4234-a187-aff9f3d1d766","year":null},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:57.219539Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:14b5715b9cb2e00986ce3003391bfecbdc87e5d1113a4f84baade2c670080fce","observation_id":"a3d24052-a4c2-4205-9a00-a273612b572c","resolution":{"observed_at":"2026-08-07T04:54:12.463826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:12.234006Z","title":"the” and “and","venue":null,"work_id":"01f3075c-e621-444e-9cd2-9aaf2879f15b","year":2000},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:57.322370Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:f8d97f455232683fcdd5a7d9a57dabc8f1b5b00c381b1dee68c9e356417797ab","observation_id":"3a697e3a-9b89-44c3-a633-5fc9add54175","resolution":{"observed_at":"2026-08-07T04:54:12.309387Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:12.112181Z","title":null,"venue":null,"work_id":"52b184c9-e074-4796-aeb5-f700544526c0","year":null},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:57.433861Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:bc508b2d7790e212458ad3e521a670f460c7ec3ec88e1e054c2947dd57f422e2","observation_id":"f86f73b0-7092-45d9-b67f-f7f5cd637c26","resolution":{"observed_at":"2026-08-07T04:54:12.161965Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:11.952076Z","title":"Ro- bust speech recognition via large-scale weak supervision","venue":null,"work_id":"d3cb9cf3-7721-4fde-b3ec-7d71d6a852a4","year":2022},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:57.544368Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:288db6e14cfbeeed9a2f9d2c5426e42bf86d66f9b28f227d7a5a202714700f05","observation_id":"b957b6df-0b3a-4e35-8947-8d3e39650e26","resolution":{"observed_at":"2026-08-07T04:54:12.039913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:11.686678Z","title":"Repro- ducing Whisper-style training using an open-source toolkit and publicly available data,","venue":null,"work_id":"2dc17ad1-13f9-433c-a0d1-567a34dc28c2","year":2023},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:57.673027Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:ce810cbc206df8d59bf4e06fb64ab983520516e94f51bee1ce17f1e334df1c0e","observation_id":"235a55a1-b154-43cf-9697-fe726a6a0d7a","resolution":{"observed_at":"2026-08-07T04:54:11.812242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01037","last_updated":"2023-09-25T01:20:23Z","snapshot_observed_at":"2026-08-04T01:36:29.191456Z","submitted_at":"2023-03-02T07:47:18Z","title":"Google USM: Scaling Automatic Speech Recognition Beyond 100 Languages","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01037","snapshot_observed_at":"2026-08-07T04:53:57.801970Z","title":"Google USM: Scaling automatic speech recognition beyond 100 lan- guages,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:57.801970Z"},"links":{"cited_paper":"/paper/2303.01037","citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:87e03240b794f8d3f868abb3c8cc1522198f71a68d2250455d6b94b8e5cfec2c","observation_id":"4f187dca-064d-4cd8-ab66-bb2d60499661","resolution":{"observed_at":"2026-08-07T04:53:57.801970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:11.341576Z","title":"Scal- ing speech technology to 1,000+ languages,","venue":null,"work_id":"e879fd0b-5068-4a53-bf91-423b10aec960","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:57.953563Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:c148844b72035c45b367cda7fd17dd4639263b548998e94191d48575801dfc42","observation_id":"826a9a5a-a245-4b2f-92e7-ac1fa68efe40","resolution":{"observed_at":"2026-08-07T04:54:11.523089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:11.023844Z","title":"Less is more: Accurate speech recognition & translation without web-scale data,","venue":null,"work_id":"54baf682-8957-4175-9728-f8041c5a1ef1","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:58.111749Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:34a2bd4b0cc20bc201446f9f982b83e5f8eb3aed745900c88a3c26b209737dff","observation_id":"febaa2cc-4d75-417e-889f-2ff813c68001","resolution":{"observed_at":"2026-08-07T04:54:11.178196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:10.826185Z","title":"OWSM-CTC: An open encoder-only speech foundation model for speech recog- nition, translation, and language identification,","venue":null,"work_id":"69f139f6-e3ad-4841-ba2c-aa705bc1ef36","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:58.207904Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:74f679fa4352f4f7d99dac1cc296d4a1b3e6f0f9a83da8ddddf7292f7ce3db94","observation_id":"6f02bc4a-7529-44ea-86d5-32f0227246d8","resolution":{"observed_at":"2026-08-07T04:54:10.945478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:10.506890Z","title":"OWSM v3.1: Better and faster open Whisper-style speech models based on e- branchformer,","venue":null,"work_id":"46dbff61-91fe-48df-93d2-4d0903194342","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:58.261774Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:46b9297a95b8d5f42c0ad143c4d9895711a6f20e43c5437bce7a981a62bf57d3","observation_id":"ff1dc0f1-86b6-4acd-9290-ec937acad892","resolution":{"observed_at":"2026-08-07T04:54:10.671293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:10.234096Z","title":"CB-Whisper: Contex- tual biasing Whisper using open-vocabulary keyword-spotting,","venue":null,"work_id":"b8957a2d-1e42-4d33-9875-c98991a0b797","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:58.304434Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:81344ce2f78abc852c3ce59cdcfa5f27eef37f5d20ac9308f48ebe781b5c94e7","observation_id":"62cd81ba-b439-44bc-ab9a-d1ebe2345837","resolution":{"observed_at":"2026-08-07T04:54:10.364686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:09.986741Z","title":"Can contex- tual biasing remain effective with Whisper and GPT-2?","venue":null,"work_id":"c20de16a-33eb-449b-bff3-0b258215a929","year":2023},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:58.418507Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:6cc6e6b723f29dcce91cc24365b57d11159f035544aaec3bd9ac6b69e86ba638","observation_id":"843c8724-e1e8-4f57-bbae-ecc6ca9e3b9e","resolution":{"observed_at":"2026-08-07T04:54:10.084534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:09.704580Z","title":"Adding user feedback to enhance CB-Whisper,","venue":null,"work_id":"5bf78e13-b036-4c8b-ab3a-5e7e09aaf0b5","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:58.545879Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:c373e84a2ee2d414cf13b7a9248fb9d5fd5aa86503206e48901d2b544f60c13f","observation_id":"93f0d36d-402a-4e37-913e-6d13d6176877","resolution":{"observed_at":"2026-08-07T04:54:09.839604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:09.440212Z","title":"Contextual biasing to improve domain- specific custom vocabulary audio transcription without explicit fine-tuning of Whisper model,","venue":null,"work_id":"e9df056f-9673-40a0-9304-3517aef6aadd","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:58.696074Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:091e0900d3937428cf779c90d62075286834f042768a65fb6b00eef0b438260e","observation_id":"380983ad-aa40-40d7-bd5f-24398ac29a06","resolution":{"observed_at":"2026-08-07T04:54:09.587036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:09.185413Z","title":"A multitask train- ing approach to enhance Whisper with open-vocabulary keyword spotting,","venue":null,"work_id":"15b8de0b-87ce-4c35-a0bb-22f0311016db","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:58.811210Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:eb74187977a3e67a900b128939bb2153ac3195ed87a9e4c49bbf64291222baea","observation_id":"361d0375-8662-4284-a6b8-6da2f19ee3dc","resolution":{"observed_at":"2026-08-07T04:54:09.323740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07919","last_updated":"2023-12-21T10:20:42Z","snapshot_observed_at":"2026-08-07T10:17:55.688598Z","submitted_at":"2023-11-14T05:34:50Z","title":"Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07919","snapshot_observed_at":"2026-08-07T04:53:58.965895Z","title":"Qwen-audio: Advancing universal audio understanding via unified large-scale audio-language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:58.965895Z"},"links":{"cited_paper":"/paper/2311.07919","citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:52121174f1b680ec063d1a2b74587bd27adc393465dff9c7ad8dc5c9db27a9aa","observation_id":"dff02807-cf82-40a2-93cf-ae1d78d5bc25","resolution":{"observed_at":"2026-08-07T04:53:58.965895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:08.902177Z","title":"SALMONN: Towards generic hearing abilities for large language models,","venue":null,"work_id":"eae1cc0d-746a-4784-b629-889a1e11e3e0","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:59.096100Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:d0f51e18a02d26c9c0159120e31483955777d0c1729547705cce15b99af3ffe2","observation_id":"ee4f9c0d-aac5-4dab-be09-7221277096ac","resolution":{"observed_at":"2026-08-07T04:54:09.069261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08846","last_updated":"2024-02-13T23:25:04Z","snapshot_observed_at":"2026-08-06T09:11:01.697195Z","submitted_at":"2024-02-13T23:25:04Z","title":"An Embarrassingly Simple Approach for LLM with Strong ASR Capacity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08846","snapshot_observed_at":"2026-08-07T04:53:59.219105Z","title":"An embarrass- ingly simple approach for LLM with strong ASR capacity,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:59.219105Z"},"links":{"cited_paper":"/paper/2402.08846","citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:0e0801a5228c187d39d86d7eab4c431b3ed01b9275d197fa8eadf11524bad53a","observation_id":"56c9aa8c-2be0-4566-b5f8-4c3940d3a695","resolution":{"observed_at":"2026-08-07T04:53:59.219105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17485","last_updated":"2025-02-07T02:08:29Z","snapshot_observed_at":"2026-07-06T19:38:09.286994Z","submitted_at":"2024-10-23T00:36:06Z","title":"VoiceTextBlender: Augmenting Large Language Models with Speech Capabilities via Single-Stage Joint Speech-Text Supervised Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2410.17485","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.17485","snapshot_observed_at":"2026-08-07T04:54:03.021809Z","title":"VoiceTextBlender: Augmenting Large Language Models with Speech Capabilities via Single-Stage Joint Speech-Text Supervised Fine-Tuning","venue":"cs.CL","work_id":"11f3681f-c6d0-4e89-8de1-2e31b7d686ef","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:59.331661Z"},"links":{"cited_paper":"/paper/2410.17485","citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:5c8875cceb907320a497b6ad8190b7d5392ec678b9d5651e70a793675119611b","observation_id":"44cf86a3-558d-4733-aef5-f4892ad12fe8","resolution":{"observed_at":"2026-08-07T04:54:03.157702Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:08.651085Z","title":"Contextual biasing speech recognition in speech-enhanced large language model,","venue":null,"work_id":"21d938e9-6d97-46ff-9d0c-bc948fdd4c5a","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:59.442949Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:186000196b42c523be31d2643dfef2e3d0d60f068a2945118dcbb24d608e15b2","observation_id":"a7bc907d-74be-42b0-b516-e1d1c7ac1e93","resolution":{"observed_at":"2026-08-07T04:54:08.766360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10524","last_updated":"2025-01-07T05:15:54Z","snapshot_observed_at":"2026-07-06T16:20:29.025335Z","submitted_at":"2023-09-19T11:10:50Z","title":"Harnessing the Zero-Shot Power of Instruction-Tuned Large Language Model in End-to-End Speech Recognition","version":3},"cited_work":{"arxiv_id":"2309.10524","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.10524","snapshot_observed_at":"2026-08-07T04:54:02.780295Z","title":"Harnessing the Zero-Shot Power of Instruction-Tuned Large Language Model in End-to-End Speech Recognition","venue":"eess.AS","work_id":"5aadfc25-5109-4393-b3cd-ee19c7ebb72b","year":2023},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:59.566215Z"},"links":{"cited_paper":"/paper/2309.10524","citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:5cf63db303d415293038c6f8353c74433e10f9b5e0abf164d3a0f89d9eb1e3bf","observation_id":"df0ac8f8-8eb2-4b95-b881-1dfecf2c26bd","resolution":{"observed_at":"2026-08-07T04:54:02.883695Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:08.288947Z","title":"Deep context: End-to-end contextual speech recogni- tion,","venue":null,"work_id":"b8849b88-84d7-4b61-a545-b46f1f10f6ef","year":2018},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:59.721060Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:9ef58d7f2b8cc49ee39a52f2142d2bb4ec46d0ee0632a3bd5f90d549b8c92842","observation_id":"8b6031f6-cf8a-45cc-ad22-f8b11d582077","resolution":{"observed_at":"2026-08-07T04:54:08.477112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:08.019067Z","title":"Contextual RNN-T for open domain asr,","venue":null,"work_id":"bd8b8188-2d8b-4de4-8b42-0b1a9f19c71c","year":2020},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:59.870856Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:86ef4d4f8cac78966a15c825e573f74805b97ac32a0daec6877d40acfec82e2d","observation_id":"e94d55c1-8e35-49a9-8f1c-a62c3d694fd2","resolution":{"observed_at":"2026-08-07T04:54:08.161085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:07.791998Z","title":"Instant one-shot word-learning for context-specific neural sequence-to-sequence speech recognition,","venue":null,"work_id":"5dbd0fc2-682e-46d5-bc2d-13e8bc41df9d","year":2021},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:59.983951Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:ada05990aef6ca6949d3d8d96ffedc643a9abf8c0845f6c47d75eb30e700d03d","observation_id":"f026e41b-e611-4ccc-9daa-898825d39f90","resolution":{"observed_at":"2026-08-07T04:54:07.904348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:07.535492Z","title":"Retraining-free customized ASR for enharmonic words based on a named-entity-aware model and phoneme similarity estimation,","venue":null,"work_id":"076f5a96-0df2-418a-b03e-efe3d94a3a1a","year":2023},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:00.110123Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:4fd16f63c4669a1c398d6423142a8c359cc3f0fa951340a9dce4516beace8fec","observation_id":"79c5e661-87dc-4fd3-9dd0-1c01cddb1e0c","resolution":{"observed_at":"2026-08-07T04:54:07.689145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:07.277172Z","title":"Contex- tualized End-to-End Speech Recognition with Contextual Phrase Prediction Network,","venue":null,"work_id":"7f98073e-b1d5-41e2-ad77-2c49f7bba7fc","year":2023},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:00.189159Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:28487715e2e388dd10f13dfec4a78d10524b3b48ddd51cff4e66ed63758633f2","observation_id":"6fad5b74-ad37-4e31-8134-c10af9bf3c82","resolution":{"observed_at":"2026-08-07T04:54:07.397919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12839","last_updated":"2024-05-27T06:35:36Z","snapshot_observed_at":"2026-07-06T15:30:30.381545Z","submitted_at":"2023-05-22T09:03:11Z","title":"CopyNE: Better Contextual ASR by Copying Named Entities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.12839","snapshot_observed_at":"2026-08-07T04:54:00.318717Z","title":"Copyne: Better contextual asr by copying named entities,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:00.318717Z"},"links":{"cited_paper":"/paper/2305.12839","citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:95c0f1d8f14e8ffb7369856f9663cf690cc25fa3a8ddc90d3aad6a50663cbd17","observation_id":"a25e54b9-02b2-42c0-8376-dcdf0c7a252a","resolution":{"observed_at":"2026-08-07T04:54:00.318717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:06.996703Z","title":"Lib- rispeech: an ASR corpus based on public domain audio books,","venue":null,"work_id":"9d30f676-a10b-4cc4-b4e9-570b8699a326","year":2015},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:00.439366Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:cc58f21bd49f588dac3ffe1e1464ed631065be52a61952e311885fad66c8e385","observation_id":"6129b83c-cf28-481e-859c-77766f5690ab","resolution":{"observed_at":"2026-08-07T04:54:07.121938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:06.705572Z","title":"Contextualized end-to-end automatic speech recognition with intermediate bias- ing loss,","venue":null,"work_id":"4028aead-7551-44d6-93df-83dd45225cf5","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:00.566901Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:5670b8c6c8ca3d70abecbdb5fb8b2c07c74c1bde19ba5fbf2deb693c09d5e22c","observation_id":"fd400bce-61db-4a71-bea1-30b938aec5f9","resolution":{"observed_at":"2026-08-07T04:54:06.868816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:06.467435Z","title":"Corpus of spontaneous Japanese: Its design and evaluation,","venue":null,"work_id":"6584bd5c-8552-4330-8d80-659754478f5a","year":2003},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:00.677729Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:fa6b41de48578479be0b279da77933a5bcabfda4da01b5cf986649acf8cb38d7","observation_id":"9e5933a4-62e5-4efa-bf61-9bc2c3e9d4ca","resolution":{"observed_at":"2026-08-07T04:54:06.575918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:06.208420Z","title":"Phoneme-aware encoding for prefix-tree-based contextual ASR,","venue":null,"work_id":"72531891-1c1c-4d60-a9a0-e43f9e714275","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:00.835123Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:3966cc669da36248ea977a587d1f1939ecc4b475b5b54dd8735e1ee5923735e2","observation_id":"bc1cc5f7-7aaf-41d7-b84f-94305fcf2fc8","resolution":{"observed_at":"2026-08-07T04:54:06.328980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:05.937444Z","title":"Interbiasing: Boost unseen word recognition through biasing intermediate predictions,","venue":null,"work_id":"0b7c0b45-3c90-4081-a841-41a63b3a3eac","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:00.924739Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:769eea3eb53e901c3ce293ea18a7e52bfa1d87b9cd8b25db2eb9c90909c34585","observation_id":"67bf9620-fd0a-4c2b-af4d-f73a07c5b631","resolution":{"observed_at":"2026-08-07T04:54:06.033611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:05.660858Z","title":"PromptASR for contextualized ASR with controllable style,","venue":null,"work_id":"ae16db88-468b-4955-bde5-ef7d41f313d5","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:01.044115Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:fa4fd04fde168db4619f32d6e79acd20d26d6b8b8ba66f4c3059baaf43489d23","observation_id":"187c9787-d8a7-4b87-aa0e-9b54b00c8276","resolution":{"observed_at":"2026-08-07T04:54:05.777584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:05.362122Z","title":"Contextualized automatic speech recognition with attention- based bias phrase boosted beam search,","venue":null,"work_id":"6be48c2b-7f9e-4c78-bce7-58cc9f44edf8","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:01.159181Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:5e789cd5de57d5216d4ea8ac4bf6fa81f7de19536f13d2577c63f87448dcabb2","observation_id":"13922ba9-ed43-418a-8f7b-85dbc1098280","resolution":{"observed_at":"2026-08-07T04:54:05.524736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:05.118839Z","title":"Improving large-scale deep biasing with phoneme features and text-only data in streaming transducer,","venue":null,"work_id":"8f5d27bc-1340-446a-8dc8-77c009d9b905","year":2023},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:01.251377Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:cca99daecb6a277eedccaffc5f5bb2b4a9d87b41c5421132d221d07684f7d427","observation_id":"9127bea1-2010-45b8-9a09-a9546f3f13bb","resolution":{"observed_at":"2026-08-07T04:54:05.220461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:04.883374Z","title":"Contextualized streaming end-to-end speech recognition with trie-based deep biasing and shallow fusion,","venue":null,"work_id":"5cbdba8c-2595-4260-951b-9e2d7a928e37","year":2021},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:01.398030Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:9d416cb887d5eddf4f76f4d59c844dd3b46d4642de9438ff91912e5641fe5666","observation_id":"5b540885-d7e6-47a5-88a0-ab7c183e5c66","resolution":{"observed_at":"2026-08-07T04:54:04.996151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:04.609073Z","title":"Contextualized automatic speech recognition with dynamic vo- cabulary,","venue":null,"work_id":"d67c8d64-90f9-4d1e-9278-7ec35e45e251","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:01.600693Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:7a8ca61972e27952b07804ed11a57c748e497ead1549c3c4981ee8111a2a4f3e","observation_id":"58b4ed50-3064-4d4b-8f8e-902c41579286","resolution":{"observed_at":"2026-08-07T04:54:04.694432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:01.741283Z","title":"Hy- brid ctc/attention architecture for end-to-end speech recognition,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:01.741283Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:6f7e6b477b0415703f25303e362afbcd8b9ea609f0f74cd4c9d3138bc5fa5099","observation_id":"9256327f-826d-476e-94b3-f7c4eedec0c9","resolution":{"observed_at":"2026-08-07T04:54:01.741283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:04.326476Z","title":"Time- synchronous one-pass beam search for parallel online and offline transducers with dynamic block training,","venue":null,"work_id":"75c5be3d-f65f-44a3-b655-115a876f7d04","year":2023},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:01.877231Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:0b83b26e7c9d5af10446557791fa870ba256e7f98b34fdaed77aeb58d37abdd2","observation_id":"d013093b-5684-4afd-b11d-159cf326c5da","resolution":{"observed_at":"2026-08-07T04:54:04.448388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:04.044668Z","title":"Joint beam search integrating ctc, attention, and transducer decoders,","venue":null,"work_id":"3dd5129d-f115-447a-8030-475574c5d3ff","year":2025},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:02.007470Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:1b929d093aa55f157459e83b993991a700ab806448366c6e3d550210c4195124","observation_id":"af9f1496-d3b5-44dd-943e-f797cc60d2a4","resolution":{"observed_at":"2026-08-07T04:54:04.152176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:03.834072Z","title":"E-Branchformer: Branchformer with enhanced merging for speech recognition,","venue":null,"work_id":"a68c080c-bb5a-4105-91c7-eae866fa68bf","year":2023},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:02.141841Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:6296dadcb9534e5851fe82fa377c693dc0f2d8c99b8efd608d6e5083fbb73d34","observation_id":"cd5e6539-0cde-4a56-a05d-a37e60ffa3c0","resolution":{"observed_at":"2026-08-07T04:54:03.930476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:03.617497Z","title":"Attention is all you need,","venue":null,"work_id":"f13bc0c5-580f-4610-9c88-ba9a6bb26dfe","year":2017},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:02.297436Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:442af20733d76c8c4719cd4a76ee9437d1bf6502f7d2b4840e690c114db8f2e5","observation_id":"7e0949b4-2891-443d-9a4a-7c8a1e5c4c43","resolution":{"observed_at":"2026-08-07T04:54:03.710031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:02.462065Z","title":"Adam: A method for stochastic opti- mization,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:02.462065Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:599b82569cad417a1b17bef94da06d0cfff5d38a1645fb11f7ee3004be44959c","observation_id":"b281a407-237d-4dab-b7b8-218de9fb78e3","resolution":{"observed_at":"2026-08-07T04:54:02.462065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:03.361205Z","title":"ESPnet: End-to-end speech processing toolkit,","venue":null,"work_id":"c1c6ef93-1a43-4f42-a870-09740a8ac008","year":2018},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:02.600982Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:0f7fbb6d44e3746cb69c6766d73c1c603976f049b8f6037832daf4dc442a92b4","observation_id":"56f76f15-2638-4ca3-927f-e1c7d519c1a1","resolution":{"observed_at":"2026-08-07T04:54:03.491927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-07T04:45:38.146737Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":2,"verified_fuzzy":35},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 2 inbound Pith citation observations for arXiv:2506.09448."}