{"as_of":"2026-08-16T01:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7c5e55fddb5d9e2de23b1d4580f0300a79ddc6c3115c9bde63595f510fa0486b","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:37:54.861443Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.05759/citation-record","integrity":"/paper/2608.05759/integrity","json":"/paper/2608.05759/citation-record.json","paper":"/paper/2608.05759"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:54.753711Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.753711Z"},"links":{"citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:cfcf7392b7626a132687e1d1f4dbf58aa258b89c22464794bc3d3b0fdf71121f","observation_id":"0488faff-ce29-4ca6-a2de-6cb2cc13afde","resolution":{"observed_at":"2026-08-15T14:37:54.753711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.13377","last_updated":"2019-05-03T14:00:16Z","snapshot_observed_at":"2026-08-14T16:39:11.834763Z","submitted_at":"2019-04-30T17:20:32Z","title":"Very Deep Self-Attention Networks for End-to-End Speech Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.13377","snapshot_observed_at":"2026-08-15T14:37:54.757887Z","title":"Very deep self-attention networks for end-to-end speech recognition,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.757887Z"},"links":{"cited_paper":"/paper/1904.13377","citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:98a3a10eeb1a8a548464b2301dbd7ec14fb398b4358559d8da6d69dc88f7ec00","observation_id":"f83f31c8-b898-41b9-9946-fb80c9d7f038","resolution":{"observed_at":"2026-08-15T14:37:54.757887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:54.761830Z","title":"Robust speech recognition via large-scale weak supervi- sion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.761830Z"},"links":{"citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:cc89f1bdd6cb6f3cdbdecb2ce99662a7d47049f4482d021a6371f8bb8ace01be","observation_id":"7cee99dc-bf42-48c6-9305-c8fc38333c19","resolution":{"observed_at":"2026-08-15T14:37:54.761830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:55.238133Z","title":"Cold fusion: Training seq2seq models together with language models,","venue":null,"work_id":"eeff982c-e384-492c-b11a-784a9193b0f2","year":2018},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.765095Z"},"links":{"citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:3986cc3e2fee1f18f9a05b5e822b84ef6834bd96ebc4e6876fe05bff72cf51b1","observation_id":"19c4d942-8864-4dbd-a23a-fe686dcdf101","resolution":{"observed_at":"2026-08-15T14:37:55.241834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:55.227947Z","title":"Contextual speech recognition in end-to-end neural network systems using beam search","venue":null,"work_id":"8eb2a87d-fe8a-4959-9c34-1c6d546edf3c","year":2018},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.768816Z"},"links":{"citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:dcf6a82620b22c5019e03e68c5e7ed11f0321eab402ecd563e21df834805b6a9","observation_id":"5349d334-eb75-49bd-9a0a-a2f2c63e3bd6","resolution":{"observed_at":"2026-08-15T14:37:55.231688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:55.218565Z","title":"An analysis of incorporating an external language model into a sequence-to-sequence model,","venue":null,"work_id":"c77e256c-c801-4e0a-b5da-19849764c650","year":2018},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.772254Z"},"links":{"citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:fd639a686b6fc9a7f50ba60d841df0f5b2e15d58ce39b0b613395d87680c355c","observation_id":"bd067287-f88d-45e7-90ce-19b0bdcab035","resolution":{"observed_at":"2026-08-15T14:37:55.221986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:55.208754Z","title":"Class lm and word mapping for contextual biasing in end-to-end asr,","venue":null,"work_id":"0df9ac8a-9104-4402-8d94-fed38f9751e9","year":2020},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.775653Z"},"links":{"citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:441840b3224a5c514406cd04db012bf98f5f8bef00b34f94a105a9410c398fdb","observation_id":"7817578e-d7a3-4b7d-9f74-7182dcfe6090","resolution":{"observed_at":"2026-08-15T14:37:55.212153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:55.198114Z","title":"A study of biasing technical terms in medical speech recognition using weighted finite-state transducer,","venue":null,"work_id":"29204d02-07c5-48ef-bc24-4d818f963a7a","year":2022},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.779036Z"},"links":{"citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:a29d0823ff8282c837d39b61d5d756040a6e84184294b12c1870cd95065ef690","observation_id":"e0655cfc-a155-4741-9ed8-ae33d4f97853","resolution":{"observed_at":"2026-08-15T14:37:55.201780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:55.188443Z","title":"Deep context: end-to-end contextual speech recognition,","venue":null,"work_id":"7900be5d-fef7-4af3-8caa-c0443b5b5598","year":2018},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.782421Z"},"links":{"citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:746d03d77fb79382b8393f19888e9f5bac66232b773d5f842fe4cdae4f7d1e88","observation_id":"9fafb509-6517-4c4b-b9f9-8f7abb4eb4fc","resolution":{"observed_at":"2026-08-15T14:37:55.191911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:55.178181Z","title":"Phoebe: Pronunciation-aware contextualization for end-to-end speech recogni- tion,","venue":null,"work_id":"ba6aef12-a477-4b94-b2ef-426af0e1bf46","year":2019},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.785569Z"},"links":{"citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:0cc197c45ea610f65e08a14de1eea424210a4ef9f89ccafd29f5946db9c77af6","observation_id":"a11b88ba-2aff-423a-8a05-c56a6e36450a","resolution":{"observed_at":"2026-08-15T14:37:55.181705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:55.167317Z","title":"Contextual rnn-t for open domain asr,","venue":null,"work_id":"255792b6-994d-4dff-9034-8c811aef57e8","year":2020},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.788468Z"},"links":{"citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:45af5d18d7cb79219cba5fa53ec7583ac839742a16addec943d0aeb63d027d00","observation_id":"5ba1f6ea-09a2-4657-b70a-0bdb87d9ea00","resolution":{"observed_at":"2026-08-15T14:37:55.170569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:55.157501Z","title":"Instant one-shot word- learning for context-specific neural sequence-to-sequence speech recog- nition,","venue":null,"work_id":"d585b7d6-097f-422e-8e9a-d35ef207d460","year":2021},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.791893Z"},"links":{"citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:d096cf42bbf613ac910991c83050e56dd066aff5da9e39b1090aba2c6c48b04d","observation_id":"8209bf31-108d-47eb-8776-4c7e8eced7d0","resolution":{"observed_at":"2026-08-15T14:37:55.161013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.02194","last_updated":"2021-06-11T23:10:43Z","snapshot_observed_at":"2026-08-15T04:28:28.985412Z","submitted_at":"2021-04-05T23:59:43Z","title":"Contextualized Streaming End-to-End Speech Recognition with Trie-Based Deep Biasing and Shallow Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.02194","snapshot_observed_at":"2026-08-15T14:37:54.795633Z","title":"Contextualized streaming end-to-end speech recognition with trie-based deep biasing and shallow fusion,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.795633Z"},"links":{"cited_paper":"/paper/2104.02194","citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:c145c279083cbda918421b2790c50a16ed5c1ccdbf7f9d5dc2d7a9d6c343cc64","observation_id":"2cb03cca-d3d7-4fa1-9b10-48f39bfc8b0f","resolution":{"observed_at":"2026-08-15T14:37:54.795633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:55.147860Z","title":"Im- proving end-to-end contextual speech recognition with fine-grained con- textual knowledge selection,","venue":null,"work_id":"062ae940-2661-44f9-846c-f0322472adf1","year":2022},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.799211Z"},"links":{"citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:d1628860a86af09c80e126cc72533af4bf711c403e56ca94a4ce21ec68040e90","observation_id":"3f4c6f7b-e99c-40b1-908f-f59221948cb5","resolution":{"observed_at":"2026-08-15T14:37:55.151478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:55.137744Z","title":"Personalization of ctc speech recognition models,","venue":null,"work_id":"0ef587fd-5327-430d-b2ed-5f334d64dfc8","year":2023},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.802398Z"},"links":{"citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:d0f51e8eae54716a007e0f4157638f879b2cc0eaa2346ece5aa5468773c05bfa","observation_id":"6f07d30b-e9e6-4926-a86f-a2ad53eb289a","resolution":{"observed_at":"2026-08-15T14:37:55.141377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:55.127606Z","title":"Contextualized end-to-end speech recognition with contextual phrase prediction network,","venue":null,"work_id":"cdc4aeb3-9313-4e87-a197-ebb093eb03d2","year":2023},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.805599Z"},"links":{"citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:fbea9f138abe2b81c24f2969aa0a075023fea5730e5be7b0bade1f3670fce32c","observation_id":"5c3f9c2b-203c-41e4-8d50-4a8758255728","resolution":{"observed_at":"2026-08-15T14:37:55.130903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:55.117680Z","title":"Promptasr for contextualized asr with controllable style,","venue":null,"work_id":"be980fa6-728a-4d3f-999c-c26706061a24","year":2024},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.808820Z"},"links":{"citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:05e7b4ab121cb1d5843f823d2e9994667adee816a1beba00f35468efa228412b","observation_id":"90f1d509-2738-41b1-a994-eaa4b9813d70","resolution":{"observed_at":"2026-08-15T14:37:55.121032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:55.107515Z","title":"Contex- tualized automatic speech recognition with attention-based bias phrase boosted beam search,","venue":null,"work_id":"9fab9a87-52c6-4cf2-87d1-f64c125ae9c7","year":2024},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.811956Z"},"links":{"citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:cf5ac1de8f594e9b5ee57442e46c5de125af38d8e00bdcaa8869dd37b9be74e4","observation_id":"1722ddd1-e807-4180-a8c2-df41db7e6960","resolution":{"observed_at":"2026-08-15T14:37:55.111017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:55.097383Z","title":"Lcb-net: Long-context bias- ing for audio-visual speech recognition,","venue":null,"work_id":"4f9d166f-762e-4d77-abe1-44b0ee0d75e9","year":2024},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.814903Z"},"links":{"citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:7e9e797f43791fc23451dc5e16f5aa2c063619bded19fc9a5fdc1ddc0db81555","observation_id":"e83321ee-8421-4e9d-ac21-ea0ff12ce3f2","resolution":{"observed_at":"2026-08-15T14:37:55.100922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:55.086535Z","title":"Contextual asr with retrieval augmented large language model,","venue":null,"work_id":"cfc05585-bcd8-4fc1-b0b1-b55f46b8164b","year":2025},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.817932Z"},"links":{"citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:ff8121fbc7cd531de3ac6fb2c0bf72e5f20a9582160a397a45d9149b3dde8b6c","observation_id":"116c156a-b541-4f6a-9dfc-f2b5473f532f","resolution":{"observed_at":"2026-08-15T14:37:55.090344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-14T07:06:51.653676Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09448","snapshot_observed_at":"2026-08-15T14:37:54.821097Z","title":"Owsm-biasing: Contextualizing open whisper-style speech models for automatic speech recognition with dynamic vocabulary,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.821097Z"},"links":{"cited_paper":"/paper/2506.09448","citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:69b6c7e3dc9e38521275b92b7547d28d8897f80e65cd2681a3a10df057f6cac6","observation_id":"aa094b2b-8a67-4b87-8d37-f407afa44880","resolution":{"observed_at":"2026-08-15T14:37:54.821097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07919","last_updated":"2023-12-21T10:20:42Z","snapshot_observed_at":"2026-08-07T10:17:55.688598Z","submitted_at":"2023-11-14T05:34:50Z","title":"Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07919","snapshot_observed_at":"2026-08-15T14:37:54.824366Z","title":"Qwen-audio: Advancing universal audio understanding via unified large-scale audio-language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.824366Z"},"links":{"cited_paper":"/paper/2311.07919","citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:3ab8b646bc69fe5eb7cc76158eb20fd1c1a64084601d5651da1ccbdd92bc5da7","observation_id":"5db425e7-7d95-4342-b523-66829189067c","resolution":{"observed_at":"2026-08-15T14:37:54.824366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:54.827387Z","title":"Salmonn: Towards generic hearing abilities for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.827387Z"},"links":{"citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:9f3c6de3ee57dd64b313b99b8073e418b350357e48dc14baaaafdf130c7e12ca","observation_id":"199ef8c5-fd3e-4ff6-9bda-eb2f6c01ca10","resolution":{"observed_at":"2026-08-15T14:37:54.827387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:54.830633Z","title":"Wavllm: Towards robust and adaptive speech large language model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.830633Z"},"links":{"citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:822920d75a529ac8d46fe9c771aba8637b99959efd38e52156e5f79738fbaf9f","observation_id":"b70be1a4-c221-421c-a3ab-aa48dead33b6","resolution":{"observed_at":"2026-08-15T14:37:54.830633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:55.064101Z","title":"End-to-end speech recognition contextualization with large language models,","venue":null,"work_id":"afe219d1-e76b-4401-8285-ebee5b768fff","year":2024},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.833752Z"},"links":{"citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:84e36390590258b6039755a627139fc8f0ffd2004341bdc9a06334e23297dadb","observation_id":"fd026fbb-fa4a-4ca8-9ce6-a76ca54d9a47","resolution":{"observed_at":"2026-08-15T14:37:55.068402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:55.054215Z","title":"Contextual biasing speech recognition in speech-enhanced large language model","venue":null,"work_id":"cc823bad-d072-42fb-adfc-4936415d7d83","year":2024},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.836538Z"},"links":{"citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:a92b25ef04e83665b6b8975e75e5db7df358a817c1d95f53ddc172d525870335","observation_id":"d2d9e38b-c99b-4d91-8d6c-3d0c91bbdbfa","resolution":{"observed_at":"2026-08-15T14:37:55.057708Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.21337","last_updated":"2026-01-30T02:58:48Z","snapshot_observed_at":"2026-08-13T02:49:58.912820Z","submitted_at":"2026-01-29T06:58:13Z","title":"Qwen3-ASR Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.21337","snapshot_observed_at":"2026-08-15T14:37:54.839441Z","title":"Qwen3-asr technical report,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.839441Z"},"links":{"cited_paper":"/paper/2601.21337","citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:e9fcb2fc07f878fe1b83ff02ee690e5025370b3dc63ff1313f83745668d2006a","observation_id":"24ff465f-c8ce-4d40-811b-3c44d8deacf7","resolution":{"observed_at":"2026-08-15T14:37:54.839441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.17765","last_updated":"2025-09-22T13:26:24Z","snapshot_observed_at":"2026-08-11T00:14:34.061687Z","submitted_at":"2025-09-22T13:26:24Z","title":"Qwen3-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.17765","snapshot_observed_at":"2026-08-15T14:37:54.842666Z","title":"Qwen3-omni technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.842666Z"},"links":{"cited_paper":"/paper/2509.17765","citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:34e0f450def374946b2edd8283f6d4633026174d39b9b550aecea6cd904e68dc","observation_id":"c878dd91-2cf5-408b-b15c-aa833db4a768","resolution":{"observed_at":"2026-08-15T14:37:54.842666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:54.846000Z","title":"Vibevoice-asr technical report,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.846000Z"},"links":{"citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:72b47b287259b2b1f05796a24297a368c1c69a7efc93de9491a584bc904b799b","observation_id":"db43992d-571f-40fc-935f-8ad1dff5a7bb","resolution":{"observed_at":"2026-08-15T14:37:54.846000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00401","last_updated":"2020-08-02T05:36:55Z","snapshot_observed_at":"2026-08-11T02:18:04.102657Z","submitted_at":"2020-08-02T05:36:55Z","title":"Multilingual Translation with Extensible Multilingual Pretraining and Finetuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.00401","snapshot_observed_at":"2026-08-15T14:37:54.848891Z","title":"Multilingual translation with extensible multilingual pretraining and finetuning,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.848891Z"},"links":{"cited_paper":"/paper/2008.00401","citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:c09c6f51b872c15bf1c9545cbcdf1eb70b1d065f1b634edc49565bf9e06dd7b1","observation_id":"0b000b07-c96f-47d4-b803-7310d9f3f5f7","resolution":{"observed_at":"2026-08-15T14:37:54.848891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.06670","last_updated":"2020-03-05T20:37:08Z","snapshot_observed_at":"2026-08-12T13:38:15.911519Z","submitted_at":"2019-12-13T19:22:44Z","title":"Common Voice: A Massively-Multilingual Speech Corpus","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.06670","snapshot_observed_at":"2026-08-15T14:37:54.851988Z","title":"Com- mon voice: A massively-multilingual speech corpus,","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.851988Z"},"links":{"cited_paper":"/paper/1912.06670","citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:e18e1d1014f8d74f2d618951adfda604c136d9a26275c9a3f922d62dbdda65cf","observation_id":"55049e77-e4df-402f-b48a-b1c9bed06c89","resolution":{"observed_at":"2026-08-15T14:37:54.851988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.11348","last_updated":"2021-06-16T02:32:23Z","snapshot_observed_at":"2026-08-15T12:23:49.405007Z","submitted_at":"2021-04-22T23:04:28Z","title":"Earnings-21: A Practical Benchmark for ASR in the Wild","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.11348","snapshot_observed_at":"2026-08-15T14:37:54.855049Z","title":"Earnings-21: A practical benchmark for asr in the wild,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.855049Z"},"links":{"cited_paper":"/paper/2104.11348","citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:cdfd4b2bad88fd208edb63cb7cb08ec8ee1d954fd2f0d85f9c5dea0a7acee619","observation_id":"6e103ab0-9c4b-4c74-bf42-85c97da94003","resolution":{"observed_at":"2026-08-15T14:37:54.855049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:54.858357Z","title":"Librispeech: an asr corpus based on public domain audio books,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.858357Z"},"links":{"citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:099c39c294d37efc311d9bb0958b403091aaa7ba035c1fc38290645c35bfc931","observation_id":"da10b423-ff19-472a-a23d-0347c1ea6817","resolution":{"observed_at":"2026-08-15T14:37:54.858357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:37:55.035332Z","title":"Yodas: Youtube-oriented dataset for audio and speech,","venue":null,"work_id":"79a522b7-7241-4b27-9afa-276046007880","year":2023},"citing_paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T14:37:54.861443Z"},"links":{"citing_paper":"/paper/2608.05759"},"observation_digest":"sha256:cfda0e4ef8e2ca5bdf0e88a6fbd434760fb5e56ebdb31e1e9ddaad4a86e07727","observation_id":"a488f792-c10e-4674-ad68-3b047976ecbd","resolution":{"observed_at":"2026-08-15T14:37:55.040695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.05759","last_updated":"2026-08-06T08:45:33Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T14:32:38.243386Z","submitted_at":"2026-08-06T08:45:33Z","title":"How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":19},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2608.05759."}