{"as_of":"2026-08-08T07:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bd44c68382560461d7f15002fbc1d079e4ac3c8ab56249cc7fc928380413438a","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:57:47.868540Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:57:45.668426Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T12:57:47.952697Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"cited_work":{"arxiv_id":"2505.23077","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23077","snapshot_observed_at":"2026-08-07T12:57:47.952697Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","venue":"cs.SD","work_id":"6d942757-d8d5-468a-9497-73d036b74d9f","year":2025},"citing_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:45.668426Z"},"links":{"cited_paper":"/paper/2505.23077","citing_paper":"/paper/2505.23077"},"observation_digest":"sha256:9518885427a687c266b696becc2538ec4e0545ec7ca1fb9c7868137bb67bb77a","observation_id":"dec09bd5-227e-4fbd-986f-8ccc5f4eb060","resolution":{"observed_at":"2026-08-07T12:57:47.995272Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.23077/citation-record","integrity":"/paper/2505.23077/integrity","json":"/paper/2505.23077/citation-record.json","paper":"/paper/2505.23077"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:52.372295Z","title":"Alexander","venue":null,"work_id":"352463ef-7956-485b-8e3e-cba90c0256cc","year":null},"citing_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:45.599691Z"},"links":{"citing_paper":"/paper/2505.23077"},"observation_digest":"sha256:3f25202850159a7a769f744adf5b8ae6d1281679171d79ce0458181062abd9fc","observation_id":"18df1e81-a96c-4099-9ad8-1a4aa931208a","resolution":{"observed_at":"2026-08-07T12:57:52.469725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"cited_work":{"arxiv_id":"2505.23077","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.23077","snapshot_observed_at":"2026-08-07T12:57:47.952697Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","venue":"cs.SD","work_id":"6d942757-d8d5-468a-9497-73d036b74d9f","year":2025},"citing_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:45.668426Z"},"links":{"cited_paper":"/paper/2505.23077","citing_paper":"/paper/2505.23077"},"observation_digest":"sha256:9518885427a687c266b696becc2538ec4e0545ec7ca1fb9c7868137bb67bb77a","observation_id":"dec09bd5-227e-4fbd-986f-8ccc5f4eb060","resolution":{"observed_at":"2026-08-07T12:57:47.995272Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:52.168232Z","title":"Experimental setup We train CTC/AED models as the baseline and the pre-trained ASR model, using the Wenet toolkit [25]","venue":null,"work_id":"be3f74c7-d957-49ed-adaa-b6a7dd2c0704","year":null},"citing_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:45.763499Z"},"links":{"citing_paper":"/paper/2505.23077"},"observation_digest":"sha256:9862f2978d839dd5f2a3d363fd1dec422f43cfa82d80c8a2331054bde3862e31","observation_id":"f8536d75-6586-41f9-bd5f-ef4f960feb2f","resolution":{"observed_at":"2026-08-07T12:57:52.308339Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:51.883264Z","title":"We investigate two labeling strategies to adaptively propagate phrase-level labels to frame-level out- puts","venue":null,"work_id":"9f6d1288-3821-43e5-807c-17fb35b74e50","year":null},"citing_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:45.864448Z"},"links":{"citing_paper":"/paper/2505.23077"},"observation_digest":"sha256:963f43ddef378d818eda7fe3d36afd0361b4d1fbe4afb09b83256ab632c787f1","observation_id":"158414c8-2f27-4a76-a444-3b327f5afd40","resolution":{"observed_at":"2026-08-07T12:57:52.002061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:51.726778Z","title":"Con- nectionist temporal classification: labelling unsegmented se- quence data with recurrent neural networks,","venue":null,"work_id":"03137b54-2f72-4bef-bb32-63bc446113e2","year":2006},"citing_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:45.945385Z"},"links":{"citing_paper":"/paper/2505.23077"},"observation_digest":"sha256:2803c032d104b5fdb906eeeb38aa04448a83d7b91d99e967fa52e3a111f99298","observation_id":"57b374dd-b7b5-4d1f-9519-0d77682d1593","resolution":{"observed_at":"2026-08-07T12:57:51.803526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:51.416336Z","title":"Sequence transduction with recurrent neural net- works,","venue":null,"work_id":"36a7434e-1c75-48e7-9664-27bae8b4579e","year":2012},"citing_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:45.997647Z"},"links":{"citing_paper":"/paper/2505.23077"},"observation_digest":"sha256:40f4aca3dfd6a9a9e77abbc2753313e3bf336c7584fe125f174a3ec9381e0b3e","observation_id":"e64911bd-5a93-4173-9433-6a525c4500a5","resolution":{"observed_at":"2026-08-07T12:57:51.547449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:51.097773Z","title":"Attention-based models for speech recognition,","venue":null,"work_id":"ff430b1c-d069-4ff6-ab25-f9139c0c296e","year":2015},"citing_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:46.087970Z"},"links":{"citing_paper":"/paper/2505.23077"},"observation_digest":"sha256:d71de2e69df33817d8f2304bce9bf30883c7455d804705a0e611f89cafa2c10e","observation_id":"d7827d8f-ebed-468a-8be3-8c1472f1e8f6","resolution":{"observed_at":"2026-08-07T12:57:51.258942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:46.155583Z","title":"Conformer: Convolution-augmented transformer for speech recognition,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:46.155583Z"},"links":{"citing_paper":"/paper/2505.23077"},"observation_digest":"sha256:0861e1b6dfb98cc940304923b0a6659f763a0b7209454e7f3928545909fa7393","observation_id":"d2394e86-8173-4ca6-9d06-fabc95da4bba","resolution":{"observed_at":"2026-08-07T12:57:46.155583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:50.813956Z","title":"Listen, attend and spell: A neural network for large vocabulary conversational speech recognition,","venue":null,"work_id":"facb272b-dc48-4963-bea4-5063e2144378","year":2016},"citing_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:46.234569Z"},"links":{"citing_paper":"/paper/2505.23077"},"observation_digest":"sha256:0338cff407f970097bcb5beb8296fca228d82ffd5ab82ff2605ad9406a59c6bb","observation_id":"f8f72c03-2dd2-4d56-b253-4ce74f0ead94","resolution":{"observed_at":"2026-08-07T12:57:50.949377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:50.507554Z","title":"Learning phrase representations using rnn encoderdecoder for statistical machine translation,","venue":null,"work_id":"b6f6487b-4f09-4acd-bc4b-88507bcb14fd","year":2014},"citing_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:46.285350Z"},"links":{"citing_paper":"/paper/2505.23077"},"observation_digest":"sha256:95e79db82ab35eb9880dbe38c08619c71534f02b43591cc52c89726c0fd1be1e","observation_id":"399d8611-74a0-478f-9f8f-743b3dc9266b","resolution":{"observed_at":"2026-08-07T12:57:50.654225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:50.205145Z","title":"Contextual speech recognition in end-to-end neural net- work systems using beam search,","venue":null,"work_id":"dfb49fb9-b326-4849-bb63-0a445f59efec","year":2018},"citing_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:46.339194Z"},"links":{"citing_paper":"/paper/2505.23077"},"observation_digest":"sha256:9413271ea70b021948cc5ed6224824d66165fdd4dbeacf4d63e51fd8c4f9c2f4","observation_id":"5bc1e1fc-55d0-4eb6-b0a5-f12ca7664b9c","resolution":{"observed_at":"2026-08-07T12:57:50.365801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:50.052376Z","title":"End- to-end contextual speech recognition using class language models and a token passing decoder,","venue":null,"work_id":"b25e48e1-40c4-4b67-9c60-adeeaf4e628e","year":2019},"citing_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:46.405957Z"},"links":{"citing_paper":"/paper/2505.23077"},"observation_digest":"sha256:c28d640263a0533a2fd25797063e597acac16b1d7031064ea7b27b37fd873371","observation_id":"a50e6e40-a658-4031-a5ee-d03b2f994a90","resolution":{"observed_at":"2026-08-07T12:57:50.068570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:49.981314Z","title":"Shallow-fusion end-to-end contextual biasing,","venue":null,"work_id":"6925ce94-00bc-4849-b9d4-0d338666e89f","year":2019},"citing_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:46.511674Z"},"links":{"citing_paper":"/paper/2505.23077"},"observation_digest":"sha256:cbd9a24dd4544b76586f1e3d2693c527fa1acc4ded2cbac08e82052f24690f9f","observation_id":"0c02e427-3d3b-4404-b61c-1f1ed6d98206","resolution":{"observed_at":"2026-08-07T12:57:50.045187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:49.846315Z","title":"Class lm and word mapping for contextual biasing in end-to-end asr,","venue":null,"work_id":"a97bcd5c-d3f4-4a4d-8950-64a1f7dd3355","year":2020},"citing_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:46.599502Z"},"links":{"citing_paper":"/paper/2505.23077"},"observation_digest":"sha256:1ee735f58c56a84000058f0688573c550aa003356d39afc1133d19ea9741a820","observation_id":"85da470b-8714-4f58-bd4e-fc983a3755d8","resolution":{"observed_at":"2026-08-07T12:57:49.910007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:49.733292Z","title":"Improved neural language model fu- sion for streaming recurrent neural network transducer,","venue":null,"work_id":"d88e83e0-4607-4170-a281-098be3b49e7e","year":2021},"citing_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:46.689418Z"},"links":{"citing_paper":"/paper/2505.23077"},"observation_digest":"sha256:52423002255d35e3db25fb88faa4e6d642df13a25d0044a84a132ba5677a741c","observation_id":"72c66884-c796-425f-b257-ed3fa8ddf1f1","resolution":{"observed_at":"2026-08-07T12:57:49.790042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:49.591971Z","title":"Joint grapheme and phoneme embeddings for contextual end-to-end asr,","venue":null,"work_id":"b7e020cf-191c-4a3f-8dad-4b28d9990b89","year":2019},"citing_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:46.759849Z"},"links":{"citing_paper":"/paper/2505.23077"},"observation_digest":"sha256:54e7affde16a0c8e9ec7ee83ae1a6e83bbedec83582e6dff7621b4d6f1f0e172","observation_id":"e17b05d8-2da0-4423-89ee-9e40076b058a","resolution":{"observed_at":"2026-08-07T12:57:49.668038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:49.462154Z","title":"Cif-based collaborative decoding for end-to-end contextual speech recognition,","venue":null,"work_id":"54f046c9-78d0-48e7-b3f4-08ee4dc26107","year":2021},"citing_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:46.829493Z"},"links":{"citing_paper":"/paper/2505.23077"},"observation_digest":"sha256:6efddb013537fbc0f93bd5d64a7cb795ff8c45ac09dc180d1aadc7bebb7e9810","observation_id":"b5a6e424-df51-4c4b-8c1d-8a1f36a5ce76","resolution":{"observed_at":"2026-08-07T12:57:49.532261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:49.309228Z","title":"Tree-constrained pointer generator for end-to-end contextual speech recognition,","venue":null,"work_id":"8de85b2a-2130-417c-b0e3-650eceb6deab","year":2021},"citing_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:46.902451Z"},"links":{"citing_paper":"/paper/2505.23077"},"observation_digest":"sha256:2ad92f6598e7de72f62cc886f2b323daae2482a556727e6ed8e33ba1ecd5505f","observation_id":"67284e69-868b-4a33-ab8d-83b4f7789809","resolution":{"observed_at":"2026-08-07T12:57:49.374676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:49.164283Z","title":"Personalization of ctc speech recognition models,","venue":null,"work_id":"9531c38f-8a32-4b7e-8411-8d1c90c8ddbd","year":2023},"citing_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:46.972762Z"},"links":{"citing_paper":"/paper/2505.23077"},"observation_digest":"sha256:043b11e3c1997eda4725bfb6ea9a3c43afca6cadd3321d0b144cbd0c17b91fd2","observation_id":"2af3deb6-c9fd-4e7d-bcf6-6620498efd2a","resolution":{"observed_at":"2026-08-07T12:57:49.212263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:49.041272Z","title":"Improving end-to-end contextual speech recognition with fine-grained contextual knowledge selection,","venue":null,"work_id":"7b0fc6a6-3eaf-40ca-ae5c-5743510abeec","year":2022},"citing_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:47.059263Z"},"links":{"citing_paper":"/paper/2505.23077"},"observation_digest":"sha256:9fd5019c08cf389e62234fda5f2fd69d2e56a7324fbf4eb6bc6b99a61355d0db","observation_id":"35d97b04-9083-4add-8a10-0b7ec17ebde9","resolution":{"observed_at":"2026-08-07T12:57:49.102715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:48.972199Z","title":"Deep context: end-to-end contextual speech recogni- tion,","venue":null,"work_id":"b6229aa9-380b-4330-bd3a-0abc4e6fb471","year":2018},"citing_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:47.095081Z"},"links":{"citing_paper":"/paper/2505.23077"},"observation_digest":"sha256:1c2e716bbc55fef25ffd404b08ad5c6844c8c74fddff5d8271eeaf85e692f006","observation_id":"6b787342-d54a-4456-853a-97b4c40adaa1","resolution":{"observed_at":"2026-08-07T12:57:48.996777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:48.913355Z","title":"Context-aware transformer trans- ducer for speech recognition,","venue":null,"work_id":"1c9de17b-69aa-4832-8af7-b4d218a456a6","year":2021},"citing_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:47.168554Z"},"links":{"citing_paper":"/paper/2505.23077"},"observation_digest":"sha256:b62c1f8d397a9ccc3fd328629998da03ba23fd9a915555be72986d3fee6ceea1","observation_id":"91b2da05-3ea6-45d6-825c-f4a958848939","resolution":{"observed_at":"2026-08-07T12:57:48.942297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:47.259116Z","title":"Contextualized end-to-end speech recognition with contextual phrase prediction network,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:47.259116Z"},"links":{"citing_paper":"/paper/2505.23077"},"observation_digest":"sha256:bdcb392005e5db63954e18181d30d8a01c4d3ff76d6f2123962653e533b258d7","observation_id":"d21eab62-bc28-4024-ac2f-64da53f5c267","resolution":{"observed_at":"2026-08-07T12:57:47.259116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:48.809971Z","title":"Contextualized streaming end-to-end speech recognition with trie-based deep biasing and shallow fusion,","venue":null,"work_id":"d564fc25-47e0-49bb-9a42-595c1e834120","year":2021},"citing_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:47.325702Z"},"links":{"citing_paper":"/paper/2505.23077"},"observation_digest":"sha256:b19e4b03e9291cf1907dcc7bf694b822633a14a404aae608ccf6081029fb64b8","observation_id":"70df722f-7810-468c-91a7-a7c91c7f835a","resolution":{"observed_at":"2026-08-07T12:57:48.850411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:48.732572Z","title":"Improving large-scale deep biasing with phoneme features and text-only data in streaming transducer,","venue":null,"work_id":"93e60e97-8169-4f85-8ce0-29db8104c485","year":2023},"citing_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:47.406193Z"},"links":{"citing_paper":"/paper/2505.23077"},"observation_digest":"sha256:767b9173b19d5f4dabc33d4daab1ff737faa9db8df80424b3a568ae34c4a5396","observation_id":"01fc5acb-48b3-4882-8159-0da86f79959e","resolution":{"observed_at":"2026-08-07T12:57:48.770260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:48.606587Z","title":"Contextualized automatic speech recognition with dynamic vo- cabulary,","venue":null,"work_id":"057db330-0f7c-4c2b-be54-02dc2d234b66","year":2024},"citing_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:47.475771Z"},"links":{"citing_paper":"/paper/2505.23077"},"observation_digest":"sha256:176f1244f811871bcd96cdbd554e94e1b39bc6beadf5cfe918d1664ae2f67944","observation_id":"83efe2f7-1bd8-4e61-be9e-25e61a167c00","resolution":{"observed_at":"2026-08-07T12:57:48.690554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:48.514742Z","title":"Lib- rispeech: An asr corpus based on public domain audio books,","venue":null,"work_id":"82ee9590-4aa5-41a1-a65f-5fd28891b1d4","year":2015},"citing_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:47.580928Z"},"links":{"citing_paper":"/paper/2505.23077"},"observation_digest":"sha256:f5dec85d583c1f7bef78691012addc495f4c5ee7a55be1cbd07ba2f41a826a47","observation_id":"5f56d29f-9cc8-452d-be25-ac304ccc5a0f","resolution":{"observed_at":"2026-08-07T12:57:48.545488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:48.402120Z","title":"Wenetspeech: A 10000+ hours multi-domain mandarin corpus for speech recognition,","venue":null,"work_id":"ed48f844-e09b-4215-af4e-51d207810fa3","year":2022},"citing_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:47.676410Z"},"links":{"citing_paper":"/paper/2505.23077"},"observation_digest":"sha256:c56bf340ceaef3c74cd19ca2eb163711602f8dc270b5a5c0badd77b97db50b93","observation_id":"c75d2599-a646-425d-8e87-c27bcbc0db67","resolution":{"observed_at":"2026-08-07T12:57:48.457654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:48.310242Z","title":"Wenet: Production oriented stream- ing and non-streaming end-to-end speech recognition toolkit,","venue":null,"work_id":"4882e47f-014c-4d92-bae5-3ff7e064914b","year":2021},"citing_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:47.748584Z"},"links":{"citing_paper":"/paper/2505.23077"},"observation_digest":"sha256:833dabc966175901f1d1635d7dcfc6c7cec4a132a51a467ee0ae6eedd1042cf9","observation_id":"2709b677-bc55-4c22-9b01-019f9ed6ed0f","resolution":{"observed_at":"2026-08-07T12:57:48.360142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:48.194936Z","title":"Specaugment: A simple data augmentation method for automatic speech recognition,","venue":null,"work_id":"4ffdce1b-232a-4ad9-8087-0a30288598a8","year":2019},"citing_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:47.812570Z"},"links":{"citing_paper":"/paper/2505.23077"},"observation_digest":"sha256:c1fa94a9d5e1e8a5c88f5b52b0b34a9b7186d4b16d7c3eb6b7bd5e3ebf69d5f4","observation_id":"34a2c274-aec6-4bf3-9366-b0f098be7935","resolution":{"observed_at":"2026-08-07T12:57:48.245798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:57:48.055947Z","title":"Cb-conformer: Contextual biasing conformer for biased word recognition,","venue":null,"work_id":"5c222664-bd84-4bca-b45d-414569866889","year":2023},"citing_paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:57:47.868540Z"},"links":{"citing_paper":"/paper/2505.23077"},"observation_digest":"sha256:b9779b1e763e40de02e510704041acd4a59ea2e6b96040c581fa32121f35b38e","observation_id":"b2c9fc57-de27-4a80-aec7-80a3197b553c","resolution":{"observed_at":"2026-08-07T12:57:48.118272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.23077","last_updated":"2025-05-29T04:31:33Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-07T12:51:48.691767Z","submitted_at":"2025-05-29T04:31:33Z","title":"Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":2,"verified_exact":1,"verified_fuzzy":27},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 1 inbound Pith citation observation for arXiv:2505.23077."}