{"as_of":"2026-08-11T20:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:aa642d02961c80d4cc158352ebb5f0dd60ef28964b93b90f34a6a67ec1e686a2","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-10T12:48:18.738249Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-10T12:48:18.738249Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T12:57:07.673047Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"cited_work":{"arxiv_id":"2607.08117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.08117","snapshot_observed_at":"2026-07-10T12:57:07.673047Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","venue":"cs.CL","work_id":"5a22331e-3cdb-456e-a4a4-674f5e3a31df","year":2026},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"cited_paper":"/paper/2607.08117","citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:44dc8913fd510c0da0792a55d755919451609ec9a10955a8f1740b3f33214157","observation_id":"4d22c1a6-308d-46a8-9b88-f4d2ac1c7c30","resolution":{"observed_at":"2026-07-10T12:57:07.674338Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2607.08117/citation-record","integrity":"/paper/2607.08117/integrity","json":"/paper/2607.08117/citation-record.json","paper":"/paper/2607.08117"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"cited_work":{"arxiv_id":"2607.08117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.08117","snapshot_observed_at":"2026-07-10T12:57:07.673047Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","venue":"cs.CL","work_id":"5a22331e-3cdb-456e-a4a4-674f5e3a31df","year":2026},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"cited_paper":"/paper/2607.08117","citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:44dc8913fd510c0da0792a55d755919451609ec9a10955a8f1740b3f33214157","observation_id":"4d22c1a6-308d-46a8-9b88-f4d2ac1c7c30","resolution":{"observed_at":"2026-07-10T12:57:07.674338Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:57:08.012242Z","title":null,"venue":null,"work_id":"9fdd7fb9-23bb-4910-aba7-56e1e724ed65","year":null},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:66f09e8bcb5f482c980dd07234129547aa21b164bef9feb9b300a437171b9922","observation_id":"9cc91b8b-4523-4b3d-95d3-dd3c0b435beb","resolution":{"observed_at":"2026-07-10T12:57:08.013292Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:57:07.975600Z","title":"Datasets We evaluate our proposed method on the LibriSpeech corpus [18], following the contextual biasing experimental setup es- tablished in prior study [19]","venue":null,"work_id":"1136112d-aeac-4ffa-93de-a892ef41c633","year":null},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:0aef8320528be09d94db75b25e80d05bd1da51e8f5d7c735d3d1ba27b7baa3cc","observation_id":"c4b7ff85-6541-4983-b3fe-d720ac24731d","resolution":{"observed_at":"2026-07-10T12:57:07.977282Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:57:07.977858Z","title":"The Performance of Biasing Scoring Table 1 compares the performance of biasing scoring across dif- ferent objectives","venue":null,"work_id":"02958eca-2257-4534-b5ad-4d0495beaee9","year":null},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:5f0225f01e889316ef68e1ed3abd06c2bc321dfef2aa15a48d7b866ec9254d9d","observation_id":"11541ae2-6a82-4318-bd91-69edafa5c461","resolution":{"observed_at":"2026-07-10T12:57:07.979161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:57:07.981685Z","title":"Notably, DPD-Loss achieves a Recall#20 of 99.09% on test-clean, signifying that target entities are al- most invariably ranked within the top-20 candidates","venue":null,"work_id":"711e7215-ef6b-4714-b599-167a5ac7201c","year":null},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:89b8df190bb583cc58a30913b8989de7d8309c13151f7df3b4def20f12de40e7","observation_id":"ab713b08-9f95-40ef-9346-8f5570ad41b0","resolution":{"observed_at":"2026-07-10T12:57:07.983070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:57:07.983722Z","title":"The COALA is optimized via DPD-Loss","venue":null,"work_id":"1c71d666-3d7f-46d1-b259-609d846a7d59","year":null},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:5de8f0b49099252f7d1ad18fdcf398ba9f8e3b2b5c06e9751377b8aab9082f3e","observation_id":"783dd15a-f484-45ca-a583-1645929a9fe7","resolution":{"observed_at":"2026-07-10T12:57:07.985143Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:57:08.006742Z","title":null,"venue":null,"work_id":"b0cc0894-4c21-4b9e-af92-6dfe75adc9e5","year":null},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:355e59831766ef7fb4ea69f5b50407d1ecc24cb50952b4af0d278864d1d4548b","observation_id":"582d6baf-db0e-44ba-ba69-a98a0e9d5bb0","resolution":{"observed_at":"2026-07-10T12:57:08.007985Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:57:08.010457Z","title":"Any findings and implications in the paper do not necessarily reflect those of the sponsors","venue":null,"work_id":"6dc1ec41-1cdc-42b3-9c55-1aa90adda9c1","year":null},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:57cd9d2350a5bbb61cdf73ed30731f2070c9f30b6469d8ecb8e8119a44543b6e","observation_id":"ca66059a-3751-4819-bd3e-9e5fd3f1c5a6","resolution":{"observed_at":"2026-07-10T12:57:08.011686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:57:08.002983Z","title":"We maintained full control over the re- search content and remain responsible for the accuracy and in- tegrity of the experimental results and the presented figures","venue":null,"work_id":"e7b6a93a-35df-43dd-8755-db1724df0c95","year":null},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:1637d9966ffe49190d184800c1ab991bd18a53d55d6803edba129bfbbf3e23d6","observation_id":"806caa08-7519-4663-8eac-2a69b917bcfe","resolution":{"observed_at":"2026-07-10T12:57:08.004259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:57:08.004841Z","title":"Con- nectionist temporal classification: labelling unsegmented se- quence data with recurrent neural networks,","venue":null,"work_id":"7f4e6408-55dc-4429-9ac2-a9c19aa08c1c","year":2006},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:9c3454aa4e35c60520d5e18380e310141329155985a367d1dc587713cd67bd00","observation_id":"15909d70-8f9c-4e90-8db0-73aca906e0b7","resolution":{"observed_at":"2026-07-10T12:57:08.006082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1211.3711","last_updated":"2012-11-14T19:25:21Z","snapshot_observed_at":"2026-08-10T08:23:44.451766Z","submitted_at":"2012-11-14T19:25:21Z","title":"Sequence Transduction with Recurrent Neural Networks","version":1},"cited_work":{"arxiv_id":"1211.3711","doi":"10.48550/arxiv.1211.3711","metadata_source":"pith","pith_arxiv_id":"1211.3711","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sequence Transduction with Recurrent Neural Networks","venue":"cs.NE","work_id":"4553c1f9-9627-48f1-bcb4-69ce67d2ad80","year":2012},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"cited_paper":"/paper/1211.3711","citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:08ad46a66e2a5620dc11ff94da0d59b96ddab625819c0de55dcfb7da6b464ac6","observation_id":"55e30e99-9839-4a25-93cb-360bbe46f0d8","resolution":{"observed_at":"2026-07-10T12:57:07.669397Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:57:08.019500Z","title":"Neural machine translation by jointly learning to align and translate,","venue":null,"work_id":"44b5f057-7a98-428e-9f42-1660db31acb0","year":2015},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:407c2bc08ce3ba4984da77b1d732913e3ff67ab64c25a2f19170ee085fc1a494","observation_id":"f1c2fff0-2b9c-4eb7-b637-b4db28885381","resolution":{"observed_at":"2026-07-10T12:57:08.020731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:57:07.995840Z","title":"Hybrid transducer and attention based encoder-decoder modeling for speech-to-text tasks,","venue":null,"work_id":"73854fc2-a47a-4b0a-9ed1-e644395c7f71","year":2023},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:4e5a455572a7ae2f43ce4cb0d283dc0cdaede9c701ed897b07440b99e69e7e42","observation_id":"ee7a3cf1-5098-4d32-a855-a06f791ae137","resolution":{"observed_at":"2026-07-10T12:57:07.997101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07919","last_updated":"2023-12-21T10:20:42Z","snapshot_observed_at":"2026-08-07T10:17:55.688598Z","submitted_at":"2023-11-14T05:34:50Z","title":"Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models","version":2},"cited_work":{"arxiv_id":"2311.07919","doi":"10.48550/arxiv.2311.07919","metadata_source":"pith","pith_arxiv_id":"2311.07919","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models","venue":"eess.AS","work_id":"d3f033ac-bfa8-4143-9d0d-51f3f5bd3f0e","year":2023},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"cited_paper":"/paper/2311.07919","citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:c04ecadc02bcded9ebee28485e87d90d985226f3f03712d8016a327090ba9289","observation_id":"2a7b53f8-8fa3-43c9-8d76-d6edcd89a459","resolution":{"observed_at":"2026-07-10T12:57:07.667044Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13289","last_updated":"2024-04-08T06:12:52Z","snapshot_observed_at":"2026-08-02T21:51:36.809095Z","submitted_at":"2023-10-20T05:41:57Z","title":"SALMONN: Towards Generic Hearing Abilities for Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.13289","doi":"10.1016/j.ajhg.2009.06.010","metadata_source":"pith","pith_arxiv_id":"2310.13289","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SALMONN: Towards Generic Hearing Abilities for Large Language Models","venue":"cs.SD","work_id":"b06d6def-ea7a-4cbd-8bb3-73f6a81db238","year":2023},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"cited_paper":"/paper/2310.13289","citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:339a8cc6db5f862417bcd1afde566df6877b03e0a9a3c7cd934faa5a356b6299","observation_id":"4cf2ba07-23f1-4ea3-aeba-fb9f00f0e4b2","resolution":{"observed_at":"2026-07-10T12:57:07.664542Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10759","last_updated":"2024-07-15T14:38:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T14:38:09Z","title":"Qwen2-Audio Technical Report","version":1},"cited_work":{"arxiv_id":"2407.10759","doi":"10.48550/arxiv.2407.10759","metadata_source":"pith","pith_arxiv_id":"2407.10759","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2-Audio Technical Report","venue":"eess.AS","work_id":"c249e63c-cf40-408f-a4ff-fdf68e8cbeb8","year":2024},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"cited_paper":"/paper/2407.10759","citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:443f8cc755d4a3d1758af2853211d4d04c5b871947cc84cf4a5ba0ba78e2d592","observation_id":"f0cc6a09-0d85-4f9d-99de-be13c0e2b105","resolution":{"observed_at":"2026-07-10T12:57:07.671793Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:57:07.999395Z","title":"Prepending or cross-attention for speech-to-text? an empirical comparison,","venue":null,"work_id":"a6e2aab8-f467-4ae6-9245-f0bb06a40595","year":2025},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:391a47050f1c840f01065cbf62422eea96704b1dab49babfc21dd8ef6dc13521","observation_id":"7eaf9504-7240-43cb-990e-e595985dc562","resolution":{"observed_at":"2026-07-10T12:57:08.000623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:57:08.001207Z","title":"Wavllm: Towards robust and adap- tive speech large language model,","venue":null,"work_id":"cddef76f-818c-4aa1-b86e-e74a9a0a01d5","year":2024},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:c58f0ca86d9d9a7e95c5c07de2ff0d04ccb2cd920356a51057b0d267c2896c8f","observation_id":"82c37faa-ed7a-4a55-954c-85838a9c1455","resolution":{"observed_at":"2026-07-10T12:57:08.002457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:57:08.015759Z","title":"Weighted finite-state trans- ducers in speech recognition,","venue":null,"work_id":"63fbde9d-cb5f-46b4-9e71-5d3b6e342fc7","year":2002},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:2cef6aa59b14fc7947cb0b28045f923c40ed3241ec1d03e1d6ef0545e403de4e","observation_id":"d964c8d6-2ce5-4da9-82aa-6d44b62ddbf3","resolution":{"observed_at":"2026-07-10T12:57:08.017106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:57:07.987677Z","title":"Shallow-fusion end-to-end contextual biasing","venue":null,"work_id":"fafb2057-3a0d-4d2d-8e9f-2902bfa23560","year":2019},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:ed2cd213043299b5ab8f84d61dea162040736008eba58841c83faa4190a05b1f","observation_id":"24a02fba-f5ec-4e50-beaf-67149a13b706","resolution":{"observed_at":"2026-07-10T12:57:07.988869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:57:07.992123Z","title":"Contextual speech recognition in end-to-end neural net- work systems using beam search","venue":null,"work_id":"c8d953e0-284a-4129-aaca-c1a20660dc4c","year":2018},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:68d0b5ef3b99d8ab07ce0b7aa1526193e125c4226e51aaa4014463cff72e56dd","observation_id":"85fa7cd9-5faa-4858-9996-f775fd41edf1","resolution":{"observed_at":"2026-07-10T12:57:07.993411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:57:07.989440Z","title":"A neural model for contextual biasing score learning and filtering,","venue":null,"work_id":"7c930bdd-5b1d-4152-af7d-537148a94322","year":2025},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:6864195cdaf917272eaebba1404a56892d17ac775ea334f75b598e21902b798d","observation_id":"fb1e0784-652a-4fe9-a204-fb7c5536c826","resolution":{"observed_at":"2026-07-10T12:57:07.991579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:57:07.997650Z","title":"Contextual adapters for personalized speech recognition in neural transducers","venue":null,"work_id":"ad89673f-33d4-4816-b42d-42773736fc61","year":2022},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:4b41d0f95df5012407a89ab57eb4b64d1a521bf02d24205fd3d111fb187dc50d","observation_id":"8bccc462-2e2f-4d06-8dc8-8ac12af43069","resolution":{"observed_at":"2026-07-10T12:57:07.998819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:57:07.993979Z","title":"Retrieve and copy: Scaling asr personalization to large catalogs,","venue":null,"work_id":"1d891ea8-a467-4f22-8984-f38a54326110","year":2023},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:a8922952009077dce6690e29ca984e0043d5c6166ea346a74f06236c64220a02","observation_id":"a52a49f7-06b1-4af9-ba26-b6d5cbe9d0d4","resolution":{"observed_at":"2026-07-10T12:57:07.995258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:57:08.013849Z","title":"Minimising biasing word errors for contextual asr with the tree-constrained pointer gener- ator,","venue":null,"work_id":"f9c70057-ad62-431e-b521-f351f35c2849","year":2022},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:dc5e7ff97ad9ead628cac2221cfe4b0a13fb7571f752f682a2c7615dc803115f","observation_id":"53382236-4e29-4bda-9bfd-873f685662da","resolution":{"observed_at":"2026-07-10T12:57:08.015202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:57:07.979823Z","title":"Graph neural networks for contextual asr with the tree-constrained pointer generator,","venue":null,"work_id":"e9bf0129-0c0d-4483-95cf-0d918c08a5cc","year":2024},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:44739314aa6471cc6b28a3613264ed0ffcd083984df1cfc0db407ab8fabbd260","observation_id":"a142f164-134c-4a25-b0b4-ab68d8d36c9d","resolution":{"observed_at":"2026-07-10T12:57:07.981096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:57:08.023113Z","title":"Lib- rispeech: An asr corpus based on public domain audio books,","venue":null,"work_id":"1fd2314b-84d3-44b8-8ddb-0d5ceb84faaa","year":2015},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:593c9e1434c7248b4881ae8761bc42278ab1c37ff7c2eed762ee575b8ae9b251","observation_id":"faf19e47-48de-4797-b376-c94508101258","resolution":{"observed_at":"2026-07-10T12:57:08.024355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:57:07.973617Z","title":"Contextualized streaming end-to-end speech recognition with trie-based deep bi- asing and shallow fusion,","venue":null,"work_id":"1797e0b7-ff2c-4573-ba09-a39a4cad07f7","year":2021},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:f303d31efa4e2b3c8d2715bf93948db1040f41791311bf7c000b7d1e686b01f1","observation_id":"c92ca048-2bb1-407e-b504-4e8c4f943c4e","resolution":{"observed_at":"2026-07-10T12:57:07.974967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:57:07.985696Z","title":"Ctc-assisted llm-based contextual asr,","venue":null,"work_id":"6294c623-e2a9-4150-963d-bff71944db36","year":2024},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:4f4946f289f65484705bd90ee083b09d5c8edbc9cca5b710d5061e8d7fd2f55c","observation_id":"7c7c5f5a-d5fd-471c-bd37-06b4630bc504","resolution":{"observed_at":"2026-07-10T12:57:07.987053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:57:08.017678Z","title":"Knowledge prompt for whisper: An asr entity correction approach with knowledge base,","venue":null,"work_id":"ec448df0-55ce-4cce-b515-96a645cc756c","year":2023},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:89d56e57738a4f2263fd8831dc400bb737e955eaa3a2ed49a037329e902c5d7f","observation_id":"6d1d9006-f13c-4ad3-b95a-7f3d8d9e612f","resolution":{"observed_at":"2026-07-10T12:57:08.018905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:57:08.008566Z","title":"Robust speech recognition via large-scale weak su- pervision","venue":null,"work_id":"64739672-5736-442e-adae-6214f1973c2c","year":2023},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:5cde3871ca8c478ca18732674a63a7e083358b183c718f4510324867149ac2af","observation_id":"39d288c4-1e77-41a0-9766-470887e55906","resolution":{"observed_at":"2026-07-10T12:57:08.009829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:57:08.021293Z","title":"Contextual biasing speech recognition in speech-enhanced large language model,","venue":null,"work_id":"29fa2948-2263-4e5b-aa2c-2ed6d52f6145","year":2024},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:5b79685ddb52d9de403c02e65e16c3826226960deefe2028bf557e80d98ffde6","observation_id":"93bede1f-1bd7-411a-8bcd-9565c2367fd8","resolution":{"observed_at":"2026-07-10T12:57:08.022539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:57:07.968274Z","title":"Contextualized end-to-end automatic speech recognition with intermediate bias- ing loss,","venue":null,"work_id":"c9195b34-9349-4e27-84d5-61b602653e2f","year":2024},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:65ad41edc49de8a18e369c0eea950316620a640689a03d75f533bec76c40f232","observation_id":"a53b192f-76f4-4a00-995c-a16fa0ce6ae6","resolution":{"observed_at":"2026-07-10T12:57:07.969513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:57:07.971883Z","title":"Hy- brid ctc/attention architecture for end-to-end speech recognition,","venue":null,"work_id":"9fdf5011-1850-40d3-ab12-b4bff6d98b5e","year":2017},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:b20b80cc89b4795c95e0569f6383bd1bfe16769185bc6144336841b05dfdf877","observation_id":"70be0856-3f39-4378-a28f-4884187a6a2c","resolution":{"observed_at":"2026-07-10T12:57:07.973044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:57:07.970080Z","title":"Contextualized automatic speech recognition with attention- based bias phrase boosted beam search,","venue":null,"work_id":"130f9aef-50ca-442f-b85e-85cc35765590","year":2024},"citing_paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-10T12:48:18.738249Z"},"links":{"citing_paper":"/paper/2607.08117"},"observation_digest":"sha256:f3a931b49efdc8bb94667e23055e9ac12ba4461a9a47d0e2e480ea3eef44d65d","observation_id":"0cf62f98-c7f3-42b4-82f0-54f8c67662cf","resolution":{"observed_at":"2026-07-10T12:57:07.971349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.08117","last_updated":"2026-07-09T05:26:22Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T04:50:08.604762Z","submitted_at":"2026-07-09T05:26:22Z","title":"COALA: Robust Contextualized Speech-augmented Language Modeling for ASR via Contrastive Regularizer and Biasing Score Estimation"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":2,"verified_exact":5,"verified_fuzzy":26},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 1 inbound Pith citation observation for arXiv:2607.08117."}