{"as_of":"2026-08-18T17:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:acbed288d7630d8a619d86964788f57468aa0cd1bb76ecc24e466113e7ff1e2a","coverage":[{"denominator":14,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T10:36:28.361661Z","state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.16474/citation-record","integrity":"/paper/2412.16474/integrity","json":"/paper/2412.16474/citation-record.json","paper":"/paper/2412.16474"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:36:28.543790Z","title":"Deep speech 2: End-to-end speech recognition in english and mandarin,","venue":null,"work_id":"3d0d3843-6887-4bdc-81aa-229835a9277b","year":2016},"citing_paper":{"arxiv_id":"2412.16474","last_updated":"2024-12-21T04:05:43Z","snapshot_observed_at":"2026-08-18T03:15:17.464595Z","submitted_at":"2024-12-21T04:05:43Z","title":"Enhancing Multilingual ASR for Unseen Languages via Language Embedding Modeling","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T10:36:28.303947Z"},"links":{"citing_paper":"/paper/2412.16474"},"observation_digest":"sha256:4282c0fd5f334f91a053aeaea28ade254bf3f452cafc40d3b0b18c75237d9e8e","observation_id":"c0ceff4f-77c2-4749-9df1-12b3ed784a1e","resolution":{"observed_at":"2026-08-11T10:36:28.548482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:36:28.309762Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.16474","last_updated":"2024-12-21T04:05:43Z","snapshot_observed_at":"2026-08-18T03:15:17.464595Z","submitted_at":"2024-12-21T04:05:43Z","title":"Enhancing Multilingual ASR for Unseen Languages via Language Embedding Modeling","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T10:36:28.309762Z"},"links":{"citing_paper":"/paper/2412.16474"},"observation_digest":"sha256:4cca7dfe6b3e48fad16ebc5ea6566dce52c4333b443b41d35c0a278e8239a631","observation_id":"b5065505-59a6-4219-aac6-42ce58676d9e","resolution":{"observed_at":"2026-08-11T10:36:28.309762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:36:28.522105Z","title":"Transformer transducer: A streamable speech recognition model with transformer encoders and rnn-t loss,","venue":null,"work_id":"6691ce78-98fd-4d04-a8c5-1d69accf36d0","year":2020},"citing_paper":{"arxiv_id":"2412.16474","last_updated":"2024-12-21T04:05:43Z","snapshot_observed_at":"2026-08-18T03:15:17.464595Z","submitted_at":"2024-12-21T04:05:43Z","title":"Enhancing Multilingual ASR for Unseen Languages via Language Embedding Modeling","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T10:36:28.313909Z"},"links":{"citing_paper":"/paper/2412.16474"},"observation_digest":"sha256:cc316349d5e17ae292d481aac73d5d64cd1945bc6518452f3a5105b8c5bfb272","observation_id":"d184aa29-9d98-4717-a2a5-eb6d728d0bb3","resolution":{"observed_at":"2026-08-11T10:36:28.526914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:36:28.318103Z","title":"Multilingual speech recognition with a single end-to-end model,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.16474","last_updated":"2024-12-21T04:05:43Z","snapshot_observed_at":"2026-08-18T03:15:17.464595Z","submitted_at":"2024-12-21T04:05:43Z","title":"Enhancing Multilingual ASR for Unseen Languages via Language Embedding Modeling","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T10:36:28.318103Z"},"links":{"citing_paper":"/paper/2412.16474"},"observation_digest":"sha256:bef0ec616c611017bb3a2436febc84c0d91ddfd73f5d22aeb9c21c843f535ed9","observation_id":"c95ed1ce-3a6f-454b-8fa5-1459de0b1645","resolution":{"observed_at":"2026-08-11T10:36:28.318103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:36:28.499705Z","title":"Un- supervised cross-lingual representation learning for speech recognition,","venue":null,"work_id":"8f5f415c-11d4-4e40-93dd-8988c7f8923c","year":2021},"citing_paper":{"arxiv_id":"2412.16474","last_updated":"2024-12-21T04:05:43Z","snapshot_observed_at":"2026-08-18T03:15:17.464595Z","submitted_at":"2024-12-21T04:05:43Z","title":"Enhancing Multilingual ASR for Unseen Languages via Language Embedding Modeling","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T10:36:28.322089Z"},"links":{"citing_paper":"/paper/2412.16474"},"observation_digest":"sha256:b416b33d8b224c93272b47770d471bc64c01ae4fde48b3b1cd2855acc99c79a0","observation_id":"9791f950-410c-492a-8fe2-06f96953880b","resolution":{"observed_at":"2026-08-11T10:36:28.503878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:36:28.485387Z","title":"Xls-r: Self-supervised cross-lingual speech representation learning at scale,","venue":null,"work_id":"baa99e94-d86f-4d22-a83d-ef3109c72cc2","year":2022},"citing_paper":{"arxiv_id":"2412.16474","last_updated":"2024-12-21T04:05:43Z","snapshot_observed_at":"2026-08-18T03:15:17.464595Z","submitted_at":"2024-12-21T04:05:43Z","title":"Enhancing Multilingual ASR for Unseen Languages via Language Embedding Modeling","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T10:36:28.326511Z"},"links":{"citing_paper":"/paper/2412.16474"},"observation_digest":"sha256:85f76af8ad3664ce2462cf84d725c767547fcc501235b199ce35f208ad93cee0","observation_id":"a8dcedf0-ba17-4e6a-88a7-b748c1e48a55","resolution":{"observed_at":"2026-08-11T10:36:28.490012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:36:28.330707Z","title":"Robust speech recognition via large-scale weak supervi- sion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16474","last_updated":"2024-12-21T04:05:43Z","snapshot_observed_at":"2026-08-18T03:15:17.464595Z","submitted_at":"2024-12-21T04:05:43Z","title":"Enhancing Multilingual ASR for Unseen Languages via Language Embedding Modeling","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T10:36:28.330707Z"},"links":{"citing_paper":"/paper/2412.16474"},"observation_digest":"sha256:ede1dff1ed565c931799404003338fcaa23dd171b50fe80f4396007bea1ab376","observation_id":"22b310b5-aa0b-416f-8e63-8949370ca151","resolution":{"observed_at":"2026-08-11T10:36:28.330707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:36:28.334366Z","title":"Yang, K.-P","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16474","last_updated":"2024-12-21T04:05:43Z","snapshot_observed_at":"2026-08-18T03:15:17.464595Z","submitted_at":"2024-12-21T04:05:43Z","title":"Enhancing Multilingual ASR for Unseen Languages via Language Embedding Modeling","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T10:36:28.334366Z"},"links":{"citing_paper":"/paper/2412.16474"},"observation_digest":"sha256:38566380db230d2531f18a5a34e4d5893760e58137a18ef02fffe1b61d1b9570","observation_id":"90027c9a-08d5-4b40-9293-ed7f1c15c24a","resolution":{"observed_at":"2026-08-11T10:36:28.334366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05806","last_updated":"2024-09-16T16:26:49Z","snapshot_observed_at":"2026-08-17T13:41:30.432834Z","submitted_at":"2024-06-09T14:44:59Z","title":"Do Prompts Really Prompt? Exploring the Prompt Understanding Capability of Whisper","version":4},"cited_work":{"arxiv_id":"2406.05806","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.05806","snapshot_observed_at":"2026-08-11T10:36:28.405487Z","title":"Do Prompts Really Prompt? Exploring the Prompt Understanding Capability of Whisper","venue":"cs.CL","work_id":"8e974a87-3b5d-4984-9891-bda8ab19bfad","year":2024},"citing_paper":{"arxiv_id":"2412.16474","last_updated":"2024-12-21T04:05:43Z","snapshot_observed_at":"2026-08-18T03:15:17.464595Z","submitted_at":"2024-12-21T04:05:43Z","title":"Enhancing Multilingual ASR for Unseen Languages via Language Embedding Modeling","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T10:36:28.338327Z"},"links":{"cited_paper":"/paper/2406.05806","citing_paper":"/paper/2412.16474"},"observation_digest":"sha256:e70000b2c89430776ab65c2ce42ed3b208279dcc5d43b2cf05c89968dd14f1c6","observation_id":"7cbb765a-1535-4394-bef2-2d101d477a90","resolution":{"observed_at":"2026-08-11T10:36:28.412451Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:36:28.454556Z","title":"Prompting the hidden talent of web-scale speech models for zero-shot task generalization,","venue":null,"work_id":"9cc48d0b-821e-4b06-a88f-6cc0e9f4491b","year":2023},"citing_paper":{"arxiv_id":"2412.16474","last_updated":"2024-12-21T04:05:43Z","snapshot_observed_at":"2026-08-18T03:15:17.464595Z","submitted_at":"2024-12-21T04:05:43Z","title":"Enhancing Multilingual ASR for Unseen Languages via Language Embedding Modeling","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T10:36:28.343499Z"},"links":{"citing_paper":"/paper/2412.16474"},"observation_digest":"sha256:7f87001cfdb66faa5422bdffb90c9d0c22cd9821919e42a0ed5d6ca28b2c04ac","observation_id":"3154b719-9713-4b30-8d71-926c95d49e66","resolution":{"observed_at":"2026-08-11T10:36:28.458867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:36:28.442137Z","title":"Zero- shot domain-sensitive speech recognition with prompt-conditioning fine- tuning,","venue":null,"work_id":"4568ca7b-5ae0-4383-9f76-f7e491a71a57","year":2023},"citing_paper":{"arxiv_id":"2412.16474","last_updated":"2024-12-21T04:05:43Z","snapshot_observed_at":"2026-08-18T03:15:17.464595Z","submitted_at":"2024-12-21T04:05:43Z","title":"Enhancing Multilingual ASR for Unseen Languages via Language Embedding Modeling","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T10:36:28.348209Z"},"links":{"citing_paper":"/paper/2412.16474"},"observation_digest":"sha256:0b6eb30ac9bb87a7302d0cbb2bfefe0404d9cbfccfa3d95c076eb72f099947c1","observation_id":"2efee83b-cf0c-43e9-a26a-3d6e11566256","resolution":{"observed_at":"2026-08-11T10:36:28.446300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05554","last_updated":"2024-08-10T13:39:13Z","snapshot_observed_at":"2026-08-16T13:27:16.898159Z","submitted_at":"2024-08-10T13:39:13Z","title":"Improving Whisper's Recognition Performance for Under-Represented Language Kazakh Leveraging Unpaired Speech and Text","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05554","snapshot_observed_at":"2026-08-11T10:36:28.352134Z","title":"Improving whisper’s recognition performance for under-represented language kazakh leveraging unpaired speech and text,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16474","last_updated":"2024-12-21T04:05:43Z","snapshot_observed_at":"2026-08-18T03:15:17.464595Z","submitted_at":"2024-12-21T04:05:43Z","title":"Enhancing Multilingual ASR for Unseen Languages via Language Embedding Modeling","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T10:36:28.352134Z"},"links":{"cited_paper":"/paper/2408.05554","citing_paper":"/paper/2412.16474"},"observation_digest":"sha256:419696291c54b909cf4b4071d0f091544a5c45c9e0c10fc4389f2927f573cdd8","observation_id":"7024d41c-da7d-4054-bf7e-496e9c231b62","resolution":{"observed_at":"2026-08-11T10:36:28.352134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:36:28.430239Z","title":"ML- SUPERB: Multilingual Speech Universal PERformance Benchmark,","venue":null,"work_id":"787ca5b5-de8d-4f9b-8dcb-0d697a781881","year":2023},"citing_paper":{"arxiv_id":"2412.16474","last_updated":"2024-12-21T04:05:43Z","snapshot_observed_at":"2026-08-18T03:15:17.464595Z","submitted_at":"2024-12-21T04:05:43Z","title":"Enhancing Multilingual ASR for Unseen Languages via Language Embedding Modeling","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T10:36:28.357639Z"},"links":{"citing_paper":"/paper/2412.16474"},"observation_digest":"sha256:388ed279dc1284fcdc7f4e346ea591e9c85d984d4c356869005a96279a417c01","observation_id":"dcf0c166-97c9-49be-9df9-6aa4200c2fde","resolution":{"observed_at":"2026-08-11T10:36:28.434433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:36:28.361661Z","title":"LoRA: Low-rank adaptation of large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.16474","last_updated":"2024-12-21T04:05:43Z","snapshot_observed_at":"2026-08-18T03:15:17.464595Z","submitted_at":"2024-12-21T04:05:43Z","title":"Enhancing Multilingual ASR for Unseen Languages via Language Embedding Modeling","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T10:36:28.361661Z"},"links":{"citing_paper":"/paper/2412.16474"},"observation_digest":"sha256:dca32238291d24d21e8f82bacf758565a843cb190726b52a530c07053ffcd4b1","observation_id":"2c510af8-a774-4878-8ef1-8f615c9871b4","resolution":{"observed_at":"2026-08-11T10:36:28.361661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.16474","last_updated":"2024-12-21T04:05:43Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-18T03:15:17.464595Z","submitted_at":"2024-12-21T04:05:43Z","title":"Enhancing Multilingual ASR for Unseen Languages via Language Embedding Modeling"},"reference_resolution":{"displayed":14,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":1,"verified_fuzzy":7},"total_outbound_references":14},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 14 of 14 outbound references and 0 inbound Pith citation observations for arXiv:2412.16474."}