{"as_of":"2026-08-22T01:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:34c396b6f737378b1d40bfe8251de124ea869d651f67472c6375dc3fb46da2ad","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:56:09.139143Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:56:06.320265Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T14:56:09.326991Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"cited_work":{"arxiv_id":"2505.16991","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.16991","snapshot_observed_at":"2026-08-07T14:56:09.326991Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","venue":"cs.CV","work_id":"df47294e-3a30-4aaf-aa65-ca082fe81f82","year":2025},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:06.320265Z"},"links":{"cited_paper":"/paper/2505.16991","citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:36002f82756e56db216bd7c4bef3126395633cec2943ea8bf87390b22b3ad23a","observation_id":"a4c72ba3-40cc-4009-b31e-f6006ae35ce8","resolution":{"observed_at":"2026-08-07T14:56:09.435784Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.16991/citation-record","integrity":"/paper/2505.16991/integrity","json":"/paper/2505.16991/citation-record.json","paper":"/paper/2505.16991"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:56:16.408503Z","title":"Several efforts have been directed to create user and device-personalized models with adaptable model sizes while minimizing the latency using different tech- niques","venue":null,"work_id":"302bd250-9abf-42b9-9981-328b6f961953","year":null},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:06.252544Z"},"links":{"citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:f75af7bd6ff001ef8a11de8bf9613ca7e027b3e64c8bdec155df6c784b109ebf","observation_id":"becd972f-c10c-4ce3-acf5-626035daad5b","resolution":{"observed_at":"2026-08-07T14:56:16.493633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"cited_work":{"arxiv_id":"2505.16991","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.16991","snapshot_observed_at":"2026-08-07T14:56:09.326991Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","venue":"cs.CV","work_id":"df47294e-3a30-4aaf-aa65-ca082fe81f82","year":2025},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:06.320265Z"},"links":{"cited_paper":"/paper/2505.16991","citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:36002f82756e56db216bd7c4bef3126395633cec2943ea8bf87390b22b3ad23a","observation_id":"a4c72ba3-40cc-4009-b31e-f6006ae35ce8","resolution":{"observed_at":"2026-08-07T14:56:09.435784Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:56:16.081718Z","title":null,"venue":null,"work_id":"ba413b23-932b-4f4b-a611-b232851da7ab","year":null},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:06.387225Z"},"links":{"citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:51cacfb5e2cb036270e3f6f2a0aabd769187fc1f5fbb4af683c3175103f8ee12","observation_id":"588f2426-8a7e-4a68-a927-a1cefcf4c5da","resolution":{"observed_at":"2026-08-07T14:56:16.258713Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:56:15.762096Z","title":null,"venue":null,"work_id":"de9752a9-806c-4c2b-80d2-58778ecc6e79","year":null},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:06.447445Z"},"links":{"citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:b05a86c5ee5a3d648ef69d2c27597418554415dacd0af90cdf3f662f80a7b5a4","observation_id":"46abc907-3433-49ba-9c8b-696afd8cb9d2","resolution":{"observed_at":"2026-08-07T14:56:15.956298Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:56:15.391081Z","title":"We demon- strated that a reference model can be employed to train a general light-weight encoder-only model that serves as a starting point for multiple light-weight networks","venue":null,"work_id":"4d81d803-49ac-461e-a365-2d115aeb09a7","year":null},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:06.550915Z"},"links":{"citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:7cf51aaa7994f058bbeacb80e088cb6da784ceb320cb4a6e28b0a13575fbf668","observation_id":"91aedfd0-a353-4465-b304-e585c0ae8e86","resolution":{"observed_at":"2026-08-07T14:56:15.577334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:56:15.190780Z","title":"Towards a person- alized clustered federated learning: A speech recognition case study,","venue":null,"work_id":"8d8c9628-12f8-4404-b8a0-2670d6a29701","year":2023},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:06.667031Z"},"links":{"citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:821a0ffb8f0b94f4b04e247147c74d5d63c2649524e1eb08055b202c698198da","observation_id":"2bead725-4fcc-48c3-a418-e52ee3c2f6aa","resolution":{"observed_at":"2026-08-07T14:56:15.275108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:56:14.987919Z","title":"W H2D2N 2: Distributed ai-enabled ok-asn ser- vice for web of things,","venue":null,"work_id":"8d1153bb-39ad-48cf-af90-7292b0ca275b","year":2023},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:06.748830Z"},"links":{"citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:e2160002005d8ced837874057be76452e66738d2fc4aeb11ae33a2f0f7754785","observation_id":"41471538-9722-48bd-b731-a7062fa127dd","resolution":{"observed_at":"2026-08-07T14:56:15.100430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:56:14.692545Z","title":"Learned token pruning for transformers,","venue":null,"work_id":"26168ca4-ccda-4268-a393-54ec799c996c","year":2022},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:06.835969Z"},"links":{"citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:ea165c4d6b7afd9b9ffcd6344b5cbffae1c56515799d8743e3d376ffb6634a96","observation_id":"a865f602-2956-4414-b51d-62e233be56e7","resolution":{"observed_at":"2026-08-07T14:56:14.840824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:56:14.427144Z","title":"Model compression by iterative pruning with knowledge distillation and its application to speech enhancement","venue":null,"work_id":"19689720-a7eb-4c6a-b471-538bb89c8d1b","year":2022},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:06.878994Z"},"links":{"citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:2b26ed5ec4624464a65e4062a355199c962fdf48fe76b441859ed6ad09ebc4e7","observation_id":"ab94d42a-a975-41b1-973d-d86baecd85c7","resolution":{"observed_at":"2026-08-07T14:56:14.524029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:56:14.190970Z","title":"Quantization aware training with absolute-cosine regularization for automatic speech recognition,","venue":null,"work_id":"6ed4f1be-ddd2-44a7-aa6f-1956f4428c5c","year":2020},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:06.903508Z"},"links":{"citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:4d85d904363415d500dea26f30ef84872a84bc0f7bb9bb2dbb4dae41b3a83f44","observation_id":"9077db30-5bdc-4cd5-94c9-2cbe5afde5bd","resolution":{"observed_at":"2026-08-07T14:56:14.323149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:56:13.897008Z","title":"Lightweight and efficient end-to-end speech recognition using low-rank trans- former,","venue":null,"work_id":"b0a0121e-ad32-4347-9f14-74188a210d1c","year":2020},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:06.952311Z"},"links":{"citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:3a276c871d8b0385ecb7277445016cc18b94626e90d975a365155d2bf9ca55bd","observation_id":"4291995d-7a60-491f-808d-94141c7710e0","resolution":{"observed_at":"2026-08-07T14:56:14.033124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:56:13.602626Z","title":"Bottleneck low-rank transformers for low-resource spoken language understanding,","venue":null,"work_id":"d05dd74a-3185-46f9-937e-7e0bbc490c4c","year":2022},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:07.008623Z"},"links":{"citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:572f472f12edbb3b0cad5d3c9c35ec1819164f19769ad6f481c30ef7918fa82a","observation_id":"3acea7ac-9c1f-419f-905e-7a1827df3b23","resolution":{"observed_at":"2026-08-07T14:56:13.744248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:56:13.329045Z","title":"Student- teacher network learning with enhanced features,","venue":null,"work_id":"f28d6618-3e55-4d39-b219-d3f704af7b9f","year":2017},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:07.150947Z"},"links":{"citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:56a55b994ced9c46d3677c9ea20dbaf0a49f94e0a70f9feeddd5e0e9b7a11c1b","observation_id":"565a79af-bb46-409c-b9a3-3424d2899150","resolution":{"observed_at":"2026-08-07T14:56:13.461244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:56:13.008262Z","title":"Efficient knowledge distillation from an ensemble of teachers","venue":null,"work_id":"12c2e5d6-09ea-472a-a8ff-a274b6f7c663","year":2017},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:07.235879Z"},"links":{"citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:5fedc90e5221778a5a6cbc108c5723a9fbf18cef5ae6b18d2cd742d4e7cef9f3","observation_id":"df5e65bc-8253-4a15-9a39-4eebc9db7e69","resolution":{"observed_at":"2026-08-07T14:56:13.162473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:56:12.751417Z","title":"Investigation of sequence-level knowledge distillation methods for ctc acoustic models,","venue":null,"work_id":"93d64deb-2a55-4d16-84fc-1b90144126da","year":2019},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:07.317402Z"},"links":{"citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:976f273ae6e535fd94ab4649afb388925c6496b66dec1db20e3c81d2edbc9c25","observation_id":"34045991-64f8-4d0d-b5d8-fb0e56913818","resolution":{"observed_at":"2026-08-07T14:56:12.871342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:56:12.529178Z","title":"Knowledge distillation from offline to streaming rnn transducer for end-to-end speech recognition","venue":null,"work_id":"2a95bf1e-6e62-4555-bd89-704c15df9fbb","year":2020},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:07.396821Z"},"links":{"citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:7ae8df83c0e790f3c6bbc34ab9ccf1b65f6f28d950b279420a58b235a018f1b1","observation_id":"0b1c2633-49cf-4968-a416-884859b71f50","resolution":{"observed_at":"2026-08-07T14:56:12.623820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:56:12.283441Z","title":"Tutornet: Towards flexible knowledge distillation for end-to-end speech recognition,","venue":null,"work_id":"576ec435-7fae-428b-a411-3150e6168a0e","year":2021},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:07.482036Z"},"links":{"citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:742a2711254416b24af68b915599c6d49f398c9c9b3a93e4a298d38923277f80","observation_id":"cd74b51c-d49e-4ec6-a06e-b9d7c7618f1e","resolution":{"observed_at":"2026-08-07T14:56:12.397946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:56:12.037339Z","title":"Knowledge distillation via module re- placing for automatic speech recognition with recurrent neural network transducer,","venue":null,"work_id":"75049da4-cb1e-4eb7-8725-5edfd5533e38","year":2022},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:07.543455Z"},"links":{"citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:f22d7d9d2c6d5a6aaf03c72b4503b1bbfe88d1c4a375bc2a32356dbe3e15e7b8","observation_id":"35d881b5-2f15-4415-983b-b432cc54471d","resolution":{"observed_at":"2026-08-07T14:56:12.165394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:56:11.732483Z","title":"Cons-kd: Dropout-robust knowledge distillation for ctc-based automatic speech recognition,","venue":null,"work_id":"612e18e4-cdfc-4288-8344-69c1ca8cc041","year":2024},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:07.641457Z"},"links":{"citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:ea582bf9375ac25ecd543ec285755651b08d5398b8ed421fcc03b9812829041f","observation_id":"baad5a5c-f6d1-4e74-8e1f-f6c9fc059ca6","resolution":{"observed_at":"2026-08-07T14:56:11.901129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:56:11.392791Z","title":"Sparsification via compressed sensing for automatic speech recognition,","venue":null,"work_id":"a5ae3b7f-5ef5-4fe1-9657-da757f8db9f0","year":2021},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:07.757592Z"},"links":{"citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:0a3d6444fde52246c7d561767040cac53677aa2b00f2de6b2c0437e1fcd81f89","observation_id":"85f826db-de47-4273-9f69-94336b8d6501","resolution":{"observed_at":"2026-08-07T14:56:11.563828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:56:11.214467Z","title":"Dynamic data pruning for automatic speech recognition,","venue":null,"work_id":"37ea7f01-1404-4107-8e9f-fe2fa83b55ef","year":2024},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:07.863674Z"},"links":{"citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:977c69184c5a8a78f85922641b897bd2b1eb08c23cb0feb70d45142b86143188","observation_id":"e7fa9a57-c8ef-4ab5-ab96-b37719985668","resolution":{"observed_at":"2026-08-07T14:56:11.273557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.09546","last_updated":"2024-02-22T15:10:06Z","snapshot_observed_at":"2026-08-21T12:44:01.806563Z","submitted_at":"2023-09-18T07:45:16Z","title":"Training dynamic models using early exits for automatic speech recognition on resource-constrained devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.09546","snapshot_observed_at":"2026-08-07T14:56:07.925702Z","title":"Training dynamic models using early exits for automatic speech recognition on resource- constrained devices,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:07.925702Z"},"links":{"cited_paper":"/paper/2309.09546","citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:c3235217169ac9b249f1568dd6d7eb0dc1dbf6973ba966b12be60f4e016b6c20","observation_id":"9cd95ea9-bf88-49dc-8fab-8b104d3d0a18","resolution":{"observed_at":"2026-08-07T14:56:07.925702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:56:10.993639Z","title":"LDASR: An experi- mental study on layer drop using conformer-based architecture,","venue":null,"work_id":"8414b654-006f-4838-baa7-8365b0e4541b","year":2024},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:07.988399Z"},"links":{"citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:60e936aea5a166ba0c8d19906836e7992f79d7895fef6eff345673c05e7e33c1","observation_id":"68f22dc9-9e8c-4e98-84b6-1dc6d7fe45ba","resolution":{"observed_at":"2026-08-07T14:56:11.065026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:56:10.852344Z","title":"Fine-tuning strategies for faster inference using speech self-supervised models: a comparative study,","venue":null,"work_id":"4fb8a129-3760-4057-a26a-1a97f9371d06","year":2023},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:08.056263Z"},"links":{"citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:7a1e2f3cfd2fccc9ddbccb2c1c5de15c9396ab39ab00faf56519e36864588a9b","observation_id":"2eb45c1c-2a34-4f4a-8659-07a673d60f61","resolution":{"observed_at":"2026-08-07T14:56:10.912560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:56:10.618566Z","title":"Masked autoencoders are scalable vision learners,","venue":null,"work_id":"f3971cd0-87ca-40fb-b850-cc72026fde82","year":2022},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:08.117702Z"},"links":{"citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:d60c98694da520ddedb65b0cb55b439570b69ebd4fd09e52148a58e4e0c8cc9a","observation_id":"27064111-8296-40dc-b0cd-1d2893a62216","resolution":{"observed_at":"2026-08-07T14:56:10.724630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:56:10.457207Z","title":"Rethinking transformers pre-training for multi- spectral satellite imagery,","venue":null,"work_id":"c2c8f7fd-b719-493e-9ecf-c4ab89cb4cfd","year":2024},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:08.242941Z"},"links":{"citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:be0a210c7b88e332d9e7c58ca6c83b752328818cdce8abb96c519bdec958ae24","observation_id":"08319fbb-f1d8-4ef3-b365-620b90385792","resolution":{"observed_at":"2026-08-07T14:56:10.516006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-07T14:56:08.366164Z","title":"Distilling the knowledge in a neural network,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:08.366164Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:c093b1860d496091f5551e1e534720d65b6c24fe37854f346639a15d62d91187","observation_id":"31a64396-f494-416c-9753-76d5da3b60eb","resolution":{"observed_at":"2026-08-07T14:56:08.366164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:56:10.230517Z","title":"Lessons from build- ing acoustic models with a million hours of speech,","venue":null,"work_id":"9988f337-9587-4eb3-95eb-0a38b5f43ccd","year":2019},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:08.484558Z"},"links":{"citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:e9874ab88446923d67029f7aff67ccd5a298ec583a99db85b0c7fd8d54674cc5","observation_id":"d86f999c-d8fb-4367-88c7-d359fc071c05","resolution":{"observed_at":"2026-08-07T14:56:10.357423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:56:08.623944Z","title":"Comparing kullback-leibler divergence and mean squared error loss in knowledge distillation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:08.623944Z"},"links":{"citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:799940d7b73e478574626e88d8bad629e01e6c26ee3a3658348fafc088210530","observation_id":"d7cd1a3d-553a-43af-b53e-d3bd5113f7c4","resolution":{"observed_at":"2026-08-07T14:56:08.623944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:56:10.068589Z","title":"SentencePiece: A simple and lan- guage independent subword tokenizer and detokenizer for neural text processing,","venue":null,"work_id":"50a550c2-2950-461f-a0db-6d2247e63599","year":2018},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:08.820352Z"},"links":{"citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:5567be1e13f93c9ec047534c3e8bc479b45c98627593fca6d2ab3ac20e5f11b6","observation_id":"607c16d4-c0d3-4455-be09-cbca99171298","resolution":{"observed_at":"2026-08-07T14:56:10.129839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:56:08.897488Z","title":"Specaugment: A simple data augmentation method for automatic speech recognition,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:08.897488Z"},"links":{"citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:355cc8fceed1edd649cdcd631edff33af4230d6dff55114a3db360fa543c1d92","observation_id":"45d28b19-9124-4b2f-b737-202686025a65","resolution":{"observed_at":"2026-08-07T14:56:08.897488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:56:09.794297Z","title":"Librispeech: an asr corpus based on public do- main audio books,","venue":null,"work_id":"419d5f8b-52b1-406b-b004-6aa21de56c50","year":2015},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:09.029367Z"},"links":{"citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:0d857e18777ee3645225019be8990751173f138581ebca6fa70e524ef04214dd","observation_id":"e1fd0297-873d-41b9-8675-6bb7a81e7dcb","resolution":{"observed_at":"2026-08-07T14:56:09.889418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:56:09.611065Z","title":"TED-LIUM 3: Twice as much data and corpus repartition for experiments on speaker adaptation,","venue":null,"work_id":"ee99e11c-c6f0-428f-b040-f7fd6da91474","year":2018},"citing_paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:56:09.139143Z"},"links":{"citing_paper":"/paper/2505.16991"},"observation_digest":"sha256:fcbce1221f6859ac8169dc315524e536b62ab0ae7501466b608232f3ffc905f0","observation_id":"82362cbb-e839-4a10-a679-a7276c4ef6c4","resolution":{"observed_at":"2026-08-07T14:56:09.726646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.16991","last_updated":"2025-05-28T17:19:11Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T02:04:05.904581Z","submitted_at":"2025-05-22T17:55:09Z","title":"An Effective Training Framework for Light-Weight Automatic Speech Recognition Models"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":2,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":4,"verified_exact":0,"verified_fuzzy":26},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 1 inbound Pith citation observation for arXiv:2505.16991."}