{"as_of":"2026-08-08T21:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b9a8410408f228f5bdf2fb0f938b2b0c4f540cfe86a49da7d215ed935c26279f","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:50:42.272617Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T17:06:02.978205Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-28T17:12:25.094606Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-08T04:51:37.440732Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"cited_work":{"arxiv_id":"2506.15912","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.15912","snapshot_observed_at":"2026-06-28T17:12:25.094606Z","title":"arXiv preprint arXiv:2506.15912 , year=","venue":null,"work_id":"b9ac0537-8c85-4442-928d-5d386c989e43","year":null},"citing_paper":{"arxiv_id":"2606.01483","last_updated":"2026-05-31T22:54:57Z","snapshot_observed_at":"2026-08-04T15:12:58.596963Z","submitted_at":"2026-05-31T22:54:57Z","title":"MURMUR: An Efficient Inference System for Long-Form ASR","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-06-28T17:06:02.978205Z"},"links":{"cited_paper":"/paper/2506.15912","citing_paper":"/paper/2606.01483"},"observation_digest":"sha256:fd67f04441036c837c066221a199cca1f78fd007e26a82e3ef57342994898794","observation_id":"3bcdc5c7-b931-4a93-be1d-fcedcbffbd8b","resolution":{"observed_at":"2026-06-28T17:12:25.096232Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.15912/citation-record","integrity":"/paper/2506.15912/integrity","json":"/paper/2506.15912/citation-record.json","paper":"/paper/2506.15912"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:50:39.956510Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-08T04:51:37.440732Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:39.956510Z"},"links":{"citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:30992cc318b9351edb0f9b04b355b5e2d77a7f22085d794f2f516f5800e849db","observation_id":"26ce869f-231e-499e-bdd1-b62011b308c2","resolution":{"observed_at":"2026-08-06T23:50:39.956510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:50:40.073181Z","title":"Robust speech recognition via large-scale weak supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-08T04:51:37.440732Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:40.073181Z"},"links":{"citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:9022c43874a5238605ef0393c1f5a04360bca52886fc4ca5d93b088cc66d02c3","observation_id":"3e84de91-8dc8-4294-ac93-0fb066ed728f","resolution":{"observed_at":"2026-08-06T23:50:40.073181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:50:42.825103Z","title":"Connectionist temporal classification: labelling unsegmented sequence data with recurrent neural networks","venue":null,"work_id":"fd25f95d-f2f2-4f1a-b8dc-0fbd42569969","year":2006},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-08T04:51:37.440732Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:40.164196Z"},"links":{"citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:e3f8a36a141bb0cd5bcb03189b3d63144e91104a92c8056ba16d5e6cb47e93ea","observation_id":"83cdc81e-a577-44c0-bde0-e5cdcbd47554","resolution":{"observed_at":"2026-08-06T23:50:42.831913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:50:42.808490Z","title":"Deep speech 2: End-to-end speech recognition in english and mandarin","venue":null,"work_id":"8db2f388-d1fb-489a-b3ea-82c72b878a6b","year":2016},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-08T04:51:37.440732Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:40.267997Z"},"links":{"citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:dde093749027ed998fd30d3e4ea820ea49c6ad21bda0e330343aaa90d206c85b","observation_id":"2a67118d-367b-40d9-b616-412eceffdb5c","resolution":{"observed_at":"2026-08-06T23:50:42.813926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:50:40.347475Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-08T04:51:37.440732Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:40.347475Z"},"links":{"citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:f4d21d5b2ef28add9a8b13c39d76d6912df34761f4ab559e7e574615336a60b4","observation_id":"c4b9d66e-34a6-4e9e-b97f-70bc1ae30a98","resolution":{"observed_at":"2026-08-06T23:50:40.347475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:50:42.779752Z","title":"H2o: Heavy-hitter oracle for efficient generative inference of large language models","venue":null,"work_id":"0b4f0995-126e-49d9-9421-05764336b668","year":2023},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-08T04:51:37.440732Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:40.423618Z"},"links":{"citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:8af0b4f600872885417bce23e07ed3759501cb202687c25a24b7363c821a1b63","observation_id":"76fd6c3b-5e62-4340-8099-bf6eacd65f1a","resolution":{"observed_at":"2026-08-06T23:50:42.784989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:50:42.761876Z","title":"Q-hitter: A better token oracle for efficient llm inference via sparse-quantized kv cache","venue":null,"work_id":"68cd51d1-61f9-4a88-8342-0ddb14903c9c","year":2024},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-08T04:51:37.440732Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:40.518367Z"},"links":{"citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:08860b302c3a35fd170a28e88f42d53a5d5e1ed43764e2c2063457dc42216b3f","observation_id":"997644ed-6095-45ef-96f6-424797a9b466","resolution":{"observed_at":"2026-08-06T23:50:42.767720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:50:42.745815Z","title":"Spatten: Efficient sparse attention architecture with cascade token and head pruning","venue":null,"work_id":"de52e791-3f15-4693-a741-2ad8978ec708","year":2021},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-08T04:51:37.440732Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:40.589858Z"},"links":{"citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:56218fab4c38d84b1e93acd175881a1e4c22150503869391e15e672d9f62098f","observation_id":"90cf1147-ac60-4bd3-b0d5-59968017aac5","resolution":{"observed_at":"2026-08-06T23:50:42.750698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:50:40.692918Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-08T04:51:37.440732Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:40.692918Z"},"links":{"citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:75c288c956ff83d0699ccbae808389408b67b8901eab1d65c47117554c62e35c","observation_id":"e89276de-cf28-4e7f-998a-c29f91b6ca33","resolution":{"observed_at":"2026-08-06T23:50:40.692918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:50:40.794663Z","title":"Hubert: Self-supervised speech representation learning by masked prediction of hidden units","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-08T04:51:37.440732Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:40.794663Z"},"links":{"citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:bca6e57d8cc70243e7dd93906c42408ecddc82095e7a60ff10e585fa1860b45d","observation_id":"15e63d53-68e7-448a-aa24-e66523c58420","resolution":{"observed_at":"2026-08-06T23:50:40.794663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:50:40.864178Z","title":"Librispeech: An asr corpus based on public domain audio books","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-08T04:51:37.440732Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:40.864178Z"},"links":{"citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:c82b88ae9c4cee3ea1cf19152fb0c0a6a508372aae6404e267b43063f31444ff","observation_id":"bd3bdc37-5bfa-46be-97da-aca0e8db58c3","resolution":{"observed_at":"2026-08-06T23:50:40.864178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01037","last_updated":"2023-09-25T01:20:23Z","snapshot_observed_at":"2026-08-04T01:36:29.191456Z","submitted_at":"2023-03-02T07:47:18Z","title":"Google USM: Scaling Automatic Speech Recognition Beyond 100 Languages","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01037","snapshot_observed_at":"2026-08-06T23:50:40.931247Z","title":"Google USM : Scaling automatic speech recognition beyond 100 languages","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-08T04:51:37.440732Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:40.931247Z"},"links":{"cited_paper":"/paper/2303.01037","citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:f91feaed7b7f54a6c77fc221de722793185cd0e725184c63fa40db8044f3f276","observation_id":"95397d90-3010-4bef-8bdb-cc5a507f6417","resolution":{"observed_at":"2026-08-06T23:50:40.931247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09841","last_updated":"2024-04-16T14:55:13Z","snapshot_observed_at":"2026-08-02T02:02:01.128117Z","submitted_at":"2024-04-15T14:48:43Z","title":"Anatomy of Industrial Scale Multilingual ASR","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09841","snapshot_observed_at":"2026-08-06T23:50:41.036372Z","title":"Anatomy of industrial scale multilingual ASR","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-08T04:51:37.440732Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:41.036372Z"},"links":{"cited_paper":"/paper/2404.09841","citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:5224aea9d01ea373351d7eb1a1d7ad282c661dc78ed296547d16d31cee36bc59","observation_id":"32741414-4479-4748-b02d-4f9087946950","resolution":{"observed_at":"2026-08-06T23:50:41.036372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.08100","last_updated":"2020-05-16T20:56:25Z","snapshot_observed_at":"2026-08-08T15:18:32.322111Z","submitted_at":"2020-05-16T20:56:25Z","title":"Conformer: Convolution-augmented Transformer for Speech Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.08100","snapshot_observed_at":"2026-08-06T23:50:41.136057Z","title":"Conformer: Convolution-augmented transformer for speech recognition","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-08T04:51:37.440732Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:41.136057Z"},"links":{"cited_paper":"/paper/2005.08100","citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:312fc89ab73028966ebde2a04245d13e3d23448265ae69b10c07ef07747d989f","observation_id":"f9f662a8-0597-4ae8-9df8-e171d0b0d4d2","resolution":{"observed_at":"2026-08-06T23:50:41.136057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:50:42.707238Z","title":"Fast conformer with linearly scalable attention for efficient speech recognition","venue":null,"work_id":"2e45875f-46a6-4dd9-825e-e3fe5777167b","year":2023},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-08T04:51:37.440732Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:41.237754Z"},"links":{"citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:d46879f584c76580551cf7fd4794a3596329e712bec72cfa7b386f5cca31f929","observation_id":"5a1b4535-e985-4949-a607-69efe96e2106","resolution":{"observed_at":"2026-08-06T23:50:42.712311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1211.3711","last_updated":"2012-11-14T19:25:21Z","snapshot_observed_at":"2026-07-06T02:59:58.238741Z","submitted_at":"2012-11-14T19:25:21Z","title":"Sequence Transduction with Recurrent Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1211.3711","snapshot_observed_at":"2026-08-06T23:50:41.251767Z","title":"Sequence transduction with recurrent neural networks","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-08T04:51:37.440732Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:41.251767Z"},"links":{"cited_paper":"/paper/1211.3711","citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:601452d5011ccde55927d1f946196e910a4c9703be89ee5331456118eb53b5f0","observation_id":"14f26328-9095-4d51-b5f5-7559eb1cf5a4","resolution":{"observed_at":"2026-08-06T23:50:41.251767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:50:42.690223Z","title":"Rnn-transducer with stateless prediction network","venue":null,"work_id":"15f9c207-a0b2-4e4f-a778-4db6250f30c0","year":2020},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-08T04:51:37.440732Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:41.351194Z"},"links":{"citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:fe0161e63c5e2154cc882fc7060f2aeb349c9d452ffb089f4c5bfbedb91174f8","observation_id":"9c1766b8-510a-49ff-ae85-94215d4d34e1","resolution":{"observed_at":"2026-08-06T23:50:42.696003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.13236","last_updated":"2022-06-23T12:18:03Z","snapshot_observed_at":"2026-07-06T13:25:02.101053Z","submitted_at":"2022-06-23T12:18:03Z","title":"Pruned RNN-T for fast, memory-efficient ASR training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.13236","snapshot_observed_at":"2026-08-06T23:50:41.514296Z","title":"Pruned rnn-t for fast, memory-efficient asr training","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-08T04:51:37.440732Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:41.514296Z"},"links":{"cited_paper":"/paper/2206.13236","citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:6d9177f5e33ea0368bf81eb6a4c668013f00e79c6b87e7fe120e2410ad56e3dd","observation_id":"8af9b248-f005-44d7-92dd-4316206f3101","resolution":{"observed_at":"2026-08-06T23:50:41.514296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:50:41.682676Z","title":"End-to-end speech recognition: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-08T04:51:37.440732Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:41.682676Z"},"links":{"citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:3ef6f814cd92a67494833118f74472342abae64fc6be6f76cb40bd860e8c143f","observation_id":"9d614886-8b84-4d78-b17f-4fe27420b3be","resolution":{"observed_at":"2026-08-06T23:50:41.682676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:50:42.661054Z","title":"Revisiting convolution-free transformer for speech recognition","venue":null,"work_id":"0ff3d6c8-da61-4871-9c6e-5b3213032eb3","year":2024},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-08T04:51:37.440732Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:41.799689Z"},"links":{"citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:c74288909172f9f2628c22c0be5970424dbeb04682852164e7bbb0d56f8a29b9","observation_id":"58f0a47e-1010-49be-bcdc-91741a049313","resolution":{"observed_at":"2026-08-06T23:50:42.667695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00430","last_updated":"2023-11-01T10:45:07Z","snapshot_observed_at":"2026-08-08T04:51:03.844048Z","submitted_at":"2023-11-01T10:45:07Z","title":"Distil-Whisper: Robust Knowledge Distillation via Large-Scale Pseudo Labelling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.00430","snapshot_observed_at":"2026-08-06T23:50:41.917000Z","title":"Distil-whisper: Robust knowledge distillation via large-scale pseudo labelling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-08T04:51:37.440732Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:41.917000Z"},"links":{"cited_paper":"/paper/2311.00430","citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:767ba678901704dd801b8a529e92952c04cfc47b13ebbedb058daecc92dce774","observation_id":"85b300a6-aef3-41b2-9a6f-a8d16749ac7f","resolution":{"observed_at":"2026-08-06T23:50:41.917000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:50:42.065387Z","title":"Open automatic speech recognition leaderboard","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-08T04:51:37.440732Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:42.065387Z"},"links":{"citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:f8d67f7efc7f6e3444195666f875289aa090f0e17837f39d4289afe116e608c4","observation_id":"879b87ea-8624-420a-b173-b84d76cdc715","resolution":{"observed_at":"2026-08-06T23:50:42.065387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20583","last_updated":"2025-08-23T22:42:54Z","snapshot_observed_at":"2026-08-07T17:41:27.808822Z","submitted_at":"2025-02-27T22:52:21Z","title":"LiteASR: Efficient Automatic Speech Recognition with Low-Rank Approximation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20583","snapshot_observed_at":"2026-08-06T23:50:42.212436Z","title":"Liteasr: Efficient automatic speech recognition with low-rank approximation, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-08T04:51:37.440732Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:42.212436Z"},"links":{"cited_paper":"/paper/2502.20583","citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:7b23194ba076002d53d8eefabd8d3d2cddef13122c67d201765ce7c37e2ee406","observation_id":"6a56947a-7a5e-4744-b517-e26ea3759166","resolution":{"observed_at":"2026-08-06T23:50:42.212436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08691","last_updated":"2023-07-17T17:50:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-17T17:50:36Z","title":"FlashAttention-2: Faster Attention with Better Parallelism and Work Partitioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08691","snapshot_observed_at":"2026-08-06T23:50:42.272617Z","title":"Flashattention-2: Faster attention with better parallelism and work partitioning, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-08T04:51:37.440732Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:42.272617Z"},"links":{"cited_paper":"/paper/2307.08691","citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:41909c8101aa8df6a2c45b66b6ed5f34dc97b393558d6434060aef1dfc6cf35b","observation_id":"8941e34a-217b-4d57-a048-60a501fed8a9","resolution":{"observed_at":"2026-08-06T23:50:42.272617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T04:51:37.440732Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":8},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 1 inbound Pith citation observation for arXiv:2506.15912."}