{"as_of":"2026-08-18T21:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8b7f404266392ada83a260a557fd00718fb1cdbbb28cf5de436f540e70db6901","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T18:31:06.776115Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T18:31:06.652611Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-15T18:31:06.981463Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"cited_work":{"arxiv_id":"2506.19761","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.19761","snapshot_observed_at":"2026-08-15T18:31:06.981463Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","venue":"cs.CL","work_id":"feb5eafe-3013-4251-ba81-24782d935fce","year":2025},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.652611Z"},"links":{"cited_paper":"/paper/2506.19761","citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:e33d5578bac02076c520fd4e5334f0c927d8bdfed833db87ee949c2a53f6ef7c","observation_id":"b17b0a7f-f1f3-4141-8b9e-5a2ea6f8e74c","resolution":{"observed_at":"2026-08-15T18:31:06.984960Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.19761/citation-record","integrity":"/paper/2506.19761/integrity","json":"/paper/2506.19761/citation-record.json","paper":"/paper/2506.19761"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:31:07.276282Z","title":"However, Transformers, especially their multi-head attention (MHA) component, are ill-suited for long- form ASR due to quadratic time/memory complexity in se- quence length","venue":null,"work_id":"a4cdbf5f-4d7e-4c47-9d5a-3d5ddadc5d9e","year":null},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.628977Z"},"links":{"citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:19b24ba113af356512df7daa9cf6126b3c80ec526fb24b8e40d0d6effa9c4f9c","observation_id":"978480a1-5261-4599-ab02-70a9963c077c","resolution":{"observed_at":"2026-08-15T18:31:07.279745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:31:07.266581Z","title":"Recently, several layer types have been introduced that mimic the properties of MHA while having linear time and memory complexity in sequence length","venue":null,"work_id":"63940b19-53dd-4e3e-852b-d750b0ff514d","year":null},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.632815Z"},"links":{"citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:eaee3f537e7fee30c4fc6ac5f3e7b125225752599af9e40709073d2dd7953ffe","observation_id":"c56b04a4-d102-47f2-8ed6-c78a1e85c1e2","resolution":{"observed_at":"2026-08-15T18:31:07.270003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:31:07.254895Z","title":"Bidi- rectional RWKV-Conformer is more efficient than standard Conformer and limited-context attention with global tokens","venue":null,"work_id":"f7c8cdde-fe07-4279-9dd5-389df48460ce","year":null},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.636159Z"},"links":{"citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:d73166b0dc3b8365e2ac394219b0f7bf759e1ca4fec2ef7d426bc7bd4ae7fa1b","observation_id":"0556f91a-3218-43bf-87d8-759f10403329","resolution":{"observed_at":"2026-08-15T18:31:07.259165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:31:07.212041Z","title":null,"venue":null,"work_id":"2c62aa4b-63b2-4a58-957e-4f4d8265f63f","year":null},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.649432Z"},"links":{"citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:a0467a34c136cb724da3341ddcac4a4ba2dc1ffbaacfb92d9baef243765f89f1","observation_id":"c5c4f5b4-b1f4-4ce5-89f3-a99fb58b3dc8","resolution":{"observed_at":"2026-08-15T18:31:07.216044Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:31:07.233429Z","title":null,"venue":null,"work_id":"4eb32c53-f966-408e-b332-a8b28e335ad2","year":null},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.642581Z"},"links":{"citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:3887c5b4ba4bf6f7895c1ee1a92dfc6fd1696be9ca68ae8bb40c6028a980fd93","observation_id":"54d97e29-6144-4be8-8d8a-ef2e8daa8ef8","resolution":{"observed_at":"2026-08-15T18:31:07.236777Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:31:07.243069Z","title":null,"venue":null,"work_id":"491d8517-d0f0-4576-8d12-0874376e0388","year":null},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.639376Z"},"links":{"citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:fd9b109205b3c3d142ef9d504f7c3ea7d381de287d57090a3a5073da701ceb0f","observation_id":"30e807e7-b7cd-4dfe-85db-0d8e50b8f6a6","resolution":{"observed_at":"2026-08-15T18:31:07.247044Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:31:07.223094Z","title":null,"venue":null,"work_id":"55d26d0d-4e71-4942-9a71-0a37450b9e4d","year":null},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.645825Z"},"links":{"citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:8301db2a3111dbda6bb34398d84c5529983bb49eb7651d6ef3906b2d3152eacd","observation_id":"0b2428a1-5cec-48db-91c2-3f3886bdef7b","resolution":{"observed_at":"2026-08-15T18:31:07.226697Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"cited_work":{"arxiv_id":"2506.19761","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.19761","snapshot_observed_at":"2026-08-15T18:31:06.981463Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","venue":"cs.CL","work_id":"feb5eafe-3013-4251-ba81-24782d935fce","year":2025},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.652611Z"},"links":{"cited_paper":"/paper/2506.19761","citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:e33d5578bac02076c520fd4e5334f0c927d8bdfed833db87ee949c2a53f6ef7c","observation_id":"b17b0a7f-f1f3-4141-8b9e-5a2ea6f8e74c","resolution":{"observed_at":"2026-08-15T18:31:06.984960Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:31:07.199091Z","title":"For all models in this paper, we maintain the same overall architecture, the same Conformer layer structure, and the same parameters for all convolutional and linear layers","venue":null,"work_id":"359dcbcd-31c2-4fd5-92c1-8a4caa0f0a90","year":null},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.656062Z"},"links":{"citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:b7c1b49ff9a9b82086071d63658311c8b92f28b372143baa054974ca44eee8af","observation_id":"f9fbea96-0b35-447a-8b8b-27e43f77e65e","resolution":{"observed_at":"2026-08-15T18:31:07.203246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:31:07.188040Z","title":"SF” (short-form), we performed training on the stan- dard segments released with the dataset, which have an average length of 4.4 seconds. For long-form training (“LF","venue":null,"work_id":"7225f33d-6d81-49f6-be73-dee8e7f96cea","year":null},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.659608Z"},"links":{"citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:8efbc45cec0e6de87bf6197c0ba1cc2738dd8e511f7ef5a15c64af1e593d118f","observation_id":"5d87758b-0080-4f0c-adca-e30cce1f4590","resolution":{"observed_at":"2026-08-15T18:31:07.191568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:31:07.177396Z","title":"Short-Form ASR Table 1: MHA vs","venue":null,"work_id":"ac9a4e12-eda6-4db9-82c2-cf787bc4e6ca","year":null},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.662712Z"},"links":{"citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:4416552e0b0abeb4b652a0759f732f495b80ee28bd3ec8c3d4ddcc853aa56173","observation_id":"36b18f25-ded7-41a8-a761-f142b8e84e9d","resolution":{"observed_at":"2026-08-15T18:31:07.180649Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:31:07.165808Z","title":"Our bi-RWKV- Conformer matches or exceeds MHA and limited-context MHA accuracy, while processing more audio per second","venue":null,"work_id":"08f39fd5-00b5-4193-86d9-c82c28ccd843","year":null},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.666232Z"},"links":{"citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:8c5b4b36aba9e867394ea701d66b85f09e29029a66dd4b10a603bb744c6ed503","observation_id":"92d8ce2c-3b7f-48de-a52b-7db93f5bc23e","resolution":{"observed_at":"2026-08-15T18:31:07.169593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04356","last_updated":"2022-12-06T18:46:04Z","snapshot_observed_at":"2026-08-16T23:32:22.645653Z","submitted_at":"2022-12-06T18:46:04Z","title":"Robust Speech Recognition via Large-Scale Weak Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04356","snapshot_observed_at":"2026-08-15T18:31:06.669637Z","title":"Robust speech recognition via large- scale weak supervision,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.669637Z"},"links":{"cited_paper":"/paper/2212.04356","citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:df2df0c965db1f1a7825d33728510b6521ef565590cad572b97d2b7dbb2f119f","observation_id":"95d28f30-37d1-4977-bd8c-f8330285c00e","resolution":{"observed_at":"2026-08-15T18:31:06.669637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13048","last_updated":"2023-12-11T03:58:56Z","snapshot_observed_at":"2026-08-17T17:58:38.402665Z","submitted_at":"2023-05-22T13:57:41Z","title":"RWKV: Reinventing RNNs for the Transformer Era","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13048","snapshot_observed_at":"2026-08-15T18:31:06.673368Z","title":"RWKV: Reinventing RNNs for the transformer era,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.673368Z"},"links":{"cited_paper":"/paper/2305.13048","citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:01c36ecfdd89bbacb0d429370e610e344013f9621afbb08dde214e6ed8530983","observation_id":"8d20eee8-ac63-4f62-97bd-c5c67c3d2ad4","resolution":{"observed_at":"2026-08-15T18:31:06.673368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05892","last_updated":"2024-09-26T22:39:08Z","snapshot_observed_at":"2026-08-12T16:03:56.235250Z","submitted_at":"2024-04-08T22:20:59Z","title":"Eagle and Finch: RWKV with Matrix-Valued States and Dynamic Recurrence","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05892","snapshot_observed_at":"2026-08-15T18:31:06.676738Z","title":"Eagle and Finch: RWKV with matrix-valued states and dynamic recur- rence,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.676738Z"},"links":{"cited_paper":"/paper/2404.05892","citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:b38fe389e46ccf3cd063069a9888ff854d3c48f4ab3878142924dfb1aea52a5b","observation_id":"a897cf3a-9733-4698-8043-244304e1ea88","resolution":{"observed_at":"2026-08-15T18:31:06.676738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-08-17T20:47:46.242385Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-15T18:31:06.680257Z","title":"Mamba: Linear-time sequence modeling with selective state spaces,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.680257Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:628bcd464f405e04d42a13c215e487c9ccdaf4daf8092f46e05335a245eae168","observation_id":"1590affa-4176-4a70-975a-84ba1f29b038","resolution":{"observed_at":"2026-08-15T18:31:06.680257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21060","last_updated":"2024-05-31T17:50:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-31T17:50:01Z","title":"Transformers are SSMs: Generalized Models and Efficient Algorithms Through Structured State Space Duality","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21060","snapshot_observed_at":"2026-08-15T18:31:06.683772Z","title":"Transformers are SSMs: Generalized models and efficient algorithms through structured state space duality,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.683772Z"},"links":{"cited_paper":"/paper/2405.21060","citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:bfc05829c645639fbe64712b91176f0822a4acb15011767e8c90948eaa4422ac","observation_id":"d611bead-e870-4a95-b2ce-1f440c62bf22","resolution":{"observed_at":"2026-08-15T18:31:06.683772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:31:07.152240Z","title":"Investigating end-to-end ASR architectures for long form audio transcription,","venue":null,"work_id":"0e2f660b-ffd4-440b-b9b5-990f940e8c09","year":2024},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.687734Z"},"links":{"citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:af9f82ff078d4bd71dcb54e3465ac353c3fa78f517aea530275e0356aa26c628","observation_id":"3179b27c-eb56-46be-b07a-ecf0eb990b66","resolution":{"observed_at":"2026-08-15T18:31:07.158012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.00396","last_updated":"2022-08-05T17:54:38Z","snapshot_observed_at":"2026-08-14T01:02:41.198730Z","submitted_at":"2021-10-31T03:32:18Z","title":"Efficiently Modeling Long Sequences with Structured State Spaces","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.00396","snapshot_observed_at":"2026-08-15T18:31:06.691266Z","title":"Efficiently modeling long sequences with structured state spaces,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.691266Z"},"links":{"cited_paper":"/paper/2111.00396","citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:4436789624ef487e9cad1f970a0e3f6339aee47f8253d2bb68d54970a2b60691","observation_id":"e42bf6c7-41da-4718-8478-9c047fea47c5","resolution":{"observed_at":"2026-08-15T18:31:06.691266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.14052","last_updated":"2023-04-29T03:18:40Z","snapshot_observed_at":"2026-08-18T19:17:21.619873Z","submitted_at":"2022-12-28T17:56:03Z","title":"Hungry Hungry Hippos: Towards Language Modeling with State Space Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.14052","snapshot_observed_at":"2026-08-15T18:31:06.694841Z","title":"Hungry hungry hippos: Towards language modeling with state space models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.694841Z"},"links":{"cited_paper":"/paper/2212.14052","citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:c2d0f0bfa06c512d6759eb32ad71c78afd7bb8a40287062f764054f06ef43a32","observation_id":"33e06311-7e2f-47c6-bdb2-9e31b006639e","resolution":{"observed_at":"2026-08-15T18:31:06.694841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12498","last_updated":"2023-05-25T21:55:58Z","snapshot_observed_at":"2026-08-16T15:31:20.346392Z","submitted_at":"2023-05-21T16:28:57Z","title":"Multi-Head State Space Model for Speech Recognition","version":2},"cited_work":{"arxiv_id":"2305.12498","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.12498","snapshot_observed_at":"2026-08-15T18:31:06.894233Z","title":"Multi-Head State Space Model for Speech Recognition","venue":"eess.AS","work_id":"8d9e7319-e7fd-41ba-8b5d-7e8aa9b7deb3","year":2023},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.698741Z"},"links":{"cited_paper":"/paper/2305.12498","citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:6e4393edd1ad7c60cbb1234e007f94df9306d6b919e9bab9cad9e9ff894c0aff","observation_id":"9d8a6bf0-a1c9-4531-b00e-c4a05937344b","resolution":{"observed_at":"2026-08-15T18:31:06.898024Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.06968","last_updated":"2024-11-11T13:17:24Z","snapshot_observed_at":"2026-08-16T13:01:10.950242Z","submitted_at":"2024-11-11T13:17:24Z","title":"Mamba-based Decoder-Only Approach with Bidirectional Speech Modeling for Speech Recognition","version":1},"cited_work":{"arxiv_id":"2411.06968","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.06968","snapshot_observed_at":"2026-08-15T18:31:06.879152Z","title":"Mamba-based Decoder-Only Approach with Bidirectional Speech Modeling for Speech Recognition","venue":"cs.SD","work_id":"0b22cc63-c0e1-45c4-824a-06d136f91a2b","year":2024},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.702446Z"},"links":{"cited_paper":"/paper/2411.06968","citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:c876e08a1fa9f1b56d88e2817cceb528e9045a1746786d87a4d528672a6419ba","observation_id":"0f33a68c-53f9-489a-804b-095f19b5904b","resolution":{"observed_at":"2026-08-15T18:31:06.882764Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:31:06.706237Z","title":"Structured state space decoder for speech recognition and synthesis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.706237Z"},"links":{"citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:6239721d1ce897a1d52999c4d2b7afe03b507489f0c846d57f542a7a59874f82","observation_id":"d741bf5e-4065-4086-b045-1198dc6931e3","resolution":{"observed_at":"2026-08-15T18:31:06.706237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14758","last_updated":"2023-09-26T08:41:24Z","snapshot_observed_at":"2026-08-18T10:06:08.538106Z","submitted_at":"2023-09-26T08:41:24Z","title":"Exploring RWKV for Memory Efficient and Low Latency Streaming ASR","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14758","snapshot_observed_at":"2026-08-15T18:31:06.709387Z","title":"Exploring RWKV for memory efficient and low latency streaming ASR,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.709387Z"},"links":{"cited_paper":"/paper/2309.14758","citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:a97d40708e7a3335bb70fe47ca4034cc5253ee1e6c02ea03eea9f7b7767c3470","observation_id":"41516056-229f-4453-9efc-668ef57618f6","resolution":{"observed_at":"2026-08-15T18:31:06.709387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:31:07.133651Z","title":"Augmenting conformers with structured state-space sequence models for online speech recognition,","venue":null,"work_id":"7f064cde-628b-4e04-b76d-2b61029615b1","year":2024},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.712584Z"},"links":{"citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:dbb8c53864b1546481c3a62a6cbc21c3cd539be1c22f55a553d2af47ba0b8a02","observation_id":"315401b0-09e5-40d3-a0ae-12a78360bf37","resolution":{"observed_at":"2026-08-15T18:31:07.137397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04159","last_updated":"2024-10-05T13:46:01Z","snapshot_observed_at":"2026-08-17T20:19:43.478585Z","submitted_at":"2024-10-05T13:46:01Z","title":"Efficient and Robust Long-Form Speech Recognition with Hybrid H3-Conformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.04159","snapshot_observed_at":"2026-08-15T18:31:06.715445Z","title":"Efficient and robust long-form speech recognition with hybrid h3-conformer,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.715445Z"},"links":{"cited_paper":"/paper/2410.04159","citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:25e3f57f7aecd9bad2d0df18cf22cc9b579b080b7304931f96016ed99225d559","observation_id":"988f1aa3-50a6-4154-a733-b5f892d7fa08","resolution":{"observed_at":"2026-08-15T18:31:06.715445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:31:07.123480Z","title":"Exploring the ca- pability of Mamba in speech applications,","venue":null,"work_id":"04dbc239-bb44-49be-9780-51711007efed","year":2024},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.718656Z"},"links":{"citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:22ab49b926e71b65e77492335cb4081771bcf47d587b6881ead6d178b7c08cbd","observation_id":"bd87678e-cd4c-4c6e-ae03-ca2464f2ffb8","resolution":{"observed_at":"2026-08-15T18:31:07.127030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:31:07.112211Z","title":"Updated corpora and benchmarks for long-form speech recognition,","venue":null,"work_id":"1a62a5c2-f59a-44c9-828b-e4f3f8ba48fd","year":2024},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.721477Z"},"links":{"citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:6e513e78ee574dc562a77b76c5f2f33907f420bcc60d9b7b648bdf46c9624577","observation_id":"070a5b32-97b5-46c1-97d8-e8458a6c8045","resolution":{"observed_at":"2026-08-15T18:31:07.116261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:31:07.101383Z","title":"Learning with marginalized corrupted features,","venue":null,"work_id":"7fc77af8-e617-4441-a904-30e0c547a9cb","year":2013},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.724685Z"},"links":{"citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:42fab02212dfdb1e7417df8c30ce970965d34202cafd0a4be60639f8b7d576c1","observation_id":"04601339-36a5-48ac-af54-e204d23ce140","resolution":{"observed_at":"2026-08-15T18:31:07.105014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:31:07.090462Z","title":"Dropout training as adaptive regularization,","venue":null,"work_id":"9e9eed81-83f4-43f3-8638-084e6b74120e","year":2013},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.727579Z"},"links":{"citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:23525871d57a96012f484f34a5885271b1b20b6f112be9b90c7f5e42cc5215d6","observation_id":"dae28afe-43e8-4ec8-bf82-93045eeb14e7","resolution":{"observed_at":"2026-08-15T18:31:07.093758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:31:07.080401Z","title":"Learning with pseudo- ensembles,","venue":null,"work_id":"c09b97ea-ab45-47b8-92ca-d61016615e24","year":2014},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.730618Z"},"links":{"citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:4c5e655fd5b208a857477eb12f193bd0b1d5b9fbb274013d6569c14c0fbccc15","observation_id":"c8492993-38ac-43f4-9877-bf0c6917a9e6","resolution":{"observed_at":"2026-08-15T18:31:07.083659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:31:07.069442Z","title":"Structured reg- ularizer for neural higher-order sequence models,","venue":null,"work_id":"d096e777-ebc2-4277-8795-ba005d9fd7f3","year":2015},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.733431Z"},"links":{"citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:bd806ba27ab7c47bedec3b64c212ec732f671d49dc97b747228a5de70e10105e","observation_id":"34de8f47-86b4-43e2-ac29-c2bc08c19262","resolution":{"observed_at":"2026-08-15T18:31:07.073345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1207.0580","last_updated":"2012-07-03T06:35:15Z","snapshot_observed_at":"2026-08-15T00:54:35.320150Z","submitted_at":"2012-07-03T06:35:15Z","title":"Improving neural networks by preventing co-adaptation of feature detectors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1207.0580","snapshot_observed_at":"2026-08-15T18:31:06.736523Z","title":"Improving neural networks by preventing co-adaptation of feature detectors,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.736523Z"},"links":{"cited_paper":"/paper/1207.0580","citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:a3e5fa392f9b83cffcd324dda06e1564c2a18b9f61c0cd2e9c50622e1942d10b","observation_id":"69d091a5-3a59-4938-a216-b44c838dbf6c","resolution":{"observed_at":"2026-08-15T18:31:06.736523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:31:07.057497Z","title":"Regularization of neural networks using dropconnect,","venue":null,"work_id":"9378f2e4-3cf9-47dd-aa8a-6dc37c970dee","year":2013},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.740084Z"},"links":{"citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:77d84ffe2fe75bd4d5fb327c602081d5bf37bf696ba4c0bf5ef203e44beb0e45","observation_id":"009f333d-0251-402c-92e8-473d71f7c82d","resolution":{"observed_at":"2026-08-15T18:31:07.061646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:31:07.043388Z","title":"Reducing transformer depth on demand with structured dropout,","venue":null,"work_id":"450f8afd-4783-4951-a6f6-edeb7739d40a","year":null},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.742961Z"},"links":{"citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:013ba9ca59b05c93611ead2df64cd9f3bc38d1b4310f1eb26969f4ca82452755","observation_id":"fbcabdca-b929-47f7-9445-2c0315709239","resolution":{"observed_at":"2026-08-15T18:31:07.048157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.02176","last_updated":"2021-04-05T22:32:20Z","snapshot_observed_at":"2026-08-16T18:33:44.239728Z","submitted_at":"2021-04-05T22:32:20Z","title":"Dynamic Encoder Transducer: A Flexible Solution For Trading Off Accuracy For Latency","version":1},"cited_work":{"arxiv_id":"2104.02176","doi":null,"metadata_source":"pith","pith_arxiv_id":"2104.02176","snapshot_observed_at":"2026-08-15T18:31:06.828856Z","title":"Dynamic Encoder Transducer: A Flexible Solution For Trading Off Accuracy For Latency","venue":"cs.CL","work_id":"a64651cb-392a-40bd-a1f8-c3070b88efbf","year":2021},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.746157Z"},"links":{"cited_paper":"/paper/2104.02176","citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:4f96c12b9b851dbe18f411bf61a49081fb7800ea9efde6eb312f304a2a2a7c8a","observation_id":"db08eddd-405e-4b08-819c-fc94cf697ced","resolution":{"observed_at":"2026-08-15T18:31:06.835711Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:31:06.749822Z","title":"Conformer: Convolution-augmented transformer for speech recognition,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.749822Z"},"links":{"citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:5c19f667895b1a2edcf443295c162b27c144a9962d3929946202722eebe6d579","observation_id":"5bd2d4eb-3fb8-45cf-bbd1-79bed895409f","resolution":{"observed_at":"2026-08-15T18:31:06.749822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:31:06.753135Z","title":"Sequence transduction with recurrent neural networks,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.753135Z"},"links":{"citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:2dd1c35464f01c976fdc5be98024ffb4a7641242a0ff7b066a538e3411c2af14","observation_id":"1d168ca7-2bc7-47bb-aeff-d11f5537d1c6","resolution":{"observed_at":"2026-08-15T18:31:06.753135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:31:06.757022Z","title":"Fast conformer with linearly scalable attention for efficient speech recognition,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.757022Z"},"links":{"citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:a7eb9c9c473a49e58a56c0ef728d0e837f83800bcbf367f6ab9add4ae2d66509","observation_id":"767ff59f-7770-4fb6-b85f-eef5554282ab","resolution":{"observed_at":"2026-08-15T18:31:06.757022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:31:07.014394Z","title":"Bidirectional recurrent neu- ral networks,","venue":null,"work_id":"d0b8893f-5b1f-4beb-b0cc-6686e4b1405f","year":1997},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.761229Z"},"links":{"citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:3453808a05cdda34342bc4b97bfcfae9eec590a6fe828419479fd93ebbb201d4","observation_id":"d8f29d9f-ae71-460b-a54c-30b60262d6d0","resolution":{"observed_at":"2026-08-15T18:31:07.017587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:31:07.003254Z","title":"WeNet: Production oriented stream- ing and non-streaming end-to-end speech recognition toolkit,","venue":null,"work_id":"d2ed9680-f40e-411b-ba6e-963d58f06ea5","year":2021},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.765282Z"},"links":{"citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:3194721592a7709394340b5dae9f977f0debc235c5a8f6ff0f14cbf6c1852067","observation_id":"e7a8ee77-f2ae-4ad0-bdc0-b0d27260d94d","resolution":{"observed_at":"2026-08-15T18:31:07.006805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15455","last_updated":"2022-07-05T07:47:22Z","snapshot_observed_at":"2026-08-16T17:10:58.388277Z","submitted_at":"2022-03-29T11:54:34Z","title":"WeNet 2.0: More Productive End-to-End Speech Recognition Toolkit","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15455","snapshot_observed_at":"2026-08-15T18:31:06.768804Z","title":"WeNet 2.0: More productive end-to- end speech recognition toolkit,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.768804Z"},"links":{"cited_paper":"/paper/2203.15455","citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:d88740273abd195652b135b163250c81138e16f971b4260a4943d28439cf1dbf","observation_id":"bc128536-7e4a-444c-b2c8-802a7ecb741a","resolution":{"observed_at":"2026-08-15T18:31:06.768804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-15T18:31:06.772280Z","title":"Longformer: The long-document transformer,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.772280Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:8cdc5a1881932c990b0a07012d56352c342c09d59b7ad917e7d45316406fb3bd","observation_id":"726d0962-9e89-45da-ac68-eea2469fd025","resolution":{"observed_at":"2026-08-15T18:31:06.772280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:31:06.991739Z","title":"Earnings-21: A practical benchmark for ASR in the wild,","venue":null,"work_id":"7b7a9272-00e3-48b7-9e10-7512f843fd1b","year":2021},"citing_paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T18:31:06.776115Z"},"links":{"citing_paper":"/paper/2506.19761"},"observation_digest":"sha256:34a0c024952d68bbc9a1d141e65d9161c047ef924160c5c9ed42ca5430ead136","observation_id":"4bbab7dd-478a-4287-a248-5981f0ccf767","resolution":{"observed_at":"2026-08-15T18:31:06.995026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.19761","last_updated":"2025-06-24T16:21:56Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T20:59:05.055651Z","submitted_at":"2025-06-24T16:21:56Z","title":"Accurate, fast, cheap: Choose three. Replacing Multi-Head-Attention with Bidirectional Recurrent Attention for Long-Form ASR"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":20,"verified_exact":3,"verified_fuzzy":19},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 1 inbound Pith citation observation for arXiv:2506.19761."}