{"as_of":"2026-08-09T21:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ebac1a8d6621e2ba2aa059aa320ab04e2efb4164f84487203bf2b4db0da9ed2d","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T17:49:21.517630Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T17:49:21.367034Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-08T17:49:21.664257Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"cited_work":{"arxiv_id":"2502.05841","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.05841","snapshot_observed_at":"2026-08-08T17:49:21.664257Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","venue":"eess.AS","work_id":"baaf0835-e3d8-4775-a75c-b7a8e186dbe3","year":2025},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.367034Z"},"links":{"cited_paper":"/paper/2502.05841","citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:ae8d19dffee2d796e75b952a98d04dc5f0a6f381819682b56c2c8f003fff0a56","observation_id":"ba651ae8-aa9d-4434-a355-19ce4c949deb","resolution":{"observed_at":"2026-08-08T17:49:21.668705Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.05841/citation-record","integrity":"/paper/2502.05841/integrity","json":"/paper/2502.05841/citation-record.json","paper":"/paper/2502.05841"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:49:22.029075Z","title":"It is often used in applications like speech recogni- tion [1, 2], language translation [3], and content filtering [4]","venue":null,"work_id":"e558759d-4654-4672-86b0-2984f2edd18c","year":null},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.354283Z"},"links":{"citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:c3e872c9f29b581230acfba7e2acad48829a6528ed205fe39ba055bbcbbe321e","observation_id":"8057e781-0a87-41b4-bac9-793f7fbd9bae","resolution":{"observed_at":"2026-08-08T17:49:22.034081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:49:22.017264Z","title":null,"venue":null,"work_id":"1d6f9f88-0688-41ba-a872-72c7ce36f600","year":null},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.359215Z"},"links":{"citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:0c195227bd0273f98f841fd77e20aa4933f964424b1afe9b054d89d5cf467b34","observation_id":"532e5be9-669f-41ad-98c8-ea5dce3ec6d7","resolution":{"observed_at":"2026-08-08T17:49:22.021212Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:49:22.005581Z","title":"Notations: We denote vectors and matrices by boldface low- ercase and uppercase letters, respectively","venue":null,"work_id":"019ea7ea-d2e9-425c-b1d3-26eba95a006a","year":null},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.363219Z"},"links":{"citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:019f6473876070ec643d65010287acb9a9219c5e175af57c21e62bf0d44d2a58","observation_id":"5aa3a298-1c94-4e23-bdc6-1ebab25e88a4","resolution":{"observed_at":"2026-08-08T17:49:22.009662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"cited_work":{"arxiv_id":"2502.05841","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.05841","snapshot_observed_at":"2026-08-08T17:49:21.664257Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","venue":"eess.AS","work_id":"baaf0835-e3d8-4775-a75c-b7a8e186dbe3","year":2025},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.367034Z"},"links":{"cited_paper":"/paper/2502.05841","citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:ae8d19dffee2d796e75b952a98d04dc5f0a6f381819682b56c2c8f003fff0a56","observation_id":"ba651ae8-aa9d-4434-a355-19ce4c949deb","resolution":{"observed_at":"2026-08-08T17:49:21.668705Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:49:21.993396Z","title":"We refer to the output of the pre-trained network (BEST-RQ) as the embedding sequence","venue":null,"work_id":"1a08cc16-25e1-4930-b1c3-cba33d91575d","year":null},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.371753Z"},"links":{"citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:926b9a55f59cf737e84d2db95172565f3a0498cfab1574a20ddf843ecb2f76c0","observation_id":"86a436cf-b926-49b0-b2e7-06ff79a0b0df","resolution":{"observed_at":"2026-08-08T17:49:21.997468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:49:21.982227Z","title":null,"venue":null,"work_id":"c4823ef2-2464-42d5-a5e8-7f0bacfdfb9d","year":null},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.375821Z"},"links":{"citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:3d862e1c3acf9b9583c6f109d193dd95b2065215c804bf2beda3885a677765e4","observation_id":"b7f85a76-ac86-42c6-97a4-3f4fb272c310","resolution":{"observed_at":"2026-08-08T17:49:21.986102Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:49:21.970335Z","title":"The computational complexity for both Eq","venue":null,"work_id":"fd06be79-6a1c-4112-b277-becfd3e5a525","year":null},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.379765Z"},"links":{"citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:2000e942531d23731a2f21c684448d9d6a8474a4cf382602d85f3b6a52b8ff52","observation_id":"c5a89950-c1a1-4f77-b58e-6971a2abe935","resolution":{"observed_at":"2026-08-08T17:49:21.974888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:49:21.958572Z","title":null,"venue":null,"work_id":"cc2147b1-0cee-45e4-90a1-4988ff1a8853","year":null},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.384097Z"},"links":{"citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:dca005f24f7561cc80a09a46504865354b7125185c289f66fca062cf2c35b324","observation_id":"76191da1-053a-4b6f-b4aa-5ddbeb45c21a","resolution":{"observed_at":"2026-08-08T17:49:21.962626Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:49:21.946957Z","title":"Typically, the agent matrix is given byG = Pooling(Q) (Sec- tion 4.4)","venue":null,"work_id":"e7195584-8faf-41a2-bf5d-05d1e4db6102","year":null},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.388249Z"},"links":{"citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:54cdd2c5f03f5b35af245b4dcb7695313d508bb6a94a6bcb763c3c2f310dcbf7","observation_id":"b76baac1-5f5d-4b75-91c2-1fddb7996b24","resolution":{"observed_at":"2026-08-08T17:49:21.950793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:49:21.934575Z","title":"Dataset Pre-training Data: We utilized the open-source V oxPopuli dataset [25] for pre-training the BEST-RQ model","venue":null,"work_id":"624a3865-8e31-4463-8fc7-7512a1e086c0","year":null},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.391964Z"},"links":{"citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:c0f8ae34bc73a034087e7f934482723f8b23dbcc59dcbf2644b5f1c881e8eefe","observation_id":"325ffd1b-c2b5-459c-aa49-b7460b668f8b","resolution":{"observed_at":"2026-08-08T17:49:21.939691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:49:21.922194Z","title":"These results are reported in Table-4","venue":null,"work_id":"f9c0166e-406c-4a00-ba1d-a4ed26f98626","year":null},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.395895Z"},"links":{"citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:2e5a2890ffa6679fcac0caadd3afbec8d79327e56162784d4d79313035157d03","observation_id":"19ccb65c-a7a2-4404-842e-f1129d6e873d","resolution":{"observed_at":"2026-08-08T17:49:21.926383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:49:21.909940Z","title":"In particu- lar, we demonstrated the effectiveness of performer- and agent- attention over self-attention for language identification in a self- supervised learning paradigm","venue":null,"work_id":"8d467516-5c3e-41bc-8819-931a171d68bf","year":null},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.399716Z"},"links":{"citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:5ea5d71add87a238f109424696ca7b5531998f890dda45846ae7eeba458a7c80","observation_id":"96973d07-7356-46d7-87b3-ef9a28e6f04c","resolution":{"observed_at":"2026-08-08T17:49:21.914433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.06058","last_updated":"2022-09-13T15:10:41Z","snapshot_observed_at":"2026-08-04T14:34:57.482435Z","submitted_at":"2022-09-13T15:10:41Z","title":"Streaming End-to-End Multilingual Speech Recognition with Joint Language Identification","version":1},"cited_work":{"arxiv_id":"2209.06058","doi":null,"metadata_source":"pith","pith_arxiv_id":"2209.06058","snapshot_observed_at":"2026-08-08T17:49:21.645635Z","title":"Streaming End-to-End Multilingual Speech Recognition with Joint Language Identification","venue":"eess.AS","work_id":"d86a1743-9a21-40d1-9455-c49c4ca1b4c8","year":2022},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.403597Z"},"links":{"cited_paper":"/paper/2209.06058","citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:c50ac69004a51dcdd9efa9ccf379b9280849d74e6ff9ec0523e7083d75b5c9b4","observation_id":"e2dae1cf-4ce4-48f4-81a8-f1c3faf77b94","resolution":{"observed_at":"2026-08-08T17:49:21.651792Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:49:21.896307Z","title":"A real-time end-to-end multi- lingual speech recognition architecture,","venue":null,"work_id":"fd98b498-fa77-45fa-b0d8-2d56ce89936b","year":2015},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.407854Z"},"links":{"citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:8ad92c6b8739d94c3a9d7342b82d4f4d1168027243f85b87e314ea3310620627","observation_id":"8fceb7a0-ffb7-497b-a1a7-a1894d06c4c4","resolution":{"observed_at":"2026-08-08T17:49:21.900429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:49:21.883095Z","title":"Transformer-based machine translation for low- resourced languages embedded with language identification,","venue":null,"work_id":"e7014cc1-9148-4a31-ba20-6d5a20da1291","year":2021},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.411680Z"},"links":{"citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:451c1e4105bc3bc5753e5a82f74235f97735eaeff338ffa91cec7e5942b562ca","observation_id":"16116d8e-66f3-45fd-9a90-36690f13a1e2","resolution":{"observed_at":"2026-08-08T17:49:21.888315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.14571","last_updated":"2020-10-29T15:18:35Z","snapshot_observed_at":"2026-07-06T10:09:10.434213Z","submitted_at":"2020-10-27T19:29:17Z","title":"Language ID in the Wild: Unexpected Challenges on the Path to a Thousand-Language Web Text Corpus","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.14571","snapshot_observed_at":"2026-08-08T17:49:21.415485Z","title":"Language id in the wild: Unexpected challenges on the path to a thousand- language web text corpus,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.415485Z"},"links":{"cited_paper":"/paper/2010.14571","citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:9ed008562863ea25814e7bebecb53f07d28db5e899cf77ba046ed24b98fada4d","observation_id":"7deb1654-d7d6-47c8-8675-ee9a757864f7","resolution":{"observed_at":"2026-08-08T17:49:21.415485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:49:21.870360Z","title":"Language and dialect identification: A survey,","venue":null,"work_id":"8f7a569a-afec-4e96-ad39-ebab708681ca","year":2015},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.419840Z"},"links":{"citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:069e2792a8802638d7d2c392513cfb7d1dc56298176110d3542f0ddb19da06d1","observation_id":"cc493032-7ee5-4967-bcb5-88206b308a26","resolution":{"observed_at":"2026-08-08T17:49:21.875055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:49:21.858121Z","title":"Language identifica- tion from short segments of speech,","venue":null,"work_id":"dfc24e8a-b5b2-4273-a332-e0310aa88fce","year":2000},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.423706Z"},"links":{"citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:2fd1a5fb280a0464f52f0d02ea5549a56929e3305efa4479a56d71271d16a194","observation_id":"189ded9e-12b3-415b-a425-15f4e8764a59","resolution":{"observed_at":"2026-08-08T17:49:21.862243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:49:21.843884Z","title":"Self-supervised learning: Generative or contrastive,","venue":null,"work_id":"790381b2-f2a6-4fa5-a0b6-5513e62d0b88","year":2021},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.427344Z"},"links":{"citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:a13951b6604f70c80322477fac08c11c55b23711031e7289e28d4f1ebaea8996","observation_id":"f290227c-b5c5-4795-a280-89e19690fa00","resolution":{"observed_at":"2026-08-08T17:49:21.849002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-07-06T06:49:24.960992Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-08T17:49:21.431222Z","title":"Representation learning with contrastive predictive coding,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.431222Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:f7ed218106c1c0ebe96ff85c27b84946aca249c1d95bed37aa6553ce6a4c24f8","observation_id":"11d5094d-060e-4c0e-b8af-16e15e44cf58","resolution":{"observed_at":"2026-08-08T17:49:21.431222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:49:21.435435Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech repre- sentations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.435435Z"},"links":{"citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:482a369b2ac950dfd66161a064071064f48ac08ca90c37192bacd67059b0e5c1","observation_id":"3270eb35-c081-43cf-a4f1-a0d056fd4f2c","resolution":{"observed_at":"2026-08-08T17:49:21.435435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:49:21.822825Z","title":"W2v-bert: Combining contrastive learning and masked language modeling for self-supervised speech pre-training,","venue":null,"work_id":"b7a91a85-1be6-4ce7-942f-78b0f8cbd28d","year":2021},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.439189Z"},"links":{"citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:db0d789f3772c9e0ab9b7ea3bbebf3a1a0f3d87e7fafd94d1eb1e897bd1b5af9","observation_id":"9cae2ffc-e533-4d71-a864-a69adc2e2d73","resolution":{"observed_at":"2026-08-08T17:49:21.827272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:49:21.442920Z","title":"Hubert: Self-supervised speech rep- resentation learning by masked prediction of hidden units,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.442920Z"},"links":{"citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:e70ee466a98cc1d7f2fd11a4e1437f68595f18fdd8924bbd69956d6983fe6cfe","observation_id":"62f2448b-646d-46ff-a5bf-5cec36c3cc0a","resolution":{"observed_at":"2026-08-08T17:49:21.442920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:49:21.803112Z","title":"Efficient self-supervised learning rep- resentations for spoken language identification,","venue":null,"work_id":"2e4b9b46-4070-40d2-b25c-61e07e1b58e0","year":2022},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.446780Z"},"links":{"citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:35871a94414b7234ef978b4fcf5837f66f9f7957537dddaea8bd0bcbd300d1d4","observation_id":"b38d37f9-6233-41f8-ad1b-955ccf383322","resolution":{"observed_at":"2026-08-08T17:49:21.807186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:49:21.791761Z","title":"Asbert: Asr-specific self-supervised learning with self-training,","venue":null,"work_id":"c85d0b1f-b4e8-44df-af93-9156a0fd169e","year":2023},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.450739Z"},"links":{"citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:732c4ed4ecada92b71f5974e9f76ded8d58dcdb01aa86c4dd6c5e751fb34e41f","observation_id":"098865ab-9758-4666-bbc4-e67a3b95e6ee","resolution":{"observed_at":"2026-08-08T17:49:21.795923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:49:21.454559Z","title":"Self-supervised learning with random-projection quantizer for speech recogni- tion,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.454559Z"},"links":{"citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:8787de92e5450da9ee701444e9743181755619a7a760e6f3251a605bf8390dbc","observation_id":"2cd7532b-de92-4005-ae0a-81001c6275c3","resolution":{"observed_at":"2026-08-08T17:49:21.454559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:49:21.772904Z","title":"Attention mechanisms in computer vision: A survey,","venue":null,"work_id":"0ed903ef-63b7-4e6d-8ad4-5ad19003fc0a","year":2022},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.458290Z"},"links":{"citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:cca4de3eb3c732b85802575233a55b4be034978a2569acee1e97edd8cee91a73","observation_id":"7bc83160-5eec-40a8-8ab1-7d8ae45fbccc","resolution":{"observed_at":"2026-08-08T17:49:21.777072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:49:21.760278Z","title":"An introductory survey on attention mechanisms in NLP problems,","venue":null,"work_id":"354125c4-fc7b-426b-84c2-a3b9619c8181","year":2019},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.462079Z"},"links":{"citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:18d3d1732702c6b34e56389ac618cf1baea5dd405b2134b11e76fb2bfc2da469","observation_id":"27119e78-2232-4d05-8ab0-9e3bce195e46","resolution":{"observed_at":"2026-08-08T17:49:21.765174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01107","last_updated":"2023-05-04T01:23:12Z","snapshot_observed_at":"2026-07-06T14:47:41.143659Z","submitted_at":"2023-02-02T13:58:18Z","title":"A Survey on Efficient Training of Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.01107","snapshot_observed_at":"2026-08-08T17:49:21.465903Z","title":"A survey on efficient training of transformers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.465903Z"},"links":{"cited_paper":"/paper/2302.01107","citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:4ea8a9162bbf21595c4828ab76081400ddb855500db6245e6804d07de617ddd9","observation_id":"c16d742c-8fae-462a-af19-7953f3add36a","resolution":{"observed_at":"2026-08-08T17:49:21.465903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.14794","last_updated":"2022-11-19T12:45:21Z","snapshot_observed_at":"2026-08-08T20:36:21.234658Z","submitted_at":"2020-09-30T17:09:09Z","title":"Rethinking Attention with Performers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.14794","snapshot_observed_at":"2026-08-08T17:49:21.470098Z","title":"Rethinking attention with performers,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.470098Z"},"links":{"cited_paper":"/paper/2009.14794","citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:fce672f57cfc85a465c63931a4c74fb09656b43370ffdc08cdce0029a538aabf","observation_id":"005f9ad5-9ecf-4a54-96d4-06a34f5b9cc5","resolution":{"observed_at":"2026-08-08T17:49:21.470098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08874","last_updated":"2024-07-15T09:42:48Z","snapshot_observed_at":"2026-07-06T17:01:40.744034Z","submitted_at":"2023-12-14T16:26:29Z","title":"Agent Attention: On the Integration of Softmax and Linear Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08874","snapshot_observed_at":"2026-08-08T17:49:21.474356Z","title":"Agent at- tention: On the integration of softmax and linear attention,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.474356Z"},"links":{"cited_paper":"/paper/2312.08874","citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:066daf8cf2199191772dc5669e0db1bce10dbd274209b4d653ea43cdefed4e2e","observation_id":"2e4e075c-df47-4e25-a287-ec792cd81619","resolution":{"observed_at":"2026-08-08T17:49:21.474356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10963","last_updated":"2019-02-25T01:44:06Z","snapshot_observed_at":"2026-08-02T00:52:09.236237Z","submitted_at":"2018-03-29T08:45:55Z","title":"Attentive Statistics Pooling for Deep Speaker Embedding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.10963","snapshot_observed_at":"2026-08-08T17:49:21.478300Z","title":"Attentive statis- tics pooling for deep speaker embedding,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.478300Z"},"links":{"cited_paper":"/paper/1803.10963","citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:a2286f9557e3a13f595ddafcefc4b016e359ad866d5b31962f1254008aa0c655","observation_id":"315fa50d-0667-4088-bad9-95df9f9bb6a7","resolution":{"observed_at":"2026-08-08T17:49:21.478300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:49:21.747978Z","title":"On the performance of time-pooling strategies for end-to-end spoken language identifi- cation,","venue":null,"work_id":"3674d45c-511c-4d20-898b-e131c8682fef","year":2020},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.482160Z"},"links":{"citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:07f39551534291c1cad4a67aa42ff5734e087c7ee0f1709e9124ed1759b90fa4","observation_id":"30731ae2-b175-40f1-8993-4182b8f77fea","resolution":{"observed_at":"2026-08-08T17:49:21.752661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:49:21.736460Z","title":"Attentive temporal pooling for conformer-based streaming lan- guage identification in long-form speech,","venue":null,"work_id":"04e02a7e-a180-49fc-884a-3127f276201e","year":2022},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.485949Z"},"links":{"citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:fce2debc989a8cda35a2f646418312198566a8102be44ec6d9af61b4004cbe6a","observation_id":"21531f14-1c36-4497-be21-79d70104ea23","resolution":{"observed_at":"2026-08-08T17:49:21.740600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:49:21.489893Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.489893Z"},"links":{"citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:0a8fd62215f96938ff77a21a76ec8a0c90e8e82409581fc058d70686dd339db9","observation_id":"672fb68b-9f97-44b0-8f4b-7027021fdd78","resolution":{"observed_at":"2026-08-08T17:49:21.489893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:49:21.715385Z","title":"Flatten trans- former: Vision transformer using focused linear attention,","venue":null,"work_id":"cc25320a-ea0e-419c-87f6-12911cf631ed","year":2023},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.493602Z"},"links":{"citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:b13d0ba1cc3de5dced8070aae878f374f0e5327f6af8f30b58413f54e1937a4d","observation_id":"68379854-5ae8-4b2e-b93c-4f07058dbfe8","resolution":{"observed_at":"2026-08-08T17:49:21.719915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00390","last_updated":"2021-07-27T04:04:57Z","snapshot_observed_at":"2026-08-09T19:09:23.880235Z","submitted_at":"2021-01-02T07:24:21Z","title":"VoxPopuli: A Large-Scale Multilingual Speech Corpus for Representation Learning, Semi-Supervised Learning and Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00390","snapshot_observed_at":"2026-08-08T17:49:21.497522Z","title":"V oxpopuli: A large-scale multilingual speech corpus for representation learn- ing, semi-supervised learning and interpretation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.497522Z"},"links":{"cited_paper":"/paper/2101.00390","citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:df22c32ddd3c5d1d5745eea7aed628a2a16e1747e5482d0594a894dd10938bdf","observation_id":"b4ca6cc9-34e4-439c-b240-26c98d0a3493","resolution":{"observed_at":"2026-08-08T17:49:21.497522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:49:21.702246Z","title":"V oxlingua107: a dataset for spoken lan- guage recognition,","venue":null,"work_id":"5bf316b1-907b-40c1-8fd9-02adc95d72f6","year":2021},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.501332Z"},"links":{"citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:975e9e3ac5102b50f2fe5606ab853dbe264784e1d3cd51117af8c529ed28e0fc","observation_id":"fa24865a-073b-4843-b24d-718cc30acc56","resolution":{"observed_at":"2026-08-08T17:49:21.707436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:49:21.688710Z","title":"Fleurs: Few-shot learning evaluation of universal representations of speech,","venue":null,"work_id":"78de033b-34a7-4e19-b2f0-23c95259d552","year":2023},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.505246Z"},"links":{"citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:d5c49cd86148b4848a171c5a95592b78c483bd68dd7fe9f7e5fccde49f41c2e8","observation_id":"c39c3631-94d8-4b54-803f-2b7a0b8483dc","resolution":{"observed_at":"2026-08-08T17:49:21.693948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:49:21.676965Z","title":"Swish: a self-gated activation function,","venue":null,"work_id":"680c9671-5e75-4870-bf28-6066ec56bbac","year":2017},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.509759Z"},"links":{"citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:df01ac172d8ae1aa0a655159f613504d0ddd6412e08b8579545ff1df4a2cfccc","observation_id":"8f0e79bc-f485-45bc-8741-07f7b193a908","resolution":{"observed_at":"2026-08-08T17:49:21.681239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-08T17:49:21.513808Z","title":"Adam: A method for stochastic opti- mization,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.513808Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:1067321a2c0e8addfaaab85096214e5a3ed9ccdbeccf57bb2793a410dba2c324","observation_id":"233e3165-be40-40f1-8f47-d99b550e6d1e","resolution":{"observed_at":"2026-08-08T17:49:21.513808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-08T17:49:21.517630Z","title":"Bert: Pre- training of deep bidirectional transformers for language under- standing,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T17:49:21.517630Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2502.05841"},"observation_digest":"sha256:949e39fe2db15d270b9347bce6699d8d4931b98ac1e66ad568e0635a54645878","observation_id":"a93d007a-4023-429f-8993-7156ec867d7d","resolution":{"observed_at":"2026-08-08T17:49:21.517630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.05841","last_updated":"2025-02-09T10:25:42Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-09T19:10:37.865545Z","submitted_at":"2025-02-09T10:25:42Z","title":"On the use of Performer and Agent Attention for Spoken Language Identification"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":16,"verified_exact":1,"verified_fuzzy":24},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 1 inbound Pith citation observation for arXiv:2502.05841."}