{"as_of":"2026-08-14T18:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8b605bbb4864af811742d1402494405f37ca162d0191695b18c95d834681b7b4","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-19T09:14:23.986764Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T16:22:07.001549Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-01T21:46:15.489876Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"cited_work":{"arxiv_id":"2506.12606","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.12606","snapshot_observed_at":"2026-07-01T21:46:15.489876Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","venue":"cs.CL","work_id":"aff4cfbc-2eae-4bab-b84d-af50d9da99fa","year":2025},"citing_paper":{"arxiv_id":"2606.01135","last_updated":"2026-05-31T10:15:08Z","snapshot_observed_at":"2026-08-14T10:06:17.182799Z","submitted_at":"2026-05-31T10:15:08Z","title":"Spiking and Event-driven Neuromorphic Mamba Models for Efficient Speech Recognition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T16:22:07.001549Z"},"links":{"cited_paper":"/paper/2506.12606","citing_paper":"/paper/2606.01135"},"observation_digest":"sha256:0785c5ace8db83d4f2f3a5113a77777119e7bc721143eab098944b7a7eae3722","observation_id":"4ff077a9-6024-43fc-893d-1013741a479f","resolution":{"observed_at":"2026-07-01T21:46:15.491266Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.12606/citation-record","integrity":"/paper/2506.12606/integrity","json":"/paper/2506.12606/citation-record.json","paper":"/paper/2506.12606"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vision Mamba: Efficient Visual Representation Learning with Bidirectional State Space Model","venue":null,"work_id":"6bd9d9f3-9a8d-4a8a-94cc-caa69e2f4588","year":2024},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:006bd9400b66e8ebd6118c9d611f1395beffb005ca2be5b64bcf9b7aa25bf602","observation_id":"f424a9ab-e333-4a89-89b0-5eb53ffff89d","resolution":{"observed_at":"2026-05-19T09:17:15.655242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MambaMOT: State-Space Model as Motion Predictor for Multi-Object Tracking","venue":null,"work_id":"738c7a8c-81d2-4e58-a121-9b8c0ee9d25b","year":2025},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:ef9d0416001f76d04092b04bf268bbc8015a31955f76ee25c815145f0469c440","observation_id":"5b03949f-76e9-44a3-a0c5-5100cc5a7742","resolution":{"observed_at":"2026-05-19T09:17:15.631965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jamba: Hybrid Transformer-Mamba Language Models","venue":null,"work_id":"fcf9e26b-23ce-447a-a458-99b1dee81231","year":2025},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:53fbd5e28c2da066199f5ac6bcd960b0bd275d2af56658cbcf8bca8b3cffdb31","observation_id":"5eeb0285-9a97-42d0-809a-edd8e7dc1429","resolution":{"observed_at":"2026-05-19T09:17:15.635636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":"2312.00752","doi":"10.48550/arxiv.2312.00752","metadata_source":"pith","pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","venue":"cs.LG","work_id":"4ee75248-1199-492c-a52f-6661e0f4adff","year":2023},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:d96f486e5757c3c03af4bb52d3538f868e36b3a1bd84fb460c0247fe50a3eea9","observation_id":"5c29b323-2c6b-489e-9fb0-941c4e660d2e","resolution":{"observed_at":"2026-05-19T09:17:14.254488Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-13T20:38:14.544227+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-13T20:38:14.544227+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Speech slytherin: Examining the performance and efficiency of mamba for speech separation, recognition, and synthesis","venue":null,"work_id":"030cca90-8815-43b9-bec1-7e2b2365a3aa","year":2025},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:abb346c662ad6c19e5302484a2da1616a8e64c6c589edfeef02975ba85012593","observation_id":"5480c8ad-cd3f-45dd-aeae-2255ef53ab99","resolution":{"observed_at":"2026-05-19T09:17:15.628212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dual-path Mamba: Short and Long-term Bidirectional Selective Structured State Space Models for Speech Separation","venue":null,"work_id":"9b5f95ac-7501-4a11-b5ee-8699d3c69b11","year":2025},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:984eeb0fa768ff0e414df4a34508eda4547c7dc11789c04282ba1c2fae732b4a","observation_id":"9b97412f-20b2-4203-a461-b1ee7d65fa37","resolution":{"observed_at":"2026-05-19T09:17:15.670482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Speech-Mamba: Long-Context Speech Recog- nition with Selective State Spaces Models","venue":null,"work_id":"fc1935e5-d6c3-4672-98bd-5e91edfc55e6","year":2024},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:ab80fc78fd3b4156b54530edbfec56745bae87a204e4c394428bae42f28a82cd","observation_id":"0371e0f9-0957-4749-9661-2267dbeace1e","resolution":{"observed_at":"2026-05-19T09:17:15.742881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02063","last_updated":"2024-09-10T14:02:58Z","snapshot_observed_at":"2026-08-13T17:37:56.375137Z","submitted_at":"2024-04-02T16:04:31Z","title":"SPMamba: State-space model is all you need in speech separation","version":2},"cited_work":{"arxiv_id":"2404.02063","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.02063","snapshot_observed_at":"2026-07-04T19:30:07.489304Z","title":"SPMamba: State-space model is all you need in speech separation","venue":null,"work_id":"0bb0d56f-1ac4-4ee1-80ec-09c3d20c9a0c","year":2024},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"cited_paper":"/paper/2404.02063","citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:ed0e18f5fbd3d872bca8cf49558f2c9fae10e57b8e8faa6ad66ce060fcd95701","observation_id":"8cc3e1fc-3fc3-4f61-8252-f5fb66fd66c2","resolution":{"observed_at":"2026-05-19T09:17:14.294989Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"HuBERT: Self-supervised speech representation learning by masked prediction of hidden units","venue":null,"work_id":"290be48d-14fb-4797-8a56-9b3279fd1a40","year":2021},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:c82acc5d0624e6bec59e641757d0404578ceaa6d0bf77497f412b1c3336b73d5","observation_id":"f1f37833-93df-4059-b0cc-913899fdac33","resolution":{"observed_at":"2026-05-19T09:17:15.759286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12609","last_updated":"2025-04-27T05:17:15Z","snapshot_observed_at":"2026-08-13T00:03:11.186397Z","submitted_at":"2024-05-21T09:04:48Z","title":"Mamba in Speech: Towards an Alternative to Self-Attention","version":6},"cited_work":{"arxiv_id":"2405.12609","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.12609","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mamba in Speech: Towards an Alternative to Self-Attention","venue":null,"work_id":"3d0b50c3-a793-4740-80ef-972480fa7687","year":2024},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"cited_paper":"/paper/2405.12609","citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:3e257b5e5c284ca8d8e076ea3a987452577c9cae77c1f9d32c9f338c370d01db","observation_id":"e99a844c-562b-4fc8-8c4f-7d0d87706270","resolution":{"observed_at":"2026-05-19T09:17:14.288905Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Relations between two sets of variates","venue":null,"work_id":"e5254a2a-e062-4a10-9f5f-88f2945eb67a","year":1936},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:d379386c3f07f371c5bb2365b0d73ff714e7f4d94f6a38a22896a3dc7aaa8a79","observation_id":"eecddfcf-583d-4b3d-9909-49a9ace310fb","resolution":{"observed_at":"2026-05-19T09:17:15.774158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SUPERB: Speech Processing Universal PERformance Benchmark","venue":null,"work_id":"08cff5b7-3053-41ae-b3d2-054341669d23","year":2021},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:0dc64d74b7a7c18ec66ed996ef8713ba83a6a08678346ffca96970e5b8121476","observation_id":"816519ec-c69c-4629-a9b4-d4ec77d54772","resolution":{"observed_at":"2026-05-19T09:17:15.659459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"wav2vec 2.0: A Framework for Self-Supervised Learning of Speech Representations","venue":null,"work_id":"302bf8cf-c3c0-4d9d-baaf-fe7d3d42e0d8","year":2020},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:d6c40726d126f0115286fbe7fc087552a4659a5abace9afa842da86f4c5431a5","observation_id":"cee98c5b-a1e0-4453-be6e-cac36b8d7820","resolution":{"observed_at":"2026-05-19T09:17:15.643466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An Investigation of Incorporating Mamba For Speech Enhancement","venue":null,"work_id":"50a04027-ff5d-46d5-af99-6d2105dc5856","year":2024},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:8254b7ccb3ea5a567e5dbdb84ea75ebe8d41629e972212d7f9177955a3081d0b","observation_id":"1bb5e881-b469-4d0e-b0f0-fb4d8215449b","resolution":{"observed_at":"2026-05-19T09:17:15.639374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mamba for Streaming ASR Combined with Unimodal Aggregation","venue":null,"work_id":"8e1d30dc-8da6-4766-a3a7-618473df230c","year":2025},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:4e27d677a919b655f2e44f01a8f5ed09facee2715d2a3e31e46bf9c7be294672","observation_id":"82f852cf-ac10-4044-89f3-faca2b8f740c","resolution":{"observed_at":"2026-05-19T09:17:15.647383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rethinking Mamba in Speech Processing by Self-Supervised Models","venue":null,"work_id":"b234a3d6-60c7-4bf6-a6e8-d4edd326ea97","year":2025},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:5433f52d9f5de1db5cb6aaf306078e03da959c3e0495ae6cf2b3d1fd612c0fcc","observation_id":"ea121dea-62bc-44cb-a12f-c30af5731637","resolution":{"observed_at":"2026-05-19T09:17:15.651118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Audio Mamba: Selective State Spaces for Self- Supervised Audio Representations","venue":null,"work_id":"bfa53483-fbba-4991-9874-7f035331beb8","year":2024},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:933781ea46638420ef3deed55de25a712c0579877141ded44be7fbad58f7e14e","observation_id":"8b2f420b-3a42-4fbf-81cc-c300b460109b","resolution":{"observed_at":"2026-05-19T09:17:15.663014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Superb@ slt 2022: Challenge on generalization and efficiency of self-supervised speech representation learning","venue":null,"work_id":"675b36b9-2567-447b-96bd-265c774a52c3","year":2022},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:155778e9508ba0e3f34a6be3525f993826cb0e2517660a38ae9ff06b60fa1d58","observation_id":"36b8ad1c-690c-4b23-963e-45aa9583c529","resolution":{"observed_at":"2026-05-19T09:17:15.769582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09949","last_updated":"2025-08-17T11:06:06Z","snapshot_observed_at":"2026-08-13T13:39:59.924954Z","submitted_at":"2022-11-17T23:53:52Z","title":"Is Smaller Always Faster? Tradeoffs in Compressing Self-Supervised Speech Transformers","version":4},"cited_work":{"arxiv_id":"2211.09949","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.09949","snapshot_observed_at":"2026-07-23T01:24:11.529612Z","title":"Compressing transformer-based self-supervised models for speech processing","venue":null,"work_id":"4ca04493-8873-412b-b14d-c19754f8b654","year":2022},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"cited_paper":"/paper/2211.09949","citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:c4287d0abc4d765e28664706abfcb650d4248e8973986b94527049504186cbad","observation_id":"9500473b-58fc-42d1-8b99-523b99de3b82","resolution":{"observed_at":"2026-07-23T01:24:11.529612Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"TED-LIUM 3: Twice as much data and corpus repartition for experi- ments on speaker adaptation","venue":null,"work_id":"49e188b7-1855-4cad-87cb-c026b9b828ef","year":2018},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:94ee402423dd8cb7d51d4ab2f27c4b62e51643a16363f25bee8588ecfe65c469","observation_id":"f538a518-ec3f-41c2-a89e-d6b0f9552a1c","resolution":{"observed_at":"2026-05-19T09:17:15.747621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On gener- ative spoken language modeling from raw audio","venue":null,"work_id":"ddf78eea-2f67-4f14-9b80-b8b9caa980e7","year":2021},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:a922279e55bfefc87acd95baca769fab66f811521546f9925cc9ae1efd9f23dd","observation_id":"c0b7c5db-88f8-4541-a282-db6da309a436","resolution":{"observed_at":"2026-05-19T09:17:15.733960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Textually Pretrained Speech Language Models","venue":null,"work_id":"2ce967f8-2ac1-475f-bb7d-91475459f5cb","year":2023},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:8485da51a616d3ed1cdd48df4b2a8d1401be5215133c65a327508a8c02612246","observation_id":"daeaf476-bac1-4e13-af04-e655732b1892","resolution":{"observed_at":"2026-05-19T09:17:15.730097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08528","last_updated":"2026-04-07T06:11:20Z","snapshot_observed_at":"2026-08-14T11:32:49.145887Z","submitted_at":"2025-04-11T13:40:53Z","title":"On The Landscape of Spoken Language Models: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":"2504.08528","doi":"10.48550/arxiv.2504.08528","metadata_source":"pith","pith_arxiv_id":"2504.08528","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"On The Landscape of Spoken Language Models: A Comprehensive Survey","venue":"cs.CL","work_id":"92746bbc-1fe6-410d-a1e9-8afab3e0a8e5","year":2025},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"cited_paper":"/paper/2504.08528","citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:e84c2a15462746943e5f87b6495f2d82bb47aeadbc1b1b0f4230414a4ed049cc","observation_id":"0ddffa19-1352-46ff-b2f6-adf4f1bfdc26","resolution":{"observed_at":"2026-05-19T09:17:14.267181Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07111","last_updated":"2024-12-27T07:29:19Z","snapshot_observed_at":"2026-08-12T22:03:09.657336Z","submitted_at":"2024-11-11T16:37:40Z","title":"Building a Taiwanese Mandarin Spoken Language Model: A First Attempt","version":2},"cited_work":{"arxiv_id":"2411.07111","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.07111","snapshot_observed_at":"2026-07-04T11:59:50.259182Z","title":"Building a taiwanese mandarin spoken language model: A first attempt","venue":null,"work_id":"124b430d-5f85-4a49-a1a2-0e0ff371dbcb","year":2024},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"cited_paper":"/paper/2411.07111","citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:ca7e2dcd5b75f2e7144ae2aacc7c100e66e483c79ae11ea5b453c9069c9811c7","observation_id":"ff4670ec-3110-42d1-a873-856cc67b65f2","resolution":{"observed_at":"2026-05-19T09:17:14.276089Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dynamic-SUPERB Phase-2: A Collaboratively Ex- panding Benchmark for Measuring the Capabilities of Spoken Language Models with 180 Tasks","venue":null,"work_id":"feeb47e1-3f34-4321-9e10-858a40429651","year":2024},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:2807b815a2d80c212b9c948e568d45b7133970b3380800accd9357f101ad3ac8","observation_id":"29dfd8ae-25fb-4689-998e-f25803d939bd","resolution":{"observed_at":"2026-05-19T09:17:15.712593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Layer-wise analysis of a self-supervised speech representation model","venue":null,"work_id":"2621104f-bf5b-4426-aeb4-e5c9511b385a","year":2021},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:ddefe5bdc8049af378b306dc436005d6b47ba39247654f7728a8a1e7e890c4f5","observation_id":"49a0c977-947f-4312-a495-5dca35bc74e4","resolution":{"observed_at":"2026-05-19T09:17:15.666631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DAISY: Data Adaptive Self- Supervised Early Exit for Speech Representation Models","venue":null,"work_id":"cf5db85d-eccd-4143-911f-a86af7594fb2","year":2024},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:b4af0a81b6713bbc2b86fd26a898fc2297236a7f199f706fcf8624a8d75b2aed","observation_id":"9161b507-8222-4825-b721-ea305aea33cd","resolution":{"observed_at":"2026-05-19T09:17:15.751975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"What do self- supervised speech models know about words?","venue":null,"work_id":"dfefe36e-0373-44c4-b955-923cbf51763e","year":2024},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:60977194659dc595420099a2817c416eed9709b8248a2cb14ce618327ee0dbea","observation_id":"5c474dcc-405c-4622-a1b1-0e6464bd3d3f","resolution":{"observed_at":"2026-05-19T09:17:15.716567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Property Neurons in Self-Supervised Speech Transformers","venue":null,"work_id":"6f82afbc-d112-443a-83f2-091a71e8b158","year":2024},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:93f94219c38c59bf3b228911d76cf93cee7208ca2b633477a7fb042c5d49276b","observation_id":"683849fe-c91e-4ccc-a4df-7274498c7a8e","resolution":{"observed_at":"2026-05-19T09:17:15.720658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MelHuBERT: A Simplified Hubert on Mel Spectrograms","venue":null,"work_id":"68abea54-0f68-4eda-9d29-2a83d1eee8dd","year":2023},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:ca01b601b41762f40937af1294f45d9257e003550e6c175cb8176b0b034daef7","observation_id":"d0313ef1-5db8-4fd3-bd3d-61cd900ead47","resolution":{"observed_at":"2026-05-19T09:17:15.708177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Generalized end-to-end loss for speaker verification","venue":null,"work_id":"9c81e347-9082-4bd2-91bc-cee8a9f298d1","year":2018},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:9ffc49c3aa844090e97ff89e9dad33c8c925a36e9063b2f49e4108b0d6742d9b","observation_id":"a2a114d9-cada-4cd9-9561-6301a9b14ac6","resolution":{"observed_at":"2026-05-19T09:17:15.724826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Titanet: Neural model for speaker representation with 1d depth-wise separable convolutions and global context","venue":null,"work_id":"e4447355-25c1-4218-9e32-cd22c016464f","year":2022},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:b1d23c8c781cfd4a83b7bac95cb0e05d6e7299c4f14d94c45f31c0d0d1cfdd66","observation_id":"2e2daf8c-8c93-4ec9-b5b1-ea598e6c7cd6","resolution":{"observed_at":"2026-05-19T09:17:15.738595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.07143","last_updated":"2020-08-10T13:50:24Z","snapshot_observed_at":"2026-08-13T13:28:56.694752Z","submitted_at":"2020-05-14T17:02:15Z","title":"ECAPA-TDNN: Emphasized Channel Attention, Propagation and Aggregation in TDNN Based Speaker Verification","version":3},"cited_work":{"arxiv_id":"2005.07143","doi":"10.48550/arxiv.2005.07143","metadata_source":"pith","pith_arxiv_id":"2005.07143","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ECAPA-TDNN: Emphasized Channel Attention, Propagation and Aggregation in TDNN Based Speaker Verification","venue":"eess.AS","work_id":"45c323c0-4c7b-4c68-9f61-82af9cce05aa","year":2020},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"cited_paper":"/paper/2005.07143","citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:bf5c1acd9ef03e2a5f323c1bb660c57fb8bc6c6a1107b8c71d2bcd7aac0081b6","observation_id":"2174fa52-9df8-49a8-8460-34183b0b55b5","resolution":{"observed_at":"2026-05-19T09:17:14.261196Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"emotion2vec: Self-Supervised Pre-Training for Speech Emotion Repre- sentation","venue":null,"work_id":"6eac8f3c-dd7c-45d2-be16-70c9924214bc","year":2024},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:15eec89ccd9f4c70af80f22b4827b66a07f55f5d7555117c2e19e79cc5265df3","observation_id":"b2b38881-561e-42c4-a509-13d6da057884","resolution":{"observed_at":"2026-05-19T09:17:15.763593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MiniSu- PEBR: Lightweight benchmark for self-supervised speech models","venue":null,"work_id":"62d88c03-0993-4d2a-a6c3-009a167584c5","year":2023},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:3dae77314aa84a5050121e20d4f6e8462ad349a65a510ecb149cfd7f4f2dc871","observation_id":"7cfc88f7-5f54-4835-81f2-9992cdc4040a","resolution":{"observed_at":"2026-05-19T09:17:15.704289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ML- SUPERB: Multilingual Speech Universal PERformance Benchmark","venue":null,"work_id":"d8bff25a-c94f-42b6-a08b-9f8237f47ee4","year":2023},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:cad026f8b2a9329f0ec729fc4b3cd72ae7d68c3ec7f9424adb6b63072d4bd415","observation_id":"68af80ba-0743-49d7-91ca-d1307323ee72","resolution":{"observed_at":"2026-05-19T09:17:15.689476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Findings of the 2023 ML-SUPERB challenge: Pre-training and evaluation over more languages and beyond","venue":null,"work_id":"5e147a09-c0c8-4e61-86b0-eb47916ad686","year":2023},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:bb53d608f3d19fc70b7ab94a68bff880c81ed3e99fceb40bfb90f4e41e57c6bb","observation_id":"eb230e87-06e0-4acb-abf7-375c622bac07","resolution":{"observed_at":"2026-05-19T09:17:15.685720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-resolution Hu- BERT: Multi-resolution Speech Self-Supervised Learning with Masked Unit Prediction","venue":null,"work_id":"30553a72-dd91-4d0b-91d0-c8289aebcbe4","year":2024},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:895225458a72be01c4046cee543c855110103225b67bc41f095aff20e1743e8b","observation_id":"006eab8f-774a-4fba-a1d9-f6091a340cf4","resolution":{"observed_at":"2026-05-19T09:17:15.693018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Task- Agnostic Structured Pruning of Speech Representation Models","venue":null,"work_id":"7b4043be-2866-4927-b019-38c8ef295728","year":2023},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:c1cc0a9e46dac883c5bf0dff914fd426f8063c23ba71a0876f806e0570fbc185","observation_id":"c1df901f-6a9b-42a3-a92c-a890968978d9","resolution":{"observed_at":"2026-05-19T09:17:15.696930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12672","last_updated":"2026-04-25T10:18:13Z","snapshot_observed_at":"2026-07-06T20:38:25.164930Z","submitted_at":"2025-02-18T09:23:42Z","title":"Speech-FT: Merging Pre-trained And Fine-Tuned Speech Representation Models For Cross-Task Generalization","version":4},"cited_work":{"arxiv_id":"2502.12672","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.12672","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Speech-FT: Merging Pre-trained And Fine-Tuned Speech Representation Models For Cross-Task Generalization","venue":"cs.CL","work_id":"879c0ef5-9ddb-4579-9ae2-ee7fba5d2f37","year":2025},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"cited_paper":"/paper/2502.12672","citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:e5ba6c8fe0fa15a4b2073a4ea5f13521eda235d8c9bbb25b9402e80cb31557b2","observation_id":"fe281e32-c847-4520-9570-5250e386113f","resolution":{"observed_at":"2026-05-19T09:17:14.282401Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Speech Self-Supervised Representation Benchmarking: Are We Doing it Right?","venue":null,"work_id":"9335005f-fc73-4f18-a19b-9402ef0a73af","year":2023},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:dd59b99b90e6878f7e287bb6c7e252e0e095935dca4c8e9debafa8856a7ffdcd","observation_id":"3491453f-5c13-4721-a53c-02700e85aa60","resolution":{"observed_at":"2026-05-19T09:17:15.674247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards a Unified Representation Evaluation Framework Beyond Downstream Tasks","venue":null,"work_id":"ab195cb7-5471-41e2-9f12-1d13a7edc1b6","year":2025},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:d1c2505b9c1c1272df79363defa7f72976b9bd4d7539308afd2abece39f898f4","observation_id":"ba8b37de-8fd1-4b06-ab55-6765351b0fd4","resolution":{"observed_at":"2026-05-19T09:17:15.677852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"What Can an Accent Identifier Learn? Probing Phonetic and Prosodic Information in a Wav2vec2-based Accent Identification Model","venue":null,"work_id":"07b9ebcb-619d-43d6-8c80-1800fe3210b8","year":2023},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:ed99927770eb9607154fcb19cb4854f0ee16b7043ac77afe30f95e5b497b9fec","observation_id":"a0706b73-fd7a-41b9-b3db-844d781c9e9c","resolution":{"observed_at":"2026-05-19T09:17:15.681904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"What Do Self-Supervised Vision Transformers Learn?","venue":null,"work_id":"eac91849-8055-4fcf-92d8-997076d0a362","year":2023},"citing_paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-19T09:14:23.986764Z"},"links":{"citing_paper":"/paper/2506.12606"},"observation_digest":"sha256:a9e127234a1b3c0beea78cbe7167f5afa768b72d8fbe79ba82e238abda8d2a4b","observation_id":"52199b8a-a4bc-4203-b4ec-3525bfb97348","resolution":{"observed_at":"2026-05-19T09:17:15.700569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.12606","last_updated":"2026-04-20T13:15:49Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-14T11:33:28.098242Z","submitted_at":"2025-06-14T19:00:44Z","title":"An Exploration of Mamba for Speech Self-Supervised Models"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":8,"verified_fuzzy":36},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 1 inbound Pith citation observation for arXiv:2506.12606."}