{"as_of":"2026-08-16T07:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4e0f36b981ca1fb72acf981a79f231e5880d105294c51290e490b42931af072c","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T06:49:46.425849Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T06:49:46.425849Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T12:29:51.736855Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"cited_work":{"arxiv_id":"2606.23332","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.23332","snapshot_observed_at":"2026-07-04T12:29:51.736855Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","venue":"eess.AS","work_id":"e00a0977-4767-4b1d-9c63-de7590f0a881","year":2026},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"cited_paper":"/paper/2606.23332","citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:100624a83e192c732ac5db32b7b0ef33ecadfbdbbb987d705defc2d50fd95738","observation_id":"6a783f39-8edd-43c0-82fa-a6e865b0d222","resolution":{"observed_at":"2026-07-04T12:29:51.738001Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2606.23332/citation-record","integrity":"/paper/2606.23332/integrity","json":"/paper/2606.23332/citation-record.json","paper":"/paper/2606.23332"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:49:46.425849Z","title":"A particularly challenging scenario arises when a far-field device, such as a table-top microphone, captures, enhances, and streams audio back to the user","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:5f3d5b2e728e909f8ac152528a207ca01220d3a625ca2e2f6d85506af9db1676","observation_id":"d59e4e19-cede-434b-b783-f9f708388b92","resolution":{"observed_at":"2026-06-26T06:49:46.425849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"cited_work":{"arxiv_id":"2606.23332","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.23332","snapshot_observed_at":"2026-07-04T12:29:51.736855Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","venue":"eess.AS","work_id":"e00a0977-4767-4b1d-9c63-de7590f0a881","year":2026},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"cited_paper":"/paper/2606.23332","citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:100624a83e192c732ac5db32b7b0ef33ecadfbdbbb987d705defc2d50fd95738","observation_id":"6a783f39-8edd-43c0-82fa-a6e865b0d222","resolution":{"observed_at":"2026-07-04T12:29:51.738001Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:49:46.425849Z","title":"base\" and","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:9454e8f8db89ab8d38467da9ca79d5da46c810bca25f0b93b96cbb19d4c53b19","observation_id":"e0d50dd2-252e-4f80-98a2-2a52062bc284","resolution":{"observed_at":"2026-06-26T06:49:46.425849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:49:46.425849Z","title":"When comparing task objectives, OVC and TSE appear comparably difficult (cf","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:6dd2df6dbbcc85781fd8ee9f76517a5dba89bd57e017109d9335f6e24b43611b","observation_id":"2f2f715c-e44e-4a2c-b3bd-84aafc902889","resolution":{"observed_at":"2026-06-26T06:49:46.425849Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:49:46.425849Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:78d3e5abb068d7963ea00954e2913cd71a4691d09eff714475f68d41329738f9","observation_id":"f1f1b91d-28ec-4a5b-8dea-3e38bb0cf20c","resolution":{"observed_at":"2026-06-26T06:49:46.425849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:49:46.425849Z","title":"AI tools were used solely for grammar correction","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:57ac4598f74c61ccb89869dc345b4f27a922f21af61ce4a75f2e5d631ce08af2","observation_id":"f3f0e5ff-2140-4187-b11b-5fa24996c918","resolution":{"observed_at":"2026-06-26T06:49:46.425849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:49:46.425849Z","title":"Tolerable hearing aid delays. I. Estimation of limits imposed by the auditory path alone using simulated hearing losses,","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:9ec59592220b73f0610a1842cd645d1e9d1e65033db223ce71b9af3be574e1a5","observation_id":"56f45bbc-63b1-4d8a-9fdf-d1cceb1e93d4","resolution":{"observed_at":"2026-06-26T06:49:46.425849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:49:46.425849Z","title":"Disturbance caused by varying prop- agation delay in non-occluding hearing aid fittings,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:862dbb45bfd8cf29dcf9a84570278dd7266b583045cf119f979199c5e858e5a9","observation_id":"e4422109-7386-45e2-a7f3-37a84e1f2620","resolution":{"observed_at":"2026-06-26T06:49:46.425849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:49:46.425849Z","title":"Tolerable hearing-aid delays: IV. Effects on subjective disturbance during speech production by hearing-impaired subjects,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:c0d4ce45273da9a3298f1d8d2b140a9b82e7142cfb4911e9a24ce213980e8439","observation_id":"27ee5aa1-4d8f-41d2-9c59-1eff79e6e692","resolution":{"observed_at":"2026-06-26T06:49:46.425849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2406.05983","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T12:29:51.722222Z","title":"Separate and Re- construct: Asymmetric Encoder-Decoder for Speech Separation,","venue":null,"work_id":"35605afb-2b43-4397-ad0c-ff6d49e8532e","year":2024},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:c95db472a189bdc589c77c01ca3c2cbada17632f2a34d96408eb4c7a8695e25d","observation_id":"e5d375c5-a65f-47ab-a0c8-fef53147601e","resolution":{"observed_at":"2026-07-04T12:29:51.723870Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20997","last_updated":"2024-10-28T13:20:53Z","snapshot_observed_at":"2026-08-12T22:13:49.533008Z","submitted_at":"2024-10-28T13:20:53Z","title":"SepMamba: State-space models for speaker separation using Mamba","version":1},"cited_work":{"arxiv_id":"2410.20997","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20997","snapshot_observed_at":"2026-07-04T12:29:51.693039Z","title":"SepMamba: State-space models for speaker separation using Mamba,","venue":null,"work_id":"55a7abe4-ecdd-4649-a009-745cf72b8264","year":2024},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"cited_paper":"/paper/2410.20997","citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:3be7cf66d5a4d2a89d32f01a8d52d3321e13a95e7ae4846e4cdfa0f39ba91edd","observation_id":"a322941b-9a8d-4b1f-aea3-5e320c81eb26","resolution":{"observed_at":"2026-07-04T12:29:51.694431Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":"2312.00752","doi":"10.48550/arxiv.2312.00752","metadata_source":"pith","pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","venue":"cs.LG","work_id":"4ee75248-1199-492c-a52f-6661e0f4adff","year":2023},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:62c78ab09f1b5cfdf775d086dc2cd99cf068860d5cb7ac71032ae752b4ec1741","observation_id":"47844663-ac23-4f91-b26b-d4e6c44ecd98","resolution":{"observed_at":"2026-07-04T12:29:51.689432Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-13T20:38:14.544227+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-13T20:38:14.544227+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01201","last_updated":"2024-11-28T07:10:33Z","snapshot_observed_at":"2026-08-12T22:32:55.628264Z","submitted_at":"2024-10-02T03:06:49Z","title":"Were RNNs All We Needed?","version":3},"cited_work":{"arxiv_id":"2410.01201","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.01201","snapshot_observed_at":"2026-07-04T12:29:51.728866Z","title":"Were RNNs all we needed?","venue":null,"work_id":"ddc105f6-c116-4fe4-b0e7-48f7b42dd9ce","year":2024},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"cited_paper":"/paper/2410.01201","citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:9c73b11ab92b87e1c08c17c5abc4f2ae69a4ed9c79f8a161bcfb4dd47af44d1a","observation_id":"b11b0929-031a-47a1-ae92-5bef3021ffc7","resolution":{"observed_at":"2026-07-04T12:29:51.730169Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:49:46.425849Z","title":"TaSNet: Time-Domain Audio Separa- tion Network for Real-Time, Single-Channel Speech Separation,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:ed312a3a6798c3ed473b8890f993fbfbe5202627a562c18579498283be9d5752","observation_id":"ea48bf71-a931-47e3-aff6-2242564c6740","resolution":{"observed_at":"2026-06-26T06:49:46.425849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:49:46.425849Z","title":"Conv-TasNet: Surpassing Ideal Time-Frequency Magni- tude Masking for Speech Separation,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:f83730e7365daf467769722d9994c39d8de9f8c4c5ba61fd1ba3bae0575f3d6c","observation_id":"a4b6af01-2edd-4d16-b24e-c9f39a75f9e6","resolution":{"observed_at":"2026-06-26T06:49:46.425849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.06379","last_updated":"2020-03-27T10:15:38Z","snapshot_observed_at":"2026-08-16T06:56:32.665582Z","submitted_at":"2019-10-14T18:52:49Z","title":"Dual-path RNN: efficient long sequence modeling for time-domain single-channel speech separation","version":2},"cited_work":{"arxiv_id":"1910.06379","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.06379","snapshot_observed_at":"2026-07-04T12:29:51.731340Z","title":"Dual-path RNN: efficient long sequence modeling for time-domain single-channel speech sepa- ration,","venue":null,"work_id":"62dee547-a83d-46fa-80c7-74495ff2a6db","year":2020},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"cited_paper":"/paper/1910.06379","citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:1ea2aa080a1be53f4bd34f741d74fd2b9a2a0142a465de803baf051632832e9b","observation_id":"da60ea97-0bc3-4100-8d80-3755ba49ae7d","resolution":{"observed_at":"2026-07-04T12:29:51.732783Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03440","last_updated":"2024-08-06T20:30:14Z","snapshot_observed_at":"2026-08-12T23:07:36.520335Z","submitted_at":"2024-08-06T20:30:14Z","title":"TF-Locoformer: Transformer with Local Modeling by Convolution for Speech Separation and Enhancement","version":1},"cited_work":{"arxiv_id":"2408.03440","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.03440","snapshot_observed_at":"2026-07-04T12:29:51.726194Z","title":"TF-Locoformer: Transformer with Local Modeling by Convolution for Speech Separation and Enhancement,","venue":null,"work_id":"a49b9fae-30c7-4445-98ca-ce0401950e53","year":2024},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"cited_paper":"/paper/2408.03440","citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:87fe6f998d2fde49c00556915e5392f65d2e7afbca53b9874be2b1164bb883e6","observation_id":"9d2fbe29-2033-4c11-bf51-a2f59df3b007","resolution":{"observed_at":"2026-07-04T12:29:51.727744Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:49:46.425849Z","title":"Tolerable hearing aid delays. II. Estimation of limits imposed during speech production,","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:ebdf297baa41e8fa7287c243c1b75199320494d711b26e157ea9eb9792cfbd4c","observation_id":"508f4333-4d87-4f56-b9c2-88e8bb82dda0","resolution":{"observed_at":"2026-06-26T06:49:46.425849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:49:46.425849Z","title":"Improving Speaker Discrimination of Target Speech Extraction With Time-Domain Speakerbeam,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:07925a7e32e8820255cded6f5c5d465c0902941dee989b7c00b19945ad99644a","observation_id":"26df3047-7688-4e7f-933a-e0dc8b985954","resolution":{"observed_at":"2026-06-26T06:49:46.425849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.04811","last_updated":"2022-07-14T05:47:19Z","snapshot_observed_at":"2026-08-13T16:04:47.537031Z","submitted_at":"2022-04-11T00:52:20Z","title":"Listen only to me! How well can target speech extraction handle false alarms?","version":2},"cited_work":{"arxiv_id":"2204.04811","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2204.04811","snapshot_observed_at":"2026-07-04T12:29:51.690558Z","title":"Listen only to me! How well can target speech ex- traction handle false alarms?","venue":null,"work_id":"f9dc826d-628c-4de6-b2ce-b8f43e3681d2","year":2022},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"cited_paper":"/paper/2204.04811","citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:8d93dbc01717d5e65da7a5e6b7081f9332aabbbead08f2654bf5dd61f40f8c2f","observation_id":"a8a45f7a-34ac-45af-9b3b-52dd354e00cb","resolution":{"observed_at":"2026-07-04T12:29:51.691971Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:49:46.425849Z","title":"TEA-PSE: Tencent-Ethereal-Audio-Lab Personal- ized Speech Enhancement System for ICASSP 2022 DNS Chal- lenge,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:56322648e43fd61a3fcc2c76c461f8af39748d4bd81d15f23055b83e1f472d21","observation_id":"691e8a3f-be64-49c5-9cfd-5c7cc6975800","resolution":{"observed_at":"2026-06-26T06:49:46.425849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01857","last_updated":"2024-07-01T23:59:16Z","snapshot_observed_at":"2026-08-12T23:30:50.646603Z","submitted_at":"2024-07-01T23:59:16Z","title":"SpeakerBeam-SS: Real-time Target Speaker Extraction with Lightweight Conv-TasNet and State Space Modeling","version":1},"cited_work":{"arxiv_id":"2407.01857","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.01857","snapshot_observed_at":"2026-07-04T12:29:51.685445Z","title":"SpeakerBeam-SS: Real-time Target Speaker Extraction with Lightweight Conv-TasNet and State Space Modeling,","venue":null,"work_id":"b42bc46a-651d-40ed-a608-a5549a6f0a22","year":2024},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"cited_paper":"/paper/2407.01857","citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:80262b11100b2e4020fded7f6d4e2b4f8728ceb880f7922b7ba57f5688881638","observation_id":"4e8f8fff-1759-43d0-bb64-01bc5a8dd500","resolution":{"observed_at":"2026-07-04T12:29:51.687116Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13199","last_updated":"2024-02-17T13:45:00Z","snapshot_observed_at":"2026-08-13T04:17:02.423221Z","submitted_at":"2024-02-17T13:45:00Z","title":"Target Speech Extraction with Pre-trained Self-supervised Learning Models","version":1},"cited_work":{"arxiv_id":"2402.13199","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13199","snapshot_observed_at":"2026-07-04T12:29:51.734032Z","title":"Target Speech Extraction with Pre-trained Self- supervised Learning Models,","venue":null,"work_id":"94a40f3a-1c5e-42ca-af7c-c3157ad571a0","year":2024},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"cited_paper":"/paper/2402.13199","citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:d3341573191402904d8a631b6af43f16a556e02f1e1659d0fa1ae16178815b41","observation_id":"1e65eda6-2a84-499a-b235-3b7412fa0e45","resolution":{"observed_at":"2026-07-04T12:29:51.735445Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14343","last_updated":"2022-05-18T18:30:07Z","snapshot_observed_at":"2026-08-13T21:48:01.297352Z","submitted_at":"2022-03-27T16:30:33Z","title":"Diagonal State Spaces are as Effective as Structured State Spaces","version":3},"cited_work":{"arxiv_id":"2203.14343","doi":"10.48550/arxiv.2203.14343","metadata_source":"arxiv_reference","pith_arxiv_id":"2203.14343","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Diagonal state spaces are as effective as structured state spaces","venue":"arXiv (Cornell University)","work_id":"265d8fcf-ab0e-4416-a9f8-c5cd8a6706ab","year":2022},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"cited_paper":"/paper/2203.14343","citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:48d5d14d596b590aa7de83415d45883d9a334265c081d93ade4a74edf6ae5993","observation_id":"d04d6f25-a4c7-47d9-a93e-853a43bee6cd","resolution":{"observed_at":"2026-07-04T12:29:51.715827Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:49:46.425849Z","title":"ICASSP 2023 Acoustic Echo Cancellation Challenge,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:88804d2ca2620b4680c9577753edd4d88cb31b4242e3cba20e738e91aed46fb9","observation_id":"45c55e70-e716-4aaf-8bbf-5f60f0fb24b6","resolution":{"observed_at":"2026-06-26T06:49:46.425849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:49:46.425849Z","title":"A Progressive Neural Network for Acoustic Echo Can- cellation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:26571eb6b9875956031cacd7effd2405c5697371b1c1cb77f274bfb5b6c17ef6","observation_id":"8bf34f55-d07a-4d25-a651-cd16b8ea2865","resolution":{"observed_at":"2026-06-26T06:49:46.425849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:49:46.425849Z","title":"Lib- rispeech: An ASR corpus based on public domain audio books,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:28e29f26a4248eb366d59ac2176e86ce5e2b72f3274f0ead5a8464ffa0a490f5","observation_id":"ba41bfed-70be-41cb-b5eb-323f68047c01","resolution":{"observed_at":"2026-06-26T06:49:46.425849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.01160","last_updated":"2019-07-02T04:27:55Z","snapshot_observed_at":"2026-07-06T08:04:17.909965Z","submitted_at":"2019-07-02T04:27:55Z","title":"WHAM!: Extending Speech Separation to Noisy Environments","version":1},"cited_work":{"arxiv_id":"1907.01160","doi":null,"metadata_source":"pith","pith_arxiv_id":"1907.01160","snapshot_observed_at":"2026-07-04T12:29:51.719708Z","title":"WHAM!: Extending Speech Separation to Noisy Environments","venue":"cs.SD","work_id":"fcbdb6bb-3960-4c2d-9079-fbbaf0c9f850","year":2019},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"cited_paper":"/paper/1907.01160","citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:996586c076cc45cd9a65b7c17e14fae2d8c9004c00d429d72e9a0f757f26927e","observation_id":"bb2bf934-a8d2-4c0c-92a9-b4ba5f518611","resolution":{"observed_at":"2026-07-04T12:29:51.720996Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.11262","last_updated":"2020-05-22T16:26:54Z","snapshot_observed_at":"2026-08-15T22:07:29.787968Z","submitted_at":"2020-05-22T16:26:54Z","title":"LibriMix: An Open-Source Dataset for Generalizable Speech Separation","version":1},"cited_work":{"arxiv_id":"2005.11262","doi":null,"metadata_source":"pith","pith_arxiv_id":"2005.11262","snapshot_observed_at":"2026-07-10T12:57:07.566849Z","title":"LibriMix: An open-source dataset for generalizable speech separation","venue":"eess.AS","work_id":"53c02064-c23e-434f-825d-3b1af09a75aa","year":2020},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"cited_paper":"/paper/2005.11262","citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:7e65ca8dc6e9fa1859236c19fa08e3e9be52a714e39614a2860497efb9a82e7c","observation_id":"65e970a6-19c2-4c65-a180-31bf8fa1ff0e","resolution":{"observed_at":"2026-07-04T12:29:51.684420Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-08-15T04:53:45.483331Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":"1607.06450","doi":"10.1007/978-3-319-32025-0","metadata_source":"pith","pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Layer Normalization","venue":"stat.ML","work_id":"20a2d720-0046-4c7c-bcd6-327ec8143f69","year":2016},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:8e3a859763a976f9736a1da8b6bf06548f23d10ef7313cf7f153650123399275","observation_id":"778e06b3-8ec5-4470-a932-6b3c308c8c1b","resolution":{"observed_at":"2026-07-04T12:29:51.704339Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1702.03118","last_updated":"2017-11-02T02:48:38Z","snapshot_observed_at":"2026-08-14T21:17:04.486241Z","submitted_at":"2017-02-10T10:04:30Z","title":"Sigmoid-Weighted Linear Units for Neural Network Function Approximation in Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"1702.03118","doi":null,"metadata_source":"pith","pith_arxiv_id":"1702.03118","snapshot_observed_at":"2026-07-10T11:57:03.332004Z","title":"Sigmoid-Weighted Linear Units for Neural Network Function Approximation in Reinforcement Learning","venue":"cs.LG","work_id":"5e02a8ca-5d0e-4a73-ad6f-c3ca805563a0","year":2017},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"cited_paper":"/paper/1702.03118","citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:5c97aa0c47734b4d85beb5e156d43990816988468e43a5ea0d4f89680519d69f","observation_id":"126164d3-5d6e-4693-b9d6-91e8aea3ae2a","resolution":{"observed_at":"2026-07-04T12:29:51.713225Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.06349","last_updated":"2023-03-11T08:53:11Z","snapshot_observed_at":"2026-08-16T05:47:09.102580Z","submitted_at":"2023-03-11T08:53:11Z","title":"Resurrecting Recurrent Neural Networks for Long Sequences","version":1},"cited_work":{"arxiv_id":"2303.06349","doi":"10.48550/arxiv.2303.06349","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.06349","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Resurrecting Recurrent Neural Networks for Long Sequences","venue":"arXiv (Cornell University)","work_id":"89102b3e-4ad3-402a-8928-8f0afbef638d","year":2023},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"cited_paper":"/paper/2303.06349","citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:ffac96eb511ebc39c5c3f451c77320c23d266942d6189abb6baa777fd718cab2","observation_id":"908aaf08-db1a-4296-ad6a-1b56f4da9b4b","resolution":{"observed_at":"2026-07-04T12:29:51.718429Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.09941","last_updated":"2024-07-13T16:34:18Z","snapshot_observed_at":"2026-08-12T23:22:48.674322Z","submitted_at":"2024-07-13T16:34:18Z","title":"Hydra: Bidirectional State Space Models Through Generalized Matrix Mixers","version":1},"cited_work":{"arxiv_id":"2407.09941","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.09941","snapshot_observed_at":"2026-07-04T12:29:51.705602Z","title":"Hydra: Bidirectional State Space Models Through Generalized Matrix Mixers,","venue":null,"work_id":"24926de7-b759-4752-8f9a-1e7634da658b","year":2024},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"cited_paper":"/paper/2407.09941","citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:6b0dbdd524a2626512b22615505688caf1048fb041aafa055cc86a34292513ed","observation_id":"89324029-61f9-4566-9f1c-ed7f8ff3a6d1","resolution":{"observed_at":"2026-07-04T12:29:51.708436Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:49:46.425849Z","title":"Unsupervised Sound Separation Using Mixture Invariant Training,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:c81120225f9c7d936f022ab2fca0e9d7d2fadec35fce12e89401303d499e5b45","observation_id":"456435af-0c6c-45cd-93f7-60861058dfa4","resolution":{"observed_at":"2026-06-26T06:49:46.425849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1811.02508","last_updated":"2018-11-06T17:20:05Z","snapshot_observed_at":"2026-08-14T18:03:15.569348Z","submitted_at":"2018-11-06T17:20:05Z","title":"SDR - half-baked or well done?","version":1},"cited_work":{"arxiv_id":"1811.02508","doi":null,"metadata_source":"pith","pith_arxiv_id":"1811.02508","snapshot_observed_at":"2026-07-04T12:29:51.700708Z","title":"SDR - half-baked or well done?","venue":"cs.SD","work_id":"bfed7377-aa22-4c1b-b49d-c56b12e93599","year":2018},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"cited_paper":"/paper/1811.02508","citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:849c2ce2f1c571aca23fc073748c587850e46b1f12d40affb633ec721b40177b","observation_id":"a1cb0da1-91c3-4b8f-8bf7-35be4ea44903","resolution":{"observed_at":"2026-07-04T12:29:51.701944Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05356","last_updated":"2025-02-07T22:08:12Z","snapshot_observed_at":"2026-08-15T18:43:24.196588Z","submitted_at":"2025-02-07T22:08:12Z","title":"Distillation and Pruning for Scalable Self-Supervised Representation-Based Speech Quality Assessment","version":1},"cited_work":{"arxiv_id":"2502.05356","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05356","snapshot_observed_at":"2026-07-04T12:29:51.697896Z","title":"Distillation and Pruning for Scal- able Self-Supervised Representation-Based Speech Quality As- sessment,","venue":null,"work_id":"5ae0d0b2-516f-4ab6-b08d-f9e70f8b777a","year":2025},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"cited_paper":"/paper/2502.05356","citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:fc680c5c72fddecb4795cffdb589d13c2fc4342dcec51eb37d83a2772aef8108","observation_id":"fb71144c-0b83-4897-9564-67f4e1a4a8ab","resolution":{"observed_at":"2026-07-04T12:29:51.699304Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":"1711.05101","doi":"10.1137/1.9781611972825.47","metadata_source":"pith","pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Decoupled Weight Decay Regularization","venue":"cs.LG","work_id":"07ef7360-d385-4033-83f7-8384a6325204","year":2017},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:87e682b7491d2cb054531c539189667bc4e2bfaad91d873dd05f51b757057763","observation_id":"3a3c191b-a47d-41f4-b2d8-4e0a2ff25346","resolution":{"observed_at":"2026-07-04T12:29:51.710799Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.15938","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T12:29:51.695457Z","title":"Straight to Zero: Why Linearly Decaying the Learning Rate to Zero Works Best for LLMs,","venue":null,"work_id":"0707bb44-40b9-4366-a976-8d42f569c203","year":2025},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:e823ca7d66000d35f4b7115b30cace17401bb48b81f6e043b3d62fa10c744bf7","observation_id":"b33aa230-b1e8-473a-93bc-14119fa94dc0","resolution":{"observed_at":"2026-07-04T12:29:51.696849Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:49:46.425849Z","title":"PYIN: A fundamental frequency esti- mator using probabilistic threshold distributions,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:25c876abe430bb461b3d320ac40e3da1338a059aec979a91ff5fcb0c40151ee4","observation_id":"62641c1a-b4eb-46d1-b00b-19642fdf0db5","resolution":{"observed_at":"2026-06-26T06:49:46.425849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T06:49:46.425849Z","title":"YIN, a fundamental fre- quency estimator for speech and music,","venue":null,"work_id":null,"year":1917},"citing_paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-26T06:49:46.425849Z"},"links":{"citing_paper":"/paper/2606.23332"},"observation_digest":"sha256:0554f56290b3070151e299681c510490eef9ed40777ddf13c7585c4d46749694","observation_id":"e2757c44-ab5a-4322-a738-398421d74d9c","resolution":{"observed_at":"2026-06-26T06:49:46.425849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.23332","last_updated":"2026-06-22T13:41:24Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-04T14:09:25.194252Z","submitted_at":"2026-06-22T13:41:24Z","title":"Don't Listen to Me: A Lightweight, Low-Latency Model for Own-Voice Cancellation in Far-Field Speech Enhancement"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":18,"verified_exact":20,"verified_fuzzy":0},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 1 inbound Pith citation observation for arXiv:2606.23332."}