{"as_of":"2026-08-11T11:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bbddf2c623c1ec62a6681ad21ed952a2d38c21917996ca3d7e6a6e09abe1a578","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T14:49:42.989313Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T01:19:05.797308Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.20885","snapshot_observed_at":"2026-08-01T01:19:05.797308Z","title":"Sincqdr-vad: A noise-robust voice activity de- tection framework leveraging learnable filters and ranking-aware optimization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25870","last_updated":"2026-07-28T15:37:44Z","snapshot_observed_at":"2026-08-06T06:44:04.480037Z","submitted_at":"2026-07-28T15:37:44Z","title":"VAD to the Bone: Ultra-Tiny Speech Activity Detection for Edge Deployment","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T01:19:05.797308Z"},"links":{"cited_paper":"/paper/2508.20885","citing_paper":"/paper/2607.25870"},"observation_digest":"sha256:cb598f1fd055d1198813a926bfca77b4cf652c43a7794602bc3d947d86fc163f","observation_id":"7c7f35f5-a180-49c6-b2d6-56f0dccd8a09","resolution":{"observed_at":"2026-08-01T01:19:05.797308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2508.20885/citation-record","integrity":"/paper/2508.20885/integrity","json":"/paper/2508.20885/citation-record.json","paper":"/paper/2508.20885"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:44.052788Z","title":"Speaker diarization with plda i-vector scoring and unsupervised calibration,","venue":null,"work_id":"176cd71d-713b-4a7c-97eb-10f707262f28","year":2014},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.701004Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:c99aa25fdb7649f5730a0d78da859f99f18c455445d83c851063d88886006ad4","observation_id":"41206a49-d0f4-45ff-b8ea-8662a8d0c9d1","resolution":{"observed_at":"2026-08-05T14:49:44.057516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:44.034879Z","title":"Recurrent neural networks for voice activity detection,","venue":null,"work_id":"792fa6a8-548d-4e85-b340-03a6c39fb6a4","year":2013},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.706148Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:5748fe23a2a79bfe6304613249cadd3b685085064f9fc5c3b72e69cae21d9da9","observation_id":"2dbc7b90-91db-4380-bb7d-72dd069b0168","resolution":{"observed_at":"2026-08-05T14:49:44.039983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:44.016750Z","title":"Deep belief networks based voice activity detection,","venue":null,"work_id":"0eb16720-fb4a-4c1a-855c-25b4ed553cc2","year":2013},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.710761Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:e631706ec4df8976fd594c5fdfceba5e60778af35fd2537e1625b07ab6921990","observation_id":"0f2720d1-5949-442a-8797-05968ab09bbf","resolution":{"observed_at":"2026-08-05T14:49:44.022829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.997223Z","title":"A statistical model-based voice activity detection,","venue":null,"work_id":"0af1f5ae-8b6e-4b2c-810b-97d399d38b05","year":1999},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.715781Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:e07e09f1bcb1eafff88dd5051d9b1004fd6ecb85cb7d54cd6dde4e7b472c522d","observation_id":"bf4087eb-e7ed-4d62-8271-08973fa1426a","resolution":{"observed_at":"2026-08-05T14:49:44.002830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.980790Z","title":"Real-life voice activity detection with LSTM Recurrent neural networks and an appli- cation to Hollywood movies,","venue":null,"work_id":"023e269e-420c-451f-a7a0-f2a8b8e8c0dd","year":2013},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.720912Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:0cbc23c25b4ffe97971dee51334cc1004ab21eed130877dd794a5d462c679bb1","observation_id":"87f61e21-83d3-49fa-aa9f-a1eb195b1db4","resolution":{"observed_at":"2026-08-05T14:49:43.985553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1309.1501","last_updated":"2013-12-10T11:51:39Z","snapshot_observed_at":"2026-07-06T03:22:20.276967Z","submitted_at":"2013-09-05T22:06:58Z","title":"Improvements to deep convolutional neural networks for LVCSR","version":3},"cited_work":{"arxiv_id":"1309.1501","doi":null,"metadata_source":"pith","pith_arxiv_id":"1309.1501","snapshot_observed_at":"2026-08-05T14:49:43.368565Z","title":"Improvements to deep convolutional neural networks for LVCSR","venue":"cs.LG","work_id":"f6c95c67-fba6-4111-a7fa-9b428ee2c2c0","year":2013},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.726329Z"},"links":{"cited_paper":"/paper/1309.1501","citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:ff248a612a44d111501ccfff17f8afa48040945bcc1c25c29911ff02a18ed094","observation_id":"3db13578-2beb-401c-8294-fff79d77a4a3","resolution":{"observed_at":"2026-08-05T14:49:43.377083Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.965473Z","title":"V oice activity detection for transient noisy environment based on diffusion nets,","venue":null,"work_id":"46546d59-f8d6-4ee3-b337-f3ea1fc465ea","year":2019},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.732681Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:a7fb629c114ffe9d6122940f4bcad2a5b670ab8d2458c79656fdace385fd54d0","observation_id":"a314cb5e-fe30-4cf0-bfc1-0e15b1e62d7f","resolution":{"observed_at":"2026-08-05T14:49:43.970184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.04261","last_updated":"2020-03-14T04:51:06Z","snapshot_observed_at":"2026-08-10T23:50:32.922715Z","submitted_at":"2019-11-08T07:16:27Z","title":"Voice Activity Detection in presence of background noise using EEG","version":5},"cited_work":{"arxiv_id":"1911.04261","doi":null,"metadata_source":"pith","pith_arxiv_id":"1911.04261","snapshot_observed_at":"2026-08-05T14:49:43.341614Z","title":"Voice Activity Detection in presence of background noise using EEG","venue":"cs.SD","work_id":"9af17564-c39b-4008-b608-2e4e0d9376bc","year":2019},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.737188Z"},"links":{"cited_paper":"/paper/1911.04261","citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:27a69c1fe37d550f4e75fcd99357735704beed8ecb074770311b6e6253c6bb04","observation_id":"9f130d50-6d99-47be-9732-5c9df7cf1986","resolution":{"observed_at":"2026-08-05T14:49:43.346542Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.950272Z","title":"A bin encoding training of a spiking neural network based voice activity detection,","venue":null,"work_id":"a1a1414e-41f9-4d4b-87bb-859305aec58e","year":2020},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.742122Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:9662485631389e3c51f95024bf6d5c0750e6f2bc08ee7c4cc5d149962491180b","observation_id":"f3eb3cf8-2e3f-4687-86a3-225b7d727dac","resolution":{"observed_at":"2026-08-05T14:49:43.954696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.934071Z","title":"V oice activity detection in the wild via weakly supervised sound event detection,","venue":null,"work_id":"d54bb2e9-0471-4de8-a60e-8b276fdf1dda","year":2020},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.746458Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:20900fcad1347ff5722b08adb1928696935cf15b87c71dff13ef7cad9f756776","observation_id":"b9685b7d-1dce-4633-ade0-3944ab38c8ff","resolution":{"observed_at":"2026-08-05T14:49:43.938689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.919904Z","title":"Spiking neural networks trained with backpropagation for low power neuromorphic implementation of voice activity detection,","venue":null,"work_id":"41987045-692b-43bc-b6f9-6c0a39899083","year":2020},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.751118Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:467074d3c1bcefa4640fd83e2e985756e5a3a7a808f947384006cfeb2775c8f4","observation_id":"10b2d720-1693-4003-af34-14e7ebd62d2a","resolution":{"observed_at":"2026-08-05T14:49:43.924373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.904225Z","title":"End-to-end domain-adversarial voice activity detection,","venue":null,"work_id":"0581aaed-e064-46cf-a76a-026e511af222","year":2020},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.755250Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:d458778813fb2e65ad41a0923bff4969ee448d551a6a7d0817378bd9a680e97a","observation_id":"1aebecaa-0757-4573-8db0-f1c05a8565f1","resolution":{"observed_at":"2026-08-05T14:49:43.909145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.889603Z","title":"End-to-end automatic speech recognition integrated with CTC-based voice activity detection,","venue":null,"work_id":"90af8a84-3b58-4627-8511-7e9872e54c7b","year":2020},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.759421Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:84eba13eda35663fed5a5c2e3d56092c4a23a259da9668aecc6b28cdec9f877b","observation_id":"1e553804-18fb-4f79-a178-a79e3a08314a","resolution":{"observed_at":"2026-08-05T14:49:43.894154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.874098Z","title":"V oice activity detection in the wild: A data-driven approach using teacher-student training,","venue":null,"work_id":"37be88f6-e63c-460d-bad7-09db322eaac1","year":2021},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.763503Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:cd4928882251f714034fa24fb34b73214b3039a2f2d82ce0d555e06b62ef519c","observation_id":"cd92ff4a-2bcf-4404-9344-6904a011a4f8","resolution":{"observed_at":"2026-08-05T14:49:43.879321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.859608Z","title":"Improvement of noise-robust single-channel voice activity detection with spatial pre-processing,","venue":null,"work_id":"d8a75e7e-57e1-425d-aa76-06bc62ca7687","year":2021},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.767750Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:cf0a3db47a01b2d40acee723042fcbcb4c4bea76f33d9debef5af7a412d58408","observation_id":"985e4b4b-e2ea-4470-9c08-d925f4e660c1","resolution":{"observed_at":"2026-08-05T14:49:43.864033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.845116Z","title":"A lightweight framework for online voice activity detection in the wild,","venue":null,"work_id":"c5c660b1-3ba5-4f4a-a368-fe256ff278a8","year":2021},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.771891Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:cd80a646be464a27e98b6e65339861c1bf0c8a8852d5220f71cdf5dc5f7a6033","observation_id":"bbca8a5e-4dbb-4ebb-9b2b-b93e339d5c45","resolution":{"observed_at":"2026-08-05T14:49:43.849679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.11061","last_updated":"2022-09-22T14:53:44Z","snapshot_observed_at":"2026-08-09T17:17:05.406607Z","submitted_at":"2022-09-22T14:53:44Z","title":"Cross-domain Voice Activity Detection with Self-Supervised Representations","version":1},"cited_work":{"arxiv_id":"2209.11061","doi":null,"metadata_source":"pith","pith_arxiv_id":"2209.11061","snapshot_observed_at":"2026-08-05T14:49:43.315722Z","title":"Cross-domain Voice Activity Detection with Self-Supervised Representations","venue":"eess.AS","work_id":"6dd5c759-ee79-4255-bfc2-5ed5e79b6569","year":2022},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.776113Z"},"links":{"cited_paper":"/paper/2209.11061","citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:8f09bdf99f3f9ea4b799396a39e4157cee3896865c598988726fba45d96ac019","observation_id":"16344eb1-0c78-495d-b1d0-c95af5789bd1","resolution":{"observed_at":"2026-08-05T14:49:43.321256Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.01691","last_updated":"2022-07-04T19:43:09Z","snapshot_observed_at":"2026-08-04T08:52:21.161341Z","submitted_at":"2022-07-04T19:43:09Z","title":"Adversarial Multi-Task Deep Learning for Noise-Robust Voice Activity Detection with Low Algorithmic Delay","version":1},"cited_work":{"arxiv_id":"2207.01691","doi":null,"metadata_source":"pith","pith_arxiv_id":"2207.01691","snapshot_observed_at":"2026-08-05T14:49:43.290383Z","title":"Adversarial Multi-Task Deep Learning for Noise-Robust Voice Activity Detection with Low Algorithmic Delay","venue":"eess.AS","work_id":"6aae0a0a-3ace-45f6-828d-79d5e81a3646","year":2022},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.780832Z"},"links":{"cited_paper":"/paper/2207.01691","citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:e0c9acfe942dfe5a44fbc468ef10a911e450717a61e3c91acb902695f91a1553","observation_id":"e69d231e-5623-4830-9b34-425d4dcc674b","resolution":{"observed_at":"2026-08-05T14:49:43.296437Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.02996","last_updated":"2022-12-06T14:14:00Z","snapshot_observed_at":"2026-07-06T14:27:22.462117Z","submitted_at":"2022-12-06T14:14:00Z","title":"BC-VAD: A Robust Bone Conduction Voice Activity Detection","version":1},"cited_work":{"arxiv_id":"2212.02996","doi":null,"metadata_source":"pith","pith_arxiv_id":"2212.02996","snapshot_observed_at":"2026-08-05T14:49:43.266680Z","title":"BC-VAD: A Robust Bone Conduction Voice Activity Detection","venue":"eess.AS","work_id":"9dd1e754-d0a0-41da-ad09-85b74d6e59a0","year":2022},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.785836Z"},"links":{"cited_paper":"/paper/2212.02996","citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:8efcb76d25af47f94b8e8c1b13b9fb99a563077f91d648c50eb461a96c3154b1","observation_id":"4ae54ad8-3159-47d4-82de-de2f1cdd8cea","resolution":{"observed_at":"2026-08-05T14:49:43.271671Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.830378Z","title":"Unsupervised voice activity detection by modeling source and system information using zero frequency filtering,","venue":null,"work_id":"2d8625bd-a17c-466b-8383-1b6c80a884b9","year":2022},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.790532Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:5dfe329a3abfbf0ceaa5f7922dce6646341fb746afb082640abc14a4f5c7475a","observation_id":"f527fc5e-afca-414e-949b-df073b7f6174","resolution":{"observed_at":"2026-08-05T14:49:43.835148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02944","last_updated":"2022-03-06T11:52:00Z","snapshot_observed_at":"2026-07-06T12:44:48.852327Z","submitted_at":"2022-03-06T11:52:00Z","title":"CNN self-attention voice activity detector","version":1},"cited_work":{"arxiv_id":"2203.02944","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.02944","snapshot_observed_at":"2026-08-05T14:49:43.240537Z","title":"CNN self-attention voice activity detector","venue":"cs.SD","work_id":"666253ae-2f25-49f8-869a-ce6c6da0e71c","year":2022},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.794635Z"},"links":{"cited_paper":"/paper/2203.02944","citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:1420377014b0dfefda4c7500011718bf577271dae72de8fcf90b4e613d6bc9e5","observation_id":"edbebfd4-177c-44fe-819a-594f8a1d9c03","resolution":{"observed_at":"2026-08-05T14:49:43.246555Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.05815","last_updated":"2023-12-10T08:17:21Z","snapshot_observed_at":"2026-08-11T09:15:49.053161Z","submitted_at":"2023-12-10T08:17:21Z","title":"Voice Activity Detection (VAD) in Noisy Environments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.05815","snapshot_observed_at":"2026-08-05T14:49:42.798923Z","title":"V oice activity detection (V AD) in noisy environments,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.798923Z"},"links":{"cited_paper":"/paper/2312.05815","citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:c1fae63ce74059b3e82c7315a47c8e293400f323a84bdd6947c604723a395c27","observation_id":"3d98060d-e406-4277-9ed6-c2cd0d7ffbe0","resolution":{"observed_at":"2026-08-05T14:49:42.798923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.815350Z","title":"Semantic V AD: Low-latency voice activity detection for speech interaction,","venue":null,"work_id":"53251933-840c-4516-9833-7e1d47f8acea","year":2023},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.803488Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:482cbc04f79bf154b3a37aca6fc821ee5f8c8bf8cb3e57956e44003744f8fabe","observation_id":"8e52a4d0-086d-43f2-a670-026657c1eef3","resolution":{"observed_at":"2026-08-05T14:49:43.820132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.800711Z","title":"Real-time causal spectro-temporal voice activity detection based on convolutional encoding and residual decoding,","venue":null,"work_id":"ed8d39e4-d13a-40da-aebc-75bb87bb8e86","year":2023},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.807602Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:d4fc179fa1434668388133b09ac00a045e6140da81ebf6d7ddf50d0286c84eef","observation_id":"ef9380ea-903d-4011-a8f9-0d84516f4adb","resolution":{"observed_at":"2026-08-05T14:49:43.805427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14509","last_updated":"2024-10-18T14:43:34Z","snapshot_observed_at":"2026-08-03T14:46:17.831985Z","submitted_at":"2024-10-18T14:43:34Z","title":"CLIP-VAD: Exploiting Vision-Language Models for Voice Activity Detection","version":1},"cited_work":{"arxiv_id":"2410.14509","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.14509","snapshot_observed_at":"2026-08-05T14:49:43.196833Z","title":"CLIP-VAD: Exploiting Vision-Language Models for Voice Activity Detection","venue":"cs.CV","work_id":"26929588-8309-499b-9210-9b92c713d372","year":2024},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.812464Z"},"links":{"cited_paper":"/paper/2410.14509","citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:be0fbca6002f82eb145f00ca43a6cc40c390394355d5a39edcedbb918749ee2c","observation_id":"e5d8c046-3ef0-4443-ae98-517deafa40f6","resolution":{"observed_at":"2026-08-05T14:49:43.201786Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16797","last_updated":"2024-05-27T03:31:16Z","snapshot_observed_at":"2026-07-06T18:20:18.770090Z","submitted_at":"2024-05-27T03:31:16Z","title":"A Real-Time Voice Activity Detection Based On Lightweight Neural","version":1},"cited_work":{"arxiv_id":"2405.16797","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.16797","snapshot_observed_at":"2026-08-05T14:49:43.170824Z","title":"A Real-Time Voice Activity Detection Based On Lightweight Neural","venue":"cs.SD","work_id":"23fe9947-a60e-4ef5-8b3a-12ea0ff2e477","year":2024},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.817480Z"},"links":{"cited_paper":"/paper/2405.16797","citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:bd22d3a6a78bdf61cebf7bce61e845c8465e53a6dd2f9fdd71804db689bddf7e","observation_id":"e116c1cc-14a5-4e62-aad3-0cff34a938cd","resolution":{"observed_at":"2026-08-05T14:49:43.176117Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.785290Z","title":"A Transformer-based voice activity detector,","venue":null,"work_id":"5f85b36d-d99d-42fd-af47-60095dd2ff1a","year":2024},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.823583Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:c87bcfe69767d303480519753e5a0851c0861e35125b0d309bb051d5dc200237","observation_id":"0222f0a4-49c9-4dac-a2d2-052d6cf1e654","resolution":{"observed_at":"2026-08-05T14:49:43.790203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.768119Z","title":"Robust voice activity detection using locality- sensitive hashing and residual frequency-temporal attention,","venue":null,"work_id":"5feda050-bf1a-43bb-b386-79b4cf75e7e7","year":2024},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.828785Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:f368cebb86d1d1d2e89f3c0f0c0e335906f304c750ade2b76a2b5d2d78020dbb","observation_id":"a3a6b1dd-8143-4efd-ae12-fe9744aa0770","resolution":{"observed_at":"2026-08-05T14:49:43.773172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.751640Z","title":"Channel- combination algorithms for robust distant voice activity and overlapped speech detection,","venue":null,"work_id":"a17152c3-43b2-4d61-93f5-8160b2b8c3e2","year":2024},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.833400Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:0155ba98c1a96227f5bbda36a2508aa2cc9d9653de2f78cc580239cd5c897036","observation_id":"b3880b40-3083-4d1b-8456-2fc45190f2f8","resolution":{"observed_at":"2026-08-05T14:49:43.756335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.737499Z","title":"sV AD: A robust, low-power, and light-weight voice activity detection with spiking neural networks,","venue":null,"work_id":"b541f805-0975-4272-9f24-66f35a7c8e74","year":2024},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.837894Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:88ca232f9d5829f30de89b111158d5e139a4bb035f023da34b91f2c303037e4b","observation_id":"98db8661-c0f8-493d-bdea-ccfb72681f32","resolution":{"observed_at":"2026-08-05T14:49:43.741894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.722948Z","title":"Robust speech activity detection in movie audio: Data resources and experimental evaluation,","venue":null,"work_id":"d17af236-e930-4629-89e1-6943951005ae","year":2019},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.843320Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:20d464894ff8c5e4c1f3f3560502d36e6aec3e2936b6ef6262a8aba36bccd8ae","observation_id":"ddd52716-7639-427b-8378-b7969cd7659c","resolution":{"observed_at":"2026-08-05T14:49:43.727394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.708362Z","title":"MarbleNet: Deep 1D time- channel separable convolutional neural network for voice activity de- tection,","venue":null,"work_id":"30009117-f969-454f-b838-a90351770f64","year":2021},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.848551Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:f95a538589211bc684960d3aa5f8837fcd5ab53f1eb94fcd6baaedf1cd54825c","observation_id":"d0a1064d-94f5-4fa6-ac49-2045e305a5b8","resolution":{"observed_at":"2026-08-05T14:49:43.712574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.693554Z","title":"SG-V AD: Stochastic gates based speech activity detection,","venue":null,"work_id":"bcbbd7e1-8ba4-417c-83f3-44b47557a94b","year":2023},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.853848Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:c6a3c378eb3b61d60501d1eb446fd5e727cc8017e3c8039690725e9ee7c1fcc0","observation_id":"6dda8084-4b71-4c89-9565-42d88ffd4b56","resolution":{"observed_at":"2026-08-05T14:49:43.698226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.679109Z","title":"ResectNet: An efficient architecture for voice activity detection on mobile devices,","venue":null,"work_id":"d09fa5be-2fbf-4fee-a4a5-92e526d96a0c","year":2022},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.858738Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:01499bcc9d515fe9953bffd8eae363625a884fd6c4a7879b19b191f9ab036f87","observation_id":"87219fda-8bfc-40bf-9342-ceb9b95126a4","resolution":{"observed_at":"2026-08-05T14:49:43.683484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.662659Z","title":"Small-footprint convolutional neural network with reduced feature map for voice activity detection,","venue":null,"work_id":"18d70e75-62fa-4ff4-953d-a166e6918e2a","year":2024},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.864378Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:9e82f78897557e6ae61e57495431198277fc8a0f8f1d0a8c124059210a90ff1a","observation_id":"75ea1723-de44-4457-9665-d0db7ea690af","resolution":{"observed_at":"2026-08-05T14:49:43.668467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.647984Z","title":"A tutorial on the cross-entropy method,","venue":null,"work_id":"f28ec9c0-48be-4ec6-b69e-eb05429de5de","year":2005},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.869397Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:20ec7ddded56edc42f4dbf208b80d250bc9c44034decad014e89565206fcaf23","observation_id":"efc34114-a6d6-4920-b41e-1c1598bb2d21","resolution":{"observed_at":"2026-08-05T14:49:43.652463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.631577Z","title":"Speaker recognition from raw waveform with SincNet,","venue":null,"work_id":"eba8591a-f938-415b-9be7-ec0faab3277e","year":2018},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.874203Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:59e4e388e80fdd1eec0bdab7fb4e5ad2fa8312afd0f59cf64ae8e6c7cce5442b","observation_id":"a1cb42ce-257d-4650-85d0-5d0b14776bda","resolution":{"observed_at":"2026-08-05T14:49:43.637124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.616898Z","title":"Learning filterbanks from raw speech for phone recogni- tion,","venue":null,"work_id":"35de0b5d-fa47-45b3-8fc8-9e60cd50318b","year":2018},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.879142Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:264e9f75dcf95b03ebe808572991dc4e77b24123e0a37b5d4f443ff256ebdd9f","observation_id":"c9a173b0-f917-495a-b68b-2f025224a602","resolution":{"observed_at":"2026-08-05T14:49:43.621222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.601423Z","title":"What do neural networks listen to? Exploring the crucial bands in speech enhancement using sinc- convolution,","venue":null,"work_id":"e45e0b72-0533-4566-a8dc-af0362470512","year":2024},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.884420Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:4510c22c592b7f4dfa68a1bb3cf54d1924124fb48a2c64b67020a59de6f0051f","observation_id":"acb89ee0-35ad-4b09-99b5-7a2bd63fa977","resolution":{"observed_at":"2026-08-05T14:49:43.606115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.585550Z","title":"Speaker conditional sinc-extractor for personal V AD,","venue":null,"work_id":"2012ea4d-1e1e-4934-9f7c-c153a6ec67b8","year":2024},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.894442Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:d1be71285783565f33c4e84b785f7a7fb95dac24f0760cb2c46e0576f76693ae","observation_id":"7ef9e80b-6ba5-41dc-bd55-5664c297cdd8","resolution":{"observed_at":"2026-08-05T14:49:43.591213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14177","last_updated":"2022-07-04T18:49:54Z","snapshot_observed_at":"2026-08-09T01:07:38.489245Z","submitted_at":"2022-03-27T00:47:00Z","title":"Benchmarking Deep AUROC Optimization: Loss Functions and Algorithmic Choices","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14177","snapshot_observed_at":"2026-08-05T14:49:42.900316Z","title":"Benchmarking deep AUROC opti- mization: Loss functions and algorithmic choices,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.900316Z"},"links":{"cited_paper":"/paper/2203.14177","citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:b066f8adceb5c0deb91a9a62909a0ae634d96af4d1182ace5b44e6cfbedf84bc","observation_id":"1a9daf2f-ecb2-4a92-bdfc-5377cdd54649","resolution":{"observed_at":"2026-08-05T14:49:42.900316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.570873Z","title":"AUC optimization for deep learning-based voice activity detection,","venue":null,"work_id":"929e8be8-0ac0-4464-991e-eab2dc30459a","year":2022},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.905170Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:58fe289fd24500b29945c675923916cd6e64b51a654375034b838f0173596679","observation_id":"3f8b449d-50e9-41e7-8835-a6a9583ef32d","resolution":{"observed_at":"2026-08-05T14:49:43.575376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.554656Z","title":"A V A- speech: A densely labeled dataset of speech activity in movies,","venue":null,"work_id":"ecf9473e-7e31-4695-94b0-b74b43a1b1cf","year":2018},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.910100Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:e8cce89ae9e51f49f8b31b594719068f412a5afaf888722b4a50c0d792362c1a","observation_id":"54362b12-4ffd-4e54-897f-d45597d97990","resolution":{"observed_at":"2026-08-05T14:49:43.559608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.539036Z","title":"V oice activity detection using an adaptive context attention model,","venue":null,"work_id":"e45d4018-235d-4db2-80c0-a6c3c772da6f","year":2018},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.914341Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:cc55e83335a58161f588bab536160aae16e9a45cc523468f039bcf87576735e1","observation_id":"84594d4c-c55e-4525-8666-456fb60d4f44","resolution":{"observed_at":"2026-08-05T14:49:43.543533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.522814Z","title":"Some windows with very good sidelobe behavior,","venue":null,"work_id":"0fb807a9-beba-43a6-8850-86cb683c954b","year":1981},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.919034Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:18dc9665a92b1addb80e6c833a3ccbecabf021a032269c621ea410420a1af76a","observation_id":"ddfa9fef-7710-4bd4-857f-69950e13cb28","resolution":{"observed_at":"2026-08-05T14:49:43.527572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04552","last_updated":"2017-11-29T14:51:40Z","snapshot_observed_at":"2026-08-10T10:31:15.628197Z","submitted_at":"2017-08-15T15:21:53Z","title":"Improved Regularization of Convolutional Neural Networks with Cutout","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.04552","snapshot_observed_at":"2026-08-05T14:49:42.923495Z","title":"Improved regularization of convolutional neural networks with cutout,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.923495Z"},"links":{"cited_paper":"/paper/1708.04552","citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:0293d0cd382719be983c88aafb9664b6485121849feed568c103ba41a69554ea","observation_id":"3f3cd6b5-f731-4580-ad3d-cf9627c35950","resolution":{"observed_at":"2026-08-05T14:49:42.923495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.01271","last_updated":"2018-04-19T14:32:38Z","snapshot_observed_at":"2026-07-06T06:26:27.965096Z","submitted_at":"2018-03-04T00:20:29Z","title":"An Empirical Evaluation of Generic Convolutional and Recurrent Networks for Sequence Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.01271","snapshot_observed_at":"2026-08-05T14:49:42.928100Z","title":"An empirical evaluation of generic convolutional and recurrent networks for sequence modeling,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.928100Z"},"links":{"cited_paper":"/paper/1803.01271","citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:d89a06aed7d0ab14e2df09dedab17b59ce0d900c9f95ca7dcb4dff6feb6d882d","observation_id":"80114a2f-a268-47e0-8ded-0620919cade5","resolution":{"observed_at":"2026-08-05T14:49:42.928100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.507164Z","title":"CSPNet: A new backbone that can enhance learning capability of CNN,","venue":null,"work_id":"9a12ae34-d011-4f33-82e5-f78136d9e80e","year":2020},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.933047Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:a16716fbd35c901aeedca896b4ba814e0adec7b2c8d3051827146559c4a497af","observation_id":"d7af3662-94ba-4a17-bcc7-828ffc2beb61","resolution":{"observed_at":"2026-08-05T14:49:43.511760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.03209","last_updated":"2018-04-09T19:58:17Z","snapshot_observed_at":"2026-07-06T06:32:32.083176Z","submitted_at":"2018-04-09T19:58:17Z","title":"Speech Commands: A Dataset for Limited-Vocabulary Speech Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.03209","snapshot_observed_at":"2026-08-05T14:49:42.937483Z","title":"Speech commands: A dataset for limited-vocabulary speech recognition,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.937483Z"},"links":{"cited_paper":"/paper/1804.03209","citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:14f400ea6cbfe915e608ea1f28d038bef9e2edb6764881daa90d5e3a1b8a4849","observation_id":"ead2a22f-3c70-4941-bba7-ad1435ecd44d","resolution":{"observed_at":"2026-08-05T14:49:42.937483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.492351Z","title":"Freesound technical demo,","venue":null,"work_id":"33f77240-7e73-4516-9e31-83820966bbf9","year":2013},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.942123Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:842c87e7fb06becdf80a280980556b32b256bd575890294a997877fccac53c3c","observation_id":"ad5b5b0d-7f68-4134-b605-5646b58dbf92","resolution":{"observed_at":"2026-08-05T14:49:43.496559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.476769Z","title":"ESC: Dataset for environmental sound classification,","venue":null,"work_id":"af24db8c-8d64-4a46-b352-e478e72bcd36","year":2015},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.946726Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:309f517ba78f5fb27535e71408a924833e90cb00d3bf1a412131918b837991b6","observation_id":"c28ff099-3e12-4586-af27-e7c766264015","resolution":{"observed_at":"2026-08-05T14:49:43.481344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.04747","last_updated":"2017-06-15T13:21:04Z","snapshot_observed_at":"2026-08-04T02:05:40.539691Z","submitted_at":"2016-09-15T17:32:34Z","title":"An overview of gradient descent optimization algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.04747","snapshot_observed_at":"2026-08-05T14:49:42.951225Z","title":"An overview of gradient descent optimization algorithms,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.951225Z"},"links":{"cited_paper":"/paper/1609.04747","citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:7c68063765d8d1f11d78f3f0b375425e864f6ee6059210da01937acc693515c7","observation_id":"4c94215b-384e-4117-b362-57c8cf59b289","resolution":{"observed_at":"2026-08-05T14:49:42.951225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.460332Z","title":"Bag of tricks for image classification with convolutional neural networks,","venue":null,"work_id":"bc1e401d-9367-4e53-8925-4c51424c8f18","year":2019},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.955788Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:5cff7b1495329a50004adb58472fdce3f6b20a741b25c8d16583695f23ee4dc1","observation_id":"e16e2485-335c-493a-a01c-3b606b7e97cc","resolution":{"observed_at":"2026-08-05T14:49:43.464971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.444721Z","title":"The use of the area under the ROC curve in the evaluation of machine learning algorithms,","venue":null,"work_id":"ca0a4878-3d98-450b-9601-112558d1f94a","year":1997},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.960601Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:4578fc326bdc6cae0b4ea9af719c51dbf52a9d401fd078c54b11e90a4c2b9116","observation_id":"79174a5d-71b9-481b-a81c-da4c63f1fe87","resolution":{"observed_at":"2026-08-05T14:49:43.449297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.427762Z","title":"A hybrid CNN-BiLSTM voice activity detector,","venue":null,"work_id":"da187175-c5db-43e9-9205-b4cbd3b122ef","year":2021},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.965345Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:5006eb54b92f6260f490a5b98b2cd8a65ad49c3a2d6212f64b1e632a6ce42046","observation_id":"c80f3cc1-fda4-490c-aacc-a3e323b16508","resolution":{"observed_at":"2026-08-05T14:49:43.433058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.410774Z","title":"ADA-V AD: Unpaired adversarial domain adaptation for noise-robust voice activity detection,","venue":null,"work_id":"7adb1c8e-7557-40c3-b649-f61ad2c57f10","year":2022},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.971084Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:a98599d6c760674bf6dcc98e769388df0cec38d3a57b909ffe862d93efd25af2","observation_id":"003ba52d-3337-43e3-aa15-148607eb391a","resolution":{"observed_at":"2026-08-05T14:49:43.415346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.392260Z","title":"NAS-V AD: Neural architecture search for voice activity detection,","venue":null,"work_id":"48dd9210-f08d-40a3-bea1-7d57129f37e5","year":2022},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.977622Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:82d78489b6d9e746705783c6c8c55bda05d6013d740e7c0d9923235136574b46","observation_id":"087a0ee7-f6ea-4f17-9832-bc406f8fe59a","resolution":{"observed_at":"2026-08-05T14:49:43.398494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.07445","last_updated":"2021-05-19T12:30:15Z","snapshot_observed_at":"2026-08-06T04:31:57.006251Z","submitted_at":"2021-02-15T10:37:14Z","title":"On training targets for noise-robust voice activity detection","version":2},"cited_work":{"arxiv_id":"2102.07445","doi":null,"metadata_source":"pith","pith_arxiv_id":"2102.07445","snapshot_observed_at":"2026-08-05T14:49:43.050871Z","title":"On training targets for noise-robust voice activity detection","venue":"eess.AS","work_id":"8459006b-ffd4-4a83-95fc-b46106508a52","year":2021},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.983421Z"},"links":{"cited_paper":"/paper/2102.07445","citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:9bc920fc1615b8776dcff9e20212c9a2d6c4d53b68b948e6785dd6c9eee57dbb","observation_id":"c78bbc80-256c-46ae-94fe-5952daa52642","resolution":{"observed_at":"2026-08-05T14:49:43.058024Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-05T14:49:42.989313Z","title":"Mamba: Linear-time sequence modeling with selective state spaces,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.989313Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:709ba4355213c4f1dc5f72cfe3e42fd25f2ad38456a1df1aaee556dc990890dc","observation_id":"94456352-0719-4867-9cbb-088ea2bc42a3","resolution":{"observed_at":"2026-08-05T14:49:42.989313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":9,"verified_fuzzy":43},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 1 inbound Pith citation observation for arXiv:2508.20885."}