{"as_of":"2026-08-23T21:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7d33e7fca7021fc98d428ac127199fbc6233e7abf9ca4c2fbe4de8648b272501","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T05:26:14.104367Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.03260/citation-record","integrity":"/paper/2502.03260/integrity","json":"/paper/2502.03260/citation-record.json","paper":"/paper/2502.03260"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.833977Z","title":"Learning filterbanks from raw speech for phone recogni- tion,","venue":null,"work_id":"faf2e0a3-e32d-4073-96bf-18031a274471","year":2018},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.879856Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:022141c04a8a4ee53f651a6caa9cff88a8decb483b220640e5279d3cd153eb42","observation_id":"ae385333-7bda-4bdc-bbc3-3000fb6d90a5","resolution":{"observed_at":"2026-08-09T05:26:14.837636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.823863Z","title":"Acoustic modelling with cd-ctc-smbr lstm rnns,","venue":null,"work_id":"0a23a38c-4bf5-4502-95f5-54ced6631a57","year":2015},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.884229Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:db5b0ace1b761e699ccf7c5d907df357abc81a3f1770a6d1c62cf4f53f59f125","observation_id":"a940fb83-a029-4d50-89fd-67c331b422c3","resolution":{"observed_at":"2026-08-09T05:26:14.827262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.813261Z","title":"Speaker recognition from raw waveform with sincnet,","venue":null,"work_id":"dd8075d2-8e81-4d78-a22c-56a0c743b5e5","year":2018},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.887667Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:aa17ba1b439a6c3263051fbcbdac8335fc8fa535fbe6a00e1c23f61af5031bbc","observation_id":"b433856f-f59f-4116-9541-a783e22ab4b7","resolution":{"observed_at":"2026-08-09T05:26:14.817135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.803227Z","title":"End-to-end spoofing detection with raw waveform CLDNNS,","venue":null,"work_id":"095d779b-4cd0-462e-bf43-8c2c4db8d34f","year":2017},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.891094Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:0a62a802c6695794771235796b0edbe3a89292fa7bc28c3fae1329ecfd4b36a6","observation_id":"568ab058-3cde-4018-b704-9df4bb8da0ec","resolution":{"observed_at":"2026-08-09T05:26:14.806780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.792451Z","title":"ESC: Dataset for environmental sound classification,","venue":null,"work_id":"6d256f53-c2f9-41cb-a8df-32a7084e0657","year":2015},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.894684Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:b70da9457533ad28ceaa4de0ec3c56d574f6e928ab5590034151f6328c091404","observation_id":"987b28f1-b92f-4cc5-99f8-aaf1b881d4c3","resolution":{"observed_at":"2026-08-09T05:26:14.796481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.783228Z","title":"Towards learning universal audio representations,","venue":null,"work_id":"9080e291-93dc-42c9-9e2a-4ae0836faff3","year":2022},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.898261Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:7866fe85c503e9521b633105ebd29408342a22ac2a4d1a970b464ad9abd7254a","observation_id":"ffcad32c-bb2f-4883-9c41-351cd4b67183","resolution":{"observed_at":"2026-08-09T05:26:14.786436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.774356Z","title":"Filterbank design for end-to-end speech separation,","venue":null,"work_id":"495dbde3-e941-4230-851c-1001f8c6aae9","year":2020},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.901994Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:cbdb5b362c6cbee292d370ee557516e7eb8608b6d1d89903513ca16f7b2f286d","observation_id":"e2b7b99e-5d1f-45af-8475-c0f596a7a4ad","resolution":{"observed_at":"2026-08-09T05:26:14.777552Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.765384Z","title":"Conformer: Convolution-augmented transformer for speech recognition,","venue":null,"work_id":"5edc526d-31e0-45a2-9844-6710c4f290a6","year":2020},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.905152Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:42768d4882adf329b7b08ef2ce56500f4a8d9e3aaa159de2854054de02361553","observation_id":"7b1da039-a887-4681-a7e8-edace45ee0a6","resolution":{"observed_at":"2026-08-09T05:26:14.768720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.756555Z","title":"Deep scattering spectrum,","venue":null,"work_id":"9d0efe80-3ff6-4995-abac-1e6c01a04cc7","year":2014},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.908110Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:7ea173761f18366969e78a64716113382a14708ace193c6daab793598dfadaf3","observation_id":"c13d1567-eb07-4a9e-9bf0-1572fb382d1d","resolution":{"observed_at":"2026-08-09T05:26:14.759439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.746593Z","title":"Pitch-Adaptive Front-End Features for Robust Children’s ASR","venue":null,"work_id":"e46b2640-825f-427b-9980-e7a2fcec1b99","year":2016},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.911056Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:d33244493f2637516ff783ead24ec3aaa59999b59543aa13cd1bbf1a25fd2352","observation_id":"07170184-b5fb-4077-8755-ccca841376d0","resolution":{"observed_at":"2026-08-09T05:26:14.749936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:13.914144Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.914144Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:8e3c833362f4ee09d77ea44a1ca43fd0ad0ad8dfd1e81b8e5a488333c057d711","observation_id":"bc707b4f-06f4-4d4d-9196-9cb09ca71960","resolution":{"observed_at":"2026-08-09T05:26:13.914144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.730782Z","title":"Conv-tasnet: Surpassing ideal time– frequency magnitude masking for speech separation,","venue":null,"work_id":"69c159b5-c0ee-4001-aff4-839808eb9ba5","year":2019},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.917582Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:97f7584c2a716f062b61b1ad33f3973461003684bc02882ec258775cbb7027d3","observation_id":"ec42de38-d2cf-442c-af3b-f8492da4dc89","resolution":{"observed_at":"2026-08-09T05:26:14.734147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.721925Z","title":"Real time speech enhancement in the waveform domain,","venue":null,"work_id":"33addbcb-9c64-46b4-bee4-b5f496ac5f2d","year":2020},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.921110Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:529295239ebae348c4827dcb31221d6b071b9001d1706a712c5777b4b6f8fdba","observation_id":"188b866e-8f95-4d63-9637-a3d9948b6e5c","resolution":{"observed_at":"2026-08-09T05:26:14.725155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.712697Z","title":"Learning the speech front-end with raw waveform cldnns,","venue":null,"work_id":"5bf11060-fe6c-4f8e-b8b3-98e2952a9106","year":2015},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.924582Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:b306f8bf0f367654acf34286e5a6a61b29a64189efdfcd3e25eee0eebcdaba4f","observation_id":"c3f36b24-9ed4-49d3-8ac2-d58ead9879f6","resolution":{"observed_at":"2026-08-09T05:26:14.715971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.05862","last_updated":"2019-09-11T08:19:49Z","snapshot_observed_at":"2026-08-17T12:28:40.241678Z","submitted_at":"2019-04-11T17:29:30Z","title":"wav2vec: Unsupervised Pre-training for Speech Recognition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.05862","snapshot_observed_at":"2026-08-09T05:26:13.931617Z","title":"wav2vec: Unsupervised pre-training for speech recognition,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.931617Z"},"links":{"cited_paper":"/paper/1904.05862","citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:387c8ffeb200665c5c42436f59e9abaf206aeeb00ab8d880db31963dad85fb95","observation_id":"e04c8143-d829-4d61-995b-dd344e649c4c","resolution":{"observed_at":"2026-08-09T05:26:13.931617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.693134Z","title":"A deep neural network integrated with filterbank learning for speech recognition,","venue":null,"work_id":"97fd0ac4-b568-4d82-9215-42be7d9b3bbf","year":2017},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.935380Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:dcc04d258e481942522b95ad02a272d0b3892610e06d7b4563a04e0bdde79bb2","observation_id":"2fc00c2b-de34-49f3-9328-f756ff147cc3","resolution":{"observed_at":"2026-08-09T05:26:14.696742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:13.938772Z","title":"Learning the speech front-end with raw waveform CLDNNs,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.938772Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:4ed05387155ec9fa403d95298a82bec8a37afd46d8b41c9a8ddeed965ab75daf","observation_id":"f9eb6d70-cb69-48e1-b275-8a2feacc7aed","resolution":{"observed_at":"2026-08-09T05:26:13.938772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.678738Z","title":"LEAF: A Learnable Frontend for Audio Classification,","venue":null,"work_id":"20382ee6-1f48-4fe5-9f1f-e4fad65feb0e","year":2022},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.942316Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:cd1f82c7c1832295d284d5411946ab4a0cbc12cd4b269cdf944c3d0c058eac45","observation_id":"96635e46-c47b-491a-a2b6-367606f4e5b6","resolution":{"observed_at":"2026-08-09T05:26:14.682192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.670044Z","title":"Train- able frontend for robust and far-field keyword spotting,","venue":null,"work_id":"0a063b7f-702c-4b4a-9c5e-f6fb05dac1ef","year":2017},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.946069Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:19662828940b2a84cc3efd8d38ff7f4368e93ade41361de9be0749deb734a31b","observation_id":"96ed5ad4-f44f-4122-8c3b-77edf07c504d","resolution":{"observed_at":"2026-08-09T05:26:14.673484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.541933Z","title":"Automatic gain control in cochlear mechanics,","venue":null,"work_id":"88c5ec72-2500-4ad0-a693-991a3c081586","year":1990},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.949703Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:a82003fae7a540fb29fb873817a93d5f8b23220d97c4b53018e9c9b7730d0c46","observation_id":"823bf4ce-98f8-4d73-bab6-3b59788ebf0a","resolution":{"observed_at":"2026-08-09T05:26:14.544843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.534026Z","title":"The cochlea as a smart structure,","venue":null,"work_id":"67c23adf-bccd-431c-b00e-5dcb48988aa3","year":2012},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.953238Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:1866a5c129cd7837fb2da1a8bac80aaa33c0b834350ac49ec16ccb8fdc5b7432","observation_id":"3ac8ca3a-36c1-4d2f-926b-d1a21d2bf462","resolution":{"observed_at":"2026-08-09T05:26:14.536970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.525922Z","title":"Integrating the active process of hair cells with cochlear function,","venue":null,"work_id":"ff44deee-7457-445c-9fb5-60134e6cb071","year":2014},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.956772Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:2205a8c4ef3bb310f8beae59fa237e2eb4963cbbcf68f20ff541f503d90b9eed","observation_id":"30e8efdd-54cd-4e67-86aa-5e978e959651","resolution":{"observed_at":"2026-08-09T05:26:14.528781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.517317Z","title":"Auditory processing of speech signals for robust speech recognition in real-world noisy environments,","venue":null,"work_id":"6e2c0a24-66e7-4beb-a0d2-825be0c7c998","year":1999},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.960227Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:18bf4cbef95b1dbb0101c76cc41738acb9f4646cd42a3ffa47b27223f0b3ede1","observation_id":"2a437d72-3168-4151-a7bf-25b8d9f34c15","resolution":{"observed_at":"2026-08-09T05:26:14.520006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.509374Z","title":"Power-normalized cepstral coefficients (pncc) for robust speech recognition,","venue":null,"work_id":"d4ab99d8-53ee-4ed2-b64c-2282ad63deba","year":2016},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.963653Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:a9d9406ce9ab3c8233ffde09fac943c234bc146a4e2e74f93550fac2a3f8f001","observation_id":"b2c10c75-0936-4af9-96e9-675fb9a6b305","resolution":{"observed_at":"2026-08-09T05:26:14.512342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.500772Z","title":"Dnn controlled adaptive front-end for replay attack detection systems,","venue":null,"work_id":"1e540056-c040-4353-9ad7-29244e17943f","year":2023},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.967195Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:2c93099c6bc25cbfba5382e69feb1a19e55da87ff0a0788d61f6a1574bee3cca","observation_id":"49d37a51-9fd5-4a01-b1de-447ae15fa9eb","resolution":{"observed_at":"2026-08-09T05:26:14.504058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.492470Z","title":"Towards learning a universal non- semantic representation of speech,","venue":null,"work_id":"f8d2f618-2283-4589-99c0-073d2e59cc8b","year":2020},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.970914Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:eb8570aab68d9beb7a90245435a101910714ceccc5da1c05132366692796c903","observation_id":"b4935bf3-18c0-43da-b8e7-eb4805662af2","resolution":{"observed_at":"2026-08-09T05:26:14.495664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.483469Z","title":"Learning filter banks within a deep neural network framework,","venue":null,"work_id":"ca0981be-1096-422e-90b1-3decf026101b","year":2013},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.974756Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:0660663aab2bbcd01bf1ef1600d2fbdd7b0b137ca664cf9f81c695c4d579e117","observation_id":"e335e00c-0181-45e6-af87-8e7fd632a97d","resolution":{"observed_at":"2026-08-09T05:26:14.486754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.474874Z","title":"Data-driven harmonic filters for audio representation learning,","venue":null,"work_id":"259b2d03-f9a5-49a0-8386-dc03c4a35d23","year":2020},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.978505Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:447b9df415cbe027ce165f757b856f11441a49ce6955d4cc9b4f83b53f631203","observation_id":"696a8325-e2f6-4544-b5d4-80b415189c30","resolution":{"observed_at":"2026-08-09T05:26:14.478110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.466731Z","title":"Learning a better representation of speech soundwaves using restricted boltzmann machines,","venue":null,"work_id":"284019eb-7f55-413f-8f0f-4e8b76b43dfb","year":2011},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.982089Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:31513c5b0a9b68b1d66d470e8e593bfcb02bbc27203ad52e1d164e6099aa2ab1","observation_id":"5f364cc1-84c6-4f33-b30d-4ae5821f6d8c","resolution":{"observed_at":"2026-08-09T05:26:14.469827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.456447Z","title":"Estimating phoneme class conditional probabilities from raw speech signal using convolutional neural networks,","venue":null,"work_id":"ea59b426-8219-4f07-8455-50e1c427d029","year":2013},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.985562Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:430205d8a4fd26b4cbd0d5022e6f09450744c22a9f401b49be048542ae281bdd","observation_id":"34089aae-4b4a-49a9-bd3c-a082aee5dcec","resolution":{"observed_at":"2026-08-09T05:26:14.460196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.702790Z","title":"Speech acoustic modeling from raw multichannel waveforms,","venue":null,"work_id":"c0b6fd2e-5e9d-4399-84d9-d68418422779","year":2015},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.989162Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:2c275d98834ef6db75947d312cd79ae0ede143a8b7e8c4da9c52db714288d65e","observation_id":"4f853213-f608-4682-8cf0-ca09f16564dd","resolution":{"observed_at":"2026-08-09T05:26:14.706115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.445906Z","title":"Learnable frontends that do not learn: Quantifying sensitivity to filterbank initialisation,","venue":null,"work_id":"36bf331e-983d-453b-977e-0c32fc60beed","year":2023},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.992627Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:3e426e6ef0ec5801714e83516c31153210c62b954d46e0b368ab2a5a2166ffc9","observation_id":"a46357da-afd4-4e0a-be0d-758f37f03f11","resolution":{"observed_at":"2026-08-09T05:26:14.449801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.436424Z","title":"What is Learnt by the LEArn- able Front-end (LEAF)? Adapting Per-Channel Energy Normalisation (PCEN) to Noisy Conditions,","venue":null,"work_id":"e147ebac-c428-42e7-9559-43aafdf41530","year":2023},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.996137Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:8ebabff5ddc39c8e015530d5d9c8039952b6474d5d3636d8444d58ec73e78e0e","observation_id":"abebbd01-ee2c-490c-9a5d-ad8ee5937b04","resolution":{"observed_at":"2026-08-09T05:26:14.439497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.426090Z","title":"Masked autoencoders that listen,","venue":null,"work_id":"74cc26b4-be88-4667-addf-3dfe3cff07a8","year":2022},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:13.999808Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:a1f21754e793b2e0b5887ce2cfab193475707fd5549439056735888e3949d809","observation_id":"26602cf0-42cb-4122-a7f0-560c84a13eaf","resolution":{"observed_at":"2026-08-09T05:26:14.429727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.415110Z","title":"Beats: Audio pre-training with acoustic tokenizers,","venue":null,"work_id":"2459bb37-980b-4442-940a-8e22fd279c17","year":2023},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:14.003648Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:1a49da2571ea1d1fff45f5f45c30343282b576a67027157d3930809430d97170","observation_id":"cd1c2a4b-0a44-4412-b0fa-4b758bcff402","resolution":{"observed_at":"2026-08-09T05:26:14.418791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.404375Z","title":"Byol for audio: Exploring pre-trained general-purpose audio representations,","venue":null,"work_id":"25ec2bdb-65ba-4b3d-8a2a-46dff2b5a419","year":2022},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:14.007243Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:aca3dc93991610246a188fc8bd8b619d9ba44282941b78f6562fc169c4915396","observation_id":"7486415e-e506-4f70-9415-29bed3426fef","resolution":{"observed_at":"2026-08-09T05:26:14.408323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.393965Z","title":"AST: Audio Spectrogram Trans- former,","venue":null,"work_id":"0511ab53-628e-4132-b98d-154f0b44a57d","year":2021},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:14.010831Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:a72746ea6a536f371ec2520cfc943fcca4b10c3a841a1632f8cb713bb53f7494","observation_id":"7ae9b71d-951e-48e3-900d-591b787d0c02","resolution":{"observed_at":"2026-08-09T05:26:14.397602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.014118Z","title":"SSAST: Self-supervised audio spectrogram transformer,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:14.014118Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:46b09aff07b712f5e9a12a5a2a0c9a7e37b21a7fe41fbb7d226513224ea98ff0","observation_id":"1768a64a-c332-4c4c-b547-4c5f54d8275a","resolution":{"observed_at":"2026-08-09T05:26:14.014118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.017817Z","title":"Hubert: Self-supervised speech representation learning by masked prediction of hidden units,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:14.017817Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:94b661e08b8c8aaf15ad2f3021ace2bd942f2e319ef5d2276e50fa0b24da425d","observation_id":"eeebf783-eb90-4f01-846d-66814d587806","resolution":{"observed_at":"2026-08-09T05:26:14.017817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.021411Z","title":"Wavlm: Large-scale self-supervised pre- training for full stack speech processing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:14.021411Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:f1c71264f8d0026d5d1c144bd4506ccc6dd1a8274be9abc56860ea729ad4c886","observation_id":"7e88e4c0-982b-4334-b898-6f64cb2aec42","resolution":{"observed_at":"2026-08-09T05:26:14.021411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.024818Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:14.024818Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:f37423eda3ca9c3f6f6be4662369468daad2f62e15078e64546e2e4bd1feae8b","observation_id":"c5f014fb-70ac-4fb9-8735-49df7d7d48a8","resolution":{"observed_at":"2026-08-09T05:26:14.024818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.361533Z","title":"Learning neural audio features without supervision,","venue":null,"work_id":"6c12f2b4-e231-4c84-a44b-955b502dda89","year":2022},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:14.028472Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:bf5f7f140bb52c71ba52c436350130eaaffa04e13c6dea403df353cfbfb9a54f","observation_id":"c3f85a8f-b93b-4cb0-a207-d0a72c9e5688","resolution":{"observed_at":"2026-08-09T05:26:14.365196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.352222Z","title":"Biologically in- spired adaptive-q filterbanks for replay spoofing attack detection,","venue":null,"work_id":"d2875912-1296-48f9-8dec-0716e462b4f2","year":2019},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:14.032393Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:d859186a34839ea42cebc67adc53f22c95b4e4aaf1525dad7d27775d290a0af1","observation_id":"bfbff5b8-db82-459b-8b86-5e33261bbef0","resolution":{"observed_at":"2026-08-09T05:26:14.355792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.343480Z","title":"Replay detection in voice biometrics: an investiga- tion of adaptive and non-adaptive front-ends,","venue":null,"work_id":"dba9d85d-f7c9-4b6e-9f96-023a1b32ccf0","year":2021},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:14.036008Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:72c04d40568b9c477f0d9d17d160a86a50d2136d756d872ce1d173e77ebe38ce","observation_id":"5f1d3b46-a94b-4de2-bd16-f29dabdd349a","resolution":{"observed_at":"2026-08-09T05:26:14.347059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.333932Z","title":"Speech nonlinearities, mod- ulations, and energy operators,","venue":null,"work_id":"f5b9da9d-e38f-4fbf-a412-3540b56c1311","year":1991},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:14.039066Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:c03b9ed41fa2e57368f524881700f1d117fb241321e609bd8ced3d72a03197b6","observation_id":"bb2a5e94-9e64-4e1a-830f-a125d7202c21","resolution":{"observed_at":"2026-08-09T05:26:14.337486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.324879Z","title":"Encoding frequency modulation to improve cochlear implant performance in noise,","venue":null,"work_id":"3c69b185-edce-43ce-9c55-b6457bd5aafa","year":2004},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:14.042172Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:7abd45cb16bc5a26aa79f6862ba31de4ef188f0ac121837f2ca4cd588c59cb48","observation_id":"9201f60c-b231-4260-a4ca-5c3bb7e82257","resolution":{"observed_at":"2026-08-09T05:26:14.328118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.314277Z","title":"Detection of replay-spoofing attacks using frequency modulation features,","venue":null,"work_id":"7dc01a59-e036-47a2-8f81-4c6f393b3db9","year":2018},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:14.045326Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:49105c01c4ffe8eb417b9a9d85f5523e8bec9a7acf7467eb2d3694d6259e3fee","observation_id":"8c08a03b-68c8-492e-99fd-53df820cfe74","resolution":{"observed_at":"2026-08-09T05:26:14.317950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.304210Z","title":"Auditory inspired spatial differentiation for replay spoofing attack detection,","venue":null,"work_id":"c21c01e4-d318-4183-8184-871b887b5153","year":2019},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:14.048523Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:0d18c39c264500095aa41329f209ae3835064165a91447cb21be7904e17e1215","observation_id":"c9ac29bd-7e39-41a9-806c-1dd3adb472bd","resolution":{"observed_at":"2026-08-09T05:26:14.308196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.294173Z","title":"SUPERB: Speech Processing Universal PERformance Benchmark,","venue":null,"work_id":"977d2888-5db1-46a3-965c-fec1024d3b9e","year":2021},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:14.051418Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:b5ddf2b9b257bd8124d603789e4cde05a3a87403b8a61eaec998ed67dfc8bbab","observation_id":"0ab6efef-faf6-4056-8537-be3afd456cda","resolution":{"observed_at":"2026-08-09T05:26:14.297393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1306.1461","last_updated":"2013-06-07T16:57:39Z","snapshot_observed_at":"2026-08-16T01:06:52.373567Z","submitted_at":"2013-06-06T16:30:44Z","title":"The GTZAN dataset: Its contents, its faults, their effects on evaluation, and its future use","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1306.1461","snapshot_observed_at":"2026-08-09T05:26:14.054794Z","title":"The GTZAN dataset: Its contents, its faults, their effects on evaluation, and its future use,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:14.054794Z"},"links":{"cited_paper":"/paper/1306.1461","citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:148fbf6d8bd43441f25c1796d19e899b1b14f6efb8f757eb8e6029b379d45f69","observation_id":"2caf3c72-d1f0-445b-a828-395bdde77a3f","resolution":{"observed_at":"2026-08-09T05:26:14.054794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.283627Z","title":"Deep learning and music adversaries,","venue":null,"work_id":"d0281f98-b650-486a-8bee-110ed5cfc2ed","year":2015},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:14.058810Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:96d2ecff751ac88a5e3d2cbf78f47e88cbb80dbf96295ba1399d0b574c0f1970","observation_id":"3779dd4e-19ec-4fe5-954c-9cd3fa21b426","resolution":{"observed_at":"2026-08-09T05:26:14.287812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.271902Z","title":"FMA: A dataset for music analysis,","venue":null,"work_id":"841d8582-4ff1-4551-bcb2-ea764efaf56a","year":2017},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:14.062146Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:5cb1b06515d935d70e4f844a0527fac4c05c9e905cb706a5f157cd1730858fb8","observation_id":"250ce5a4-a1a9-4ba3-9192-eca598d227de","resolution":{"observed_at":"2026-08-09T05:26:14.275726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.261345Z","title":"CREMA-D: Crowd-sourced emotional multimodal actors dataset,","venue":null,"work_id":"4e908fcb-18ed-4ed2-ae70-ad9f1037fcc0","year":2014},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:14.065607Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:15324f12ceb594fbb65f79a3c15581a313b90f8c2668a600ac3faac2738c4af1","observation_id":"05b29f96-459b-4640-88ab-fd42e35594ac","resolution":{"observed_at":"2026-08-09T05:26:14.264969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.249448Z","title":"IEMOCAP: Interactive emotional dyadic motion capture database,","venue":null,"work_id":"a0cd6d6b-6c70-47e3-b374-6cdffab600ac","year":2008},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:14.069586Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:c99dffa44e93c2376a27550ec14c08e9d25d0136d9f09ca55d72719ec529ec14","observation_id":"e364dc85-aead-457a-812a-15451f7c3fbb","resolution":{"observed_at":"2026-08-09T05:26:14.253238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.03209","last_updated":"2018-04-09T19:58:17Z","snapshot_observed_at":"2026-08-15T16:28:51.252929Z","submitted_at":"2018-04-09T19:58:17Z","title":"Speech Commands: A Dataset for Limited-Vocabulary Speech Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.03209","snapshot_observed_at":"2026-08-09T05:26:14.073221Z","title":"Speech commands: A dataset for limited-vocabulary speech recognition,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:14.073221Z"},"links":{"cited_paper":"/paper/1804.03209","citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:00ff7762e3f46dea8fb7dc69fa53e62873b23f47c0691f31b0f7822b8232c841","observation_id":"d553a0da-0f99-4cbc-981a-86d097cd55f3","resolution":{"observed_at":"2026-08-09T05:26:14.073221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.237272Z","title":"V oxceleb: A large-scale speaker identification dataset,","venue":null,"work_id":"0a73cef7-bb55-4203-882c-2c8dcf2a9dba","year":2017},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:14.077714Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:061dc9ff0cc38f42f5dc5d5b950a7802b181fdb9f1f73dad092e1e5acf969fce","observation_id":"616539e7-81b2-4ce4-b42d-0c78dc2c6876","resolution":{"observed_at":"2026-08-09T05:26:14.241327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.226589Z","title":"Efficientnet: Rethinking model scaling for convolutional neural networks,","venue":null,"work_id":"8b74a11d-73be-489d-8886-beb632b70037","year":2019},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:14.081608Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:cfaa20aad228fe2d45d072d4673d8b8aafd851046b5dd5f5f1da35531cdf31d0","observation_id":"4227709d-dc71-45af-a170-1dfaec37d54c","resolution":{"observed_at":"2026-08-09T05:26:14.230834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.085174Z","title":"Squeeze-and-excitation networks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:14.085174Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:4e5004d118c1debd146100629c2c6e362ef79edd33b318e6a0e276382ac9b755","observation_id":"57cef8dd-893e-4a9a-a016-19520797f8f0","resolution":{"observed_at":"2026-08-09T05:26:14.085174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.208875Z","title":"MobilenNetv2: Inverted residuals and linear bottlenecks,","venue":null,"work_id":"f433f734-2d5c-4401-8699-05e7c498c901","year":2018},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:14.089407Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:590b96966047f3cb67655d5c3bc73e04747443c2f9b5ecfb4f390b6025d55082","observation_id":"775b265a-9b47-4a8d-aad4-3f138c61ac15","resolution":{"observed_at":"2026-08-09T05:26:14.212700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.093471Z","title":"Adam: A method for stochastic optimization,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:14.093471Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:a1389e5e45703c69ae64c2637bf82e0b8e4227f215685414b2677f992164757f","observation_id":"f53d3120-767c-4e3a-b08b-efdb9fa3a50f","resolution":{"observed_at":"2026-08-09T05:26:14.093471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.190467Z","title":"Audio set: An ontology and human- labeled dataset for audio events,","venue":null,"work_id":"47359b11-d92c-4552-b8cd-84e05c9b17f1","year":2017},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:14.097222Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:79bea3a70bcf11782c6252267675c57a4703c4eeb258efc388ff34f51140ebf5","observation_id":"9169a92b-ae62-4e6e-8daf-ac86329aa8f0","resolution":{"observed_at":"2026-08-09T05:26:14.194668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.100684Z","title":"PANNs: Large-scale pretrained audio neural networks for audio pattern recognition,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:14.100684Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:613201149714c43841b46b1ff6ec5206a52c6da2026374ebcf7ca22471fd71be","observation_id":"1f4c2ae0-74c0-48ba-af35-65f75a28ad04","resolution":{"observed_at":"2026-08-09T05:26:14.100684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T05:26:14.167143Z","title":"Librispeech: an asr corpus based on public domain audio books,","venue":null,"work_id":"a529b50b-bb39-46ae-a89b-ee8c6162337c","year":2015},"citing_paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-09T05:26:14.104367Z"},"links":{"citing_paper":"/paper/2502.03260"},"observation_digest":"sha256:715ac1b74c5e2d4c8f61680b623a21dc142d942019d440734637352e5409720a","observation_id":"3873f4f9-cb4f-4cbb-b080-eab6cc314233","resolution":{"observed_at":"2026-08-09T05:26:14.173769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.03260","last_updated":"2025-02-05T15:16:52Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-14T16:52:13.580995Z","submitted_at":"2025-02-05T15:16:52Z","title":"Should Audio Front-ends be Adaptive? Comparing Learnable and Adaptive Front-ends"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":51},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 0 inbound Pith citation observations for arXiv:2502.03260."}