{"as_of":"2026-08-07T15:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2beb3a0f3bc242e8860855a43bd004babd26cb5d885bc4157fdb9ee5eb4bdf3a","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:57:10.638866Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.09570/citation-record","integrity":"/paper/2507.09570/integrity","json":"/paper/2507.09570/citation-record.json","paper":"/paper/2507.09570"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1807.00129","last_updated":"2018-12-17T12:47:10Z","snapshot_observed_at":"2026-07-06T06:47:40.492339Z","submitted_at":"2018-06-30T06:05:20Z","title":"Sound Event Localization and Detection of Overlapping Sources Using Convolutional Recurrent Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.00129","snapshot_observed_at":"2026-08-06T17:57:10.461560Z","title":"Sound Event Localization and Detection of Overlap- ping Sources Using Convolutional Recurrent Neural Networks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.461560Z"},"links":{"cited_paper":"/paper/1807.00129","citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:f02e09fcc52ed30dd00cde141a7d3071e44880ba92e6ff5e616581dc1c83aeb8","observation_id":"1770cc71-7c09-4e42-b603-5b953cc812c9","resolution":{"observed_at":"2026-08-06T17:57:10.461560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:11.253302Z","title":"Context-dependent sound event detection,","venue":null,"work_id":"8c3960e0-35cc-4cb7-b9bf-8ab09c8c458e","year":2013},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.467666Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:4139775b66ca8d654d98bb9f918f33f48a7f4bc8875f698f9b27afe695d6b0b9","observation_id":"230234ee-d22b-40bf-9021-207e134286c7","resolution":{"observed_at":"2026-08-06T17:57:11.258803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:11.235431Z","title":"Acoustic event detection in real life recordings,","venue":null,"work_id":"eeecd99d-c451-4f48-827a-dd98c6d68a5d","year":2010},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.472737Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:d7cfec367bba6158974e021e934b1def495fde1b95e6cce024a11aa4d3f2a2ca","observation_id":"28e7abcd-239b-44ca-a05b-5d1856a1c1d5","resolution":{"observed_at":"2026-08-06T17:57:11.240897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:11.218280Z","title":"FMSG- JLESS submission for DCASE 2024 task4 on sound event detection with heterogeneous training dataset and potentially missing labels,","venue":null,"work_id":"76504adb-5a3b-4f2d-a677-2bfdc4ff2ceb","year":2024},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.478462Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:ab2b006f40b5000d12d0d0bde7cbfeef8ffb85dbd13012d8d4823806929c6ba7","observation_id":"565e1df0-9d40-43d5-88fe-a5610797add9","resolution":{"observed_at":"2026-08-06T17:57:11.223808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:11.201292Z","title":"WildDESED: An LLM- powered dataset for wild domestic environment sound event detection system,","venue":null,"work_id":"8e46fe23-d5be-4af0-9d88-2425f3c9818a","year":2024},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.484282Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:4582185dff2d5ee53a25379e4744eee13feeb9c2c74a3b265e4e12abcc743a47","observation_id":"4cf4f565-2e3a-4914-94e4-43572f779b4b","resolution":{"observed_at":"2026-08-06T17:57:11.206571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03657","last_updated":"2025-01-11T11:57:08Z","snapshot_observed_at":"2026-07-06T18:41:23.047537Z","submitted_at":"2024-07-04T05:57:30Z","title":"UCIL: An Unsupervised Class Incremental Learning Approach for Sound Event Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.03657","snapshot_observed_at":"2026-08-06T17:57:10.489465Z","title":"UCIL: An Unsupervised Class Incremental Learning Approach for Sound Event Detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.489465Z"},"links":{"cited_paper":"/paper/2407.03657","citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:a8794f1b4b40b38a0563b60c01e56d9fef48bd6cce34a1a724cdcb04b1563b80","observation_id":"9774cf50-7d59-4a2f-a7a9-a803cca9baad","resolution":{"observed_at":"2026-08-06T17:57:10.489465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03654","last_updated":"2025-08-26T04:32:04Z","snapshot_observed_at":"2026-07-06T18:41:23.047537Z","submitted_at":"2024-07-04T05:50:40Z","title":"DG-SED: Domain Generalization for Sound Event Detection with Heterogeneous Training Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.03654","snapshot_observed_at":"2026-08-06T17:57:10.495073Z","title":"Mixstyle based domain generalization for sound event detec- tion with heterogeneous training data,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.495073Z"},"links":{"cited_paper":"/paper/2407.03654","citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:86a0cae5129da0df32aef96cff531965fde64448d2baa1ab7e9b2896b22689bc","observation_id":"1cdaf043-7510-454f-b971-626efe599679","resolution":{"observed_at":"2026-08-06T17:57:10.495073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:11.184917Z","title":"Multiple emitter location and signal pa- rameter estimation,","venue":null,"work_id":"a6481e00-80b6-4887-ba75-ed7e9a2738e7","year":1986},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.500498Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:f796e62d2a497abb7caa4f568dbd983779c979d1d719c7ce540836b76ea7fb07","observation_id":"b914c395-9fbd-4236-b93f-47becbac13ee","resolution":{"observed_at":"2026-08-06T17:57:11.190243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03661","last_updated":"2025-03-20T17:45:12Z","snapshot_observed_at":"2026-07-06T18:41:23.047537Z","submitted_at":"2024-07-04T06:02:52Z","title":"Where's That Voice Coming? Continual Learning for Sound Source Localization","version":3},"cited_work":{"arxiv_id":"2407.03661","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.03661","snapshot_observed_at":"2026-08-06T17:57:10.876169Z","title":"Where's That Voice Coming? Continual Learning for Sound Source Localization","venue":"eess.AS","work_id":"7742c273-3073-4259-8ea6-2b3d7874e7eb","year":2024},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.505976Z"},"links":{"cited_paper":"/paper/2407.03661","citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:065d2b8e511472b7eca74b6f6801d1150d3a95748c946f2f628d845d8b88d782","observation_id":"9c50665c-1860-4a7e-adb7-ba2ed21d43ce","resolution":{"observed_at":"2026-08-06T17:57:10.881510Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:11.167323Z","title":"An Improved Event-Independent Net- work for Polyphonic Sound Event Localization and Detection,","venue":null,"work_id":"764bc2c0-8a42-4b53-b3be-87e97d7489aa","year":2021},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.511205Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:88b26f549fcc27ef00b857ff2768243fec0ac73ea2036a322474d42321764266","observation_id":"98de5ad4-0c58-47ee-8c34-c5fa101b94e7","resolution":{"observed_at":"2026-08-06T17:57:11.172466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.15306","last_updated":"2021-02-15T03:48:35Z","snapshot_observed_at":"2026-07-06T10:09:37.267994Z","submitted_at":"2020-10-29T01:47:07Z","title":"ACCDOA: Activity-Coupled Cartesian Direction of Arrival Representation for Sound Event Localization and Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.15306","snapshot_observed_at":"2026-08-06T17:57:10.516419Z","title":"ACCDOA: Activity-Coupled Carte- sian Direction of Arrival Representation for Sound Event Localization and Detection,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.516419Z"},"links":{"cited_paper":"/paper/2010.15306","citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:c4adac7df53227305ef0cfbfdc2715d34a7465ad3dff1071e7c57e8b1391ddc9","observation_id":"3fd0da71-20b8-4217-8714-e07de56b32d5","resolution":{"observed_at":"2026-08-06T17:57:10.516419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.07124","last_updated":"2022-03-28T01:07:20Z","snapshot_observed_at":"2026-07-06T11:57:42.646453Z","submitted_at":"2021-10-14T02:35:50Z","title":"Multi-ACCDOA: Localizing and Detecting Overlapping Sounds from the Same Class with Auxiliary Duplicating Permutation Invariant Training","version":2},"cited_work":{"arxiv_id":"2110.07124","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.07124","snapshot_observed_at":"2026-08-06T17:57:10.836905Z","title":"Multi-ACCDOA: Localizing and Detecting Overlapping Sounds from the Same Class with Auxiliary Duplicating Permutation Invariant Training","venue":"eess.AS","work_id":"37465ba0-8216-4822-9df6-c7c30877590b","year":2021},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.521604Z"},"links":{"cited_paper":"/paper/2110.07124","citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:96b30b9d42ae338d35fa0ea53d16d05f3cbb1a536d922d5827f8084a6cc29a16","observation_id":"5e6cab15-a4e0-4192-ab6e-dd9ad126ddc1","resolution":{"observed_at":"2026-08-06T17:57:10.841998Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.02919","last_updated":"2023-03-07T07:00:29Z","snapshot_observed_at":"2026-07-06T10:30:56.646456Z","submitted_at":"2021-01-08T08:55:37Z","title":"A Four-Stage Data Augmentation Approach to ResNet-Conformer Based Acoustic Modeling for Sound Event Localization and Detection","version":2},"cited_work":{"arxiv_id":"2101.02919","doi":null,"metadata_source":"pith","pith_arxiv_id":"2101.02919","snapshot_observed_at":"2026-08-06T17:57:10.812624Z","title":"A Four-Stage Data Augmentation Approach to ResNet-Conformer Based Acoustic Modeling for Sound Event Localization and Detection","venue":"cs.SD","work_id":"4990bbe4-76a0-44f6-83ef-e05e09f8702e","year":2021},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.526396Z"},"links":{"cited_paper":"/paper/2101.02919","citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:d7799b8ba97deba25e73c4948673a6cf179f44d584f7e1b1d218c7cfb35bba78","observation_id":"d0cb43ad-fbde-40b5-8c05-f4c9099ef7fd","resolution":{"observed_at":"2026-08-06T17:57:10.819618Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:11.151067Z","title":"PSELDNets: Pre-trained Neural Networks on Large-scale Synthetic Datasets for Sound Event Localization and Detection,","venue":null,"work_id":"5c44c26d-c9c3-415a-8556-13423eecbef2","year":null},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.531847Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:b218b560f8fca784272ccdc7a36a7cdfea0b488148c5c50078d028ea55031213","observation_id":"f279602c-e2e1-48f0-b97e-da2a7ae74752","resolution":{"observed_at":"2026-08-06T17:57:11.156215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.10211","last_updated":"2020-08-23T11:35:41Z","snapshot_observed_at":"2026-08-02T19:54:33.817072Z","submitted_at":"2019-12-21T06:53:14Z","title":"PANNs: Large-Scale Pretrained Audio Neural Networks for Audio Pattern Recognition","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.10211","snapshot_observed_at":"2026-08-06T17:57:10.536756Z","title":"PANNs: Large-Scale Pretrained Au- dio Neural Networks for Audio Pattern Recognition,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.536756Z"},"links":{"cited_paper":"/paper/1912.10211","citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:3e6735280291835ec719530ad497ce7e3191c146555e17e5c0af229bf8bd0f11","observation_id":"9082b0e0-d3da-4199-a88c-2ae0bed190bc","resolution":{"observed_at":"2026-08-06T17:57:10.536756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05069","last_updated":"2022-03-29T12:25:02Z","snapshot_observed_at":"2026-08-04T12:25:56.734801Z","submitted_at":"2021-10-11T08:07:50Z","title":"Efficient Training of Audio Transformers with Patchout","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.05069","snapshot_observed_at":"2026-08-06T17:57:10.542254Z","title":"Efficient Training of Audio Transformers with Patchout,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.542254Z"},"links":{"cited_paper":"/paper/2110.05069","citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:edda56f18c0810efb9e3460a366a0841fe71949b83de22605dcc7451e4bfd49c","observation_id":"1e94711d-41dc-4b9b-b442-dfcc01a66665","resolution":{"observed_at":"2026-08-06T17:57:10.542254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.00874","last_updated":"2022-02-02T04:49:14Z","snapshot_observed_at":"2026-08-07T00:04:27.412290Z","submitted_at":"2022-02-02T04:49:14Z","title":"HTS-AT: A Hierarchical Token-Semantic Audio Transformer for Sound Classification and Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.00874","snapshot_observed_at":"2026-08-06T17:57:10.547383Z","title":"HTS-AT: A Hierarchical Token- Semantic Audio Transformer for Sound Classification and Detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.547383Z"},"links":{"cited_paper":"/paper/2202.00874","citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:b7ac327895cfb517345091efaed6a64d3da6b6b9076ea5e5bf6c5fb69e039144","observation_id":"3594eb40-aa50-4d1f-aa81-41edd030dc88","resolution":{"observed_at":"2026-08-06T17:57:10.547383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:11.133815Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces,","venue":null,"work_id":"bac40a94-1ba3-43d1-a422-39165a3de0cb","year":null},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.552259Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:8a780ea507b976c0acf3ee467733929128430a38b4046e1f9da30c3e1c7a16c6","observation_id":"de27121e-4299-4f4f-b4e0-3cc4f710b102","resolution":{"observed_at":"2026-08-06T17:57:11.139962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21060","last_updated":"2024-05-31T17:50:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-31T17:50:01Z","title":"Transformers are SSMs: Generalized Models and Efficient Algorithms Through Structured State Space Duality","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21060","snapshot_observed_at":"2026-08-06T17:57:10.557141Z","title":"Transformers are SSMs: General- ized Models and Efficient Algorithms Through Struc- tured State Space Duality,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.557141Z"},"links":{"cited_paper":"/paper/2405.21060","citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:1d866f227004ffea87a2d61cc386bd43ae5be78d0e4e57e4f11de16b2130985d","observation_id":"a51ef3ab-93ec-44e2-8f6c-c4daf11d01b2","resolution":{"observed_at":"2026-08-06T17:57:10.557141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02063","last_updated":"2024-09-10T14:02:58Z","snapshot_observed_at":"2026-07-06T17:54:39.685251Z","submitted_at":"2024-04-02T16:04:31Z","title":"SPMamba: State-space model is all you need in speech separation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02063","snapshot_observed_at":"2026-08-06T17:57:10.562636Z","title":"SPMamba: State- space model is all you need in speech separation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.562636Z"},"links":{"cited_paper":"/paper/2404.02063","citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:4d991ea8bd398d33f36c81f42e81292bf3e72b46bf011b8962a8a71f179b871e","observation_id":"3a06e65c-62bc-4206-92a4-132a3b64c22b","resolution":{"observed_at":"2026-08-06T17:57:10.562636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05034","last_updated":"2025-05-20T16:53:31Z","snapshot_observed_at":"2026-07-06T19:12:06.671181Z","submitted_at":"2024-09-08T09:20:04Z","title":"TF-Mamba: A Time-Frequency Network for Sound Source Localization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05034","snapshot_observed_at":"2026-08-06T17:57:10.568516Z","title":"Xiao and R","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.568516Z"},"links":{"cited_paper":"/paper/2409.05034","citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:49aa9f70ca0e99eb689a195ba6485782d6df8845e9edc5fc9cf9b5d82c584789","observation_id":"f3b305f8-63fc-47a5-a603-bb8ee7d4cc41","resolution":{"observed_at":"2026-08-06T17:57:10.568516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:11.117444Z","title":"XLSR-Mamba: a dual-column bidirectional state space model for spoofing attack detection,","venue":null,"work_id":"ef188fe9-d090-4ee4-81a8-075732d53b9f","year":2025},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.573367Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:43b20d42ee99503c0cf6b82ded5acdea149e2cb9aaca0602896cf9004fc9b29c","observation_id":"a1f55789-8148-4f94-8cc2-e01d295050c6","resolution":{"observed_at":"2026-08-06T17:57:11.123050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:11.100497Z","title":"Mamba in Speech: Towards an Alternative to Self-Attention,","venue":null,"work_id":"bebb4c67-ee46-4c92-a982-4624803e1496","year":null},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.578980Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:0a4c992779a6d5e6659e461e66011b914646914b43d54b147b005111da2c19e9","observation_id":"b58e98fc-743b-4ddb-bdb1-a9da8ed587de","resolution":{"observed_at":"2026-08-06T17:57:11.106141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05057","last_updated":"2024-08-09T13:26:08Z","snapshot_observed_at":"2026-08-04T23:08:13.853275Z","submitted_at":"2024-08-09T13:26:08Z","title":"SELD-Mamba: Selective State-Space Model for Sound Event Localization and Detection with Source Distance Estimation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05057","snapshot_observed_at":"2026-08-06T17:57:10.584768Z","title":"SELD-Mamba: Selective State-Space Model for Sound Event Localization and Detection with Source Distance Estimation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.584768Z"},"links":{"cited_paper":"/paper/2408.05057","citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:97a1de8d65e9b35f236f805e2b58a2609cd092ac9a9659723dec35d224ab51e7","observation_id":"de73558b-270c-406b-8a55-47ef9016330a","resolution":{"observed_at":"2026-08-06T17:57:10.584768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:11.084078Z","title":"Fonseca, X","venue":null,"work_id":"78460ab6-e3ab-44eb-bed6-46556c7850fc","year":2025},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.590277Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:49d04121532d8208ed11ba27f3536f6b29f6bf05ba18dfe71234877b00e8ef80","observation_id":"0201688c-3e95-44d7-baf1-d5af7961de45","resolution":{"observed_at":"2026-08-06T17:57:11.089042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:11.066097Z","title":"Image method for efficiently simulating small-room acoustics,","venue":null,"work_id":"e9ad3391-2002-4188-9721-e87dc62c48dd","year":1979},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.596148Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:c814a4992d005f981b8c843de983d89ae4a400cfe880246581c1fa716130758f","observation_id":"94244e51-cb99-416a-96e3-ae2512ef20c2","resolution":{"observed_at":"2026-08-06T17:57:11.071710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:10.601046Z","title":"Rafaely, Fundamentals of Spherical Array Process- ing","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.601046Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:2bcbfbf6a87f253384d073911421a1166af7ee6e56d6cc590625e8135b533051","observation_id":"7f8a3b5a-1ad3-4132-8ecf-aa0de9f3d109","resolution":{"observed_at":"2026-08-06T17:57:10.601046Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:11.048239Z","title":"Efficiently Modeling Long Sequences with Structured State Spaces,","venue":null,"work_id":"b7be55eb-7a03-4a90-bf6d-c694f4e4f192","year":null},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.606418Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:0bc13901b7d679925669d6a0ad398fc6b81c0d5fc79c9f9a9061e1114eaa7d16","observation_id":"3d33a7fe-ea22-4a19-ac14-056f1a618ccf","resolution":{"observed_at":"2026-08-06T17:57:11.054598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:11.030284Z","title":"DCASE2025 Task3 Stereo SELD Dataset,","venue":null,"work_id":"00fd92ac-4569-41f3-9e88-cffd2e9c2511","year":2025},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.612108Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:3c85e68b64ed0b7317bb9484a972bf4cb9a8d9b25756061896b5d80d5773af60","observation_id":"4c972436-0bcc-4826-a708-9127ea7c4cc3","resolution":{"observed_at":"2026-08-06T17:57:11.035802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:11.012931Z","title":"STARSS23: Sony-TAu Realistic Spatial Soundscapes 2023,","venue":null,"work_id":"f644a12c-30d4-43f8-adbc-5fbda5924521","year":2023},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.617511Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:fb21bc355b5747a88529c539ec7dfe09328c17bdd58ea113ffd8db8b40203e8a","observation_id":"7b58e63d-978c-4054-8875-1675ea1f86f6","resolution":{"observed_at":"2026-08-06T17:57:11.017982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:10.996168Z","title":"A multi-level feature extraction network for sound event localization and detection in dcase 2025 task 3,","venue":null,"work_id":"b6ab9f00-90ac-486a-ac18-b518c0ae431a","year":2025},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.622343Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:6564c9ad02ddc4b72cdecd10096a7d363784265e8bbaf106860b04395203d81a","observation_id":"c7a1a083-0366-44f7-a66d-d18d73e57883","resolution":{"observed_at":"2026-08-06T17:57:11.001398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:10.979657Z","title":"Enhancing stereo sound event localization and detection through pre- trained audio representations and hybrid architectures,","venue":null,"work_id":"bcf9bb9f-18e3-4a4e-81b1-84f573ce84d8","year":2025},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.627308Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:a29aef387b84e7d886056264a0afc3bc1ee4d7058c49c9438d31edfa5c05a357","observation_id":"b15b4206-b64a-4140-97a6-0e288225cda4","resolution":{"observed_at":"2026-08-06T17:57:10.985243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:10.964058Z","title":"Resnet-conformer for stereo sound event localization and distance estimation in dcase 2025 task3,","venue":null,"work_id":"cf449975-654e-45a8-87fb-9762b569cd76","year":2025},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.632388Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:bba7a6894d6cca5a23f93808ec3a76d56e43cc7f7eae3f4d04749f812b3a7436","observation_id":"09211142-961e-45cf-8233-05ab656888bf","resolution":{"observed_at":"2026-08-06T17:57:10.969074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:57:10.946959Z","title":"A conformer-based ensem- ble approach for sound event localization and detection for stereo data,","venue":null,"work_id":"972821a1-636a-4286-8c69-e5beb81c213c","year":2025},"citing_paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T17:57:10.638866Z"},"links":{"citing_paper":"/paper/2507.09570"},"observation_digest":"sha256:b06a35892c387cc98a561c3ce7ea423e889ed37ff1b53c1f9c9d1569e9644fae","observation_id":"e313b286-7d5e-47eb-a57f-180dfb0c774f","resolution":{"observed_at":"2026-08-06T17:57:10.952973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.09570","last_updated":"2025-07-13T10:38:24Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-07T00:05:16.860593Z","submitted_at":"2025-07-13T10:38:24Z","title":"Enhancing Stereo Sound Event Detection with BiMamba and Pretrained PSELDnet"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":3,"verified_fuzzy":19},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2507.09570."}