{"as_of":"2026-08-23T03:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:868ac4428c74d2bb88dec1fe4cfd7d85002abe486ebf995ce0cf0c66dd732564","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:03:49.824737Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:03:49.677719Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-15T20:03:49.930811Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"cited_work":{"arxiv_id":"2506.13455","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.13455","snapshot_observed_at":"2026-08-15T20:03:49.930811Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","venue":"eess.AS","work_id":"8df3cd7a-ce8f-4955-b010-3d725607d56a","year":2025},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.677719Z"},"links":{"cited_paper":"/paper/2506.13455","citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:d67b46ac2de7810239592c13603f87d537c8b6321abb5f761cffa0c2dcb54e74","observation_id":"74e3322a-7953-48b9-9ff6-a09093cd6e8f","resolution":{"observed_at":"2026-08-15T20:03:49.939290Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.13455/citation-record","integrity":"/paper/2506.13455/integrity","json":"/paper/2506.13455/citation-record.json","paper":"/paper/2506.13455"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"cited_work":{"arxiv_id":"2506.13455","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.13455","snapshot_observed_at":"2026-08-15T20:03:49.930811Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","venue":"eess.AS","work_id":"8df3cd7a-ce8f-4955-b010-3d725607d56a","year":2025},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.677719Z"},"links":{"cited_paper":"/paper/2506.13455","citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:d67b46ac2de7810239592c13603f87d537c8b6321abb5f761cffa0c2dcb54e74","observation_id":"74e3322a-7953-48b9-9ff6-a09093cd6e8f","resolution":{"observed_at":"2026-08-15T20:03:49.939290Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:03:50.610562Z","title":null,"venue":null,"work_id":"f0cbc22f-6cc2-4e82-85f6-3c59c305d54d","year":null},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.683128Z"},"links":{"citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:47294b405c1ceefaa1a74b3f2cde0e8f772eb0ac5cab416eec1f5ea4a86c777c","observation_id":"a6f8c14e-c461-4151-af15-e55fa4144757","resolution":{"observed_at":"2026-08-15T20:03:50.614781Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:03:50.596641Z","title":null,"venue":null,"work_id":"c90ca420-9235-4eea-9a28-e01de9004362","year":2025},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.688041Z"},"links":{"citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:b9421c9779053a9428242e5f3dc9b66c3c696f8ddb4d852bc2843fc42c59ab3a","observation_id":"ca07acd6-be77-4ee6-9fd3-cf46e8946432","resolution":{"observed_at":"2026-08-15T20:03:50.601237Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:03:50.576029Z","title":"The audio is resampled to 24 kHz, and 64 mel filters are used for feature extraction","venue":null,"work_id":"93d03a76-64a3-49bd-ab97-b872d7fe5990","year":null},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.692417Z"},"links":{"citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:a6d87ef7a02942fdb98945abb8e5f4184ac344e1c5c977a77985395907cf0ffe","observation_id":"d2ef2f6f-71e0-4d86-9aa2-388cb557a26e","resolution":{"observed_at":"2026-08-15T20:03:50.585286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:03:50.558079Z","title":null,"venue":null,"work_id":"0aded638-a1a1-488a-b9e1-eb83eb2d32a4","year":null},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.697435Z"},"links":{"citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:746164f07d1f9d7124eee8591425ef8d5e59b97b55ac60c5755448bb9ee61a21","observation_id":"e34c3b87-e007-416c-b849-2b4013679567","resolution":{"observed_at":"2026-08-15T20:03:50.564741Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:03:50.542125Z","title":null,"venue":null,"work_id":"30751498-3621-4050-8261-dbe2bd576630","year":2025},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.702008Z"},"links":{"citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:a8516e104709ff94423b28be806b5a7fb87e84259843c6578659f3ce8953e70f","observation_id":"25adcba7-6b90-4aaf-8777-6017ff94a22b","resolution":{"observed_at":"2026-08-15T20:03:50.547555Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:03:50.527302Z","title":"Sound Event Localization and Detection of Overlapping Sources Us- ing Convolutional Recurrent Neural Networks,","venue":null,"work_id":"081e9636-63c4-4188-bcda-946d4a73f6fa","year":2018},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.707164Z"},"links":{"citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:7cbca79ba580b4d8e836012b83882e8ca5853e9ffecefd30f5a2cab04aedc113","observation_id":"8aee6c68-2edb-412a-b182-cbb5d056df80","resolution":{"observed_at":"2026-08-15T20:03:50.531867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:03:50.513741Z","title":"Context- dependent sound event detection,","venue":null,"work_id":"3d2d25dc-1199-4651-a632-41538e9e87f0","year":2013},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.711419Z"},"links":{"citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:c430b8e5f31f86d59e86b24b76433a1f1f276c293b48f10d097a8318c3264674","observation_id":"18fb2e8e-5dd0-4dca-a421-4614c3328013","resolution":{"observed_at":"2026-08-15T20:03:50.518093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:03:50.499475Z","title":"Acoustic event detection in real life recordings,","venue":null,"work_id":"1f75169b-486e-4443-a880-54642776817b","year":2010},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.715514Z"},"links":{"citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:6936363d9db12125c95490f92a7c222469d51db24d339a171861ad57a5bb844d","observation_id":"4177634e-4a8d-442a-b9a2-b2092bf685bb","resolution":{"observed_at":"2026-08-15T20:03:50.504403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:03:50.479419Z","title":"FMSG-JLESS sub- mission for DCASE 2024 task4 on sound event detection with heterogeneous training dataset and potentially missing labels,","venue":null,"work_id":"cbd64dde-92ce-42d1-bab3-8ad2860e9156","year":2024},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.719918Z"},"links":{"citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:b63801a6eb706e0b4d80590b96f4f3cd3f694e5a12418dfb1888fa22b387320e","observation_id":"2a042543-1247-4731-8057-8e6d4a394f3d","resolution":{"observed_at":"2026-08-15T20:03:50.485667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:03:50.463924Z","title":"WildDESED: an LLM-powered dataset for wild domestic environment sound event detection system,","venue":null,"work_id":"28e7a88b-a520-43ce-b5fd-66a4478f6c35","year":2024},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.723773Z"},"links":{"citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:489c76b837b9ea39c2fef9a92e646a4bf9f738632ee84c4c3f9f1ee8705184c0","observation_id":"00caa86f-99f3-44ca-98f5-9385bc93fcb9","resolution":{"observed_at":"2026-08-15T20:03:50.469313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03657","last_updated":"2025-01-11T11:57:08Z","snapshot_observed_at":"2026-08-21T17:02:13.448694Z","submitted_at":"2024-07-04T05:57:30Z","title":"UCIL: An Unsupervised Class Incremental Learning Approach for Sound Event Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.03657","snapshot_observed_at":"2026-08-15T20:03:49.727224Z","title":"UCIL: An Unsupervised Class Incremental Learn- ing Approach for Sound Event Detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.727224Z"},"links":{"cited_paper":"/paper/2407.03657","citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:57541a3b039dd1179aa03f88e2fb400a8324fda138e2ce3fab12e9aa4bdadb08","observation_id":"0aed29e2-4ef9-462c-a1f4-6327e73bf643","resolution":{"observed_at":"2026-08-15T20:03:49.727224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03654","last_updated":"2025-08-26T04:32:04Z","snapshot_observed_at":"2026-08-21T21:05:27.111027Z","submitted_at":"2024-07-04T05:50:40Z","title":"DG-SED: Domain Generalization for Sound Event Detection with Heterogeneous Training Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.03654","snapshot_observed_at":"2026-08-15T20:03:49.731574Z","title":"Mixstyle based do- main generalization for sound event detection with heteroge- neous training data,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.731574Z"},"links":{"cited_paper":"/paper/2407.03654","citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:6e32447a676446119b09018833e4623db53812d096f99dda12afc28a14ee510e","observation_id":"9ae8b4ed-21d2-4b4c-b18a-81262de32df1","resolution":{"observed_at":"2026-08-15T20:03:49.731574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:03:50.391768Z","title":"Multiple emitter location and signal parameter estimation,","venue":null,"work_id":"5b04e176-7005-49ff-9e92-a466e98ae3aa","year":1986},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.735869Z"},"links":{"citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:a02bd0d3c9cbff028b0339c775de54cc29113dff05f7ac8ce73ddafd5107064a","observation_id":"72f44309-505d-4f13-ba82-09e59166e784","resolution":{"observed_at":"2026-08-15T20:03:50.396431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03661","last_updated":"2025-03-20T17:45:12Z","snapshot_observed_at":"2026-08-18T20:58:41.592766Z","submitted_at":"2024-07-04T06:02:52Z","title":"Where's That Voice Coming? Continual Learning for Sound Source Localization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.03661","snapshot_observed_at":"2026-08-15T20:03:49.740011Z","title":"Where’s that voice coming? continual learning for sound source localization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.740011Z"},"links":{"cited_paper":"/paper/2407.03661","citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:d48696d8c0fd8002c4ffbad0bcd9204863d3537e3d3741ee353e5925fa4980f0","observation_id":"3e0760db-c790-42d6-906a-cd401e659978","resolution":{"observed_at":"2026-08-15T20:03:49.740011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:03:50.370097Z","title":"An Improved Event-Independent Network for Poly- phonic Sound Event Localization and Detection,","venue":null,"work_id":"c8e96c8b-f8ec-472d-934b-0b53513987b9","year":2021},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.743932Z"},"links":{"citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:a5c245441ac120233cd6ffc6a33b72e2ef7db65387bf9ed47860615e63bc4c74","observation_id":"775468fd-1478-4966-9cb1-05c53208b02f","resolution":{"observed_at":"2026-08-15T20:03:50.375991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:03:50.351872Z","title":"ACCDOA: Activity-Coupled Cartesian Direc- tion of Arrival Representation for Sound Event Localization and Detection,","venue":null,"work_id":"9d7fc56c-2800-4e53-9eaf-c3f6908d93f9","year":2020},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.748727Z"},"links":{"citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:def093785bf3c9aff78ac28e6668c7fc0989957ffd896afe1aa711a7549b8b01","observation_id":"c493bda1-bf24-459c-8897-a8f7d1858cab","resolution":{"observed_at":"2026-08-15T20:03:50.357247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:03:50.337073Z","title":"Multi-ACCDOA: Localizing and Detecting Overlapping Sounds from the Same Class with Auxiliary Duplicating Permutation Invariant Training,","venue":null,"work_id":"e58849c0-60bc-4604-a6c5-9875f057b4ba","year":2021},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.754099Z"},"links":{"citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:4ef192224db5746dc5fae31a9305eeb5ad8dc128fb8fb5c0c412cf450dba8d97","observation_id":"c3c6969b-e4d7-4a46-99cc-85069bb27773","resolution":{"observed_at":"2026-08-15T20:03:50.341659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:03:50.317780Z","title":"PSELDNets: Pre-trained Neural Net- works on Large-scale Synthetic Datasets for Sound Event Lo- calization and Detection,","venue":null,"work_id":"fababd25-be3b-4850-8b06-fa701cda71fb","year":2024},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.758861Z"},"links":{"citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:39f33179666d2f0e1da7421a8f3858ca33be7be12f5475a18d56063f75a24298","observation_id":"b7d421fe-445f-486e-b1b5-0775bf525dcd","resolution":{"observed_at":"2026-08-15T20:03:50.323506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:03:50.294849Z","title":"PANNs: Large-Scale Pretrained Audio Neural Networks for Audio Pattern Recognition,","venue":null,"work_id":"e5899b86-8628-4c09-b86b-451e352c7984","year":2019},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.763563Z"},"links":{"citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:3edfdccd66f0a71d59e45be4918a8b553c11e681fda9d54e9b93e13b3f71a77e","observation_id":"38726ac8-1d65-423a-94f1-8b32c62a45d7","resolution":{"observed_at":"2026-08-15T20:03:50.305512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:03:50.217289Z","title":"Ef- ficient Training of Audio Transformers with Patchout,","venue":null,"work_id":"e77fdbab-e793-4484-80d9-df07a51f16f6","year":2021},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.768680Z"},"links":{"citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:a1d0e49d94e35dfa4633e8696446d52cb1bde6062c92adeb20083b2238a59c08","observation_id":"7a2883da-38dd-455a-8cf0-827f404a91bf","resolution":{"observed_at":"2026-08-15T20:03:50.250097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:03:50.126367Z","title":"HTS-AT: A Hierarchical Token-Semantic Audio Transformer for Sound Classification and Detection,","venue":null,"work_id":"01bfcbad-e869-4300-8e2c-8a3950ad7694","year":2022},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.773848Z"},"links":{"citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:583a005a7bfdc3bb27353c58d667bf32f0d9e0d2f644a5c411d4b49d78ff55fa","observation_id":"6934ad7b-9763-4c5e-acf8-e0dc6344f60e","resolution":{"observed_at":"2026-08-15T20:03:50.172208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:03:50.110173Z","title":"STARSS23: An Audio- Visual Dataset of Spatial Recordings of Real Scenes with Spa- tiotemporal Annotations of Sound Events,","venue":null,"work_id":"34002bb2-7d13-4ad2-ab98-bab2f230b879","year":2023},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.778481Z"},"links":{"citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:6b05f8bab7e148b80d224a3b7ae168e2e66fbf493970722bf17d1747bdcf76cf","observation_id":"b8055afc-bde7-43bf-a06b-c8493c23bbe5","resolution":{"observed_at":"2026-08-15T20:03:50.115585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:03:50.090763Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces,","venue":null,"work_id":"38303c9d-ac80-453d-b866-bbbd4da25be0","year":2023},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.782853Z"},"links":{"citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:83e419d4d19fc7d9c9441842c6718450939df2cb5b855492c9aefd7634fe8b4b","observation_id":"561b084d-e77b-4259-8d74-c313b4a097cd","resolution":{"observed_at":"2026-08-15T20:03:50.097461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:03:50.060856Z","title":"SPMamba: State-space model is all you need in speech separation,","venue":null,"work_id":"9abafdec-8e7d-4ac2-bf53-616085fa87f2","year":2024},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.787767Z"},"links":{"citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:6a3f3b4aad38a804e9a8c09ab6ae9c2ac37e66af6cdcf6c38212520a439d75e7","observation_id":"afa36f20-1c10-453f-ba00-239d144e3be5","resolution":{"observed_at":"2026-08-15T20:03:50.073975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:03:50.044050Z","title":"Mamba in Speech: To- wards an Alternative to Self-Attention,","venue":null,"work_id":"c7c474ea-25b7-4906-874d-fd7bef5d88d3","year":2024},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.792531Z"},"links":{"citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:0075f196b686607452b38dc5839f90a7963561e156b26ebebadc47f5d311b04b","observation_id":"0e91f393-ff41-474f-bb7f-eb5992632bbb","resolution":{"observed_at":"2026-08-15T20:03:50.048207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:03:50.025104Z","title":"SELD-Mamba: Selective State-Space Model for Sound Event Localization and Detection with Source Distance Es- timation,","venue":null,"work_id":"686e1480-d24f-461a-8928-8ffd816f29eb","year":2024},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.797222Z"},"links":{"citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:7c9030fb45a173b9bc9ea78253e53bc77fa7fd0d7b7a2514ef4a6063f8e147cd","observation_id":"c92fb8fd-897a-4807-9f15-56ac67144a4e","resolution":{"observed_at":"2026-08-15T20:03:50.031596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:03:50.008268Z","title":"Nd-BiMamba2: A Unified Bidirectional Architecture for Multi-Dimensional Data Processing,","venue":null,"work_id":"a0e12930-13ab-4f9b-b73f-f6df9b0f2977","year":2024},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.802509Z"},"links":{"citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:e10c23d2e14ea6e047b65e95ced65a43c86a28b973e98388ab6ad765f20cc47c","observation_id":"d6e94a4f-d159-452c-aa78-0be6012899de","resolution":{"observed_at":"2026-08-15T20:03:50.013899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:03:49.993145Z","title":"Transformers are SSMs: Generalized Models and Efficient Algorithms Through Structured State Space Duality,","venue":null,"work_id":"13bd8dc8-b781-4f62-9306-912f4a8e3a4a","year":2024},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.807304Z"},"links":{"citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:2b0b3040c6ddc7e862061cb62163f0faf306978043e292e56f010bd6126a801f","observation_id":"70f74f9e-a0f0-4e4a-a8d0-aa24376e2013","resolution":{"observed_at":"2026-08-15T20:03:49.997296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:03:49.979368Z","title":"A Four-Stage Data Augmentation Approach to ResNet- Conformer Based Acoustic Modeling for Sound Event Local- ization and Detection,","venue":null,"work_id":"79077aa2-577a-49f2-a73c-3de474085f4a","year":2021},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.811762Z"},"links":{"citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:ef56de05f7a276698089b325b4e23c10254e138f3a0aafca578d6813eaedf496","observation_id":"b11757d2-ce81-4839-803f-422bb5754810","resolution":{"observed_at":"2026-08-15T20:03:49.983711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:03:49.964880Z","title":"Efficiently Modeling Long Se- quences with Structured State Spaces,","venue":null,"work_id":"a867825e-9a88-486c-ba2b-2be630284d23","year":2021},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.816092Z"},"links":{"citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:26225665576465759d1668869ea5f1692743bb3a291b657e4ee675d1b4d44bfe","observation_id":"089a8e4a-da8c-488d-aa12-952db16d13de","resolution":{"observed_at":"2026-08-15T20:03:49.968988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05034","last_updated":"2025-05-20T16:53:31Z","snapshot_observed_at":"2026-08-16T14:35:38.564177Z","submitted_at":"2024-09-08T09:20:04Z","title":"TF-Mamba: A Time-Frequency Network for Sound Source Localization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05034","snapshot_observed_at":"2026-08-15T20:03:49.820183Z","title":"Tf-mamba: A time-frequency network for sound source localization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.820183Z"},"links":{"cited_paper":"/paper/2409.05034","citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:379525929c162f206ddb1f327abbcb9af9844b3ddc7d7330763805ef38d0dad8","observation_id":"76f0c81e-d16f-4fc4-858a-bca4f3f34580","resolution":{"observed_at":"2026-08-15T20:03:49.820183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:03:49.950847Z","title":"DCASE2025 Task3 Stereo SELD Dataset,","venue":null,"work_id":"da3a63b4-0492-4418-8976-62c8277740a2","year":2025},"citing_paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T20:03:49.824737Z"},"links":{"citing_paper":"/paper/2506.13455"},"observation_digest":"sha256:9c6fd457118f0e48f3116babe6b2f7d841b797a10e9326c0fe66fa12121e4bc4","observation_id":"fdb4fde6-47d0-4a5b-8682-4f9e20be6257","resolution":{"observed_at":"2026-08-15T20:03:49.955147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.13455","last_updated":"2025-06-16T13:14:05Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-22T23:21:04.260330Z","submitted_at":"2025-06-16T13:14:05Z","title":"Stereo sound event localization and detection based on PSELDnet pretraining and BiMamba sequence modeling"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":1,"verified_fuzzy":24},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 1 inbound Pith citation observation for arXiv:2506.13455."}