{"as_of":"2026-08-08T03:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dce0efc020702465b74c7d51ffd4b9547d20fc897b712b89bef4ffba0eb3644e","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:42:46.371250Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:42:46.286372Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T14:42:46.494173Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-06T14:37:36.127802Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"cited_work":{"arxiv_id":"2507.17941","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.17941","snapshot_observed_at":"2026-08-06T14:42:46.494173Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","venue":"cs.SD","work_id":"994b03e2-6e6d-4981-99fd-57a3bd54e534","year":2025},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-06T14:37:36.127802Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.286372Z"},"links":{"cited_paper":"/paper/2507.17941","citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:68080ccceb2150100b604a94cc760fb1a4e5190b20bf1a9ccbfb9f8b16c02041","observation_id":"de07afc2-1311-476a-b346-de4ffb576f67","resolution":{"observed_at":"2026-08-06T14:42:46.504514Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.17941/citation-record","integrity":"/paper/2507.17941/integrity","json":"/paper/2507.17941/citation-record.json","paper":"/paper/2507.17941"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-06T14:37:36.127802Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"cited_work":{"arxiv_id":"2507.17941","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.17941","snapshot_observed_at":"2026-08-06T14:42:46.494173Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","venue":"cs.SD","work_id":"994b03e2-6e6d-4981-99fd-57a3bd54e534","year":2025},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-06T14:37:36.127802Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.286372Z"},"links":{"cited_paper":"/paper/2507.17941","citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:68080ccceb2150100b604a94cc760fb1a4e5190b20bf1a9ccbfb9f8b16c02041","observation_id":"de07afc2-1311-476a-b346-de4ffb576f67","resolution":{"observed_at":"2026-08-06T14:42:46.504514Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.708480Z","title":"Features In our approach, we use audio files in Ambisonic format of the De- velopment Dataset 2024 [3]","venue":null,"work_id":"71440763-825d-4686-9d82-f13f69ebf3b3","year":2024},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-06T14:37:36.127802Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.290887Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:e73f71ea1e62eab44b4814d43ee104f0081edaf599f12076bb779114cbdfa2ff","observation_id":"fdc35a21-81ad-42b7-9096-32a71fa58f97","resolution":{"observed_at":"2026-08-06T14:42:46.711543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.699702Z","title":"The network was trained using a multi-phase approach involving syn- thetic, real, and augmented data","venue":null,"work_id":"f3f89e14-b58e-4495-9aaa-16c2fe94ad14","year":2024},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-06T14:37:36.127802Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.294734Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:985f76a67492bd3e700e408a243b1e7f75477321cbf9f2ead3aced1aafab329f","observation_id":"3b0d0bef-2037-4f8a-973a-b57aed8da570","resolution":{"observed_at":"2026-08-06T14:42:46.702772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.691375Z","title":null,"venue":null,"work_id":"2648b348-3e1f-45d6-adde-a95f0a6a8f08","year":null},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-06T14:37:36.127802Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.298530Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:c8aac2cc9ec111372f69488f01c9c64bff6c16fa7fa17aff30a927a8b0e0c44f","observation_id":"0d22982d-2ff3-4029-a16f-b284aea4c34d","resolution":{"observed_at":"2026-08-06T14:42:46.694245Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.682638Z","title":null,"venue":null,"work_id":"a780430b-5ac0-47df-ac49-7b1a0d4fcc05","year":null},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-06T14:37:36.127802Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.302152Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:4b6c237afc996effdb75ba708fc20664f7800bb91578621eb2aa7e7dadae59cf","observation_id":"0139295a-c866-4ab0-ac8b-49c96bacd21f","resolution":{"observed_at":"2026-08-06T14:42:46.685424Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.673670Z","title":"An improved event-independent network for polyphonic sound event localization and detection,","venue":null,"work_id":"9a6fd7b8-b5ad-47ab-9c7c-32eca6cf2c77","year":2021},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-06T14:37:36.127802Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.305720Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:9407f5cff4e33ecc5f2ff5da6a187f54f457f73c54a8aff8d8754e4c78bfe472","observation_id":"677c7f69-3bcd-4e4e-baf1-c583535b9663","resolution":{"observed_at":"2026-08-06T14:42:46.676653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.665097Z","title":"STARSS22: A dataset of spatial recordings of real scenes with spatiotemporal annotations of sound events,","venue":null,"work_id":"4787acd5-d9c0-42ed-9dec-1f99f0b5f20a","year":2022},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-06T14:37:36.127802Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.309292Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:59a9195c5dd75eb718331dd2b3999eb190533d94d3d28a43b8a2dbcc7f5a128d","observation_id":"26c1f7b0-8393-4c6f-8ed1-2bacd3e5e947","resolution":{"observed_at":"2026-08-06T14:42:46.668184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.656452Z","title":"Shimada, A","venue":null,"work_id":"da6a9e12-5ebc-45ce-8488-ae6d3271bc78","year":2024},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-06T14:37:36.127802Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.312645Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:62d1f5a74d2630c000381de236bf916ff2081f44cbfdf38b8535b76790f38bb3","observation_id":"a4e9777e-7234-46f4-9b07-9d7c6cb8e13d","resolution":{"observed_at":"2026-08-06T14:42:46.659184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.647794Z","title":"Accdoa: Activity-coupled cartesian direction of arrival representation for sound event localization and de- tection,","venue":null,"work_id":"fd9197ff-1cb4-4ee0-84f8-ab8440563df9","year":2021},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-06T14:37:36.127802Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.316853Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:a56876b753ef3e768b4abb57d6568086bddccfd478644b5be199aad0baa8bee2","observation_id":"43fb0b9b-503d-4ab1-8d1c-4602306fb978","resolution":{"observed_at":"2026-08-06T14:42:46.650671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.639671Z","title":"Permutation invariant training for speaker-independent multi-pitch tracking,","venue":null,"work_id":"58d872c1-cc3c-43d5-8bea-2dbe415c61c3","year":2018},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-06T14:37:36.127802Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.319982Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:4b02b0b667568aecd0a5c6021ed1240a1c77343125b3cdef48cc724e45e3f0ca","observation_id":"19f9c593-8223-420e-94d5-5007ad99cda8","resolution":{"observed_at":"2026-08-06T14:42:46.642457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.630604Z","title":"Multi-accdoa: Localizing and detecting overlapping sounds from the same class with aux- iliary duplicating permutation invariant training,","venue":null,"work_id":"d3a9b752-19a4-413e-844d-d0484c44918e","year":2022},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-06T14:37:36.127802Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.323127Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:64ced5d2f04bb83832b2966b2be1e6c8035b107e5a0ca97dd23ef4d9e200dd32","observation_id":"ba7aafad-fba5-4e99-8754-562c54e55be2","resolution":{"observed_at":"2026-08-06T14:42:46.634088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.621216Z","title":"Sound event localization and detection using foa domain spatial aug- mentation,","venue":null,"work_id":"a4218331-63d4-41be-a867-111a2ba6a64a","year":2019},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-06T14:37:36.127802Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.326309Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:fa97bac2480f090c73ea165ca654564b032f25cc7932e9830d145044cb0dcf92","observation_id":"443618e9-923a-45ca-ba61-51e0870349ed","resolution":{"observed_at":"2026-08-06T14:42:46.624393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.00268","last_updated":"2019-11-05T10:18:18Z","snapshot_observed_at":"2026-08-06T21:46:50.069705Z","submitted_at":"2019-05-01T11:27:28Z","title":"Polyphonic Sound Event Detection and Localization using a Two-Stage Strategy","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.00268","snapshot_observed_at":"2026-08-06T14:42:46.329992Z","title":"Polyphonic sound event detection and localization using a two-stage strategy,","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-06T14:37:36.127802Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.329992Z"},"links":{"cited_paper":"/paper/1905.00268","citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:b18e886af287696d819fbc653e4c03ad0bda4d10690270dde62653dd0162088a","observation_id":"082ac626-c830-4d23-89b3-4e5a42c8c964","resolution":{"observed_at":"2026-08-06T14:42:46.329992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.611798Z","title":"The generalized correlation method for estimation of time delay,","venue":null,"work_id":"2e8603dc-0f9f-489c-96c3-2836c7930fad","year":1976},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-06T14:37:36.127802Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.333817Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:6da4c5616818d0a2d7ca4014414067cc4663a200d1264c78fce9432227d8336b","observation_id":"624e239c-d85e-4b52-8ece-17b93354fac1","resolution":{"observed_at":"2026-08-06T14:42:46.614956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.602324Z","title":"Random erasing data augmentation,","venue":null,"work_id":"13fa6e55-737d-4692-b1ca-e7c9b507500f","year":2020},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-06T14:37:36.127802Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.337381Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:04cccf9754a0405fd26da24f9154109ce1dbe2c592ef65a2636ee53f3bcc415b","observation_id":"d6a369fc-9938-442e-89e6-9087587e5957","resolution":{"observed_at":"2026-08-06T14:42:46.605443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.08779","last_updated":"2019-12-03T18:19:07Z","snapshot_observed_at":"2026-08-04T08:35:21.943076Z","submitted_at":"2019-04-18T17:53:38Z","title":"SpecAugment: A Simple Data Augmentation Method for Automatic Speech Recognition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.08779","snapshot_observed_at":"2026-08-06T14:42:46.340920Z","title":"Specaugment: A simple data aug- mentation method for automatic speech recognition,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-06T14:37:36.127802Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.340920Z"},"links":{"cited_paper":"/paper/1904.08779","citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:21477bf7ed97704a42c7aafa6987a7a72e7feaca2673011c60ec69a756ca3b7f","observation_id":"b73be1b6-38ab-48fe-9807-0a0d3a789b23","resolution":{"observed_at":"2026-08-06T14:42:46.340920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.592684Z","title":"A four-stage data augmentation approach to resnet-conformer based acoustic modeling for sound event localization and de- tection,","venue":null,"work_id":"ea80e280-1a94-4f7c-b7ef-e71b9da51d80","year":2023},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-06T14:37:36.127802Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.344443Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:068fdcf6e4d1ffaf54956398c61c02e5fb15d99e92116128aac4ff6a2f623726","observation_id":"5bbb8524-06e1-47ec-9918-6d842bbf44c9","resolution":{"observed_at":"2026-08-06T14:42:46.595849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.584075Z","title":"Conformer: Local features coupling global representations for visual recognition,","venue":null,"work_id":"708d829a-361b-4aac-8deb-06cfd94e1517","year":2021},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-06T14:37:36.127802Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.347760Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:2f768ac4c8533cab1288598caad158a4ba05391b3f826eefaeb014ef7fe592fb","observation_id":"22eb01c0-b973-4216-8188-1fb311f9a4d4","resolution":{"observed_at":"2026-08-06T14:42:46.587257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.574327Z","title":"Sound event localization based on sound intensity vector refined by dnn-based denoising and source separation,","venue":null,"work_id":"2bf821f9-3dd0-48a2-acf2-9a4946535cc7","year":2020},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-06T14:37:36.127802Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.351115Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:6e6f34add8751322f2c3bd1f983e758f826c6b2a5562086f1ebbfc41c3a4d269","observation_id":"3544f9b7-58ba-417a-9a34-4b0a8ac9da5a","resolution":{"observed_at":"2026-08-06T14:42:46.577618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.564502Z","title":"Spatial scaper: A library to simulate and augment soundscapes for sound event localization and detection in real- istic rooms,","venue":null,"work_id":"78944fe6-e901-4b48-9777-aa4681ad7ae1","year":2024},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-06T14:37:36.127802Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.354492Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:1c70988e7a33402ac2232c59d24d53c2fc8ea21379366c2df062873008e0d0fb","observation_id":"5d91b2dc-f9f9-48df-9a08-c625991c9cac","resolution":{"observed_at":"2026-08-06T14:42:46.567970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.555004Z","title":"At- tentional feature fusion,","venue":null,"work_id":"c93bf060-e794-435f-939a-f097fa20b70b","year":2021},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-06T14:37:36.127802Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.357816Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:773931ee98945cbb18ca840f671f92f4c1acf247b4f8edb2b9db699164a8ed80","observation_id":"61aaecea-e59b-4a17-8aff-c6a299624ca3","resolution":{"observed_at":"2026-08-06T14:42:46.558002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.545411Z","title":"Attention mechanism network and data augmentation for sound event localization and detec- tion","venue":null,"work_id":"baa8ffed-eea2-4991-9ccc-7d7d11b9bdfc","year":null},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-06T14:37:36.127802Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.360940Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:5974cb6033c9a5de24df2435ce68bf93f76cab815e86db05e4e8b338e43c7e80","observation_id":"7568d313-3c37-4597-b654-be2bdc2ec6e0","resolution":{"observed_at":"2026-08-06T14:42:46.548384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11827","last_updated":"2024-06-12T13:54:11Z","snapshot_observed_at":"2026-07-06T17:46:20.935124Z","submitted_at":"2024-03-18T14:34:16Z","title":"Sound Event Detection and Localization with Distance Estimation","version":2},"cited_work":{"arxiv_id":"2403.11827","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.11827","snapshot_observed_at":"2026-08-06T14:42:46.439364Z","title":"Sound Event Detection and Localization with Distance Estimation","venue":"cs.SD","work_id":"07fea921-41d5-475e-b3d4-bffa0bdb8289","year":2024},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-06T14:37:36.127802Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.364337Z"},"links":{"cited_paper":"/paper/2403.11827","citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:925f09e72d9a751dbf9592e216af4ea9ae724193014674266bb3b9ae69ef6d77","observation_id":"19cad754-b1fb-401b-b294-af4e69a96bef","resolution":{"observed_at":"2026-08-06T14:42:46.451060Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5281/zenodo.10932241","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.398239Z","title":"DCASE2024 Task 3 synthetic seld mixtures for baseline training,","venue":null,"work_id":"df4529f8-b6ad-436b-8b9b-9b96c10efb87","year":2024},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-06T14:37:36.127802Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.368005Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:9b0cbea5720c342b07f344266127376156e5197e67be6c62e3156ba6027b486c","observation_id":"0d931698-43e6-4bc2-8379-0b479f15b248","resolution":{"observed_at":"2026-08-06T14:42:46.417594Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.525001Z","title":"Overview and evaluation of sound event localization and detection in dcase 2019,","venue":null,"work_id":"94f2a406-0668-4707-ab6d-cbcbe07cafe6","year":2019},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-06T14:37:36.127802Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.371250Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:ef583ee82e8e568eeab5ed06c2caf9ca032c2eb81040988abb13c692e6dc7a09","observation_id":"7f5e3607-bfa3-479e-8afd-f6fd28038c98","resolution":{"observed_at":"2026-08-06T14:42:46.538080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-06T14:37:36.127802Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":3,"verified_fuzzy":18},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 1 inbound Pith citation observation for arXiv:2507.17941."}