{"as_of":"2026-08-08T08:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:53711a1daeb4e02d3b7a648447e4c9d7fa2f90e22ff3cf00814de68a99a4eff0","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:12:32.514636Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:12:29.445618Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T12:12:32.763786Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"cited_work":{"arxiv_id":"2506.00273","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.00273","snapshot_observed_at":"2026-08-07T12:12:32.763786Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","venue":"eess.AS","work_id":"b7d9dcc0-8290-4dc2-905c-c4af61d54673","year":2025},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:29.445618Z"},"links":{"cited_paper":"/paper/2506.00273","citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:09e2049a7b9d934c05a4b738955ed215debc397f0b2938fee76c6a17e77a9c92","observation_id":"ebff7117-1e89-4077-8be3-251ca117e8b4","resolution":{"observed_at":"2026-08-07T12:12:32.878777Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.00273/citation-record","integrity":"/paper/2506.00273/integrity","json":"/paper/2506.00273/citation-record.json","paper":"/paper/2506.00273"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:37.164306Z","title":"Ambisonics, a popular spatial audio format, enables binaural rendering of head-tracked spatial audio and is commonly used in VR [1]","venue":null,"work_id":"ac694fed-51cb-4d02-a953-09ea8928c20f","year":null},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:29.362348Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:f5917bd63cbc9907a9ad597694710947cd361827b7036298b8322abb0b2550c7","observation_id":"707aa02c-9f34-4e91-8b4b-aa8fd010b9f3","resolution":{"observed_at":"2026-08-07T12:12:37.236391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:36.916094Z","title":"Problem Setup Let a(t, θ, ϕ) be the plane wave amplitude distribution describ- ing an incident sound field","venue":null,"work_id":"b2c06aab-4842-4074-bdcd-0f18b6a69a96","year":null},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:29.533135Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:b8ba07bdd18d55a2637c847dad34bc8baea0e940cd18fd22967285d16b33f2ce","observation_id":"dbd1cfed-4848-4d81-8992-eb292f2dde65","resolution":{"observed_at":"2026-08-07T12:12:37.020510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:36.383695Z","title":"We present SI-SDRi (averaged across channels) for the baseline algorithms and SoundSculpt models that use various types of conditioning","venue":null,"work_id":"328d37f7-2c1f-4889-8db5-2f394b1b48e8","year":null},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:29.829724Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:13d946826a5677b2f96dfd5326f7e649691202c00dbbc95b23f9d81f90183130","observation_id":"543ebcdb-1f5b-465b-8982-7eff7c39e6f0","resolution":{"observed_at":"2026-08-07T12:12:36.446984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:36.242062Z","title":"SoundSculpt consis- tently outperformed traditional signal processing baselines","venue":null,"work_id":"9c4a4b8e-82ce-48a5-a6fa-a6dc4a8d55cf","year":null},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:29.912317Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:98ef2be3ad95e500ba8c820b3431dc37c381caaacc976884424d1e196f7aca63","observation_id":"ba630ec9-f45c-4623-800f-166889a94363","resolution":{"observed_at":"2026-08-07T12:12:36.307469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:35.737365Z","title":"Direction preserving wiener matrix filtering for ambisonic input-output systems,","venue":null,"work_id":"dad50cd6-fada-425b-810e-da6f6a9d9b61","year":2019},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:30.269690Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:36138b505a9ef0caf4e96fed2044d85d18d009ebdd58557689b6b572aaa6c99c","observation_id":"e695a57c-48bb-4747-9d27-1133ee396e53","resolution":{"observed_at":"2026-08-07T12:12:35.807318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"cited_work":{"arxiv_id":"2506.00273","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.00273","snapshot_observed_at":"2026-08-07T12:12:32.763786Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","venue":"eess.AS","work_id":"b7d9dcc0-8290-4dc2-905c-c4af61d54673","year":2025},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:29.445618Z"},"links":{"cited_paper":"/paper/2506.00273","citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:09e2049a7b9d934c05a4b738955ed215debc397f0b2938fee76c6a17e77a9c92","observation_id":"ebff7117-1e89-4077-8be3-251ca117e8b4","resolution":{"observed_at":"2026-08-07T12:12:32.878777Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05738","last_updated":"2022-04-12T12:26:01Z","snapshot_observed_at":"2026-08-05T07:59:20.592230Z","submitted_at":"2022-04-12T12:26:01Z","title":"Text-Driven Separation of Arbitrary Sounds","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05738","snapshot_observed_at":"2026-08-07T12:12:30.479701Z","title":"Text-driven separation of arbitrary sounds,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:30.479701Z"},"links":{"cited_paper":"/paper/2204.05738","citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:eca4f1e429a519930da310d9689a0e22bad70777717f6dfc45c83f58ded4391b","observation_id":"c4ae24dc-9f3f-414c-935d-1d75520af679","resolution":{"observed_at":"2026-08-07T12:12:30.479701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:36.048084Z","title":"Zotter and M","venue":null,"work_id":"b961bc12-01aa-4953-a8b8-d5a13c9f0185","year":2019},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:29.967025Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:fd1d388d2f8c87d44300c9c1b1a4de36cc53b1ed4a711d8bf496f5e14f75404f","observation_id":"8ee4436c-cb64-4808-b138-35921451d59e","resolution":{"observed_at":"2026-08-07T12:12:36.136065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:30.042793Z","title":"Rafaely, Fundamentals of spherical array processing","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:30.042793Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:d6bd5c049f33e8bfb4399df6865c12f7ae266bcc9e06bdef976007a70faafffe","observation_id":"1a9753b9-3cc3-4d24-aefc-ff8e155975f3","resolution":{"observed_at":"2026-08-07T12:12:30.042793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17362","last_updated":"2024-02-27T09:54:40Z","snapshot_observed_at":"2026-07-06T17:36:05.934286Z","submitted_at":"2024-02-27T09:54:40Z","title":"Ambisonics Encoding For Arbitrary Microphone Arrays Incorporating Residual Channels For Binaural Reproduction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17362","snapshot_observed_at":"2026-08-07T12:12:30.118676Z","title":"Ambisonics encoding for arbitrary microphone arrays incorpo- rating residual channels for binaural reproduction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:30.118676Z"},"links":{"cited_paper":"/paper/2402.17362","citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:f89e23ecbd34f69586a59240357bb634365b16b572a651a604ab65b379c395b2","observation_id":"faf72521-cd9a-4f3a-9e71-ffa2acfdee00","resolution":{"observed_at":"2026-08-07T12:12:30.118676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:35.888457Z","title":"Spatial transformations for the en- hancement of ambisonic recordings,","venue":null,"work_id":"43d78461-59d6-4b26-bc5a-b3d030d6d330","year":2014},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:30.182967Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:203c1e30416962656a5679c3d8d52a3417c92e895582708bc91ee8ff0d430065","observation_id":"100d6bd7-b8c2-4e82-93b1-b2cb0ea44982","resolution":{"observed_at":"2026-08-07T12:12:35.954453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:31.138823Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:31.138823Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:fbbf7c25a583ec382608e95f1b4377fee4c7c28ee96e2a2fd7f62278455add6c","observation_id":"898bf0de-8412-4f37-a4a8-bc5f6dc6d4a4","resolution":{"observed_at":"2026-08-07T12:12:31.138823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:35.597622Z","title":"Direction and reverberation pre- serving noise reduction of ambisonics signals,","venue":null,"work_id":"b85b3b16-3a29-4db5-bd0e-3d5de5c59ae5","year":2020},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:30.341171Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:fd795727ec1abbabfdc057040a5c6e39d958d6ad64eed332bcdd18f2d854c1aa","observation_id":"e722abc8-231c-4bae-9f6c-341475efc918","resolution":{"observed_at":"2026-08-07T12:12:35.656869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:34.574486Z","title":"Bert experts (wikibooks),","venue":null,"work_id":"046b3043-b480-4fcd-8c69-8929fe574034","year":2023},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:31.333775Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:c2cbab72aab1f67eda7a096fd20113790b5f722972c06935f4d101a301a4e91a","observation_id":"5c85cd34-ec6c-4eb2-906c-0b22d61c3e09","resolution":{"observed_at":"2026-08-07T12:12:34.704727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:35.423817Z","title":"Real-time target sound extraction,","venue":null,"work_id":"3db83e0c-737a-40db-a89a-2dd14a4582a6","year":2023},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:30.603238Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:5d5f64ce877354b7af96701742a11b500edcdd2c03951a0b0922d5584fb33d0b","observation_id":"06c30f9f-1f58-406f-82b2-fe55523ac38f","resolution":{"observed_at":"2026-08-07T12:12:35.492915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:35.223798Z","title":"Se- mantic hearing: Programming acoustic scenes with binaural hear- ables,","venue":null,"work_id":"45000abb-8caa-4b1e-a8de-530a467c8481","year":2023},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:30.741649Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:fbb12e837ec26ab6aa8b338aad1bb1ab481bc5af0b4878f183711d4571baccfa","observation_id":"83a85ecc-8ea4-4ee3-a66b-044957d66c74","resolution":{"observed_at":"2026-08-07T12:12:35.312664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:35.023414Z","title":"Binaural angular separation network,","venue":null,"work_id":"336f2b30-bc9f-4b63-8ee1-f66cfc017bc5","year":2024},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:30.938063Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:97db2a0af897390bfc44aec6c707c13acf698d7ee912540ee99e7348d3021cb4","observation_id":"4a272632-9102-4474-82a2-8d2cbc122387","resolution":{"observed_at":"2026-08-07T12:12:35.113500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:31.031505Z","title":"Rezero: Region-customizable sound extrac- tion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:31.031505Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:92778b42fea2a551c8db6a6674a08e81af0d058b4ccbf3daf1279e58e8cdde1e","observation_id":"2a57f6d8-e471-453e-a0b6-9ef5b10ed1d3","resolution":{"observed_at":"2026-08-07T12:12:31.031505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:33.867264Z","title":"On the modeling of rectangular geometries in room acoustic sim- ulations,","venue":null,"work_id":"4ab9cee6-a592-4d60-88f0-5823fcabe7c0","year":2015},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:31.812238Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:fe92fe6f5ef21830980c412dd34b08d61cb92f9ff6b003e1db5e409edfa804c5","observation_id":"88f73f71-2f29-4de0-bfbe-bf02b2903d64","resolution":{"observed_at":"2026-08-07T12:12:33.952354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:34.832037Z","title":"Efficient encoding and decoding of bin- aural sound with resonance audio,","venue":null,"work_id":"67e59268-f886-4244-8bef-4b1a8b23dbbc","year":2019},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:31.256336Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:8f5846d490cb24e694b5dfb2df814a5decb3d45e66f117c3b57bf2bb326a64ed","observation_id":"ba5e926c-ee2f-4bb0-8a26-992d4ed453d5","resolution":{"observed_at":"2026-08-07T12:12:34.885846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:31.955910Z","title":"Clotho: An audio cap- tioning dataset,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:31.955910Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:71f03c2678ac93b0971581c681823005421a3a50e64da00374a81941ee372672","observation_id":"7daeec2b-1c06-4473-b169-545bb4ead6a2","resolution":{"observed_at":"2026-08-07T12:12:31.955910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:31.440819Z","title":"Film: Visual reasoning with a general conditioning layer,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:31.440819Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:21448f10da92dfe9eb520cbf311a7ec49368bc57f0d8da7dbb01641f4e3921d2","observation_id":"84b55b69-aeed-48fa-bca0-242712f964a6","resolution":{"observed_at":"2026-08-07T12:12:31.440819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:36.735193Z","title":"Random source gains and si- lencing of secondary sources were applied to increase diversity","venue":null,"work_id":"c188d734-6a0d-450b-9b20-1030a486d636","year":null},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:29.681864Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:cb1ee808fe77e55ea48973802018ce0e84be53039dd812439daafdabf9b7d6e5","observation_id":"827b2d4d-9b6d-4344-8424-a403f80930c0","resolution":{"observed_at":"2026-08-07T12:12:36.819472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:31.551953Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:31.551953Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:1288c95e8885cd4d2c9110fa06648a261ebcde458b9a4f0516d1653602951649","observation_id":"c2d7a5c7-9301-4d54-b124-ab2af91b7811","resolution":{"observed_at":"2026-08-07T12:12:31.551953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:36.560610Z","title":"These descriptions were used to extract semantic embeddings for the target sounds","venue":null,"work_id":"241f3b82-9478-4d87-843a-879c1a5549af","year":null},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:29.771917Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:7fc77b6e371a76abff188cdbc1af9ddc4a9c589e7bbda21aeb57c30a739d2e02","observation_id":"0e47624e-a224-4f15-8982-dfaa9cb2dd0b","resolution":{"observed_at":"2026-08-07T12:12:36.648303Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:34.315406Z","title":"Image method for efficiently sim- ulating small-room acoustics,","venue":null,"work_id":"4630dc84-275b-4c8f-8e21-63221f81001b","year":1979},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:31.629250Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:1817bc9b9cabcfe495e010cef36dbd01a0904d1e76567758be3b10f6ccba0163","observation_id":"ee8562c1-befe-409f-a1dc-9ae65d1fc2ce","resolution":{"observed_at":"2026-08-07T12:12:34.393769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:34.096420Z","title":"A note on a method for generating points uniformly on n-dimensional spheres,","venue":null,"work_id":"b033bd2d-322b-42e2-b050-e37f05888e25","year":1959},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:31.711541Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:4f542f3bb0ea96f0602e108b0f6a2c9d76e254cca835608368ea0606f985c121","observation_id":"e141348d-b156-46cb-97a9-d0bf20b4728c","resolution":{"observed_at":"2026-08-07T12:12:34.201320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:33.660192Z","title":"Libri-light: A benchmark for asr with limited or no su- pervision,","venue":null,"work_id":"a15def50-1a94-43e4-9302-257719f840a2","year":2020},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:31.885365Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:9b74f3467f0de9315e4a6662f46e02afad692f55fa672feadc594a5d27d3b5d8","observation_id":"01fb8b16-ee7a-4b95-9a34-6b579358b0c7","resolution":{"observed_at":"2026-08-07T12:12:33.714244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:33.458532Z","title":"Fsd50k: an open dataset of human-labeled sound events,","venue":null,"work_id":"246d4c88-6166-4f6a-b34c-50a824e2dc69","year":2021},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:32.043804Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:13fc6a639f5c05680c105709e2deb5394e430d74d7da453780115f9518806a0b","observation_id":"63a5eef5-1daa-49f7-bc2d-f61ee77b93a1","resolution":{"observed_at":"2026-08-07T12:12:33.552078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:33.232130Z","title":"Freesound - Collaborative database of creative-commons li- censed sound effects,","venue":null,"work_id":"a472cd73-19d3-4efc-b4a0-aa50bc52b66b","year":2025},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:32.119727Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:8c42c3e2413b5ca8702907bb1712bca24572594126584fb9e6d9efcb553610a3","observation_id":"dc060940-779a-49c9-a180-7b1693833dab","resolution":{"observed_at":"2026-08-07T12:12:33.353100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.02882","last_updated":"2019-04-05T06:05:00Z","snapshot_observed_at":"2026-08-07T13:32:24.356336Z","submitted_at":"2019-04-05T06:05:00Z","title":"LibriTTS: A Corpus Derived from LibriSpeech for Text-to-Speech","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.02882","snapshot_observed_at":"2026-08-07T12:12:32.212526Z","title":"Libritts: A corpus derived from librispeech for text- to-speech,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:32.212526Z"},"links":{"cited_paper":"/paper/1904.02882","citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:4543cd7e3cafd4ba4eb95656232fe11bf56b813c7b22ebc9c60b68fd4a53833f","observation_id":"1dad2592-052c-4c14-b5f8-414ae112518b","resolution":{"observed_at":"2026-08-07T12:12:32.212526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:32.325036Z","title":"Audio set: An ontology and human-labeled dataset for audio events,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:32.325036Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:2a341e209a3f4575d0be3931164eb074a2918cee6048e7ec558e78fff9b8041c","observation_id":"254a95e6-5c72-474c-a940-d72cf7caf6a2","resolution":{"observed_at":"2026-08-07T12:12:32.325036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:32.435566Z","title":"Starss23: An audio-visual dataset of spatial recordings of real scenes with spatiotemporal annotations of sound events,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:32.435566Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:677c2f5260f11cfba92efef22bfc09cdbec89eff03eada7006afe86f864d7438","observation_id":"d18f55f0-684f-40f0-8247-59d03c9709da","resolution":{"observed_at":"2026-08-07T12:12:32.435566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:32.997538Z","title":"Direction specific ambisonics source separation with end-to-end deep learning,","venue":null,"work_id":"57b8d376-0142-4176-b976-a081aee2b5bb","year":2023},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:32.514636Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:bd2588685fc4bcfe5aeb9c8c6c2f2453a75bcd56014052845e04b18c2ae51e71","observation_id":"3a172ba9-82d5-49e1-a9a1-eb6c50840c78","resolution":{"observed_at":"2026-08-07T12:12:33.112320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-07T12:06:36.574202Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":21},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 1 inbound Pith citation observation for arXiv:2506.00273."}