{"as_of":"2026-08-07T22:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9d8d633413fd643ecced70858997d0710502fda075c51b214f1118df7a6bc53c","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T13:13:07.182612Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T13:13:04.567985Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T04:57:37.975653Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.20926","snapshot_observed_at":"2026-08-06T13:13:04.567985Z","title":"Problem formulation Let X ∈ RM ×L be the multichannel mixture recorded by an M-microphone array, whereL denotes the number of time sam- ples","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:04.567985Z"},"links":{"cited_paper":"/paper/2507.20926","citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:46902d7bd408e798e9c39ee70442776f291560c5f382efd695cc876b60a137ec","observation_id":"c9f72f9c-a67c-4c91-99df-cf8bcbac0804","resolution":{"observed_at":"2026-08-06T13:13:04.567985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"cited_work":{"arxiv_id":"2507.20926","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.20926","snapshot_observed_at":"2026-07-03T04:57:37.975653Z","title":"End-to-end doa-guided speech extraction in noisy multi-talker scenarios,","venue":null,"work_id":"cba639fe-b17d-4e30-823c-691ac4ef4111","year":2025},"citing_paper":{"arxiv_id":"2607.02296","last_updated":"2026-07-02T15:13:32Z","snapshot_observed_at":"2026-08-02T07:05:47.023745Z","submitted_at":"2026-07-02T15:13:32Z","title":"Spatial Speech Perception Systems: A Survey of Sound Source Localization, Directional Enhancement, and Speech Recognition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-03T04:52:36.712797Z"},"links":{"cited_paper":"/paper/2507.20926","citing_paper":"/paper/2607.02296"},"observation_digest":"sha256:42fec97383e514ff24a6ef3a08283de867044f8e3e76fdfffe2e7bfd46148f34","observation_id":"27ad84c5-009e-4227-9796-919a0c83b8b4","resolution":{"observed_at":"2026-07-03T04:57:37.977094Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.20926","snapshot_observed_at":"2026-07-31T00:58:13.711323Z","title":"End-to-end doa-guided speech extraction in noisy multi-talker scenarios,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27436","last_updated":"2026-07-29T20:05:39Z","snapshot_observed_at":"2026-08-07T01:15:56.832491Z","submitted_at":"2026-07-29T20:05:39Z","title":"WeSep: A Modular and Cue-Composable Framework for Target Speaker Extraction","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-31T00:58:13.711323Z"},"links":{"cited_paper":"/paper/2507.20926","citing_paper":"/paper/2607.27436"},"observation_digest":"sha256:f0ef9c2576ea38df7af786d2d98ecc871c1db21faa47a72a5256879d22aeec3b","observation_id":"83d52725-d8fa-47ae-b9f0-e0dea7aea5d0","resolution":{"observed_at":"2026-07-31T00:58:13.711323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.20926/citation-record","integrity":"/paper/2507.20926/integrity","json":"/paper/2507.20926/citation-record.json","paper":"/paper/2507.20926"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:11.498183Z","title":"cocktail party effect","venue":null,"work_id":"c3e4e589-dabf-48b0-a91a-52aa8267afe4","year":null},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:04.490653Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:fe3b1715be3c2167bda06257356f02ce32d4b97e5793c351083038787fa98bd6","observation_id":"ff6aaa57-ffd2-4e86-82f6-82f9556f8793","resolution":{"observed_at":"2026-08-06T13:13:11.502683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.20926","snapshot_observed_at":"2026-08-06T13:13:04.567985Z","title":"Problem formulation Let X ∈ RM ×L be the multichannel mixture recorded by an M-microphone array, whereL denotes the number of time sam- ples","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:04.567985Z"},"links":{"cited_paper":"/paper/2507.20926","citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:46902d7bd408e798e9c39ee70442776f291560c5f382efd695cc876b60a137ec","observation_id":"c9f72f9c-a67c-4c91-99df-cf8bcbac0804","resolution":{"observed_at":"2026-08-06T13:13:04.567985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:11.480622Z","title":"Dataset For this study, the speech data is sourced from the LibriSpeech corpus [23], while the background noise is taken from the DE- MAND dataset [24]","venue":null,"work_id":"446e504d-040a-4f6a-a4ec-db1691e9736b","year":null},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:04.684310Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:c9b5b1eccce45d35d28469bbc443140976c69f1d28c28dbe62aa6e879ac06fc2","observation_id":"c53dc4db-99e7-4cb1-92f3-4383aa4f1a32","resolution":{"observed_at":"2026-08-06T13:13:11.486535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:11.381986Z","title":null,"venue":null,"work_id":"57d376fc-860b-4e74-9f12-204aa4ef1aaf","year":null},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:04.766743Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:f4f790c31200be02df897a71a6980659b6aef8fa91a3025040e0e8a047f18329","observation_id":"2340fc59-cb73-47d0-adb5-140a72445203","resolution":{"observed_at":"2026-08-06T13:13:11.469192Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:11.358016Z","title":null,"venue":null,"work_id":"ec669a28-aaa9-4b7d-a595-49d2bb42b35b","year":null},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:04.837903Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:b5a0c55607887db4ee54d4e434323c7dcc75ceddf1c70a8ace08c282f98aa8a7","observation_id":"897568b5-e357-4285-96a4-317dc2fc63ba","resolution":{"observed_at":"2026-08-06T13:13:11.363481Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:04.916426Z","title":"The cocktail party problem,","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:04.916426Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:3eb766ec29e145f83e5a1025442090ab0707e6116cbd0a9c7f241cdf0e568c93","observation_id":"94664007-a3ae-4187-9074-92e6f3e93053","resolution":{"observed_at":"2026-08-06T13:13:04.916426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:05.004044Z","title":"Music source separation with band-split rnn,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:05.004044Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:8d2c48c8375df6370e9dfeb76c019a11555c6ffcb28d9e2e8b2d5491e9162e82","observation_id":"d0ba75bb-3586-4cbf-a584-97a2773c8e4a","resolution":{"observed_at":"2026-08-06T13:13:05.004044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:11.315217Z","title":"Distance- based sound separation,","venue":null,"work_id":"b671c844-86c4-4726-ada8-41f0b8abd453","year":2022},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:05.092275Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:c71b3c28e9c2e5f8fe1d7ba89207bd4a73beb5b0fd9e6c8935aac3bf82f3de59","observation_id":"ac199df7-91e8-4f09-86f6-19dfedd90db2","resolution":{"observed_at":"2026-08-06T13:13:11.321185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18141","last_updated":"2024-12-30T09:57:09Z","snapshot_observed_at":"2026-08-02T15:29:10.291795Z","submitted_at":"2024-12-24T03:54:17Z","title":"Neural Directed Speech Enhancement with Dual Microphone Array in High Noise Scenario","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18141","snapshot_observed_at":"2026-08-06T13:13:05.153295Z","title":"Neural directed speech enhancement with dual microphone array in high noise scenario,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:05.153295Z"},"links":{"cited_paper":"/paper/2412.18141","citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:94f0e42777109d06c72815c9ee4ded3b7545888984c0c3166cbea8fe5a7b4285","observation_id":"c7b39a2a-086d-4b3f-80fc-8d1b905ba00a","resolution":{"observed_at":"2026-08-06T13:13:05.153295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:11.299361Z","title":"Dasformer: Deep alternating spectrogram transformer for multi/single-channel speech separation,","venue":null,"work_id":"08f5c1d5-94d3-4ae9-bb17-7ddbeddbdecf","year":2023},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:05.235084Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:6e588e108d5b8def1220ed2921bbd82c885f0f1f7a4fe7a06876fe9b28eb4ee2","observation_id":"879139d5-f8d1-4350-b917-2b08e322c9b0","resolution":{"observed_at":"2026-08-06T13:13:11.304241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:11.100134Z","title":"Tf-gridnet: Integrating full-and sub-band modeling for speech separation,","venue":null,"work_id":"fefc9800-4c8c-4063-962f-71059b0530dd","year":2023},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:05.324273Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:167ddab99a08713c5e676573c317ba85fa9b84ac6ff2b034a463dcbba35f1801","observation_id":"da76c1d6-6b02-454f-bc2a-680bf646a699","resolution":{"observed_at":"2026-08-06T13:13:11.166929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:10.792898Z","title":"Deft-an: Dense frequency-time atten- tive network for multichannel speech enhancement,","venue":null,"work_id":"c96b0af4-3f59-4b25-ab82-62e4df796fa6","year":2023},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:05.404059Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:815e87c4c65e773f7f2ea50a6fa0bdde18ad382dd99bea510fdf45e506db5271","observation_id":"aa1021fd-503d-460b-bcb9-fbd822b78800","resolution":{"observed_at":"2026-08-06T13:13:10.938519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18913","last_updated":"2024-12-25T14:04:21Z","snapshot_observed_at":"2026-08-06T02:06:11.451347Z","submitted_at":"2024-12-25T14:04:21Z","title":"Robust Target Speaker Direction of Arrival Estimation","version":1},"cited_work":{"arxiv_id":"2412.18913","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.18913","snapshot_observed_at":"2026-08-06T13:13:07.286138Z","title":"Robust Target Speaker Direction of Arrival Estimation","venue":"cs.SD","work_id":"f2e9a3cf-302c-4c4c-9652-541446e3191f","year":2024},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:05.464848Z"},"links":{"cited_paper":"/paper/2412.18913","citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:9a879b21d439d0d8d1d0bcc4461a6c4a3d76e39a26e271b37d6f23a04da7bb37","observation_id":"dc996a2d-6232-47b6-9e87-579f5db58619","resolution":{"observed_at":"2026-08-06T13:13:07.394934Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:10.573618Z","title":"Dsenet: Directional sig- nal extraction network for hearing improvement on edge devices,","venue":null,"work_id":"3720243f-114c-4733-a494-f66e352612e6","year":2023},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:05.529148Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:e4abccf643af5bdff554bb6c4dfd59ad33e49803c13f833e101b5d06e8a1d2ae","observation_id":"7653121b-df0e-4a14-a45a-ffb0739bee14","resolution":{"observed_at":"2026-08-06T13:13:10.692428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:10.316526Z","title":"Insights into deep non-linear filters for improved multi-channel speech enhancement,","venue":null,"work_id":"8a98a00f-bf6b-4857-b5bd-fff1c3daab50","year":2022},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:05.614537Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:7efb73319f13a87bcb9ac5da80d823b76b96ee95a29cfd27568347d884ec4080","observation_id":"74357548-a1a8-47e6-9c1a-29a4b709cc36","resolution":{"observed_at":"2026-08-06T13:13:10.420302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:10.033229Z","title":"Neural spatio-temporal beamformer for target speech separa- tion,","venue":null,"work_id":"79d60a92-d539-406f-a030-d7c933e725ef","year":2020},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:05.705751Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:3c049cdd93ae7c9411cecab09a9a1b30ae749f29d008fc89d55578bb1f8af58e","observation_id":"b16e9fb5-02de-4486-a591-077de3ff8ce5","resolution":{"observed_at":"2026-08-06T13:13:10.142250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:09.804791Z","title":"Multi-channel speech separation us- ing spatially selective deep non-linear filters,","venue":null,"work_id":"133ef63f-fc09-4b9e-a1f2-083a26542975","year":2023},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:05.785136Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:69a4f1a78c9bbe6eecce9e8025489e894e1277d845d4114814d6319763c60a5f","observation_id":"7fdef1d6-2a7b-405d-973b-8dcbb75be067","resolution":{"observed_at":"2026-08-06T13:13:09.906820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:05.869531Z","title":"Rezero: Region-customizable sound extrac- tion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:05.869531Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:e8bfe83de025ae747e3b705152c6a4f6ab17cae1ac2b565cc3c95d7bbab9f758","observation_id":"029df0b6-a33c-424e-a9c2-f22399f80b8f","resolution":{"observed_at":"2026-08-06T13:13:05.869531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:09.555923Z","title":"All neural low-latency directional speech extraction,","venue":null,"work_id":"4fb67dc1-83d6-48a3-a29d-1c8e08c02ab2","year":2024},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:05.955750Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:0a442eb6eb46caf2d448111b7e6023270a8604e86c55b92e03caf1e5e4844415","observation_id":"d7bfaef1-6b53-473d-a035-0afc3db2d4ab","resolution":{"observed_at":"2026-08-06T13:13:09.663702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:09.426217Z","title":"Direction of arrival correction through speech quality feedback,","venue":null,"work_id":"1437bb7d-4e1e-4e16-9df0-4d85ad5f89b8","year":2025},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:06.045737Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:48345cb1310bac31794b18c5e9c45c3e6bcddff16f8c32430a1c9fd7e9ee9657","observation_id":"ee2efc9f-b5fc-4a7a-b0e2-45911b445142","resolution":{"observed_at":"2026-08-06T13:13:09.466357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:09.240096Z","title":"Spatio-temporal outdoor lighting aggregation on image se- quences using transformer networks,","venue":null,"work_id":"8b62fe98-5403-48b5-9458-74e94ba85806","year":2023},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:06.129641Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:d840cbab04f99df61cac428152bf13821f2cff5744ee355dc105cf08111a1a4d","observation_id":"3baea1f0-a661-4a31-9b99-03689e812be4","resolution":{"observed_at":"2026-08-06T13:13:09.318286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:06.180494Z","title":"Layer normalization,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:06.180494Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:bb872fc9fb0f45d6e1dbd7f4a592cf64a60a4b1427a95c0ac4599228e9fd48f7","observation_id":"e786deec-f1af-46d4-a120-b6abc248ff28","resolution":{"observed_at":"2026-08-06T13:13:06.180494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:06.239999Z","title":"Delving deep into rectifiers: Surpassing human-level performance on imagenet classification,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:06.239999Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:439e7609863ee583bbf0517679941892158e02ee30384d07e4860bb465655294","observation_id":"afde31cf-e670-4442-9f0f-9f102a149790","resolution":{"observed_at":"2026-08-06T13:13:06.239999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:09.059328Z","title":"Spatialnet: Extensively learning spatial in- formation for multichannel joint speech separation, denoising and dereverberation,","venue":null,"work_id":"083fb693-769e-4b52-9fc3-864715086627","year":2024},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:06.295315Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:2a93c0b3b4a74bd155e34cc6d1e486782be383ca2ecacdf6b1814c81ca0df99e","observation_id":"77596097-f6a1-49b7-afd6-c3e4a90a301a","resolution":{"observed_at":"2026-08-06T13:13:09.135710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:06.375350Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:06.375350Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:e7abaef9d643ec1acb5411c565b24092dac97ecf01282defb0096e5949d89ac3","observation_id":"9b0f394a-b8fb-400d-aaf1-4d1ad3ec11fb","resolution":{"observed_at":"2026-08-06T13:13:06.375350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:08.830910Z","title":"Group normalization,","venue":null,"work_id":"f1e63c12-b6f9-437c-8f67-908df8b6ff96","year":2018},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:06.441584Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:8b5337582c0ac2137473bb255fff0135376fdcbb2064be3cce10b4fc02c785f0","observation_id":"eaf96f2b-fbbe-4e43-a45d-bb12e37e4e0c","resolution":{"observed_at":"2026-08-06T13:13:08.919661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:08.646270Z","title":"Sdr – half-baked or well done?","venue":null,"work_id":"b76ab55b-df6e-4617-97dd-0f088e65d1ae","year":2019},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:06.528006Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:928bff94b25714aca35c5802295c6535fa46db717825a294cef1e1b20e6ff204","observation_id":"83a1c1cb-cbc7-4b7b-9ef4-c1a6c3e2ee07","resolution":{"observed_at":"2026-08-06T13:13:08.751226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:06.592312Z","title":"Lib- rispeech: an asr corpus based on public domain audio books,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:06.592312Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:0b91d6c3c07d6564a1358f762e3316e99398ca7927948dafc43f87144621fb89","observation_id":"194bbed6-143d-48d9-bb85-246d19232c86","resolution":{"observed_at":"2026-08-06T13:13:06.592312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:08.411660Z","title":"The diverse environments multi-channel acoustic noise database (demand): A database of multichannel environmental noise recordings,","venue":null,"work_id":"2d287be0-171e-4e40-87ca-7b81684ada8e","year":2013},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:06.686131Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:b6c0677b1b4a2e674f23dec6f1e46066dacc77546524bc353f999652f3bc0964","observation_id":"617ec4b1-5a06-4b19-a9df-1586e4fd7f43","resolution":{"observed_at":"2026-08-06T13:13:08.504057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:08.212658Z","title":"Pyroomacoustics: A python package for audio room simulation and array processing algorithms,","venue":null,"work_id":"115f986d-461f-452f-9f4d-632cb4eaa093","year":2018},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:06.768245Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:abdc3fc07b279327522426d936a3f118240bcfde73ce6129791568b1733e8d75","observation_id":"c1b1dc30-8fe6-4a27-96de-72c888ee12b6","resolution":{"observed_at":"2026-08-06T13:13:08.303256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:08.028104Z","title":"Adam: A method for stochastic optimiza- tion,","venue":null,"work_id":"a8f54da5-fceb-4cfc-bf86-4a5eadefe789","year":2014},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:06.836055Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:12d8da63eab827ca6e28669054bfd40515d564db363b52829a0924ec80cea998","observation_id":"57a355b6-4190-485a-95ea-6d7b8cde84db","resolution":{"observed_at":"2026-08-06T13:13:08.113292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:06.893421Z","title":"Performance measure- ment in blind audio source separation,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:06.893421Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:dd294dd1726f06827d3fa5d000cb25f5b94afb06a2fd68f15b52d8fd46183568","observation_id":"d9c6d166-a622-4c0f-8348-2c2865fbc7ed","resolution":{"observed_at":"2026-08-06T13:13:06.893421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:06.958589Z","title":"Perceptual evaluation of speech quality (pesq)-a new method for speech quality assessment of telephone networks and codecs,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:06.958589Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:9a7fc457269cda99c700adb567dd0de6b8568a5bc4ff9e093b67cc69ea8373b2","observation_id":"923eb69f-499e-444e-b928-98873d4c8fcb","resolution":{"observed_at":"2026-08-06T13:13:06.958589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:07.841664Z","title":"A signal subspace tracking algorithm for microphone array processing of speech,","venue":null,"work_id":"c0054435-6439-4f46-96c1-c43a7ae40627","year":1997},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:07.033254Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:ba4af04bad1a321ed41cefb3860d69871dc2c6800c34ad287a62f722faa60c96","observation_id":"288d1091-5204-4b32-ab7b-12aadc74c36d","resolution":{"observed_at":"2026-08-06T13:13:07.927833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:07.684900Z","title":"Spatially selective deep non-linear filters for speaker extraction,","venue":null,"work_id":"df22170b-aef6-43f3-82f5-e5cab3d7db73","year":2023},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:07.098928Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:b4f5724e5ca5bb9845ef71122886f96bf2cb49771141912a33acdaf3138ac454","observation_id":"7e87f3ff-1d58-47a0-a80b-574690b16c7b","resolution":{"observed_at":"2026-08-06T13:13:07.748603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:13:07.517392Z","title":"On the importance of acoustic reflections in beamforming,","venue":null,"work_id":"3f1bc83d-e481-42f6-92c0-dc65cfbcfc0f","year":2022},"citing_paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T13:13:07.182612Z"},"links":{"citing_paper":"/paper/2507.20926"},"observation_digest":"sha256:7191d0ac495e55528efc31c9172a1373a42e8179440d26db4e9a248607b0f498","observation_id":"05cd7ce8-fc79-4222-a5eb-0098d9884608","resolution":{"observed_at":"2026-08-06T13:13:07.589421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.20926","last_updated":"2025-07-28T15:36:30Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-06T13:13:03.576056Z","submitted_at":"2025-07-28T15:36:30Z","title":"End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":1,"verified_fuzzy":22},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 3 inbound Pith citation observations for arXiv:2507.20926."}