{"as_of":"2026-08-10T23:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:56a0f28a7f967caab2da08da5a0c8d26177a62659ad77f2b36e24378b39ab8cd","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:37:15.270632Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.14433/citation-record","integrity":"/paper/2505.14433/integrity","json":"/paper/2505.14433/citation-record.json","paper":"/paper/2505.14433"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:20.512429Z","title":"Target Speaker Extraction by Directly Exploiting Contextual Information in the Time-Frequency Domain,","venue":null,"work_id":"7209fe76-22f1-4bfe-998b-ccfdf8671d60","year":2024},"citing_paper":{"arxiv_id":"2505.14433","last_updated":"2025-05-20T14:40:18Z","snapshot_observed_at":"2026-08-07T15:32:00.761071Z","submitted_at":"2025-05-20T14:40:18Z","title":"Single-Channel Target Speech Extraction Utilizing Distance and Room Clues","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:37:12.140615Z"},"links":{"citing_paper":"/paper/2505.14433"},"observation_digest":"sha256:b857d3be2d775f84989e2ea177187657cee9a4bc747180fb9e8975d5d8f3fb5c","observation_id":"5f9e80de-64cd-4ee8-998f-cf1edc843072","resolution":{"observed_at":"2026-08-07T15:37:20.661205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:20.260625Z","title":"Coarse-to-Fine Target Speaker Ex- traction Based on Contextual Information Exploitation,","venue":null,"work_id":"8346832c-9c73-45d5-bc5c-64030ca8fd5f","year":2024},"citing_paper":{"arxiv_id":"2505.14433","last_updated":"2025-05-20T14:40:18Z","snapshot_observed_at":"2026-08-07T15:32:00.761071Z","submitted_at":"2025-05-20T14:40:18Z","title":"Single-Channel Target Speech Extraction Utilizing Distance and Room Clues","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:37:12.232136Z"},"links":{"citing_paper":"/paper/2505.14433"},"observation_digest":"sha256:3e3712a59fdf421ca1c4f80181941542e62c418d8998f8075729a088f981cafb","observation_id":"d0b0390f-ada3-4835-9522-d48039848d0f","resolution":{"observed_at":"2026-08-07T15:37:20.349878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:20.037750Z","title":"Target Speaker Extraction with Ultra-Short Reference Speech by VE-VE Framework,","venue":null,"work_id":"66ea3a55-6234-49cc-9f52-861320db94f9","year":2023},"citing_paper":{"arxiv_id":"2505.14433","last_updated":"2025-05-20T14:40:18Z","snapshot_observed_at":"2026-08-07T15:32:00.761071Z","submitted_at":"2025-05-20T14:40:18Z","title":"Single-Channel Target Speech Extraction Utilizing Distance and Room Clues","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:37:12.350155Z"},"links":{"citing_paper":"/paper/2505.14433"},"observation_digest":"sha256:8ffcc1bcf004a932207875afedfae256ba970c861b034508dd9eb7c3a481429f","observation_id":"f9db5d6f-46fd-4f02-ae8f-940aa9835fbe","resolution":{"observed_at":"2026-08-07T15:37:20.145366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:19.836660Z","title":"Separate in the Speech Chain: Cross-Modal Conditional Audio-Visual Target Speech Extraction,","venue":null,"work_id":"1f7ca016-ff60-4cab-9fef-99621d3b9812","year":2024},"citing_paper":{"arxiv_id":"2505.14433","last_updated":"2025-05-20T14:40:18Z","snapshot_observed_at":"2026-08-07T15:32:00.761071Z","submitted_at":"2025-05-20T14:40:18Z","title":"Single-Channel Target Speech Extraction Utilizing Distance and Room Clues","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:37:12.498457Z"},"links":{"citing_paper":"/paper/2505.14433"},"observation_digest":"sha256:8fb6f151e40b14d4b0a5d4fa3a18503798a283df384cc9d52c68f0bde6ce0202","observation_id":"37696deb-ead9-45b2-b0e8-18e475edf0bd","resolution":{"observed_at":"2026-08-07T15:37:19.920063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:19.621876Z","title":"Speaker Extraction With Co-Speech Gestures Cue,","venue":null,"work_id":"a59fa885-43be-412c-bd39-2df1b0619b29","year":2022},"citing_paper":{"arxiv_id":"2505.14433","last_updated":"2025-05-20T14:40:18Z","snapshot_observed_at":"2026-08-07T15:32:00.761071Z","submitted_at":"2025-05-20T14:40:18Z","title":"Single-Channel Target Speech Extraction Utilizing Distance and Room Clues","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:37:12.612835Z"},"links":{"citing_paper":"/paper/2505.14433"},"observation_digest":"sha256:1bbc817b196b78650008462388362fe00b09da943110aa570a88b3801613ef13","observation_id":"2e728235-d717-4ca5-92d6-4c23cf3ea90b","resolution":{"observed_at":"2026-08-07T15:37:19.731387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:19.385367Z","title":"Computer- steered microphone arrays for sound transduction in large rooms,","venue":null,"work_id":"0316dd9c-03ea-416f-8cbe-ce30cd9aa898","year":1985},"citing_paper":{"arxiv_id":"2505.14433","last_updated":"2025-05-20T14:40:18Z","snapshot_observed_at":"2026-08-07T15:32:00.761071Z","submitted_at":"2025-05-20T14:40:18Z","title":"Single-Channel Target Speech Extraction Utilizing Distance and Room Clues","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:37:12.746179Z"},"links":{"citing_paper":"/paper/2505.14433"},"observation_digest":"sha256:8533a432ce039c46c3fbb46b6487d4428523647f8b9429cd500f20556b21f7e6","observation_id":"172c7805-2b09-4d8b-a7cc-381bbad5eb5c","resolution":{"observed_at":"2026-08-07T15:37:19.494460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:19.231123Z","title":"Neural Target Speech Extraction: An overview,","venue":null,"work_id":"d6775784-5a07-4525-8aba-b6cb8a886f41","year":2023},"citing_paper":{"arxiv_id":"2505.14433","last_updated":"2025-05-20T14:40:18Z","snapshot_observed_at":"2026-08-07T15:32:00.761071Z","submitted_at":"2025-05-20T14:40:18Z","title":"Single-Channel Target Speech Extraction Utilizing Distance and Room Clues","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:37:12.840747Z"},"links":{"citing_paper":"/paper/2505.14433"},"observation_digest":"sha256:13d5652f0199db5ee7c5eb41e444a77e23eebce2951f2e78d77f310a3fc74f42","observation_id":"1f532526-f250-4f1e-93f5-7bed636e3a52","resolution":{"observed_at":"2026-08-07T15:37:19.321408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:19.028032Z","title":"Neural Spatial Filter: Target Speaker Speech Separation Assisted with Directional Information,","venue":null,"work_id":"e2cbaada-dd18-4421-8aed-77cc5f58b09d","year":2019},"citing_paper":{"arxiv_id":"2505.14433","last_updated":"2025-05-20T14:40:18Z","snapshot_observed_at":"2026-08-07T15:32:00.761071Z","submitted_at":"2025-05-20T14:40:18Z","title":"Single-Channel Target Speech Extraction Utilizing Distance and Room Clues","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:37:12.971256Z"},"links":{"citing_paper":"/paper/2505.14433"},"observation_digest":"sha256:5128557369d1e0c2bd71f2ce60dc8f1ca7eff38ae7bd92ebb0de81c93457a21d","observation_id":"2d91dd18-f7c8-4558-9795-7f0ae92240da","resolution":{"observed_at":"2026-08-07T15:37:19.135035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:18.700943Z","title":"Multi-Modal Multi-Channel Target Speech Separation,","venue":null,"work_id":"44af4ae4-bd0a-46ed-b059-2289519330b0","year":2020},"citing_paper":{"arxiv_id":"2505.14433","last_updated":"2025-05-20T14:40:18Z","snapshot_observed_at":"2026-08-07T15:32:00.761071Z","submitted_at":"2025-05-20T14:40:18Z","title":"Single-Channel Target Speech Extraction Utilizing Distance and Room Clues","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:37:13.080756Z"},"links":{"citing_paper":"/paper/2505.14433"},"observation_digest":"sha256:a71b71acd1ed437c28673eb15606809004a82ea4a19aaf3e1b2827c88d825320","observation_id":"029d97a3-6e4c-4fa0-a4a5-32ebc9f7505e","resolution":{"observed_at":"2026-08-07T15:37:18.837023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.04454","last_updated":"2021-06-16T08:40:07Z","snapshot_observed_at":"2026-08-09T21:21:15.269484Z","submitted_at":"2020-12-08T14:47:23Z","title":"Adversarial Disentanglement of Speaker Representation for Attribute-Driven Privacy Preservation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.04454","snapshot_observed_at":"2026-08-07T15:37:13.215243Z","title":"Adversarial disentanglement of speaker repre- sentation for attribute-driven privacy preservation,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2505.14433","last_updated":"2025-05-20T14:40:18Z","snapshot_observed_at":"2026-08-07T15:32:00.761071Z","submitted_at":"2025-05-20T14:40:18Z","title":"Single-Channel Target Speech Extraction Utilizing Distance and Room Clues","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:37:13.215243Z"},"links":{"cited_paper":"/paper/2012.04454","citing_paper":"/paper/2505.14433"},"observation_digest":"sha256:b1fad155fb8b8423c69d84faa06585a657d53eaf8f046cd1676fba5cb144bb3c","observation_id":"c2d9571e-a603-485f-b622-1c6742f354f9","resolution":{"observed_at":"2026-08-07T15:37:13.215243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:18.425102Z","title":"Sound Source Distance Estimation in Diverse and Dynamic Acoustic Conditions,","venue":null,"work_id":"3ebce2c4-b924-4426-a8da-b0a1028c71ae","year":2023},"citing_paper":{"arxiv_id":"2505.14433","last_updated":"2025-05-20T14:40:18Z","snapshot_observed_at":"2026-08-07T15:32:00.761071Z","submitted_at":"2025-05-20T14:40:18Z","title":"Single-Channel Target Speech Extraction Utilizing Distance and Room Clues","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:37:13.350054Z"},"links":{"citing_paper":"/paper/2505.14433"},"observation_digest":"sha256:1736da572ef36f3a6cb51bf63bc8650ae88328335b2bfa734232fb0344129f4b","observation_id":"0ba428ce-1ecf-4095-bf32-705f646f0053","resolution":{"observed_at":"2026-08-07T15:37:18.536994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:18.247937Z","title":"Speaker Distance Estimation in Enclosures From Single-Channel Au- dio,","venue":null,"work_id":"e9ab0741-f62f-4d2e-8260-090dcded5d00","year":2024},"citing_paper":{"arxiv_id":"2505.14433","last_updated":"2025-05-20T14:40:18Z","snapshot_observed_at":"2026-08-07T15:32:00.761071Z","submitted_at":"2025-05-20T14:40:18Z","title":"Single-Channel Target Speech Extraction Utilizing Distance and Room Clues","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:37:13.472997Z"},"links":{"citing_paper":"/paper/2505.14433"},"observation_digest":"sha256:52cccf36d99f24f5ac767eb9398fc86874a7a62e3d0ca7d44ebec32b573044b6","observation_id":"c423a833-c6b0-4138-b99a-065cf0386031","resolution":{"observed_at":"2026-08-07T15:37:18.305036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:17.999661Z","title":"Distance-Based Sound Separation,","venue":null,"work_id":"119a6f95-1316-47f5-b742-aff039decca3","year":2022},"citing_paper":{"arxiv_id":"2505.14433","last_updated":"2025-05-20T14:40:18Z","snapshot_observed_at":"2026-08-07T15:32:00.761071Z","submitted_at":"2025-05-20T14:40:18Z","title":"Single-Channel Target Speech Extraction Utilizing Distance and Room Clues","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:37:13.606995Z"},"links":{"citing_paper":"/paper/2505.14433"},"observation_digest":"sha256:a1b879636fc8ac960c696ca2a59594c32e79842299585b1e3a037bb169d088b7","observation_id":"f946587a-71d5-4602-8a46-19fc0219c940","resolution":{"observed_at":"2026-08-07T15:37:18.130635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:17.788996Z","title":"Rezero: Region-customizable sound extraction,","venue":null,"work_id":"7fa1933f-f209-40f0-b56b-8a33c589232d","year":2024},"citing_paper":{"arxiv_id":"2505.14433","last_updated":"2025-05-20T14:40:18Z","snapshot_observed_at":"2026-08-07T15:32:00.761071Z","submitted_at":"2025-05-20T14:40:18Z","title":"Single-Channel Target Speech Extraction Utilizing Distance and Room Clues","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:37:13.748791Z"},"links":{"citing_paper":"/paper/2505.14433"},"observation_digest":"sha256:65c5a606d7a801776a400bf6fb5f5fc089792633388e30cb8a47c300812895a5","observation_id":"648c0e97-e55e-444b-a27d-5e6c6d63cb3c","resolution":{"observed_at":"2026-08-07T15:37:17.887881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.16241","last_updated":"2023-10-07T09:25:32Z","snapshot_observed_at":"2026-07-31T23:21:23.733560Z","submitted_at":"2023-06-28T14:09:46Z","title":"Focus on the Sound around You: Monaural Target Speaker Extraction via Distance and Speaker Information","version":2},"cited_work":{"arxiv_id":"2306.16241","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.16241","snapshot_observed_at":"2026-08-07T15:37:15.706838Z","title":"Focus on the Sound around You: Monaural Target Speaker Extraction via Distance and Speaker Information","venue":"cs.SD","work_id":"472c8ed5-0068-4323-8d10-296e8ebded11","year":2023},"citing_paper":{"arxiv_id":"2505.14433","last_updated":"2025-05-20T14:40:18Z","snapshot_observed_at":"2026-08-07T15:32:00.761071Z","submitted_at":"2025-05-20T14:40:18Z","title":"Single-Channel Target Speech Extraction Utilizing Distance and Room Clues","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:37:13.875620Z"},"links":{"cited_paper":"/paper/2306.16241","citing_paper":"/paper/2505.14433"},"observation_digest":"sha256:6a5997329c899c44b1a34b6e8560bca9b62e95b5b9864d85f530cffedb35ee56","observation_id":"c36c7ce9-eba9-4a81-b3b7-515b45b3a302","resolution":{"observed_at":"2026-08-07T15:37:15.765470Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20144","last_updated":"2024-12-28T13:13:15Z","snapshot_observed_at":"2026-07-06T20:14:03.824268Z","submitted_at":"2024-12-28T13:13:15Z","title":"Distance Based Single-Channel Target Speech Extraction","version":1},"cited_work":{"arxiv_id":"2412.20144","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.20144","snapshot_observed_at":"2026-08-07T15:37:15.456745Z","title":"Distance Based Single-Channel Target Speech Extraction","venue":"eess.AS","work_id":"af156418-9d66-4e3c-8537-fd2da70a9fbd","year":2024},"citing_paper":{"arxiv_id":"2505.14433","last_updated":"2025-05-20T14:40:18Z","snapshot_observed_at":"2026-08-07T15:32:00.761071Z","submitted_at":"2025-05-20T14:40:18Z","title":"Single-Channel Target Speech Extraction Utilizing Distance and Room Clues","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:37:14.041353Z"},"links":{"cited_paper":"/paper/2412.20144","citing_paper":"/paper/2505.14433"},"observation_digest":"sha256:a601e2d6c11c85986f0cfd43f08ed9240a6af5e387b638672be627f238331756","observation_id":"3352ef1b-5c2d-4e5e-ae54-7716effa4e7f","resolution":{"observed_at":"2026-08-07T15:37:15.588581Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:17.629784Z","title":"TF-GridNet: Integrating Full- and Sub-Band Modeling for Speech Separation,","venue":null,"work_id":"a4f62cc6-8f47-4506-a6be-674542c531b0","year":2023},"citing_paper":{"arxiv_id":"2505.14433","last_updated":"2025-05-20T14:40:18Z","snapshot_observed_at":"2026-08-07T15:32:00.761071Z","submitted_at":"2025-05-20T14:40:18Z","title":"Single-Channel Target Speech Extraction Utilizing Distance and Room Clues","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:37:14.136445Z"},"links":{"citing_paper":"/paper/2505.14433"},"observation_digest":"sha256:e341ae75c0acaa54eacbca33a494e7a83e19674c53e39cf118028ac12c188726","observation_id":"eac04e55-0d4f-45e1-b696-40857af6eb96","resolution":{"observed_at":"2026-08-07T15:37:17.673595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:17.448702Z","title":"Learning neural acoustic fields,","venue":null,"work_id":"adca9747-6a11-4c24-928b-04e7509ec06d","year":2022},"citing_paper":{"arxiv_id":"2505.14433","last_updated":"2025-05-20T14:40:18Z","snapshot_observed_at":"2026-08-07T15:32:00.761071Z","submitted_at":"2025-05-20T14:40:18Z","title":"Single-Channel Target Speech Extraction Utilizing Distance and Room Clues","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:37:14.299566Z"},"links":{"citing_paper":"/paper/2505.14433"},"observation_digest":"sha256:c09fefec802a0978fa97e07bc68cf87101b3be87ed60f639051062c3d4c5c454","observation_id":"2804510e-0fe7-46db-a2c8-77e23b6a1e42","resolution":{"observed_at":"2026-08-07T15:37:17.565990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:17.161910Z","title":"Dual-path rnn: efficient long sequence modeling for time-domain single-channel speech separation,","venue":null,"work_id":"ff4ea0d6-6ec5-4ef6-a4b7-21a9f2a01c65","year":2020},"citing_paper":{"arxiv_id":"2505.14433","last_updated":"2025-05-20T14:40:18Z","snapshot_observed_at":"2026-08-07T15:32:00.761071Z","submitted_at":"2025-05-20T14:40:18Z","title":"Single-Channel Target Speech Extraction Utilizing Distance and Room Clues","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:37:14.434091Z"},"links":{"citing_paper":"/paper/2505.14433"},"observation_digest":"sha256:3e006bb032675aaea2a519f42b6b2999e53dddb6090945bef14de8f1b1da7103","observation_id":"1eca524b-f002-44a1-8611-cd3f2097da3e","resolution":{"observed_at":"2026-08-07T15:37:17.302335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:16.978057Z","title":"SDR – Half- baked or Well Done?","venue":null,"work_id":"846d5903-d497-4a1a-9a64-8e3944342a41","year":2019},"citing_paper":{"arxiv_id":"2505.14433","last_updated":"2025-05-20T14:40:18Z","snapshot_observed_at":"2026-08-07T15:32:00.761071Z","submitted_at":"2025-05-20T14:40:18Z","title":"Single-Channel Target Speech Extraction Utilizing Distance and Room Clues","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:37:14.538873Z"},"links":{"citing_paper":"/paper/2505.14433"},"observation_digest":"sha256:c6370d5f1073a8b28fa63c886e1e6c288dc0a03539fb02584e66048835ef32d7","observation_id":"90341bcd-80f1-44d1-85f3-9f307cfe0ce8","resolution":{"observed_at":"2026-08-07T15:37:17.035274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:16.755468Z","title":"Soundbeam: Target sound extraction conditioned on sound- class labels and enrollment clues for increased performance and continu- ous learning,","venue":null,"work_id":"f072beb4-07cf-4764-ac31-014d376227fb","year":2022},"citing_paper":{"arxiv_id":"2505.14433","last_updated":"2025-05-20T14:40:18Z","snapshot_observed_at":"2026-08-07T15:32:00.761071Z","submitted_at":"2025-05-20T14:40:18Z","title":"Single-Channel Target Speech Extraction Utilizing Distance and Room Clues","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:37:14.645542Z"},"links":{"citing_paper":"/paper/2505.14433"},"observation_digest":"sha256:bc4e2332697a953a9339374180be23231414ac7e71ca165fdd2428701bf70d99","observation_id":"6ef86dff-a4cd-432a-9c97-722322a3bc34","resolution":{"observed_at":"2026-08-07T15:37:16.873818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:16.466073Z","title":"What’s all the Fuss about Free Universal Sound Separation Data?","venue":null,"work_id":"c27167fb-1367-4756-acba-f00e6ede9767","year":2021},"citing_paper":{"arxiv_id":"2505.14433","last_updated":"2025-05-20T14:40:18Z","snapshot_observed_at":"2026-08-07T15:32:00.761071Z","submitted_at":"2025-05-20T14:40:18Z","title":"Single-Channel Target Speech Extraction Utilizing Distance and Room Clues","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:37:14.755669Z"},"links":{"citing_paper":"/paper/2505.14433"},"observation_digest":"sha256:8d0f07953883835a02c8b3313371e0454dc980d6b2ed9f8a6c033e2c43170841","observation_id":"e9bd9e8b-0f9e-4a52-bfaf-421ded4d3c30","resolution":{"observed_at":"2026-08-07T15:37:16.613829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:16.262504Z","title":"Pyroomacoustics: A Python package for audio room simulations and array processing algorithms,","venue":null,"work_id":"18339d03-3cd0-42e4-a6ff-77d2bb04fc4a","year":2018},"citing_paper":{"arxiv_id":"2505.14433","last_updated":"2025-05-20T14:40:18Z","snapshot_observed_at":"2026-08-07T15:32:00.761071Z","submitted_at":"2025-05-20T14:40:18Z","title":"Single-Channel Target Speech Extraction Utilizing Distance and Room Clues","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:37:14.839154Z"},"links":{"citing_paper":"/paper/2505.14433"},"observation_digest":"sha256:7e855a66463ce598568a083924675e5993f95b289ea6cc98267d58f29acb028e","observation_id":"22a2f732-e645-42da-910b-5395f2218f1b","resolution":{"observed_at":"2026-08-07T15:37:16.359878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:16.085920Z","title":"Advancements in impulse response measurements by sine sweeps,","venue":null,"work_id":"93e907e0-c492-4d08-ac35-af0179fd6606","year":2007},"citing_paper":{"arxiv_id":"2505.14433","last_updated":"2025-05-20T14:40:18Z","snapshot_observed_at":"2026-08-07T15:32:00.761071Z","submitted_at":"2025-05-20T14:40:18Z","title":"Single-Channel Target Speech Extraction Utilizing Distance and Room Clues","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:37:14.914516Z"},"links":{"citing_paper":"/paper/2505.14433"},"observation_digest":"sha256:c7f5ebb8697efc47def6d89c631860cc675a194445b17f11c261feb9396c9cd2","observation_id":"cc515019-8357-42c7-973f-b7d07f5a5aaa","resolution":{"observed_at":"2026-08-07T15:37:16.152071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:15.929305Z","title":"Libri-light: A benchmark for asr with limited or no supervision,","venue":null,"work_id":"921eb1ba-db0d-4785-b496-0fb677ae9876","year":2020},"citing_paper":{"arxiv_id":"2505.14433","last_updated":"2025-05-20T14:40:18Z","snapshot_observed_at":"2026-08-07T15:32:00.761071Z","submitted_at":"2025-05-20T14:40:18Z","title":"Single-Channel Target Speech Extraction Utilizing Distance and Room Clues","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:37:15.024741Z"},"links":{"citing_paper":"/paper/2505.14433"},"observation_digest":"sha256:04927d6077637d38722c418f30b17fdbb3d39fd9cd3cc74a8fa0c993b86d548c","observation_id":"11d18ccb-f2b7-493f-b193-cbc620890f6f","resolution":{"observed_at":"2026-08-07T15:37:15.971562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-07T15:37:15.148779Z","title":"Adam: A method for stochastic optimization,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.14433","last_updated":"2025-05-20T14:40:18Z","snapshot_observed_at":"2026-08-07T15:32:00.761071Z","submitted_at":"2025-05-20T14:40:18Z","title":"Single-Channel Target Speech Extraction Utilizing Distance and Room Clues","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:37:15.148779Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2505.14433"},"observation_digest":"sha256:903d80c5f65b27b13b3d1496850f6b54d9169bf8194b2191ce9080c177004cd5","observation_id":"fc4507b7-c9c1-454e-9a14-28fa0f24461c","resolution":{"observed_at":"2026-08-07T15:37:15.148779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.04686","last_updated":"2020-08-18T03:03:01Z","snapshot_observed_at":"2026-08-10T11:50:41.077369Z","submitted_at":"2020-05-10T15:00:07Z","title":"SpEx+: A Complete Time Domain Speaker Extraction Network","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.04686","snapshot_observed_at":"2026-08-07T15:37:15.270632Z","title":"Spex+: A complete time domain speaker extraction network,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2505.14433","last_updated":"2025-05-20T14:40:18Z","snapshot_observed_at":"2026-08-07T15:32:00.761071Z","submitted_at":"2025-05-20T14:40:18Z","title":"Single-Channel Target Speech Extraction Utilizing Distance and Room Clues","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:37:15.270632Z"},"links":{"cited_paper":"/paper/2005.04686","citing_paper":"/paper/2505.14433"},"observation_digest":"sha256:6ca4131f67c49585b1773f95a0a568616c148ffc35ec65158cc7bed8abcd4b5a","observation_id":"4bf526e9-e602-42ec-b64b-02c6a4150e99","resolution":{"observed_at":"2026-08-07T15:37:15.270632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.14433","last_updated":"2025-05-20T14:40:18Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-07T15:32:00.761071Z","submitted_at":"2025-05-20T14:40:18Z","title":"Single-Channel Target Speech Extraction Utilizing Distance and Room Clues"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":2,"verified_fuzzy":22},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 0 inbound Pith citation observations for arXiv:2505.14433."}