{"as_of":"2026-08-11T02:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:076bf15b0eac5a5a668021765fd9f9a845ef182ed3a8c8a9e30f3876f1f08ab4","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T23:35:49.647342Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:37:14.041353Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T15:37:15.456745Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.20144","last_updated":"2024-12-28T13:13:15Z","snapshot_observed_at":"2026-08-10T23:28:16.446391Z","submitted_at":"2024-12-28T13:13:15Z","title":"Distance Based Single-Channel Target Speech Extraction","version":1},"cited_work":{"arxiv_id":"2412.20144","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.20144","snapshot_observed_at":"2026-08-07T15:37:15.456745Z","title":"Distance Based Single-Channel Target Speech Extraction","venue":"eess.AS","work_id":"af156418-9d66-4e3c-8537-fd2da70a9fbd","year":2024},"citing_paper":{"arxiv_id":"2505.14433","last_updated":"2025-05-20T14:40:18Z","snapshot_observed_at":"2026-08-07T15:32:00.761071Z","submitted_at":"2025-05-20T14:40:18Z","title":"Single-Channel Target Speech Extraction Utilizing Distance and Room Clues","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:37:14.041353Z"},"links":{"cited_paper":"/paper/2412.20144","citing_paper":"/paper/2505.14433"},"observation_digest":"sha256:e6059a0d5a8a6a1b93e843169142de96044888ff06eaae9de3e302ceabaf15ed","observation_id":"3352ef1b-5c2d-4e5e-ae54-7716effa4e7f","resolution":{"observed_at":"2026-08-07T15:37:15.588581Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.20144/citation-record","integrity":"/paper/2412.20144/integrity","json":"/paper/2412.20144/citation-record.json","paper":"/paper/2412.20144"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:35:50.057097Z","title":"Neural Target Speech Extraction: An overview,","venue":null,"work_id":"d3b3249d-fa61-4e6b-84f2-809e62676ed3","year":2023},"citing_paper":{"arxiv_id":"2412.20144","last_updated":"2024-12-28T13:13:15Z","snapshot_observed_at":"2026-08-10T23:28:16.446391Z","submitted_at":"2024-12-28T13:13:15Z","title":"Distance Based Single-Channel Target Speech Extraction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T23:35:49.536258Z"},"links":{"citing_paper":"/paper/2412.20144"},"observation_digest":"sha256:157ef32454098091ed13ed3fde6801e4aced184c1115958ddb3dd00a08b1b455","observation_id":"2eae27e7-8ccb-4219-9df6-5b7803161f73","resolution":{"observed_at":"2026-08-10T23:35:50.064488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:35:50.034601Z","title":"Separate in the speech chain: Cross-modal conditional audio-visual target speech extraction,","venue":null,"work_id":"83f9b40f-e772-4b20-8e96-4a129b9e889c","year":2024},"citing_paper":{"arxiv_id":"2412.20144","last_updated":"2024-12-28T13:13:15Z","snapshot_observed_at":"2026-08-10T23:28:16.446391Z","submitted_at":"2024-12-28T13:13:15Z","title":"Distance Based Single-Channel Target Speech Extraction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T23:35:49.542301Z"},"links":{"citing_paper":"/paper/2412.20144"},"observation_digest":"sha256:23d4975a577dfad87becbaa988ae4db24ebac75d568bc1c8a8651ab6ec1c6d5b","observation_id":"cfd4ed42-ae57-4907-95b1-cac3b1e3b343","resolution":{"observed_at":"2026-08-10T23:35:50.041451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.04454","last_updated":"2021-06-16T08:40:07Z","snapshot_observed_at":"2026-08-09T21:21:15.269484Z","submitted_at":"2020-12-08T14:47:23Z","title":"Adversarial Disentanglement of Speaker Representation for Attribute-Driven Privacy Preservation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.04454","snapshot_observed_at":"2026-08-10T23:35:49.547934Z","title":"Adversarial disentanglement of speaker repre- sentation for attribute-driven privacy preservation,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.20144","last_updated":"2024-12-28T13:13:15Z","snapshot_observed_at":"2026-08-10T23:28:16.446391Z","submitted_at":"2024-12-28T13:13:15Z","title":"Distance Based Single-Channel Target Speech Extraction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T23:35:49.547934Z"},"links":{"cited_paper":"/paper/2012.04454","citing_paper":"/paper/2412.20144"},"observation_digest":"sha256:b533bf865403e36dabd7691f5b73d590e070682ec7834607758bc4c9516e1427","observation_id":"d935a50d-a9ce-4d0c-94b9-571f24e1617d","resolution":{"observed_at":"2026-08-10T23:35:49.547934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:35:50.011458Z","title":"Sound Source Distance Estimation in Diverse and Dynamic Acoustic Conditions,","venue":null,"work_id":"75fa597f-cc26-41d0-91b9-1081aaed9d00","year":2023},"citing_paper":{"arxiv_id":"2412.20144","last_updated":"2024-12-28T13:13:15Z","snapshot_observed_at":"2026-08-10T23:28:16.446391Z","submitted_at":"2024-12-28T13:13:15Z","title":"Distance Based Single-Channel Target Speech Extraction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T23:35:49.554701Z"},"links":{"citing_paper":"/paper/2412.20144"},"observation_digest":"sha256:4fd4678bdadaf884eb4b82943cc1f54315388a886ec6866186d8c57e5ba26e05","observation_id":"83ef8ede-feab-48dd-b32a-d23850ec15f3","resolution":{"observed_at":"2026-08-10T23:35:50.018182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:35:49.987695Z","title":"Distance-Based Sound Separation,","venue":null,"work_id":"29daad1e-6383-4324-b75a-4fe76725bdcc","year":2022},"citing_paper":{"arxiv_id":"2412.20144","last_updated":"2024-12-28T13:13:15Z","snapshot_observed_at":"2026-08-10T23:28:16.446391Z","submitted_at":"2024-12-28T13:13:15Z","title":"Distance Based Single-Channel Target Speech Extraction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T23:35:49.560472Z"},"links":{"citing_paper":"/paper/2412.20144"},"observation_digest":"sha256:48db1f2555a1a763a2e51360d57afcfada7810d34b719d2fda168bf133ce749a","observation_id":"48d8033d-4592-4de3-b950-f6a92d44cf6b","resolution":{"observed_at":"2026-08-10T23:35:49.994772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:35:49.565892Z","title":"Rezero: Region-customizable sound extraction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.20144","last_updated":"2024-12-28T13:13:15Z","snapshot_observed_at":"2026-08-10T23:28:16.446391Z","submitted_at":"2024-12-28T13:13:15Z","title":"Distance Based Single-Channel Target Speech Extraction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T23:35:49.565892Z"},"links":{"citing_paper":"/paper/2412.20144"},"observation_digest":"sha256:392b260cd4931e471e623281e21d0112c317f2ceda9fecc5e4d0a72cc103ee28","observation_id":"f48709ac-364e-468f-8481-e29c8b15336a","resolution":{"observed_at":"2026-08-10T23:35:49.565892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.16241","last_updated":"2023-10-07T09:25:32Z","snapshot_observed_at":"2026-07-31T23:21:23.733560Z","submitted_at":"2023-06-28T14:09:46Z","title":"Focus on the Sound around You: Monaural Target Speaker Extraction via Distance and Speaker Information","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.16241","snapshot_observed_at":"2026-08-10T23:35:49.572786Z","title":"Focus on the sound around you: Monaural target speaker extraction via distance and speaker information,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.20144","last_updated":"2024-12-28T13:13:15Z","snapshot_observed_at":"2026-08-10T23:28:16.446391Z","submitted_at":"2024-12-28T13:13:15Z","title":"Distance Based Single-Channel Target Speech Extraction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T23:35:49.572786Z"},"links":{"cited_paper":"/paper/2306.16241","citing_paper":"/paper/2412.20144"},"observation_digest":"sha256:97e6d34999e068363b8774476de615cb9c98212207935d91a669554cb6e2ab20","observation_id":"f455ad03-76bb-473e-a532-f9c1fae6c2f6","resolution":{"observed_at":"2026-08-10T23:35:49.572786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:35:49.957442Z","title":"Multi-channel talker-independent speaker separation through location-based training,","venue":null,"work_id":"8793a76e-7d1b-41ab-82bb-af69ad291e47","year":2022},"citing_paper":{"arxiv_id":"2412.20144","last_updated":"2024-12-28T13:13:15Z","snapshot_observed_at":"2026-08-10T23:28:16.446391Z","submitted_at":"2024-12-28T13:13:15Z","title":"Distance Based Single-Channel Target Speech Extraction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T23:35:49.580220Z"},"links":{"citing_paper":"/paper/2412.20144"},"observation_digest":"sha256:f85657ad8db8305b62e1b39c296346e56f30be0ede9a72d358f0f945f3f51962","observation_id":"a6e86205-b19c-4f0f-80ea-c5005b68872c","resolution":{"observed_at":"2026-08-10T23:35:49.963477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:35:49.933817Z","title":"Hyperbolic distance-based speech sep- aration,","venue":null,"work_id":"5447df24-eaf3-4efc-9172-dc002d164f6b","year":2024},"citing_paper":{"arxiv_id":"2412.20144","last_updated":"2024-12-28T13:13:15Z","snapshot_observed_at":"2026-08-10T23:28:16.446391Z","submitted_at":"2024-12-28T13:13:15Z","title":"Distance Based Single-Channel Target Speech Extraction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T23:35:49.587873Z"},"links":{"citing_paper":"/paper/2412.20144"},"observation_digest":"sha256:46e4b0f99aa228e69afd62eea55c7524c449171872192a25598dffd3b8319105","observation_id":"a8b22d1c-bbac-4bf1-9225-a3b71ecc2b7d","resolution":{"observed_at":"2026-08-10T23:35:49.940080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:35:49.594039Z","title":"TF-GridNet: Integrating Full- and Sub-Band Modeling for Speech Separation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.20144","last_updated":"2024-12-28T13:13:15Z","snapshot_observed_at":"2026-08-10T23:28:16.446391Z","submitted_at":"2024-12-28T13:13:15Z","title":"Distance Based Single-Channel Target Speech Extraction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T23:35:49.594039Z"},"links":{"citing_paper":"/paper/2412.20144"},"observation_digest":"sha256:65dedf5ed2a378e53eda64daa378bb03e72c4285c2c8e3bda8a428f3fef8e316","observation_id":"0c605c51-521e-4d61-a00e-59b1220e31b9","resolution":{"observed_at":"2026-08-10T23:35:49.594039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:35:49.896817Z","title":"Das- former: Deep Alternating Spectrogram Transformer For Multi/Single- Channel Speech Separation,","venue":null,"work_id":"be347060-a7b8-4879-a679-45c1caa09d46","year":2023},"citing_paper":{"arxiv_id":"2412.20144","last_updated":"2024-12-28T13:13:15Z","snapshot_observed_at":"2026-08-10T23:28:16.446391Z","submitted_at":"2024-12-28T13:13:15Z","title":"Distance Based Single-Channel Target Speech Extraction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T23:35:49.599838Z"},"links":{"citing_paper":"/paper/2412.20144"},"observation_digest":"sha256:ee888b90e1e57b02e5d0cf0a50f6b82d03057ef16baebd1ad4b1e73ef84a73d5","observation_id":"fb8ae09c-ae02-4929-acf9-7094f579767d","resolution":{"observed_at":"2026-08-10T23:35:49.903606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:35:49.876248Z","title":"Dual-path rnn: efficient long sequence modeling for time-domain single-channel speech separation,","venue":null,"work_id":"0270b261-c83f-4def-bcc1-85de5052f4b2","year":2020},"citing_paper":{"arxiv_id":"2412.20144","last_updated":"2024-12-28T13:13:15Z","snapshot_observed_at":"2026-08-10T23:28:16.446391Z","submitted_at":"2024-12-28T13:13:15Z","title":"Distance Based Single-Channel Target Speech Extraction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T23:35:49.605371Z"},"links":{"citing_paper":"/paper/2412.20144"},"observation_digest":"sha256:b8d954e7962d6b04f404ec17d6e295181cbfa2bef5653e910ca910ac40a310f7","observation_id":"352ab751-1e45-49e7-87a6-c448d4ab7d24","resolution":{"observed_at":"2026-08-10T23:35:49.881767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:35:49.857860Z","title":"SDR – Half- baked or Well Done?","venue":null,"work_id":"7f703f36-0ec2-4eaa-9884-c15bbf663f9e","year":2019},"citing_paper":{"arxiv_id":"2412.20144","last_updated":"2024-12-28T13:13:15Z","snapshot_observed_at":"2026-08-10T23:28:16.446391Z","submitted_at":"2024-12-28T13:13:15Z","title":"Distance Based Single-Channel Target Speech Extraction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T23:35:49.611466Z"},"links":{"citing_paper":"/paper/2412.20144"},"observation_digest":"sha256:3859daa13d29f38d9214d579049498c0366f884a7cf0a77c7dea0d0ae67a1e7b","observation_id":"b703ddec-2200-4cff-af3b-af2773a70a83","resolution":{"observed_at":"2026-08-10T23:35:49.863622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:35:49.616706Z","title":"Soundbeam: Target sound extraction conditioned on sound- class labels and enrollment clues for increased performance and continu- ous learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.20144","last_updated":"2024-12-28T13:13:15Z","snapshot_observed_at":"2026-08-10T23:28:16.446391Z","submitted_at":"2024-12-28T13:13:15Z","title":"Distance Based Single-Channel Target Speech Extraction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T23:35:49.616706Z"},"links":{"citing_paper":"/paper/2412.20144"},"observation_digest":"sha256:a5a69f6cc012e89daf6c3c507176cea749c4a27e7629adf3bb0e85522b5b2f9f","observation_id":"0c7cd43f-e668-40ac-956a-e351f3801eac","resolution":{"observed_at":"2026-08-10T23:35:49.616706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:35:49.823817Z","title":"What’s all the fuss about free universal sound separation data?","venue":null,"work_id":"b533edc3-ebdc-4e28-a084-9adf54204b6e","year":2021},"citing_paper":{"arxiv_id":"2412.20144","last_updated":"2024-12-28T13:13:15Z","snapshot_observed_at":"2026-08-10T23:28:16.446391Z","submitted_at":"2024-12-28T13:13:15Z","title":"Distance Based Single-Channel Target Speech Extraction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T23:35:49.622685Z"},"links":{"citing_paper":"/paper/2412.20144"},"observation_digest":"sha256:633214d652ae492052cb0a95f9066b7ca9ce0cf3d51c7ad5b5b6b67a162919a4","observation_id":"c4a36b0d-9786-4d65-80df-a5e73b7f4305","resolution":{"observed_at":"2026-08-10T23:35:49.830186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:35:49.802629Z","title":"Pyroomacoustics: A Python package for audio room simulations and array processing algorithms,","venue":null,"work_id":"bdb1dfa0-7def-49c5-ba9e-01034e45659d","year":2018},"citing_paper":{"arxiv_id":"2412.20144","last_updated":"2024-12-28T13:13:15Z","snapshot_observed_at":"2026-08-10T23:28:16.446391Z","submitted_at":"2024-12-28T13:13:15Z","title":"Distance Based Single-Channel Target Speech Extraction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T23:35:49.630719Z"},"links":{"citing_paper":"/paper/2412.20144"},"observation_digest":"sha256:e7e7243f204b0153cf2edbff2cf7961aeb6b403da3256e7674e2f0b2b4995907","observation_id":"76baafef-8126-4b93-aaf5-9cbcf0b7b81a","resolution":{"observed_at":"2026-08-10T23:35:49.810050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:35:49.779186Z","title":"Building and evaluation of a real room impulse response dataset,","venue":null,"work_id":"f97dfd90-9fd7-40c8-b780-77966d5217cb","year":2019},"citing_paper":{"arxiv_id":"2412.20144","last_updated":"2024-12-28T13:13:15Z","snapshot_observed_at":"2026-08-10T23:28:16.446391Z","submitted_at":"2024-12-28T13:13:15Z","title":"Distance Based Single-Channel Target Speech Extraction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T23:35:49.635961Z"},"links":{"citing_paper":"/paper/2412.20144"},"observation_digest":"sha256:72c090300bbcb933f22bf691f4f6b54b3ab93a38221494d901fd379b7f42c686","observation_id":"bf473b54-92cb-4c3d-ac9a-4a17d7eda0c8","resolution":{"observed_at":"2026-08-10T23:35:49.786579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:35:49.641165Z","title":"Libri-light: A benchmark for asr with limited or no supervision,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.20144","last_updated":"2024-12-28T13:13:15Z","snapshot_observed_at":"2026-08-10T23:28:16.446391Z","submitted_at":"2024-12-28T13:13:15Z","title":"Distance Based Single-Channel Target Speech Extraction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T23:35:49.641165Z"},"links":{"citing_paper":"/paper/2412.20144"},"observation_digest":"sha256:78410ca1f6ccb5db2466ad368156f2fadd8f90b8ab862b584f9df9975407f6b2","observation_id":"318b128a-00b5-432f-a7bc-761e0c447a52","resolution":{"observed_at":"2026-08-10T23:35:49.641165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-10T23:35:49.647342Z","title":"Adam: A method for stochastic optimization,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.20144","last_updated":"2024-12-28T13:13:15Z","snapshot_observed_at":"2026-08-10T23:28:16.446391Z","submitted_at":"2024-12-28T13:13:15Z","title":"Distance Based Single-Channel Target Speech Extraction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T23:35:49.647342Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2412.20144"},"observation_digest":"sha256:8728d4886e747b20b4b22d1cb22bf76b1878decc1d21d332beda14d6361fe965","observation_id":"693a2811-30bc-49f8-aca6-e2d3a9b08612","resolution":{"observed_at":"2026-08-10T23:35:49.647342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.20144","last_updated":"2024-12-28T13:13:15Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-10T23:28:16.446391Z","submitted_at":"2024-12-28T13:13:15Z","title":"Distance Based Single-Channel Target Speech Extraction"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":0,"verified_fuzzy":12},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 1 inbound Pith citation observation for arXiv:2412.20144."}