{"as_of":"2026-08-07T08:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bce9e85efe6823960bbf6a203a2b06676a00865745b0af9c86b1897dfc8bd6c8","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T04:15:55.752679Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T04:15:55.752679Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.11630","snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"Tasks related to separation of vocal signals SE and SVS can both be formulated as vocal signal separation prob- lems","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"cited_paper":"/paper/2607.11630","citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:6f67c741c67d59dc16f15789d14039ec8da578bdc533cb7eb0e24901f9065f8c","observation_id":"a741e0e3-71d4-4356-8a6a-8ed0288d2b0a","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.11630/citation-record","integrity":"/paper/2607.11630/integrity","json":"/paper/2607.11630/citation-record.json","paper":"/paper/2607.11630"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"Interactive Audiovisual Digital Twins of Performance Venues","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:d8223726841e8feda59f64f50cf835715720589b436b0865778338aef4f0c4ce","observation_id":"0afe5fdd-1714-4a9f-96a4-809daecddcbc","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.11630","snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"Tasks related to separation of vocal signals SE and SVS can both be formulated as vocal signal separation prob- lems","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"cited_paper":"/paper/2607.11630","citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:6f67c741c67d59dc16f15789d14039ec8da578bdc533cb7eb0e24901f9065f8c","observation_id":"a741e0e3-71d4-4356-8a6a-8ed0288d2b0a","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"Full fine-tuning With full fine-tuning all parameters of the pretrained SE model are updated during SVS training","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:a88e0ad6d6338ea7772de3cce2af4e660beafd30df45150d5c9d8584208fd9c8","observation_id":"82298051-0556-4be9-9cc8-c6234c878a44","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"Pretraining and adaptation All models in this work operate at a sampling rate of48 kHzand are initialized from pretrained checkpoints","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:568197f89a02e04f86aabcbcbc66a22ec9cd371d1af58fbf1cc702782493eb0a","observation_id":"9beebe45-b5a8-4da2-9d9a-ea8188f0c59e","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"The SGM, which utilizes a noise-conditional score network (NCSN++) [22] as its backbone, was pretrained for SE on the EARS-WHAM dataset [23] (approx.87 h)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:c4dc64da78e7a6e0a0902574f0e92aa3127d991c1a40e42f0a4fe67354a0dbed","observation_id":"104ef5cf-f3c8-458a-8cce-bf3fe5be53fe","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"from scratch","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:4613d02b2a337055120d9ce7fb97698f572bef444fac1c63b5de9400f2e6623a","observation_id":"1942b4a6-2258-4d32-b214-d2717e6b1963","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"While full fine-tuning achieves the best SVS performance, our results show that LoRA enables domain adaptation while preserving the original model capabilities","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:0a813a7f458bfb1ba53f3409afb3ed61d8ab8206a39d6a2afbc155c1f08edfb8","observation_id":"ecec330c-f292-4116-8417-c74c1ef3dcac","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"INTERSPEECH 2021 deep noise suppression challenge,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:544ac3150b81ffddbbc8d98331a661241b38c5c763b8372ab2f6e8541d86d2b0","observation_id":"4c5e8c2e-6bba-49ea-8f5d-15befad2f5d9","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"ICASSP 2022 deep noise suppression challenge,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:07a1d5314d5067b922aedf0ffe0d9e791d1b1938541024e29e1d6ef2af807c5c","observation_id":"da0f9293-1f63-4442-aed1-af5aa45a6746","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"ICASSP 2023 deep noise suppression challenge,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:bc0ba2466e973d2f64479e5b9328a3503b536bdadac0bd9968cefcaeaee3fa9b","observation_id":"4474c44a-4327-4cd3-997d-a0a02280ef59","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"URGENT challenge: Universality, robustness, and generalizability for speech en- hancement,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:842fff03e2d3a83ce1629fa9460dbc3ba886db6055ff7be4ef64b7e33d6d69ed","observation_id":"fceb123f-e7bc-4d9f-93d7-c5668c71c019","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"Speech enhancement and dereverberation with diffusion-based gen- erative models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:aaddccdd01cd50ba0d6fdc866283f0c0c377d2c814606dec09aacec39d98abaf","observation_id":"e1d4e112-15d8-4046-a1df-3c1d429a2f80","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"StoRM: A diffusion-based stochastic regeneration model for speech enhance- ment and dereverberation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:5cb817c7113e612d6132bde1952b8b07f2ec797c4be2bbb1e140bf76ac0b0bf6","observation_id":"d9138df4-2fdc-4057-b71e-9295cf4294f8","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"Universal score- based speech enhancement with high content preservation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:1711e30a1e4264ec4af130d2921a95e8ee4d621c2f7a42f4803b49e03fd73ed4","observation_id":"88d486f0-c140-447f-bf1e-29577ee82c4e","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"Diffusion-based signal refiner for speech enhancement and separa- tion,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:c2cdfdf6bf4e143f02361a41ecfca6dcb16ea99691057ab38d9c44ac84a0253b","observation_id":"c4c21d0e-358c-4aec-8269-d60d1afd6bfb","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"The MUSDB18 corpus for music separation,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:6401292b457d220e096df6246c41b68b05e838c2a8f89f36aa17a50e08f9aa60","observation_id":"a87fc1f7-b28b-4d0d-b4c4-3c5b5e758271","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"MoisesDB: A dataset for source separation beyond 4-stems,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:284fd14e203cfc005ae7bc69920aac3beaf2287fb38f905317048450afbeef40","observation_id":"548d57f5-8fe9-4b38-8004-1e818303ffa4","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"High fidelity speech enhancement with band-split RNN,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:8fac80ce7211a25acd61f0da412e60ae37e865cb164fd9e00303524f9ddb36cc","observation_id":"bf0cdf9a-fdae-4920-832b-abc098e6d83a","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"Music source separation with band-split RNN,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:3cc6cbc882ff416ffd0ad201cc8e591d42aeb7a512091e2fb60c3b6b29682392","observation_id":"97d50998-865e-4df1-ae34-7b320b314446","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"Towards reliable objective evaluation metrics for generative singing voice sepa- ration models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:96082ab3564bcbdb998151c06ebcfaca557e20df2b89e8095c474c323be12045","observation_id":"ff03bd4b-ae43-494e-936f-ef8369f5e8be","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"Diff-VS: Efficient audio-aware diffusion u-net for vocals separation,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:42c734e3b290f657fa07dfa3fb69dda36133e21086dc9f5781aca6fc44195f21","observation_id":"58601b24-6f13-455b-a5b4-057e57401fa6","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"Music source restora- tion,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:d9b2b713c267af12500ca3c8112286e4608beecb7887e1d2d818821c9dfa8d41","observation_id":"edd4ceb4-9a5f-4677-a528-40c97128c7f5","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"Overcoming catastrophic forgetting in neural networks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:9a6ff446dd02ca7e448d6cda5851c1c57b13f24a60c5c508d1f68fd4a07072e3","observation_id":"1ad52ee8-51ac-46af-b26c-1731d0918f26","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"SERIL: Noise adaptive speech enhancement using regularization-based incre- mental learning,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:2b9e6fc90197a2a2697d13e0f818718afb42e2f9e35c4d1b205d5e8304341061","observation_id":"23a09c2e-f0ea-4667-a604-86100de87990","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"LoRA: Low-rank adaptation of large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:cf1d80fc25c3f25c76aae16c30f4aec3d61e61cf2d9a9ece0fe508f68e7cbfc1","observation_id":"43b71d03-d34b-432f-87ab-d57eb2d330dc","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"Parameter- efficient transfer learning of audio spectrogram transformers,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:74b363e53fffbf09670dc06cc05c597ab9b7e4c1055e1b6b636341be990874ae","observation_id":"56b44a23-97ec-4b6e-9e0a-29ffcc1ab5b9","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"Improving anomalous sound detection via low-rank adaptation fine- tuning of pre-trained audio models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:5bd0a4b342faba9ccc7a507c2fc359ae0fb87eb244962686d7c4298057d5e0d3","observation_id":"45a48e11-c050-4a55-96f1-5681d73f10ef","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"Mel-band-roformer-vocal-model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:7fa9a36b6e0cc6e65a5b91ed3e92fb8f2aae1e95440ee3e6e0639fce46b0959e","observation_id":"f3d3ecfc-cade-482f-a8b1-6f73da1ecd2f","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"Score-based generative modeling through stochastic differential equations,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:bd84236984cb43e1a8bd23df11e47315ad4266b36ddb6523a7a2bfa04f57e11f","observation_id":"3e8cb96f-ce30-4d58-a659-f7db688a16de","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"EARS: An anechoic fullband speech dataset benchmarked for speech enhancement and dereverberation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:c40ee6d0a6ca61a67f6aab2f6eb3072eceb60edbc4c6b2575fe24e5a3cff7d80","observation_id":"9ddf2be8-32f4-4714-8b88-68c1c5320f2c","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"MSRBench: A benchmarking dataset for music source restoration,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:2908c27430f68e78eedfc11b81add5e41231f5a4d663348d9462e33c5fa191db","observation_id":"a714549f-4d88-4be3-8464-d672434e240a","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"EBU R 128: Loudness normalisation and permitted maximum level of audio signals,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:6c364ed96944f2d0cf246354b7d7b855bf847843e340aff88378a395ac142da4","observation_id":"1861a3bb-29df-4a8a-b9f0-e3569fcaab11","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"Generative modeling by estimating gradients of the data distribution,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:156e93ef6dff515cd719b2526624f61842b403e19b387b87785f4850994bf894","observation_id":"25baf78e-ef1a-412d-91c3-e786aa233765","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"PEFT: State-of-the-art parameter-efficient fine- tuning methods,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:d33738a5ade7649305228065df37c55c56f117da3b36e0cc41db1f919343a408","observation_id":"5929d63f-5b52-4de8-8487-2f741987b688","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"Delving deep into rectifiers: Sur- passing human-level performance on imagenet classification,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:c13ba0aee9c9c4fa002377c028a87a957a07a76d2ae7bbff8dbedb0067acd5cd","observation_id":"0ef97e39-e7b1-43b5-bd39-1cae8cfee359","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"Performance measurement in blind audio source separation,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:bf613077ee9a7e116be0644aa7ff308e2c8f14e665303bac18d922824bee449d","observation_id":"e7c35e37-7596-4aa7-bcba-a248c1f3f6d0","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"TorchMetrics - measuring reproducibility in PyTorch,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:9ea09843e1d49f25b6dd9203d1a878959f5ad9709da4956a70e59b1c4c08ea38","observation_id":"52c31c02-a711-4654-936f-6fed72920180","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"MERT: Acous- tic music understanding model with large-scale self-supervised train- ing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:f2bb35f1c1f6cb8297c44efdebc1222a311c23b1cfe22dfc0f9c7a2c13a0c691","observation_id":"066213b2-69f4-4506-a21c-5dccd42b0bfc","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"auraloss: Audio focused loss functions in PyTorch,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:395e4b8ffa51e0e9d5598ab5dde26abfac1a29172805b9abce09efe8fabbde4a","observation_id":"c8f71c21-3886-42a8-be90-d73134c7e33f","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"Embedding-based intrusive evaluation metrics for musical source separation using MERT representations,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:aba5b7a206696a455bf494fa3f1fd7b94c0784d5dfb02ea5c9c26d5ac8deaac7","observation_id":"21056434-f1a2-4b4c-ab62-0f090cbbf0a8","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"SDR – Half- baked or well done?","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:bb67c152729297a7d1fa14a7e7abcae81b8f017fb41c057dc1c8ba07b30f8e44","observation_id":"50953a67-6f17-486c-b51b-075baa9ceddd","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"Perceptual evaluation of speech quality (pesq)-a new method for speech quality assessment of telephone networks and codecs,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:2aea0e9e1da6fd1b5e7a973005aa836fe4af426dfd289322e405c6b801bef415","observation_id":"74dd1257-64b8-4722-a0f2-288ba9dcec46","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"Distillation and pruning for scalable self- supervised representation-based speech quality assessment,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:5d449608350c6a3114fa92a9330df15a48334264c515fa9515ec26387e8ff5e8","observation_id":"d48a0466-8710-46ed-b4b2-622f6bf62a2c","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"Mel-RoFormer for vocal separa- tion and vocal melody transcription,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:2f9dbb83864d7eed2eea9acf44b1249e71b0a795e29ca5ee5124018e104968d2","observation_id":"5e9475b8-0c10-456f-971e-ca7acfb6f5e3","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T04:15:55.752679Z","title":"ptflops: A flops counting tool for neural networks in pytorch framework,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-14T04:15:55.752679Z"},"links":{"citing_paper":"/paper/2607.11630"},"observation_digest":"sha256:84d0ffb4934d4a8884acc288ea789cbac68bbbf405720ac58158a0d6b5823487","observation_id":"659ba9bf-fb80-4388-9367-80345d891cb7","resolution":{"observed_at":"2026-07-14T04:15:55.752679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.11630","last_updated":"2026-07-13T14:48:09Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-02T14:12:55.304061Z","submitted_at":"2026-07-13T14:48:09Z","title":"Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":44,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 1 inbound Pith citation observation for arXiv:2607.11630."}