{"as_of":"2026-08-09T14:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4438fc2be36d875a626ed23661602051078e6d6d2946f1f0277740bafbaeb964","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:30:35.426830Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:30:35.281047Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T00:30:35.591170Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"cited_work":{"arxiv_id":"2506.13709","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.13709","snapshot_observed_at":"2026-08-07T00:30:35.591170Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","venue":"eess.AS","work_id":"0c3b3d20-cc31-433f-bfe4-12e56c90a4bc","year":2025},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.281047Z"},"links":{"cited_paper":"/paper/2506.13709","citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:f8ba208118221e38a98945db948e3e24d9abe43d7623aff0e8551364553ce876","observation_id":"25873659-1329-428d-ba3e-1c9cb7b1f49d","resolution":{"observed_at":"2026-08-07T00:30:35.594901Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.13709/citation-record","integrity":"/paper/2506.13709/integrity","json":"/paper/2506.13709/citation-record.json","paper":"/paper/2506.13709"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.964443Z","title":null,"venue":null,"work_id":"cb4726ed-1ddd-40db-8294-095fbc5f9498","year":null},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.276157Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:85630353b4c875f22e308c420f46bce11c02ba27623288a4a5168b75c6a4663a","observation_id":"3120960a-32d8-473d-99a3-37f5ceba9f40","resolution":{"observed_at":"2026-08-07T00:30:35.968338Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"cited_work":{"arxiv_id":"2506.13709","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.13709","snapshot_observed_at":"2026-08-07T00:30:35.591170Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","venue":"eess.AS","work_id":"0c3b3d20-cc31-433f-bfe4-12e56c90a4bc","year":2025},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.281047Z"},"links":{"cited_paper":"/paper/2506.13709","citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:f8ba208118221e38a98945db948e3e24d9abe43d7623aff0e8551364553ce876","observation_id":"25873659-1329-428d-ba3e-1c9cb7b1f49d","resolution":{"observed_at":"2026-08-07T00:30:35.594901Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.943151Z","title":"Front-end processing systems We aim to test our system on speech processed by different front-end algorithms to evaluate its generalization performance","venue":null,"work_id":"0ba467a9-bc99-4121-a53d-8829ce19984b","year":null},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.289365Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:939f57a17e5aa04c30ec58cc7b48a8284eab2b5f0b28c17d6e2bd0d37394dcaf","observation_id":"f3c1f7e4-37ef-45a1-99b7-92266d5c6309","resolution":{"observed_at":"2026-08-07T00:30:35.947504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.922003Z","title":"Comparison with front-end-specific baselines We first evaluate SpeechRefiner against state-of-the-art refin- ers designed for specific front-end tasks","venue":null,"work_id":"0cd03b19-9a87-44d0-a925-30943320504f","year":null},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.297046Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:b7d73544ab674c40330a7dcc6c0f1bf381e917f8097a07e7824c60d846594989","observation_id":"6415ca1a-2130-4255-a709-6ed702329607","resolution":{"observed_at":"2026-08-07T00:30:35.925582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.911329Z","title":"Trained on data derived from a single impairment source, SpeechRefiner demonstrated re- markable generalization capabilities across a variety of unseen front-end algorithms","venue":null,"work_id":"b8777be9-9047-49ed-9833-23ad74098ddf","year":null},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.301751Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:a0d3b609c3019fc5db1adade253260c694791ef384d7dd3241ed784d235ead57","observation_id":"76a13b62-46e4-4868-a768-9ee6ecf713c1","resolution":{"observed_at":"2026-08-07T00:30:35.914745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.900916Z","title":"62401377, Shenzhen Science and Technology Program (Shenzhen Key Laboratory, Grant No","venue":null,"work_id":"5168a975-1c63-4740-afda-97623d36f2db","year":null},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.305071Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:b15bc1e9e8081769885ca0a08902e159c4f1d32bda2c658b4d1754905c223314","observation_id":"07c7a5b9-f1b0-4bf6-8827-867d43166402","resolution":{"observed_at":"2026-08-07T00:30:35.904386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.834796Z","title":"Tasnet: time-domain audio separa- tion network for real-time, single-channel speech separation,","venue":null,"work_id":"f40ea437-69f3-4e2f-9384-901f0d19a755","year":2018},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.332091Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:804a1faf5b9eac51036d15cda1e109c29e47be19594edd27083cb05e5f53328a","observation_id":"081be2da-21d3-4d40-a5c3-ec5d6d13bb86","resolution":{"observed_at":"2026-08-07T00:30:35.838325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04389","last_updated":"2024-01-09T07:21:28Z","snapshot_observed_at":"2026-07-06T17:13:08.935785Z","submitted_at":"2024-01-09T07:21:28Z","title":"RaD-Net: A Repairing and Denoising Network for Speech Signal Improvement","version":1},"cited_work":{"arxiv_id":"2401.04389","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.04389","snapshot_observed_at":"2026-08-07T00:30:35.573071Z","title":"RaD-Net: A Repairing and Denoising Network for Speech Signal Improvement","venue":"cs.SD","work_id":"3c8e3d4f-dc81-47a0-a565-11435a8ee85c","year":2024},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.335599Z"},"links":{"cited_paper":"/paper/2401.04389","citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:181ff6b5019c3b2a4f9304af7669911fedc51e0d864c3b98d584fc4ed7164eb0","observation_id":"2ee4dad0-f678-469b-be58-26c4266a8182","resolution":{"observed_at":"2026-08-07T00:30:35.580078Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.890290Z","title":"A review of multi-objective deep learning speech denoising methods,","venue":null,"work_id":"5cfad97a-b931-4bd9-b317-44dc38c037a7","year":2020},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.308832Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:db9dbeca1f5d13c30e541641cedb634ac50d383011034e2c23b926a2d5ea14df","observation_id":"f38d5ecc-5d9a-4993-bc6c-27f18e203167","resolution":{"observed_at":"2026-08-07T00:30:35.893750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.879461Z","title":null,"venue":null,"work_id":"1d9c520b-824b-4dd8-965e-cf10184e1dfb","year":2010},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.312545Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:e46745bd822fe2cc348157852f9a360584ed6ee9253d87e4844a1cc8e7f4427b","observation_id":"7100e415-0564-474e-a62b-616157fa8d05","resolution":{"observed_at":"2026-08-07T00:30:35.883567Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.868647Z","title":"Supervised speech separation based on deep learning: An overview,","venue":null,"work_id":"1e264cae-1e11-4080-9130-7e837df3ee1f","year":2018},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.316184Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:16b1772c7b6d5e6768db2ac5855b8ccfb64e6d34f83dce725a264e271e572ffc","observation_id":"bd7e8a93-ba9f-47c8-9ad4-49d2ad54bceb","resolution":{"observed_at":"2026-08-07T00:30:35.872130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.319547Z","title":"Conv-tasnet: Surpassing ideal time– frequency magnitude masking for speech separation,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.319547Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:54cf5845e3cfc1e448a2d228a3aee83e19f12ce99bedc8ea87e90716ac40dc1a","observation_id":"427fd728-a477-4958-bb9a-7d3a2d23d3bf","resolution":{"observed_at":"2026-08-07T00:30:35.319547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.323688Z","title":"Neural target speech extraction: An overview,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.323688Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:8ec6ae7322a9c24593508e43191a9eca3bdf9f388bec42dded2b9e7e09563ba5","observation_id":"5066caf9-40b3-443d-8993-2fc370f03074","resolution":{"observed_at":"2026-08-07T00:30:35.323688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.845998Z","title":"Sdr– half-baked or well done?","venue":null,"work_id":"13139f69-177e-4bf3-b22e-769e67b76163","year":2019},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.327733Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:494605aa0ec9792b49f9d89711ebad6ae11985c0e821009e3e4e6c8282921c57","observation_id":"69c547f5-d61f-47cb-810f-2539d207123a","resolution":{"observed_at":"2026-08-07T00:30:35.849068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.762590Z","title":"Miipher: A ro- bust speech restoration model integrating self-supervised speech and text representations,","venue":null,"work_id":"a9126ca5-f9ae-4cbb-9198-7af796f43b8f","year":2023},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.364737Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:aef95f5b73adf5655724b5ac761d6779db87d609dc564d08531e16cb096b5a4a","observation_id":"113ceae6-6f4d-47ca-b0f3-92e6d5cb5700","resolution":{"observed_at":"2026-08-07T00:30:35.766162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.932133Z","title":null,"venue":null,"work_id":"aba97d7a-5cd0-4d42-9932-7ffe1020a85b","year":2024},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.293473Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:1214198dd5f4e5ef06b9f614e3e360fe80c5f9fd49d10716d847ec07694da903","observation_id":"28195c6e-c597-49b0-827a-6a3dff56e6ec","resolution":{"observed_at":"2026-08-07T00:30:35.935545Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.823410Z","title":"Rad-net 2: A causal two-stage repairing and denois- ing speech enhancement network with knowledge distillation and complex axial self-attention,","venue":null,"work_id":"5c9cfecb-d062-4017-9741-69d81dbc7bbd","year":2024},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.339872Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:7dd6fc0accda05639125e21d90996ab118a1b190b24156fddcb6df269ebefbb4","observation_id":"dc0bb4f1-196b-4332-85c9-ed64ddb6306e","resolution":{"observed_at":"2026-08-07T00:30:35.827454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.813402Z","title":"Autoprep: An automatic preprocessing framework for in-the-wild speech data,","venue":null,"work_id":"b03c9d61-e904-4985-8d67-4bde091bdad2","year":2024},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.344688Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:68e3c2021dc45da14cf6ae531be2d662ee88ecdaca2c680ae05a3aede2bc8f7a","observation_id":"b0a846e2-ae79-43f4-907c-93998380c44d","resolution":{"observed_at":"2026-08-07T00:30:35.816983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.803102Z","title":"Wenetspeech4tts: A 12,800-hour mandarin tts corpus for large speech generation model bench- mark,","venue":null,"work_id":"96703f71-75cb-4bf4-82cc-e90a8939d8c8","year":2024},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.349118Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:b608c0de2a9160dc1552b4b78f812530b2278c8db955cb2c86cd6ac7e2c6f631","observation_id":"d5bfa731-0b0b-4551-a87c-ef16969fa8e3","resolution":{"observed_at":"2026-08-07T00:30:35.806822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.793632Z","title":"Dnsmos: A non-intrusive perceptual objective speech quality metric to evaluate noise sup- pressors,","venue":null,"work_id":"38b3a23e-735d-49b2-a16f-e35d398c73da","year":2021},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.352334Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:9044eb737183802347db722e75389f00f677097c7e5de064d66e5d343f75fb8a","observation_id":"e943fbdb-ae53-4ca4-8124-64383fa87f3e","resolution":{"observed_at":"2026-08-07T00:30:35.796789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.954166Z","title":"The loss function for CFM is expressed as: LCF M(θ) =Et,q(x1),pt(x|x1)∥vt(x; θ) − ut(x|x1)∥2","venue":null,"work_id":"5816904c-3a51-46ed-9207-d9903d1bd610","year":null},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.285222Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:6087017e9587f3218f10f02617ade0160a39cf149886bf1e498b57ca12edea87","observation_id":"d725084a-67dd-471b-8d38-892849f9010a","resolution":{"observed_at":"2026-08-07T00:30:35.957835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.782822Z","title":"Icassp 2024 speech signal improvement challenge,","venue":null,"work_id":"9ffa163f-ff02-439c-b1d9-4aaf7387cc71","year":2024},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.356797Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:1546f324461d9d661709d3efe299416d233ac0e0edeca11977a60f4345a73567","observation_id":"800260f2-3466-48b1-9ba7-f4def1cb0620","resolution":{"observed_at":"2026-08-07T00:30:35.786578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.772474Z","title":"V oicefixer: A unified framework for high-fidelity speech restoration,","venue":null,"work_id":"3e10f468-f818-440a-b2f9-9ea678da3a85","year":2022},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.361468Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:7c724b68508ff5ddba12acf6df472408c6c73591e26a3fcd3048908f2f944bf4","observation_id":"0a5aa18f-4749-49fb-b9ae-6f30523ca017","resolution":{"observed_at":"2026-08-07T00:30:35.775888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.752264Z","title":"Storm: A diffusion-based stochastic regeneration model for speech en- hancement and dereverberation,","venue":null,"work_id":"5510c8a2-3a69-461f-8779-f9114e97f1b4","year":2023},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.367978Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:0db49da52d4aa69f21b09f4bb2d248f3e37e21a68d79e3e82a57c0e840d3cdad","observation_id":"f39bf6c4-9d03-4ad1-a38f-72dba3cb89cf","resolution":{"observed_at":"2026-08-07T00:30:35.755883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.742000Z","title":"Diffiner: A versatile diffusion-based generative refiner for speech enhancement,","venue":null,"work_id":"03a5a52d-65db-4ef6-a9d8-da9fc027f4aa","year":2023},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.371862Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:82d02e7886e2e8d098755aae0ce1944b1c767853be92c9d02c1116984e3168cf","observation_id":"d4edd344-60fe-4b47-b743-999271f0b6a7","resolution":{"observed_at":"2026-08-07T00:30:35.745254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.375508Z","title":"Diffusion-based signal refiner for speech separation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.375508Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:4e241a1ce32b487b79e9950d373c6901cf93d30a62856d27c0abc414097ad365","observation_id":"5c4a6b26-d17d-449a-8e9a-a4a1807bf45f","resolution":{"observed_at":"2026-08-07T00:30:35.375508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.731501Z","title":"Separate and diffuse: Us- ing a pretrained diffusion model for better source separation,","venue":null,"work_id":"c6fcb813-e225-4216-bbe3-2848a5f0ae91","year":2024},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.378328Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:d10c660784caa4df50cdd6ccf2ab0824218255fe37280292ba0863925af55b70","observation_id":"0b746e96-9e27-47c8-a69f-525b0cd203de","resolution":{"observed_at":"2026-08-07T00:30:35.735341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.717502Z","title":"Noise-robust speech separation with fast generative correction,","venue":null,"work_id":"3343604d-19aa-4f1f-a37a-3eb6127d2353","year":2024},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.381627Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:3f1c37785eb0539c523be8e12f4bd4ae515bb9ba45e1a476a375880cebbd940f","observation_id":"22270425-893b-4e09-b595-059f8b62e0f0","resolution":{"observed_at":"2026-08-07T00:30:35.722357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.705333Z","title":"Flow matching for generative modeling,","venue":null,"work_id":"0d9007b3-3346-4514-a1a0-2e30c724e373","year":2023},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.384769Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:2247b01f52a6fc64d6976eb7157d2e7cb8f359026110708987118346b87a1f89","observation_id":"fa2f77af-d0e8-4450-af09-406ee421086b","resolution":{"observed_at":"2026-08-07T00:30:35.709089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.693074Z","title":"Conformer: Convolution- augmented transformer for speech recognition,","venue":null,"work_id":"ff553071-3e86-4526-a4ca-f8a539156449","year":2020},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.387604Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:31141b378529fb7ba1525fe5caa3960d2018b00ffe5c89d1b4e4e60adaf6f3c5","observation_id":"9b942e08-405c-4724-8954-c0ca87c3e087","resolution":{"observed_at":"2026-08-07T00:30:35.697056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.680675Z","title":"Roformer: Enhanced transformer with rotary position embedding,","venue":null,"work_id":"5b1e17b5-34f8-4a35-ae22-75afaabd5f3d","year":2024},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.390801Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:5cfbee1a7ec2ed0dd50cd5c9591ecc5d07c4b8c4e7cf0a5ddd3859af1ae038ef","observation_id":"e9fb4313-6eb4-4c8e-a388-15a34005b87b","resolution":{"observed_at":"2026-08-07T00:30:35.684682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.668993Z","title":"Train short, test long: At- tention with linear biases enables input length extrapolation,","venue":null,"work_id":"dcc45b16-9ce1-4e2a-91f1-cf0cc0f1bd5e","year":2022},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.393525Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:d34ac4ade1e62fb73bf29e90063214a91fc4445a2b5ebe30ada9f09273dd9de0","observation_id":"1a3f87aa-b495-45fa-86c1-6831b5da1c8a","resolution":{"observed_at":"2026-08-07T00:30:35.672832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00814","last_updated":"2024-05-29T14:21:47Z","snapshot_observed_at":"2026-08-08T02:04:12.090464Z","submitted_at":"2023-06-01T15:40:32Z","title":"Vocos: Closing the gap between time-domain and Fourier-based neural vocoders for high-quality audio synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00814","snapshot_observed_at":"2026-08-07T00:30:35.396683Z","title":"V ocos: Closing the gap between time-domain and fourier-based neural vocoders for high-quality audio synthesis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.396683Z"},"links":{"cited_paper":"/paper/2306.00814","citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:517ae211cd6631b914226886670cf543963038d8a2ab7f8b7dbc50d180bd0978","observation_id":"513f7c56-5181-4066-ab7d-01fffc8e987d","resolution":{"observed_at":"2026-08-07T00:30:35.396683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.658030Z","title":"Conditional diffusion probabilistic model for speech en- hancement,","venue":null,"work_id":"fc8aa2ac-05b1-450f-a4b1-efa3c0b94a50","year":2022},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.400718Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:6849ad878f1a7fdeab7e8dd4946a28e2caeec7a7827ae32f746a76a1b9c16106","observation_id":"48f2fc4d-5211-4c85-a933-16213b3d393f","resolution":{"observed_at":"2026-08-07T00:30:35.662060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.403803Z","title":"Investigating rnn-based speech enhancement methods for noise- robust text-to-speech","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.403803Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:0ece4c97f07076a48e7c6655d865a973eb7b2c045801e67a5908b945fb2d0212","observation_id":"1ed69ef0-491a-41c1-be2f-a1a6b1f1a322","resolution":{"observed_at":"2026-08-07T00:30:35.403803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.640293Z","title":"Speech enhancement and dereverberation with diffusion-based generative models,","venue":null,"work_id":"2fb6056a-962d-4cc5-a91c-49e0135e24ad","year":2023},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.406705Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:29c98ca44613c463fb06fd3fc077629e7ce148b2aca4b41e2ad502615f6b62c5","observation_id":"de3a22f9-3b71-4b70-a7e4-5e37da78bb46","resolution":{"observed_at":"2026-08-07T00:30:35.643733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.629845Z","title":"Attention is all you need in speech separation,","venue":null,"work_id":"537fa161-eee8-462e-9954-35f75cf30a92","year":2021},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.409804Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:b37683e2a4cbe05cffe89b5cf7f5b90be7d11f32f2829478f15a31a46f4b7a36","observation_id":"64c6161a-cf9d-4d0b-bc16-aa0da80e4d35","resolution":{"observed_at":"2026-08-07T00:30:35.633290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.11262","last_updated":"2020-05-22T16:26:54Z","snapshot_observed_at":"2026-08-04T10:15:33.124350Z","submitted_at":"2020-05-22T16:26:54Z","title":"LibriMix: An Open-Source Dataset for Generalizable Speech Separation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.11262","snapshot_observed_at":"2026-08-07T00:30:35.412898Z","title":"Librimix: An open-source dataset for generalizable speech separation,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.412898Z"},"links":{"cited_paper":"/paper/2005.11262","citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:549e410c236868aebbceb92209d17e1b10ad35561e41575893becca1f1595fb7","observation_id":"e503fbd7-3814-4625-8716-bed84fe69c16","resolution":{"observed_at":"2026-08-07T00:30:35.412898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.619945Z","title":"Spex+: A complete time domain speaker extraction network,","venue":null,"work_id":"4300cd81-78a2-4dde-996f-6fe2eaa54cc9","year":2020},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.417269Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:eb1ce93a8a3405b8bd738276c667e01b330aa2b93d34b8aa9537c5557e161a3b","observation_id":"ac869582-0f68-4170-9792-971b4a90ed2a","resolution":{"observed_at":"2026-08-07T00:30:35.623164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.609210Z","title":"Muse: Multi-modal target speaker extraction with visual cues,","venue":null,"work_id":"5c42a2f0-a7c5-47b8-ad6d-ca6ed9faac4d","year":2021},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.420551Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:db6f6f4b3bd48e51d229cf5c5cf14b236b750d1bac15e08d24fd85b14b26163e","observation_id":"c92fd0b3-2d4b-4622-beaf-06f6b1347b7b","resolution":{"observed_at":"2026-08-07T00:30:35.612754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18802","last_updated":"2023-05-30T07:30:21Z","snapshot_observed_at":"2026-07-06T15:35:15.564727Z","submitted_at":"2023-05-30T07:30:21Z","title":"LibriTTS-R: A Restored Multi-Speaker Text-to-Speech Corpus","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18802","snapshot_observed_at":"2026-08-07T00:30:35.423748Z","title":"Libritts-r: A restored multi-speaker text-to-speech corpus,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.423748Z"},"links":{"cited_paper":"/paper/2305.18802","citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:0e8bb4128c9660ab4043335685f44e5a0fa5ce7ce51de003c6b0e4a44612c8b6","observation_id":"34b1ff22-ef2d-433a-89ec-88726927f0d8","resolution":{"observed_at":"2026-08-07T00:30:35.423748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:30:35.426830Z","title":"Grad-tts: A diffusion probabilistic model for text-to-speech,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:35.426830Z"},"links":{"citing_paper":"/paper/2506.13709"},"observation_digest":"sha256:ca984f592ba9f9d99e12ae7604fe712169b9874985acb73924a489fc765c8e1e","observation_id":"f7c708e0-ec04-4340-8da6-ec9c8050da49","resolution":{"observed_at":"2026-08-07T00:30:35.426830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.13709","last_updated":"2025-06-16T17:19:04Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-09T13:59:40.461155Z","submitted_at":"2025-06-16T17:19:04Z","title":"SpeechRefiner: Towards Perceptual Quality Refinement for Front-End Algorithms"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":2,"verified_fuzzy":29},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 1 inbound Pith citation observation for arXiv:2506.13709."}