{"as_of":"2026-08-08T00:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b2b58cb5613813cdb4317db414d8e3ad64c150e15584e75930ee3a5148ddd0b2","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:18:27.425864Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:18:22.773602Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T22:07:46.554247Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19476","snapshot_observed_at":"2026-08-07T14:18:22.773602Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:22.773602Z"},"links":{"cited_paper":"/paper/2505.19476","citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:4497bbf69e945d7aadffde59d780e7c642000b96807e983dbca304137511e054","observation_id":"d3c57126-7014-42bc-bd8b-c6ad76c16477","resolution":{"observed_at":"2026-08-07T14:18:22.773602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"cited_work":{"arxiv_id":"2505.19476","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.19476","snapshot_observed_at":"2026-08-05T22:07:46.554247Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","venue":"eess.AS","work_id":"d2ca90b0-0061-4625-beea-7ec5c2fc1163","year":2025},"citing_paper":{"arxiv_id":"2508.07558","last_updated":"2025-08-11T02:35:54Z","snapshot_observed_at":"2026-08-07T18:33:16.287011Z","submitted_at":"2025-08-11T02:35:54Z","title":"UniFlow: Unifying Speech Front-End Tasks via Continuous Generative Modeling","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-05T22:07:46.322930Z"},"links":{"cited_paper":"/paper/2505.19476","citing_paper":"/paper/2508.07558"},"observation_digest":"sha256:b7a73297015bfa20ef8179bef9d7ed107aefecea36f45c6bcfc489efaf21ce8b","observation_id":"3da803c5-b39b-4804-abdf-80c69241abce","resolution":{"observed_at":"2026-08-05T22:07:46.567077Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19476","snapshot_observed_at":"2026-07-14T06:37:05.257817Z","title":"Flowse: Efficient and high-quality speech enhancement via flow matching,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11157","last_updated":"2026-07-13T06:51:12Z","snapshot_observed_at":"2026-07-30T05:02:25.925930Z","submitted_at":"2026-07-13T06:51:12Z","title":"Where Speech Enhancement Hurts Recognition: An Inference Time Polar Projection Diagnosis","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-14T06:37:05.257817Z"},"links":{"cited_paper":"/paper/2505.19476","citing_paper":"/paper/2607.11157"},"observation_digest":"sha256:ee368fff70f8c5f63ce2a0c226138a01a8c97abb63501d8727f9b5fed7aa8ac0","observation_id":"e11eb73e-e443-4743-8752-51a8c564cf2f","resolution":{"observed_at":"2026-07-14T06:37:05.257817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.19476/citation-record","integrity":"/paper/2505.19476/integrity","json":"/paper/2505.19476/citation-record.json","paper":"/paper/2505.19476"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:31.611997Z","title":"While traditional deterministic methods can attenuate noise, they often struggle to preserve speech naturalness under challenging conditions","venue":null,"work_id":"20c95dd4-cda5-4c76-9b06-4e6fbf1010bd","year":null},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:22.616326Z"},"links":{"citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:2009de9220752164edd7cc1a257c0a4c6ae2d642f5a8caf8149e773ce1505bb5","observation_id":"72f0b7ad-39c2-4fee-8365-6f90721b9f18","resolution":{"observed_at":"2026-08-07T14:18:31.727552Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19476","snapshot_observed_at":"2026-08-07T14:18:22.773602Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:22.773602Z"},"links":{"cited_paper":"/paper/2505.19476","citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:4497bbf69e945d7aadffde59d780e7c642000b96807e983dbca304137511e054","observation_id":"d3c57126-7014-42bc-bd8b-c6ad76c16477","resolution":{"observed_at":"2026-08-07T14:18:22.773602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:31.224698Z","title":null,"venue":null,"work_id":"d11a4e19-e468-47e7-b2f7-771d4de010ee","year":null},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:22.867091Z"},"links":{"citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:d1f284513a45cfc7eff9cf91db32ead94566156ac83b5f27b998b3cee442b2cd","observation_id":"c54903ab-cd38-4140-a1dd-cb600ee18c8c","resolution":{"observed_at":"2026-08-07T14:18:31.380858Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3920.9413","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:27.727247Z","title":null,"venue":null,"work_id":"1ea30eba-8b1c-410f-9b5c-73e7d78a538b","year":2021},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:23.032110Z"},"links":{"citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:e00d7c8f828c6f8f53d8ce1c885311ffe61ffc158e9695a87b2b2812471e82f5","observation_id":"b24cb30b-0885-4c31-a478-a6dd0cde626b","resolution":{"observed_at":"2026-08-07T14:18:27.788680Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:30.976469Z","title":"FlowSE efficiently reconstructs high-quality speech while preserving speaker characteristics, achieving state-of-the-art performance","venue":null,"work_id":"38df53d3-356d-43f4-be93-05304b0ed3d9","year":null},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:23.133661Z"},"links":{"citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:b7caa6e51f1391cbc8a112a4e27627393f2aac4104dbd20120698bb8c465819c","observation_id":"e6d835f3-bc02-400a-8745-343049d7a156","resolution":{"observed_at":"2026-08-07T14:18:31.071123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:30.752879Z","title":"Selm: Speech enhancement using discrete tokens and language models,","venue":null,"work_id":"24d8e552-20be-4627-a7a9-7e5af1cfec18","year":2024},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:23.265036Z"},"links":{"citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:a26009ca67cfad852619d509d6140cca5e4facd6e51191a077131f0a03ea2636","observation_id":"9ffffae6-8ab1-4c07-a29f-6c74a456897f","resolution":{"observed_at":"2026-08-07T14:18:30.840498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02092","last_updated":"2024-06-04T08:23:57Z","snapshot_observed_at":"2026-08-04T07:15:53.208003Z","submitted_at":"2024-06-04T08:23:57Z","title":"MaskSR: Masked Language Model for Full-band Speech Restoration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02092","snapshot_observed_at":"2026-08-07T14:18:23.335398Z","title":"Masksr: Masked language model for full-band speech restoration,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:23.335398Z"},"links":{"cited_paper":"/paper/2406.02092","citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:32038cc6c14220ec6f285f5021795bcaccb4cb9f36b11b1672871b7f541b66b5","observation_id":"9779de21-5c3f-4fac-b15c-a4a13eee7079","resolution":{"observed_at":"2026-08-07T14:18:23.335398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:23.481815Z","title":"Neural discrete represen- tation learning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:23.481815Z"},"links":{"citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:79126ac43845b8ba18c82ad1140310b5e4707b3567089bd254339035754ced20","observation_id":"8576a88e-b602-4b15-b470-bc5ea21e5d57","resolution":{"observed_at":"2026-08-07T14:18:23.481815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:23.544542Z","title":"Soundstream: An end-to-end neural audio codec,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:23.544542Z"},"links":{"citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:640f524d311e6c14141002b8933fa2bd46d46a610ac2693cbccc272e78fbdfd9","observation_id":"e5f113c1-d76b-403b-9bfc-7a476c7fd1ef","resolution":{"observed_at":"2026-08-07T14:18:23.544542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.13438","last_updated":"2022-10-24T17:52:02Z","snapshot_observed_at":"2026-08-03T16:47:47.192907Z","submitted_at":"2022-10-24T17:52:02Z","title":"High Fidelity Neural Audio Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.13438","snapshot_observed_at":"2026-08-07T14:18:23.671668Z","title":"High fidelity neural audio compression,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:23.671668Z"},"links":{"cited_paper":"/paper/2210.13438","citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:c8099bc11092ecc7aca5171639a52e9b4d8d94e351ba4dc70a5957c26a22fd00","observation_id":"92165fc9-2425-4121-8aa9-3ab060f6b295","resolution":{"observed_at":"2026-08-07T14:18:23.671668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:30.485197Z","title":"Conditional diffusion probabilistic model for speech en- hancement,","venue":null,"work_id":"8f3ada4c-528f-4467-bbca-bbfc75a0aa56","year":2022},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:23.764142Z"},"links":{"citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:b041d38e040710a09c9e2f3e07b76ba4f51fd402b8b2737717e968125ca92178","observation_id":"8abacfba-94ed-4e49-83f4-2651a89b2c49","resolution":{"observed_at":"2026-08-07T14:18:30.608370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17004","last_updated":"2022-07-07T16:12:45Z","snapshot_observed_at":"2026-08-05T09:14:41.106005Z","submitted_at":"2022-03-31T12:53:47Z","title":"Speech Enhancement with Score-Based Generative Models in the Complex STFT Domain","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17004","snapshot_observed_at":"2026-08-07T14:18:23.918183Z","title":"Speech enhancement with score-based generative models in the complex stft domain,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:23.918183Z"},"links":{"cited_paper":"/paper/2203.17004","citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:4304ae743a9765f51c10779db6568bfc774588c96910d8aa9232aff5f258f5a2","observation_id":"11337c80-67ae-46e7-9bff-f5351cc5c7fb","resolution":{"observed_at":"2026-08-07T14:18:23.918183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:30.226930Z","title":"Storm: A diffusion-based stochastic regeneration model for speech en- hancement and dereverberation,","venue":null,"work_id":"c08d1025-b56e-4641-9b79-90cd181efd58","year":2023},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:24.057227Z"},"links":{"citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:4fd530537f6330fc668b0a90caa959996bcc3b1b77fdbf6699d1d22263251cfd","observation_id":"e2e27ef2-878e-4ef5-bbd7-71b08b55e08e","resolution":{"observed_at":"2026-08-07T14:18:30.329126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:24.177611Z","title":"Flow matching for generative modeling,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:24.177611Z"},"links":{"citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:a43943d47533c6afb2cb41bc73da06e57e9bb6a506b8e56b0e0bafc01f42f1e5","observation_id":"3b581676-f7b3-422d-9ac8-0478704123e1","resolution":{"observed_at":"2026-08-07T14:18:24.177611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:29.694226Z","title":"Flowsep: Language-queried sound separation with rectified flow matching,","venue":null,"work_id":"f4a89647-f7f8-4c73-b958-cc190097f12c","year":2025},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:25.155639Z"},"links":{"citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:7cd163acf8c79880e0051fd55830f59869edc75993042b4185694f8e3e4bfae9","observation_id":"2e2c3ca4-f4e5-419b-9004-c7970e3bf3c0","resolution":{"observed_at":"2026-08-07T14:18:29.747269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:24.466351Z","title":"Matcha-tts: A fast tts architecture with conditional flow match- ing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:24.466351Z"},"links":{"citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:026702244390c16bffeec54bac3b3ac9ab74c28e331a2d207c302dcf238a00b9","observation_id":"7612924a-f519-408b-b576-cd57f592e10c","resolution":{"observed_at":"2026-08-07T14:18:24.466351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:29.968334Z","title":"E2 tts: Embarrassingly easy fully non-autoregressive zero-shot tts,","venue":null,"work_id":"87d42de6-f7fc-4699-a1df-01512bd50dc4","year":2024},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:24.585946Z"},"links":{"citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:7b56b4ee427f5c499fe53d2db9e84be9f9cf23eb20f3e95424206d65544644cd","observation_id":"6e70ccb8-1bb4-47ef-b218-2ea519e1effd","resolution":{"observed_at":"2026-08-07T14:18:30.087332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06885","last_updated":"2025-05-20T15:53:10Z","snapshot_observed_at":"2026-08-01T23:52:25.071174Z","submitted_at":"2024-10-09T13:46:34Z","title":"F5-TTS: A Fairytaler that Fakes Fluent and Faithful Speech with Flow Matching","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06885","snapshot_observed_at":"2026-08-07T14:18:24.707447Z","title":"F5-tts: A fairytaler that fakes fluent and faithful speech with flow matching,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:24.707447Z"},"links":{"cited_paper":"/paper/2410.06885","citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:0cc389983efc4b2cd06f60609067f1b634b9a078feee5bb5201990d43bb2e9db","observation_id":"c62cbeb1-29f2-4ecf-987d-6723bb48b6c8","resolution":{"observed_at":"2026-08-07T14:18:24.707447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:29.829161Z","title":"A flow-based deep latent variable model for speech spectrogram modeling and en- hancement,","venue":null,"work_id":"f2a920e7-f347-40c3-914e-bc4cb12ca986","year":2020},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:24.844417Z"},"links":{"citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:c57aeaff9acf9987082df5c0fe27fe21502c4563805fb7eaa661350bcdf8e187","observation_id":"30c3a814-3c14-40ef-9197-60fd65959c2b","resolution":{"observed_at":"2026-08-07T14:18:29.906664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09286","last_updated":"2024-06-13T16:26:33Z","snapshot_observed_at":"2026-08-07T06:13:46.439256Z","submitted_at":"2024-06-13T16:26:33Z","title":"FlowAVSE: Efficient Audio-Visual Speech Enhancement with Conditional Flow Matching","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09286","snapshot_observed_at":"2026-08-07T14:18:24.979857Z","title":"Flowavse: Efficient audio-visual speech enhancement with conditional flow match- ing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:24.979857Z"},"links":{"cited_paper":"/paper/2406.09286","citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:c2f070964b0b5f571a940284042e1c987e3e590c9bc5edc6f424fc0029eaa4dc","observation_id":"1b40d9f1-7816-4d80-ae9e-fe67e7215438","resolution":{"observed_at":"2026-08-07T14:18:24.979857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:25.976981Z","title":"Speech enhancement and dereverberation with diffusion-based generative models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:25.976981Z"},"links":{"citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:02f3f883ae1493d6928942a55b8269ac296bc23ceeafdf2cf4af769fe2736e65","observation_id":"7f51340c-aae7-45a7-b231-772936fadadd","resolution":{"observed_at":"2026-08-07T14:18:25.976981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:25.225733Z","title":"Conv-tasnet: Surpassing ideal time– frequency magnitude masking for speech separation,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:25.225733Z"},"links":{"citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:e0fbcc923e4f2a9785cae5e35dccc59fa80e836e1315513a7452b264002f4057","observation_id":"394a827d-e211-4f3c-864c-8bce7fc820e7","resolution":{"observed_at":"2026-08-07T14:18:25.225733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.12847","last_updated":"2020-09-06T14:32:59Z","snapshot_observed_at":"2026-07-06T09:31:50.012114Z","submitted_at":"2020-06-23T09:19:13Z","title":"Real Time Speech Enhancement in the Waveform Domain","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.12847","snapshot_observed_at":"2026-08-07T14:18:25.378067Z","title":"Real time speech enhancement in the waveform domain,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:25.378067Z"},"links":{"cited_paper":"/paper/2006.12847","citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:1daff88e53ef37c565ac270a0a4babb1a31ba2e75882a70deebc2b1a763db65c","observation_id":"47e6dddf-8934-4a41-825c-19793f342a5d","resolution":{"observed_at":"2026-08-07T14:18:25.378067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00264","last_updated":"2020-09-23T03:16:28Z","snapshot_observed_at":"2026-07-06T09:43:44.262748Z","submitted_at":"2020-08-01T13:42:29Z","title":"DCCRN: Deep Complex Convolution Recurrent Network for Phase-Aware Speech Enhancement","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.00264","snapshot_observed_at":"2026-08-07T14:18:25.596410Z","title":"Dccrn: Deep complex convolution re- current network for phase-aware speech enhancement,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:25.596410Z"},"links":{"cited_paper":"/paper/2008.00264","citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:39c1649ad1f6771e0c028cae95a55fb4b9e36ac9bbb30e946a1fc62289c4a3e5","observation_id":"8d1a4cc2-6bef-4432-9685-8d3b892426f9","resolution":{"observed_at":"2026-08-07T14:18:25.596410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:29.515064Z","title":"Cp-gan: Context pyra- mid generative adversarial network for speech enhancement,","venue":null,"work_id":"7a1eb881-9a4d-4eaa-9d94-ef1d8cbd09b1","year":2020},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:25.731141Z"},"links":{"citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:b181d07f111be09ab4acb9551a284bd044393198ff96666c3d7ecd66a15a6b5f","observation_id":"a41521d1-e99b-4b1d-ab40-73476d6a7e96","resolution":{"observed_at":"2026-08-07T14:18:29.589930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:29.316322Z","title":"A multi-resolution approach to gan-based speech enhancement,","venue":null,"work_id":"4a98e6e1-b0de-49c9-80ed-4abf4b9dac79","year":2021},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:25.871126Z"},"links":{"citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:7863141b819cde75fd2b669023f81da7bb67ab992f4b35da482d2342da934e62","observation_id":"60a50299-9a8a-4651-af59-072face088fe","resolution":{"observed_at":"2026-08-07T14:18:29.417784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:28.702759Z","title":"The voice bank corpus: De- sign, collection and data analysis of a large regional accent speech database,","venue":null,"work_id":"7ab57f03-829b-4476-ac79-b35017b5b930","year":2013},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:26.743583Z"},"links":{"citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:f4bb809dbbf4f516fa069d2e7d062083ba046fb2c4e38b5d39249096002852c7","observation_id":"a5a9d663-3403-4dd3-8fdf-bac8d6088675","resolution":{"observed_at":"2026-08-07T14:18:28.805648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:26.080047Z","title":"Scalable diffusion models with transform- ers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:26.080047Z"},"links":{"citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:d0cc6ed31a9e6d3e0239843198f0007cc8d079593291b99340e095e8e53065e8","observation_id":"b7716fbd-9f20-489c-9ac5-acb61f4a2669","resolution":{"observed_at":"2026-08-07T14:18:26.080047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00814","last_updated":"2024-05-29T14:21:47Z","snapshot_observed_at":"2026-07-06T15:36:41.266003Z","submitted_at":"2023-06-01T15:40:32Z","title":"Vocos: Closing the gap between time-domain and Fourier-based neural vocoders for high-quality audio synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00814","snapshot_observed_at":"2026-08-07T14:18:26.198033Z","title":"V ocos: Closing the gap between time-domain and fourier-based neural vocoders for high-quality audio synthesis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:26.198033Z"},"links":{"cited_paper":"/paper/2306.00814","citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:d1e857b7b2f0e1828375c92ad6168497ec294d2ed7287821dab5092846c83e24","observation_id":"d35f41a3-464e-4842-b976-c54aa9b8cf8e","resolution":{"observed_at":"2026-08-07T14:18:26.198033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04658","last_updated":"2023-02-16T18:48:56Z","snapshot_observed_at":"2026-07-06T13:19:12.109592Z","submitted_at":"2022-06-09T17:56:10Z","title":"BigVGAN: A Universal Neural Vocoder with Large-Scale Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.04658","snapshot_observed_at":"2026-08-07T14:18:26.333141Z","title":"Bigvgan: A universal neural vocoder with large-scale training,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:26.333141Z"},"links":{"cited_paper":"/paper/2206.04658","citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:4788c2a6efb97d02dc784d5df3e97cbde0b27bdaa1ef68b438a884c34650c889","observation_id":"19438aab-9d1a-45a9-81ef-0bfca388140b","resolution":{"observed_at":"2026-08-07T14:18:26.333141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:29.084213Z","title":"Wenet: Production oriented streaming and non- streaming end-to-end speech recognition toolkit,","venue":null,"work_id":"d61846d2-601c-4933-a7eb-0a98277afe2d","year":2021},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:26.433871Z"},"links":{"citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:efba4105fa2b47f178b7e6c8a6200df20e2fbc3e3e64eb52e6ccf83f1f74e581","observation_id":"75a9bc4e-dc8d-403e-a0ce-6aa7a96de7ad","resolution":{"observed_at":"2026-08-07T14:18:29.183963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:28.896734Z","title":"GigaSpeech: An Evolving, Multi-Domain ASR Corpus with 10,000 Hours of Transcribed Audio,","venue":null,"work_id":"a35fddfd-2d1f-4724-b189-f5924efe298c","year":2021},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:26.597635Z"},"links":{"citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:d284bcbd651cdc3e5e285830766cf96936aca684d2364f9a1aa08fc868eec228","observation_id":"b7098ac5-aeef-46eb-b7c6-b7d2cb0ec865","resolution":{"observed_at":"2026-08-07T14:18:28.977473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:27.272199Z","title":"Wespeaker: A research and production oriented speaker embedding learning toolkit,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:27.272199Z"},"links":{"citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:c0cc5fa265188487bae80687ec4f2d165f0004bc452d00192730fb0d5ef083ea","observation_id":"2a992e7d-b8ed-4b16-8e68-5ab5504f5a5d","resolution":{"observed_at":"2026-08-07T14:18:27.272199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:28.419786Z","title":"The INTERSPEECH 2020 Deep Noise Sup- pression Challenge: Datasets, Subjective Testing Framework, and Challenge Results,","venue":null,"work_id":"888b3d5e-ae45-4cfa-8df7-ada0f9dc0e8c","year":2020},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:26.816724Z"},"links":{"citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:400a62b371a4fbce7493c6504110638d98278ca9f271cc586203176a2a884b9f","observation_id":"830afd48-125b-40b1-80d0-1600c9547c81","resolution":{"observed_at":"2026-08-07T14:18:28.539941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.01160","last_updated":"2019-07-02T04:27:55Z","snapshot_observed_at":"2026-07-06T08:04:17.909965Z","submitted_at":"2019-07-02T04:27:55Z","title":"WHAM!: Extending Speech Separation to Noisy Environments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.01160","snapshot_observed_at":"2026-08-07T14:18:26.931970Z","title":"Wham!: Extend- ing speech separation to noisy environments,","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:26.931970Z"},"links":{"cited_paper":"/paper/1907.01160","citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:754574d3793c216262345896b0b7d781414ee96ff3aa359574d729998a0e8306","observation_id":"4bfe0a7c-3067-4849-9cc2-c2aa2baab6ae","resolution":{"observed_at":"2026-08-07T14:18:26.931970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:28.112400Z","title":"The diverse environments multi-channel acoustic noise database (demand): A database of multichannel environmental noise recordings,","venue":null,"work_id":"908a4be8-26f8-4de5-9ce2-4bb37eb745f4","year":2013},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:27.010626Z"},"links":{"citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:a5e4557ec07e9dcb58d2debd9c23b4975e690f6ec716e2fa2761df8271e47d4d","observation_id":"7de8c295-2f52-4973-a35b-3764f1719938","resolution":{"observed_at":"2026-08-07T14:18:28.267405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:27.949029Z","title":"A study on data augmentation of reverberant speech for robust speech recognition,","venue":null,"work_id":"68378506-06b7-4456-b3e0-97557104b5f5","year":2017},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:27.094071Z"},"links":{"citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:6f3838179d07a0ec3c7ceb89c2228338e8e3fc680a885684d3f8281e052cf943","observation_id":"960b5fbd-96b6-4e81-a37a-444f3300a9c5","resolution":{"observed_at":"2026-08-07T14:18:28.021740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04356","last_updated":"2022-12-06T18:46:04Z","snapshot_observed_at":"2026-07-06T14:28:21.844826Z","submitted_at":"2022-12-06T18:46:04Z","title":"Robust Speech Recognition via Large-Scale Weak Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04356","snapshot_observed_at":"2026-08-07T14:18:27.221397Z","title":"Robust speech recognition via large- scale weak supervision,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:27.221397Z"},"links":{"cited_paper":"/paper/2212.04356","citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:181e611c0dfeb7425ef946273bf4b800f80278e9b3391f36f8b474e5054a840c","observation_id":"82083e53-5fa3-4c13-a1a8-e6e616108ce4","resolution":{"observed_at":"2026-08-07T14:18:27.221397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:27.341710Z","title":"Tf-gridnet: Integrating full-and sub-band modeling for speech separation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:27.341710Z"},"links":{"citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:51c87fec597663469474f915229c99d7d89dd601e33ab7595d591a747fd5300e","observation_id":"59f75783-3c3f-4c29-ae48-aa7df108de50","resolution":{"observed_at":"2026-08-07T14:18:27.341710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:27.425864Z","title":"Convnext v2: Co-designing and scaling convnets with masked autoencoders,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:27.425864Z"},"links":{"citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:c22e5ad33959a0d983ee5c9cf110b8f496e36d86edc916aa4f87615145f5df3f","observation_id":"f393ccb9-a549-442a-9dec-5b3a4d976ff7","resolution":{"observed_at":"2026-08-07T14:18:27.425864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:18:24.299905Z","title":"Available: https://openreview.net/forum?id= PqvMRDCJT9t","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T14:18:24.299905Z"},"links":{"citing_paper":"/paper/2505.19476"},"observation_digest":"sha256:f36b6673022912e588db1f9ce87db602446ce6a3f4c2de698265bb24f842efb6","observation_id":"d8fba3ec-1922-4c7b-8bb4-50e3a420ccc8","resolution":{"observed_at":"2026-08-07T14:18:24.299905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.19476","last_updated":"2025-05-27T09:33:56Z","latest_version":2,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-07T14:11:15.226290Z","submitted_at":"2025-05-26T03:55:00Z","title":"FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":1,"verified_fuzzy":16},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 3 inbound Pith citation observations for arXiv:2505.19476."}