{"as_of":"2026-08-07T22:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:257f0c0891ce0109ba5ad992d82064276cbf83d1c9827ef683d50ebefd0e7322","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:01:34.417494Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:01:31.923229Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T12:01:34.538061Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"cited_work":{"arxiv_id":"2506.00809","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.00809","snapshot_observed_at":"2026-08-07T12:01:34.538061Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","venue":"cs.SD","work_id":"14c6a5db-415e-4a92-bacb-d9cad88d58fd","year":2025},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:31.923229Z"},"links":{"cited_paper":"/paper/2506.00809","citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:0e6b266238f4327601a5d9fcccff0dd678c2e523feaaa4a087c65b02d7e9abc2","observation_id":"bb16165a-f05c-4d15-a8f1-15c85410c3ea","resolution":{"observed_at":"2026-08-07T12:01:34.589250Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.00809/citation-record","integrity":"/paper/2506.00809/integrity","json":"/paper/2506.00809/citation-record.json","paper":"/paper/2506.00809"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:38.100255Z","title":null,"venue":null,"work_id":"9fab9a31-5918-451c-9657-6d2175c302ca","year":2025},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:31.812218Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:32888c1c59b157cb2d0033708e655abda99f790c11641ac23d1ffbab2549f62d","observation_id":"f96e1558-c09a-4ec9-bc1f-297b2ddd8eed","resolution":{"observed_at":"2026-08-07T12:01:38.174821Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"cited_work":{"arxiv_id":"2506.00809","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.00809","snapshot_observed_at":"2026-08-07T12:01:34.538061Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","venue":"cs.SD","work_id":"14c6a5db-415e-4a92-bacb-d9cad88d58fd","year":2025},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:31.923229Z"},"links":{"cited_paper":"/paper/2506.00809","citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:0e6b266238f4327601a5d9fcccff0dd678c2e523feaaa4a087c65b02d7e9abc2","observation_id":"bb16165a-f05c-4d15-a8f1-15c85410c3ea","resolution":{"observed_at":"2026-08-07T12:01:34.589250Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:37.919496Z","title":null,"venue":null,"work_id":"7e1142f0-54f9-49fb-8058-6b155273b592","year":2025},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:31.979929Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:ef28f3e84a9b917c2df3953281d94d525520ba46c65ab69a2c44b14c693930c2","observation_id":"e2a4906f-7f91-4ca1-bf5c-16867dba7ac7","resolution":{"observed_at":"2026-08-07T12:01:37.996812Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:37.736001Z","title":null,"venue":null,"work_id":"b98c3414-ffc4-4f95-a0fd-b38e18483858","year":2025},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:32.046530Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:15d47ce751c4376039feb9123a59609e3136d6e1a7c0edae302553cb60cb81e0","observation_id":"0f26afc9-d691-42b6-9327-7378c8c4bf05","resolution":{"observed_at":"2026-08-07T12:01:37.838598Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:37.608252Z","title":null,"venue":null,"work_id":"e946572d-7b51-48e3-b639-63b1cc0bfd7d","year":null},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:32.119217Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:de89d369b14a1bc21edc44b6acd50038461b915fb07267a9ff0aa7c0d4d44ac4","observation_id":"ae84b20e-900d-4433-a01e-92e7fc197dc5","resolution":{"observed_at":"2026-08-07T12:01:37.686806Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:37.419854Z","title":null,"venue":null,"work_id":"15f02685-7287-4072-b0cd-203e1e5408c1","year":2013},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:32.212253Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:8ba2eebd058b81db087f0b5de085f2ef9da6fe8a88ade44818e780f6f39cefbf","observation_id":"493b2714-f97c-4ee9-b979-994b2451c8dc","resolution":{"observed_at":"2026-08-07T12:01:37.479628Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:37.245055Z","title":"Interspeech 2025 URGENT speech enhancement challenge,","venue":null,"work_id":"d27da902-d756-4c22-941f-a2d614b6666c","year":2025},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:32.283850Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:030f669037f34356c3ca92dc6cd05c7893bbe6234cbad123158ab271376f3faf","observation_id":"367a6ba7-5dc3-45ec-8632-5163a3d54fde","resolution":{"observed_at":"2026-08-07T12:01:37.321324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:37.090112Z","title":"Music source separation in the waveform domain,","venue":null,"work_id":"2bb3252c-16a1-438e-9084-f3815a31afa1","year":2020},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:32.356169Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:f0b4d517a1ea5e4ecdada5ab9edf10776aa2e590da5fb5fe7510bbee46438f02","observation_id":"e5d716a5-6494-4ba8-8764-96a617dcba7d","resolution":{"observed_at":"2026-08-07T12:01:37.157527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:32.457123Z","title":"Scnet: Sparse compression network for music source separation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:32.457123Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:10e292b959fe8fdfec283eac91a148e09200cb72de6874f215b2c65aca5579d7","observation_id":"9236ba3f-ca3a-457c-87bf-2b3d0d6f8ccd","resolution":{"observed_at":"2026-08-07T12:01:32.457123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:36.911910Z","title":"Tf-gridnet: Integrating full-and sub-band modeling for speech separation,","venue":null,"work_id":"f14953fc-18eb-4d09-8b34-bc9ed1fa0184","year":2023},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:32.494946Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:68b30f76747cd380da4716b9b09b66495a0744f1988c11970f3de638459341a1","observation_id":"b56dc0e3-8825-4e22-9c8e-a5f8ab94ea99","resolution":{"observed_at":"2026-08-07T12:01:36.988000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:36.731684Z","title":"Speech enhancement and dereverberation with diffusion-based generative models,","venue":null,"work_id":"43dbc69c-7ab3-4e43-b3a9-88a65f0e2b37","year":2023},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:32.563917Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:77384480ad776412e40dd7adbd96c9d15dd99bc4f2c07dd51ead9c03f220c7f0","observation_id":"d61be144-a88a-4633-b3e7-d89311cd736c","resolution":{"observed_at":"2026-08-07T12:01:36.807544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:32.624736Z","title":"Storm: A diffusion-based stochastic regeneration model for speech en- hancement and dereverberation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:32.624736Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:744f97052030777cf35b6477ed7a4bf2c3b32862bb41a52f552dd8b8eda81a81","observation_id":"7f30d897-1930-4cd6-8288-40e72fa14510","resolution":{"observed_at":"2026-08-07T12:01:32.624736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:36.588177Z","title":"Hifi-gan-2: Studio-quality speech enhancement via generative adversarial networks condi- tioned on acoustic features,","venue":null,"work_id":"0d959f36-c8be-41a2-83d4-61c60399a640","year":2021},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:32.721482Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:37ccf1e65a4048268c91b9548e7fa394356bfcb6625eecf4b00ba4327033fdba","observation_id":"3084c8b7-68a5-4aa8-af85-ef8162c234d3","resolution":{"observed_at":"2026-08-07T12:01:36.658011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:32.799443Z","title":"Finally: fast and universal speech enhancement with studio-like quality,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:32.799443Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:6cb70cdf71441a6686afb6595481f61e94f78e4139dd5e00ba7ac1cb9f6e364b","observation_id":"a54bcdaa-fceb-45ee-8f8e-6f57bd4c5de5","resolution":{"observed_at":"2026-08-07T12:01:32.799443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:36.439722Z","title":"Genhancer: High-fidelity speech enhancement via generative modeling on discrete codec tokens,","venue":null,"work_id":"d123b904-1fe4-424b-a67d-e416cf4595f2","year":2024},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:32.878188Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:faa06e242be72a4e6fa56bae25452f239b96cd27298717d10786885d0623a346","observation_id":"d81cf185-7287-4262-b83a-8275e23b2f9e","resolution":{"observed_at":"2026-08-07T12:01:36.511150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:32.970893Z","title":"High-fidelity audio compression with improved rvqgan,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:32.970893Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:3c2fa70e0bad4a1e967de5b50d4350d62274563258a4e36e175ce0bc45820e62","observation_id":"c33007a3-d314-46da-8999-29a71cdf94d1","resolution":{"observed_at":"2026-08-07T12:01:32.970893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:36.246686Z","title":"High fidelity neural audio compression,","venue":null,"work_id":"41dfe707-6872-4015-8ee8-9c9c2cebed66","year":2023},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:33.041342Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:a2104f7f08694fefe0522a047f2cec2fa97eca6641411abc90f1de7a64a0afb5","observation_id":"dde14055-1360-4136-b039-9d86cbc862d0","resolution":{"observed_at":"2026-08-07T12:01:36.322726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.09636","last_updated":"2023-05-16T17:41:25Z","snapshot_observed_at":"2026-08-06T19:45:49.830925Z","submitted_at":"2023-05-16T17:41:25Z","title":"SoundStorm: Efficient Parallel Audio Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.09636","snapshot_observed_at":"2026-08-07T12:01:33.109033Z","title":"Soundstorm: Efficient parallel audio gen- eration,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:33.109033Z"},"links":{"cited_paper":"/paper/2305.09636","citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:aebd50d8a22fdd59c64c0aa7cf6fd502183f4fa00aa35cdec5672b66a04cdf26","observation_id":"be01b860-3c63-4c64-8bdc-5f7424d1977c","resolution":{"observed_at":"2026-08-07T12:01:33.109033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:36.091078Z","title":"EDM-TTS: Efficient Dual-Stage Masked Modeling for Alignment-Free Text-to- Speech Synthesis,","venue":null,"work_id":"139fef19-67b1-4df2-8ff2-63378956362c","year":2025},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:33.208791Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:e880ae4ce86efa43afc0edbd46ede30290bfdb21fad900778c28c9c6952c03c6","observation_id":"19f0fa93-94d0-427f-9b34-cbae6b8e646d","resolution":{"observed_at":"2026-08-07T12:01:36.166253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:35.916526Z","title":"Towards robust speech representation learning for thousands of languages,","venue":null,"work_id":"d4c2c2cf-97bb-44d8-9d7a-cdeca4d53b3f","year":2024},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:33.302674Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:a52757018ab7fb920c8221e1bd3f1b0c9eed0915089eefdfc162a0d73d7f6f7e","observation_id":"ab169d63-ea66-4383-9107-a12ba84be74b","resolution":{"observed_at":"2026-08-07T12:01:35.993984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:33.340225Z","title":"Wavlm: Large-scale self- supervised pre-training for full stack speech processing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:33.340225Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:5778cd318df6d61ac0ff9e8a258f3a11ac7fe59a3154ca1e899db9f197123291","observation_id":"daccfddc-1153-4d64-8615-c12806cf20ba","resolution":{"observed_at":"2026-08-07T12:01:33.340225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:35.735430Z","title":"Tokensplit: Using dis- crete speech representations for direct, refined, and transcript- conditioned speech separation and recognition,","venue":null,"work_id":"ea5afd5e-3d3c-4d76-9b60-f6521b23f899","year":2023},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:33.390957Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:cf6f3b84978a6a936fd69008eda9783cf9cb000e47d61d6c2a72da0db6478e01","observation_id":"98eba353-9f50-4105-b90f-ba965fc01bae","resolution":{"observed_at":"2026-08-07T12:01:35.799869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:33.460059Z","title":"Conformer: Convolution-augmented transformer for speech recognition,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:33.460059Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:1aa5f4fa1b9e40fe46da9a21d55c9a3bfeb25ed076ef00cbed04afaf2cb3685a","observation_id":"ce297c90-ccf8-46eb-ac67-7aac19c9494a","resolution":{"observed_at":"2026-08-07T12:01:33.460059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:35.574719Z","title":"Improving music source separation based on deep neural networks through data augmentation and network blending,","venue":null,"work_id":"387bafa4-5fcb-41b6-88ea-e65a8244c1bf","year":2017},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:33.561097Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:03d2fa3e571bd6070243c23aa3dbd3825112e7bd10e9318abc25434f8713dfc4","observation_id":"ae059441-79d8-4879-ba5a-4091d8320f97","resolution":{"observed_at":"2026-08-07T12:01:35.643525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:33.621229Z","title":"Sdr– half-baked or well done?","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:33.621229Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:d1700a297c8bb9b381b4b7a1d488cca4d5c7bf96d71668b0badf1a9665c0cf45","observation_id":"6bd82b1a-d667-435f-b466-6106e1fafe35","resolution":{"observed_at":"2026-08-07T12:01:33.621229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.11680","last_updated":"2021-09-23T22:50:32Z","snapshot_observed_at":"2026-08-02T00:37:53.191869Z","submitted_at":"2021-09-23T22:50:32Z","title":"Simple and Effective Zero-shot Cross-lingual Phoneme Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.11680","snapshot_observed_at":"2026-08-07T12:01:33.692653Z","title":"Simple and effective zero-shot cross-lingual phoneme recognition,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:33.692653Z"},"links":{"cited_paper":"/paper/2109.11680","citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:2f1efb01e31521ed8fc0e98a8479d3d0ee48b52d88608e77b260dad8eccac8d5","observation_id":"478ab6df-37d6-407f-a199-7e20b7016ef7","resolution":{"observed_at":"2026-08-07T12:01:33.692653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:35.363648Z","title":"Utmos: Utokyo-sarulab system for voicemos challenge 2022,","venue":null,"work_id":"55f11064-9154-4c75-badf-8ed03b5246f5","year":2022},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:33.766585Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:c0680dd2b2e40a907b2928952ad6ee7210c8adc85ca3190c11a1565271fbdd4e","observation_id":"0f654e45-7586-4867-98ef-7d2b7fc57871","resolution":{"observed_at":"2026-08-07T12:01:35.442379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-07T12:01:33.840130Z","title":"Adam: A method for stochastic optimization,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:33.840130Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:02f6dcfa3df8e43992934c7eb5cd6e8a9928fb2e5cb03166d8ca07e5911f6eb3","observation_id":"9be281a7-9a0f-4479-9893-c94351461137","resolution":{"observed_at":"2026-08-07T12:01:33.840130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:35.211806Z","title":"Simulating wind noise with airflow speed-dependent characteristics,","venue":null,"work_id":"9b2bab24-80da-4e53-8cec-4940b950220c","year":2022},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:33.892787Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:63b3e912badce231097a250396c023f1e106a2d56ee4758bd04c5e98e435bddf","observation_id":"bf70be28-8521-4d58-b70f-47f04c9363d0","resolution":{"observed_at":"2026-08-07T12:01:35.295694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:35.060735Z","title":"Perceptual objective listening quality assessment (polqa), the third generation itu-t standard for end-to-end speech quality measurement part i—temporal align- ment,","venue":null,"work_id":"61568695-561d-4dc2-bf32-ebb62221318d","year":2013},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:33.926562Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:819a1a85a26c5adc901b090c2be1e069b715219fa8851f793ec6d164212c7e64","observation_id":"d570bedd-2bab-4dc0-908a-c3613b9899ec","resolution":{"observed_at":"2026-08-07T12:01:35.127198Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:34.000498Z","title":"Perceptual evaluation of speech quality (pesq)-a new method for speech quality assessment of telephone networks and codecs,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:34.000498Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:452e047c8bb8932073bba301b89223de0e224e6f8ef30efc3948c6209bafe0bc","observation_id":"ed435efb-429a-419e-b04b-a605f6b7000a","resolution":{"observed_at":"2026-08-07T12:01:34.000498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:34.090779Z","title":"An algorithm for predicting the in- telligibility of speech masked by modulated noise maskers,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:34.090779Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:5cfb855e11da23b63cc640a825cefc8bf6e5450ccdcbbfe410bfb9a3f8fa7478","observation_id":"565395df-ba1f-40ff-97d4-ec376514dffa","resolution":{"observed_at":"2026-08-07T12:01:34.090779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:34.895898Z","title":"Mel-cepstral distance measure for objective speech quality assessment,","venue":null,"work_id":"adf7a815-93e6-42b3-8505-ec92832be668","year":1993},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:34.201829Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:da8e9d26ef99d58f582282203128dc9c85cd4e86137057ebe99e0bd0fb3d11a9","observation_id":"c782e164-6f7b-4002-92f4-6293e93cf082","resolution":{"observed_at":"2026-08-07T12:01:34.967420Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:34.283710Z","title":"Distance measures for speech process- ing,","venue":null,"work_id":null,"year":1976},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:34.283710Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:9bc5e5bf3286609c6013885d49135d9798fb05c9b14ebba35cc23e7ea74b2583","observation_id":"ff1e091b-2dd3-4dda-aa89-890544a4b4cc","resolution":{"observed_at":"2026-08-07T12:01:34.283710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16812","last_updated":"2024-09-01T14:34:27Z","snapshot_observed_at":"2026-08-06T17:12:30.832433Z","submitted_at":"2024-01-30T08:26:28Z","title":"SpeechBERTScore: Reference-Aware Automatic Evaluation of Speech Generation Leveraging NLP Evaluation Metrics","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16812","snapshot_observed_at":"2026-08-07T12:01:34.351568Z","title":"Speechbertscore: Reference-aware automatic evaluation of speech generation leveraging nlp evaluation metrics,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:34.351568Z"},"links":{"cited_paper":"/paper/2401.16812","citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:c696f4d1937d0c239d9551da0cc3bc1ff01ac84c42896e80bce7a197040c91a7","observation_id":"c797946e-3184-4032-94bd-8df5cd3da96d","resolution":{"observed_at":"2026-08-07T12:01:34.351568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:34.698289Z","title":"Evaluation metrics for generative speech en- hancement methods: Issues and perspectives,","venue":null,"work_id":"ed579092-0cdc-4515-ae20-fa3f007e24cf","year":2023},"citing_paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:34.417494Z"},"links":{"citing_paper":"/paper/2506.00809"},"observation_digest":"sha256:d6c141f8de29e455a11d86adb61f7a3d3733c1ce80eb4f443184e3fcc86a1e53","observation_id":"5f77411c-4ea9-4705-9018-8d7cba7d55e2","resolution":{"observed_at":"2026-08-07T12:01:34.783696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.00809","last_updated":"2025-06-01T03:23:27Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-07T17:14:34.242100Z","submitted_at":"2025-06-01T03:23:27Z","title":"FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":16},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 1 inbound Pith citation observation for arXiv:2506.00809."}