{"as_of":"2026-08-21T13:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1e8f52e8776778f072447f8069f847d6acd28c7cb75e19b1b7984d547821e8eb","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:22:15.154844Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:22:14.947985Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-16T00:22:15.394980Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"cited_work":{"arxiv_id":"2608.12082","doi":null,"metadata_source":"pith","pith_arxiv_id":"2608.12082","snapshot_observed_at":"2026-08-16T00:22:15.394980Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","venue":"eess.AS","work_id":"f68a8094-2d70-4d27-bca7-5ae6bff47f85","year":2026},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:14.947985Z"},"links":{"cited_paper":"/paper/2608.12082","citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:b5d40c60d8a8dfd51ca64898d8d207a7fc5f766fb60e2f6aaf4cfdc8f0a2f18e","observation_id":"ac0db359-6fad-4f44-92a9-7f49371b8aed","resolution":{"observed_at":"2026-08-16T00:22:15.402867Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2608.12082/citation-record","integrity":"/paper/2608.12082/integrity","json":"/paper/2608.12082/citation-record.json","paper":"/paper/2608.12082"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:16.056562Z","title":null,"venue":null,"work_id":"d0a54e59-f20a-47e7-9bd0-9e5da0e15e68","year":null},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:14.942116Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:9de2596f38bd6e1d994b27e383e84b21b9544a42a834ac1de2b11da11c5b2157","observation_id":"e2548229-44f6-44ec-9f00-ec511af72113","resolution":{"observed_at":"2026-08-16T00:22:16.062546Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"cited_work":{"arxiv_id":"2608.12082","doi":null,"metadata_source":"pith","pith_arxiv_id":"2608.12082","snapshot_observed_at":"2026-08-16T00:22:15.394980Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","venue":"eess.AS","work_id":"f68a8094-2d70-4d27-bca7-5ae6bff47f85","year":2026},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:14.947985Z"},"links":{"cited_paper":"/paper/2608.12082","citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:b5d40c60d8a8dfd51ca64898d8d207a7fc5f766fb60e2f6aaf4cfdc8f0a2f18e","observation_id":"ac0db359-6fad-4f44-92a9-7f49371b8aed","resolution":{"observed_at":"2026-08-16T00:22:15.402867Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:16.018768Z","title":"Networks In the proposed SE models, the pretrained 16 kHzDAC[25] and WavLM[26] weights are adopted","venue":null,"work_id":"7a75f87f-dae7-4d0e-aa8b-2b96e944bdc6","year":2025},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:14.958606Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:34d833801e20886e99b634121cb316f0b60d704c12ef86efaa6b118bfe78c912","observation_id":"00ca68b4-a7de-40af-a5e4-c1d3bee9c0d7","resolution":{"observed_at":"2026-08-16T00:22:16.023750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.985486Z","title":"C... ”) are consistently outperforming their discrete-domain counterparts (methods named “D","venue":null,"work_id":"533cdcf0-1e2d-4776-a0b7-542d0a8d5863","year":null},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:14.968671Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:16cd755a6dca96deff5a59ab589ffc55be2d71b1b1de1e17ee7b3bc6233d8bc5","observation_id":"8122321e-f33b-4445-bda3-da5b526a152e","resolution":{"observed_at":"2026-08-16T00:22:15.990634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.968820Z","title":"We are the first to de- liver a comprehensive and fair synopsis of the paradigms by employ- ing both non-intrusive and intrusive metrics","venue":null,"work_id":"1d36ef6a-b1ea-4473-b307-5165eac39e81","year":null},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:14.973709Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:11db2215e496cfbea9d67a594aee81add9fccd5eb9c8f678f9877e1b38229c0f","observation_id":"bd9652df-f5ba-4def-a2a0-eea0ab2b4965","resolution":{"observed_at":"2026-08-16T00:22:15.974349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.951387Z","title":null,"venue":null,"work_id":"53c74d75-5baf-4f5c-9036-9ade25601312","year":null},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:14.978330Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:b853c0aa1c9f959cf930d3979efe9171b9002f0ea2adf936ed592529702c46ce","observation_id":"5805f68a-0880-4c8f-b279-0a7ad01e96b5","resolution":{"observed_at":"2026-08-16T00:22:15.956646Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.870299Z","title":"Speech Enhancement Using Continuous Embeddings of Neural Audio Codec,","venue":null,"work_id":"928cc5ae-1e1f-4d90-844a-4cfe4d0d7c38","year":2025},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:15.012970Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:b94f92904bf03d4aa91726ea9c954ea9477563b721f67479dec05f5396ffd8d9","observation_id":"6def8921-f3cf-4dc9-b242-b8a5b21f5389","resolution":{"observed_at":"2026-08-16T00:22:15.875410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.018061Z","title":"AnyEnhance: A Unified Generative Model with Prompt-Guidance and Self-Critic for V oice En- hancement,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:15.018061Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:e63949a9f7e57539c5f7852c8340e7e5b302c946b2b7fa38a0af5700a2670480","observation_id":"e5beb3b0-5980-42c6-a1cc-0e144eb5e2d6","resolution":{"observed_at":"2026-08-16T00:22:15.018061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-16T00:22:14.983206Z","title":"Llama: Open and Efficient Foundation Language Models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:14.983206Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:d63ee51a33c1add4f585a6a9abe3271be7276380e36ef4ccef7fe16e246ac214","observation_id":"47592323-8a9b-4fdd-88bf-eced6bf8cdac","resolution":{"observed_at":"2026-08-16T00:22:14.983206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.933520Z","title":"GenSE: Generative Speech Enhancement via Language Models using Hierarchical Modeling,","venue":null,"work_id":"9d606648-4186-4e93-b72f-b18abfb8bca2","year":2025},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:14.987662Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:de83a262c6c70c727514b1922dcec11921596fcb7ba13ef7f7869f40eb0b4068","observation_id":"b7b87fea-d3a7-4e44-acfc-16c87c9d6b14","resolution":{"observed_at":"2026-08-16T00:22:15.939941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.918495Z","title":"LLaSE-G1: Incentivizing Generalization Capability for Llama-based Speech Enhancement,","venue":null,"work_id":"ba774c71-3a47-4328-9f64-1cb9ec87e20c","year":2025},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:14.992217Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:8a86e77a09b2608f8b13a1d8aca1b54dc4a3d8270ab1752cd6420cb325619534","observation_id":"9737c5ea-1406-45af-a768-3b463b472f2f","resolution":{"observed_at":"2026-08-16T00:22:15.923043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.20441","last_updated":"2026-07-02T11:50:55Z","snapshot_observed_at":"2026-08-15T06:29:47.526342Z","submitted_at":"2025-10-23T11:22:24Z","title":"UniSE: A Unified Framework for Decoder-Only Autoregressive LM-Based Speech Enhancement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.20441","snapshot_observed_at":"2026-08-16T00:22:14.997112Z","title":"UniSE: A Unified Framework for Decoder-only Autoregressive LM-based Speech Enhance- ment,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:14.997112Z"},"links":{"cited_paper":"/paper/2510.20441","citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:3e02b138abd33105c86c7bfc213809a92083450b4607bd514992106012909803","observation_id":"bcf74c10-fa97-4f06-a083-916e468ca1d9","resolution":{"observed_at":"2026-08-16T00:22:14.997112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.902185Z","title":"Modeling Strategies for Speech En- hancement in the Latent Space of a Neural Audio Codec,","venue":null,"work_id":"ed58d6f1-0760-4c51-a435-9ba79e92f567","year":2026},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:15.002641Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:b493e07a22aaf53eb0c9ce8249f082d3a87b8700f15e82bb8935186f54d82780","observation_id":"5edebc01-c165-42a5-92b4-383163e90f1e","resolution":{"observed_at":"2026-08-16T00:22:15.907608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:16.036532Z","title":null,"venue":null,"work_id":"c9eaece8-b147-4a45-8f2d-738a12c7de69","year":null},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:14.953402Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:2871dd742928bff9153941dea73ebf7aa57bc099a175b46233cc46d6c26594d8","observation_id":"624a359c-9951-4bba-bc89-a6f2322753f2","resolution":{"observed_at":"2026-08-16T00:22:16.042114Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.886328Z","title":"High-Fidelity Speech Enhance- ment via Discrete Audio Tokens,","venue":null,"work_id":"b1117526-0bc5-4d01-b09f-68d8798ec978","year":2026},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:15.007609Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:84ae83c764787673f8e7c19e6a9ce06687fcbf57970b5d77d65d4baae0a2efe3","observation_id":"ba856785-120b-4c7d-a054-f33afb372a2e","resolution":{"observed_at":"2026-08-16T00:22:15.891220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.750761Z","title":"Codec Does Matter: Exploring the Seman- tic Shortcoming of Codec for Audio Language Model,","venue":null,"work_id":"041424f0-9c86-4891-b78e-977537ea48ec","year":2025},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:15.056628Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:2c5912a8f7da2be250dd26663d25e4cd397edebe1131bb162bfa260f63dc302f","observation_id":"b2ea674e-b48a-43b1-9c28-9f1e58493520","resolution":{"observed_at":"2026-08-16T00:22:15.755519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.853653Z","title":"Genhancer: High-Fidelity Speech Enhance- ment via Generative Modeling on Discrete Codec Tokens,","venue":null,"work_id":"a8c51d7c-22d5-439d-9106-8e99bd1af437","year":2024},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:15.022765Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:60c64946e448a693f9c2696c432517a1fc7eb96eb963eb91a5f01028cdb449e5","observation_id":"906a7c7e-d675-4995-b2b8-84418b437623","resolution":{"observed_at":"2026-08-16T00:22:15.858802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.837328Z","title":"DisContSE: Single-Step Diffusion Speech Enhancement Based on Joint Discrete and Continuous Embed- dings,","venue":null,"work_id":"4e0bad68-31b1-41b1-ae9b-32b17b1bf02e","year":2026},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:15.027639Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:5f92ca8421a68d6b7e12136427c5254b5d18bf205a835468dcaa4c7d06d22a31","observation_id":"58bef9d2-5649-4bbb-be02-b1aab53d4020","resolution":{"observed_at":"2026-08-16T00:22:15.842906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.821074Z","title":"Flow Matching for Generative Model- ing,","venue":null,"work_id":"6fa96b99-6ad6-4555-976e-a5bfb36646f4","year":2023},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:15.032659Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:e9ce9b6e95762768d3d3cdf391ae531b9197d5ce15cf4882cf54594a8220b663","observation_id":"369a354c-3a12-4605-9891-81db50515939","resolution":{"observed_at":"2026-08-16T00:22:15.826540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.803463Z","title":"FlowDec: A Flow-Based Full-Band General Audio Codec with High Perceptual Quality,","venue":null,"work_id":"314a90fa-7239-43d4-8921-523bcc60ef57","year":2025},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:15.037522Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:e6e0e988624df1d24d84eddf108bcf03f100c60d86a1b92c4676af7a4418f057","observation_id":"c34d593d-699d-40d9-9afc-dca70f70e02e","resolution":{"observed_at":"2026-08-16T00:22:15.809078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.785196Z","title":"High Fidelity Neural Audio Com- pression,","venue":null,"work_id":"6795d4d9-4531-49e0-9c95-0ce36515957a","year":2023},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:15.042074Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:017b7211981283c9e68a9116652e20c5020680df81ca28665d32d1fc9d9ca4ae","observation_id":"894c424b-7db8-4cfb-8e7a-37b5e90e3464","resolution":{"observed_at":"2026-08-16T00:22:15.790923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.766495Z","title":"High-Fidelity Audio Compression with Improved RVQGAN,","venue":null,"work_id":"b67a938c-c078-44fd-8a39-430a64794bcf","year":2023},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:15.046748Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:3f3d356fcaf2195c441252f8bd06c5f5c0cc2dd23bd30300648a970dc39eb78e","observation_id":"487d4ca8-2add-40de-acdf-e631c1b04246","resolution":{"observed_at":"2026-08-16T00:22:15.772457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01710","last_updated":"2025-03-03T16:23:10Z","snapshot_observed_at":"2026-08-20T01:09:59.849605Z","submitted_at":"2025-03-03T16:23:10Z","title":"Spark-TTS: An Efficient LLM-Based Text-to-Speech Model with Single-Stream Decoupled Speech Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01710","snapshot_observed_at":"2026-08-16T00:22:15.051545Z","title":"Spark-TTS: An Efficient LLM-Based Text-to-Speech Model with Single-Stream Decoupled Speech Tokens,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:15.051545Z"},"links":{"cited_paper":"/paper/2503.01710","citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:66fd639bd6747774570f182e8b64ee3028df5d61546b844df69850ed610b3ddb","observation_id":"1f4fc372-c793-4fc4-96fd-5ad5fa39434e","resolution":{"observed_at":"2026-08-16T00:22:15.051545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.618529Z","title":"Understanding Straight-Through Esti- mator in Training Activation Quantized Neural Nets,","venue":null,"work_id":"6aaf6883-54c1-4e72-b14e-5e58f4f8bacb","year":2019},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:15.096307Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:2ea1e6758fa563656145c7d39a6138874c726d740d4721c3bdf5b4e5c058f7a0","observation_id":"52049a1a-51e5-4b43-8fcb-c6f8572394bc","resolution":{"observed_at":"2026-08-16T00:22:15.623089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.735223Z","title":"Residual Quantization with Implicit Neural Codebooks,","venue":null,"work_id":"5ecf8524-a475-4814-80e8-9ec092c5b26d","year":2024},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:15.061410Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:8a93f772e0712871f6279d8d8e043cac3a8296d6e7ce55bc522bb8f169529043","observation_id":"204345bb-4593-4176-9ede-4020e25d6b0d","resolution":{"observed_at":"2026-08-16T00:22:15.740047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.718926Z","title":"WavLM: Large-Scale Self-Supervised Pre-Training for Full Stack Speech Processing,","venue":null,"work_id":"a9aa1f0b-8edc-4686-83d6-dd05843a13a7","year":2022},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:15.066461Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:1029995f5e0bfc3ca57c05b377d81c28ae675d1385fb087193cc786abfc0c76f","observation_id":"784a394e-2b0d-410c-b458-64bafdaa2673","resolution":{"observed_at":"2026-08-16T00:22:15.724094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.702705Z","title":"MaskGIT: Masked Generative Image Transformer,","venue":null,"work_id":"f5bc737d-a81b-4063-a5e8-a1ffe44f8d6d","year":2022},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:15.071584Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:4d746f1b7ad4a9b336bedbac205d8814203fdc20e74f875c1df473763a1225fc","observation_id":"06ec2a8e-080b-4a30-b149-35253cb7da8d","resolution":{"observed_at":"2026-08-16T00:22:15.707831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.685592Z","title":"A Consolidated View of Loss Func- tions for Supervised Deep Learning-Based Speech Enhance- ment,","venue":null,"work_id":"ad479138-a1bf-477d-a4fe-4d2a877220ba","year":2021},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:15.076586Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:3a154c35172c757ad5f2503d8d1c141af6ad85a76164637721b201756dd67bdc","observation_id":"c56653f4-cf3e-4034-ad1b-0ee670d3a829","resolution":{"observed_at":"2026-08-16T00:22:15.690690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:16.002622Z","title":null,"venue":null,"work_id":"f672cf05-ddb3-46bf-b1fa-0162f02f5e63","year":null},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:14.963425Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:1d29a17a34386450e20e3eae473c12bcc9b76d026851aed5b805ca39afe2c015","observation_id":"482c7594-a71e-48d2-afb2-a02f01812cdd","resolution":{"observed_at":"2026-08-16T00:22:16.007900Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.668525Z","title":"EffCRN: An Efficient Convolutional Re- current Network for High-Performance Speech Enhancement,","venue":null,"work_id":"27f28e76-bc6c-45bd-b76d-42c3f4bef34b","year":2023},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:15.081411Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:f4adb4989a0635bcc5e48bd14c1b0916843701fda7c6e2a24bd10518fa6c2e00","observation_id":"1cc15669-2248-48e0-b877-a56ac6c71d78","resolution":{"observed_at":"2026-08-16T00:22:15.674040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.652044Z","title":"Loss Function Inspired by the PESQ Score,","venue":null,"work_id":"376c8849-c7ad-4b2d-bf7c-9688c7a3374e","year":2022},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:15.086320Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:a502a0086d257836a041713c1f1f2335f42efb6ef2c4fb8a6e6815d26f8a85f9","observation_id":"bc3bb79a-19a5-4efb-a6ec-ee666c2aa898","resolution":{"observed_at":"2026-08-16T00:22:15.657046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.635127Z","title":"PyTorch Implementation of STOI ,","venue":null,"work_id":"3a0e650e-c96a-4136-accb-fb952d30d51d","year":2020},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:15.091242Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:221ff9e8b2f317f14af05ac0dfb3cd586d78138a767530f6a1a1c78e7228880b","observation_id":"c618ff79-e9b9-4841-9ee1-cd6ec182afc9","resolution":{"observed_at":"2026-08-16T00:22:15.640514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.601650Z","title":"Descript Audio Codec (.dac): High-Fidelity Audio Compression with Improved RVQ- GAN,","venue":null,"work_id":"1d4f0f10-f15a-4a68-9916-21643b1da10c","year":2023},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:15.101268Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:04945def4717d1e3390e16608346610308e8fecdaca8878b8bd8c46a98b8543a","observation_id":"0d79e9ab-6245-4aad-b935-d81e2020c01a","resolution":{"observed_at":"2026-08-16T00:22:15.607065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.585427Z","title":"WavLM-Large,","venue":null,"work_id":"58c2368d-516e-498c-87e8-4ebd8a9f5707","year":2023},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:15.106054Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:b510139a65f663d43d95418fa90234925e9d7b2ea844c1096c22244c9d4e76a5","observation_id":"d5566bd3-5d2c-4994-aba5-54c565fd8ca8","resolution":{"observed_at":"2026-08-16T00:22:15.590387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.567353Z","title":"Attention Is All You Need,","venue":null,"work_id":"99631d77-0643-4d36-b700-4bdde4769a20","year":2017},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:15.111349Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:f64727193f19b5ee5dc9d5269596befa7e2f85b25472fb785014556a49878ec2","observation_id":"431f2714-505a-432e-bac7-9c346f6ee5a3","resolution":{"observed_at":"2026-08-16T00:22:15.573245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.551010Z","title":"Interspeech 2025 URGENT Speech En- hancement Challenge,","venue":null,"work_id":"55335658-cb3f-46ba-8165-8090802e7e22","year":2025},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:15.116159Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:bb02cc1b38223149da447ce2d9beb063f9eabd8a5f135b6c9924ece72d4fa297","observation_id":"71241c32-39a6-4991-8cdb-eeec21fdced8","resolution":{"observed_at":"2026-08-16T00:22:15.556356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.535332Z","title":"Common V oice: A Massively- Multilingual Speech Corpus,","venue":null,"work_id":"d52f4921-58e1-43cc-ac29-96e6955a6123","year":2020},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:15.121044Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:411ac267c62acba5f5b8f65e99d6475341305aa0b8a08c5daf533bb06e178998","observation_id":"7bc8193f-34a9-445e-af79-a1e71569a62b","resolution":{"observed_at":"2026-08-16T00:22:15.540227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.519879Z","title":"P .56: Objective Measurement of Active Speech Level, International Telecommunication Union, Telecommu- nication Standardization Sector (ITU-T), Dec","venue":null,"work_id":"495b7418-d530-43f0-bb38-9bad041f91d7","year":2011},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:15.125825Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:49c551097c7ab6d29cb607620aad10dbba28bdb3e74b1b6aae3c548c0ac19a90","observation_id":"632c197f-80b8-481c-a11a-985af16d1fae","resolution":{"observed_at":"2026-08-16T00:22:15.524537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.503678Z","title":"Perceptual Evaluation of Speech Quality (PESQ)—A New Method for Speech Quality Assessment of Telephone Networks and Codecs,","venue":null,"work_id":"89d1e939-6840-4edd-bf01-68aada0756d8","year":2001},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:15.130624Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:8f027df35b153f62c910ea84d2e0c5897dfb35be62653a0df312cd67712347be","observation_id":"a33432d6-cf74-4312-9fb4-c4ff87d94223","resolution":{"observed_at":"2026-08-16T00:22:15.509281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.484701Z","title":"An Algorithm for Predicting the Intel- ligibility of Speech Masked by Modulated Noise Maskers,","venue":null,"work_id":"f8c349e9-14af-43da-bac3-1560c998a5fe","year":2009},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:15.135625Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:f7ade8f86d4c6c6086b5d5306b19997d7a9f17033a42e58738b70fa0d6860eee","observation_id":"d5bd8283-df88-46df-a8a6-3b2f3f01b669","resolution":{"observed_at":"2026-08-16T00:22:15.490807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.468380Z","title":"DNSMOS P. 835: A Non- Intrusive Perceptual Objective Speech Quality Metric to Eval- uate Noise Suppressors,","venue":null,"work_id":"00ae56f0-face-41e1-8496-e00c3c7d113b","year":2022},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:15.140206Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:010949ac8d8b0b1ac4d02008c472990242a845359f41d70f1a1a25347276348d","observation_id":"2902e11d-b382-46a9-9b4c-d7fa28b133a3","resolution":{"observed_at":"2026-08-16T00:22:15.473450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.451366Z","title":"NISQA: A Deep CNN-Self-Attention Model for Multidimensional Speech Quality Prediction with Crowdsourced Datasets,","venue":null,"work_id":"cf2044b3-3db5-4a2d-ae23-78c7209d68d9","year":2021},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:15.144743Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:c976461f59f1fbb5932a0b3c245be94c9d7419ad3185429ee84aa4fffaf6c324","observation_id":"519ef48a-0930-41bd-93eb-d53ccef1cf7f","resolution":{"observed_at":"2026-08-16T00:22:15.456687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.432828Z","title":"UTMOS: UTokyo-SaruLab System for V oiceMOS Challenge 2022,","venue":null,"work_id":"353a26f6-16d6-4c37-8840-f0d01427c98e","year":2022},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:15.149709Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:b75dc281b810a6242b795b24938d253b9a70d6305ba6ae10689a973fded8c8c0","observation_id":"15b66ef5-562e-452b-87f9-328c3e9b3f80","resolution":{"observed_at":"2026-08-16T00:22:15.438156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:22:15.415355Z","title":"Evaluation Metrics for Generative Speech Enhancement Methods: Issues and Perspectives,","venue":null,"work_id":"4f8fa155-c001-48fd-b86a-be0199a75797","year":2023},"citing_paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T00:22:15.154844Z"},"links":{"citing_paper":"/paper/2608.12082"},"observation_digest":"sha256:4e59f456472738d931c24cc862a60665cdc57ec78eefa04d48b77454210580e2","observation_id":"7d2d90cd-a032-468f-9817-23d8c452b7c5","resolution":{"observed_at":"2026-08-16T00:22:15.420878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.12082","last_updated":"2026-08-12T14:04:37Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-21T01:45:28.461369Z","submitted_at":"2026-08-12T14:04:37Z","title":"Rethinking Language Model-Based Generative Speech Enhancement in the Latent Space of a Neural Audio Codec"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":1,"verified_fuzzy":35},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 1 inbound Pith citation observation for arXiv:2608.12082."}