{"as_of":"2026-08-09T06:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c8b8c1bc9bc20a7bbf4964be23b891e29e039fb2350b24e8a4c5722c1a2e903c","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T21:58:50.975699Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.07711/citation-record","integrity":"/paper/2508.07711/integrity","json":"/paper/2508.07711/citation-record.json","paper":"/paper/2508.07711"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:57.980345Z","title":"Natural TTS synthesis by conditioning wavenet on mel spectrogram predictions,","venue":null,"work_id":"428abfe2-bec1-403f-ae82-c9953be1f141","year":2018},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:46.746460Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:b32ab2dbd6662c68196af906e41da98aaa5162fc6896d609609da95197e85e43","observation_id":"6c859b90-d1ac-4e8d-88ce-ab09c041f1f1","resolution":{"observed_at":"2026-08-05T21:58:58.124195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05407","last_updated":"2024-07-09T07:42:51Z","snapshot_observed_at":"2026-07-06T18:42:34.958119Z","submitted_at":"2024-07-07T15:16:19Z","title":"CosyVoice: A Scalable Multilingual Zero-shot Text-to-speech Synthesizer based on Supervised Semantic Tokens","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05407","snapshot_observed_at":"2026-08-05T21:58:46.879398Z","title":"Cosyvoice: A scalable multilingual zero-shot text-to-speech synthesizer based on supervised semantic tokens,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:46.879398Z"},"links":{"cited_paper":"/paper/2407.05407","citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:2ee5c672cba0df030baa482ddd631c8f241c9806cbc3aec66721af08baccdfb9","observation_id":"dfa96865-0b41-47db-afda-0b16f687e426","resolution":{"observed_at":"2026-08-05T21:58:46.879398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:46.982214Z","title":"MP-SENet: A speech enhancement model with parallel denoising of magnitude and phase spectra,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:46.982214Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:fdf2865fb00b028294b731eb2bfed1758f1ca1edb8e74e785db9a2e563e6974d","observation_id":"9e7d108b-fbd7-45c6-a0b0-a09d57dbe5f0","resolution":{"observed_at":"2026-08-05T21:58:46.982214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:47.076228Z","title":"AudioSR: Versatile audio super-resolution at scale,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:47.076228Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:a9c55f014fdc9dbb19ae58fe895b919406026863a7f2e4d2138e7e3ba4f084da","observation_id":"2db30915-421d-4ecc-860f-5db20f53230c","resolution":{"observed_at":"2026-08-05T21:58:47.076228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:57.709572Z","title":"Towards high-quality and efficient speech bandwidth extension with parallel amplitude and phase prediction,","venue":null,"work_id":"0cea5077-fc74-4721-aea4-1427d7f7a53f","year":2024},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:47.164702Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:24ecdbcd9662bc1019e8a2ce6454ab3e67504aa002e5eb8a5877ec74fac3b7dc","observation_id":"e4a7dc4a-09a1-475f-9e42-fb8e13ad4de7","resolution":{"observed_at":"2026-08-05T21:58:57.847695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05298","last_updated":"2025-06-04T16:25:54Z","snapshot_observed_at":"2026-07-06T18:27:24.526210Z","submitted_at":"2024-06-07T23:47:51Z","title":"Spectral Codecs: Improving Non-Autoregressive Speech Synthesis with Spectrogram-Based Audio Codecs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05298","snapshot_observed_at":"2026-08-05T21:58:47.274633Z","title":"Spectral codecs: Spectrogram-based audio codecs for high quality speech synthesis,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:47.274633Z"},"links":{"cited_paper":"/paper/2406.05298","citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:ab26969ae2ae95ab51d6e481043f64df251b8cda76972ac2e341e1cbf204a6a8","observation_id":"33c1a620-8ab2-404d-b00e-c8e949a92a2d","resolution":{"observed_at":"2026-08-05T21:58:47.274633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:57.460573Z","title":"A bitrate-scalable variational recurrent mel-spectrogram coder for real-time resynthesis-based speech coding,","venue":null,"work_id":"9fe904b3-9b7d-4cd3-812c-9d16325df2d2","year":2024},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:47.412541Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:b93198bfb51152d3a2fc093be9d83be24e79548e9168c26db1637f756ba5e7cb","observation_id":"5441a9d9-da6f-4eb0-a2cb-cfe0b602ed5f","resolution":{"observed_at":"2026-08-05T21:58:57.591430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:57.173074Z","title":"Speaker-dependent WaveNet vocoder","venue":null,"work_id":"e67353b0-5121-49f9-973b-f0cbde963816","year":2017},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:47.546314Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:95446b110803c04abad549d87338d4109afd3321f371df0d622b7379856bdaa6","observation_id":"f42669cb-bf37-4286-b90e-1ccde5739f80","resolution":{"observed_at":"2026-08-05T21:58:57.317288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:56.931383Z","title":"SampleRNN-based neural vocoder for statistical parametric speech synthesis,","venue":null,"work_id":"0ba1d3ea-b88e-4acd-8484-bd479e4fe1c1","year":2018},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:47.669624Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:732c3dd4709c96096cdc6d547cb2c82e1241fc701251b378a2e5955c3feb5b4d","observation_id":"3c1c86a8-5998-419b-898b-81f96cee2141","resolution":{"observed_at":"2026-08-05T21:58:57.062141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:56.673607Z","title":"A neural vocoder with hierarchical generation of amplitude and phase spectra for statistical parametric speech synthesis,","venue":null,"work_id":"a1ee9ec9-9eb3-41da-a203-74e4a2fd1977","year":2020},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:47.790780Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:ae923523c90f5f57c540e7214feac51f0a983719eef65d390cf09c671f0f9f0f","observation_id":"1a7c2d6a-50dc-4114-8f94-46fc84d81c2a","resolution":{"observed_at":"2026-08-05T21:58:56.757880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:56.441814Z","title":"WaveGlow: A flow-based generative network for speech synthesis,","venue":null,"work_id":"35b872d0-801e-4e25-8b47-77f1190300f9","year":2019},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:47.931953Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:058981b1620203b9c1c4113ff076bee19bbcf19937d7b4e3e8b184c3ff132ea6","observation_id":"c06cbfdf-3879-4da8-bcf4-bc07036232b7","resolution":{"observed_at":"2026-08-05T21:58:56.534952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:56.240525Z","title":"WaveFlow: A compact flow- based model for raw audio,","venue":null,"work_id":"c8ad9ae9-6cf8-4b3e-b7fb-27b504520cf3","year":2020},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:48.082993Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:cf61e6f73e08808f1c38488abc08352db791348456ba926236d01e9a553b6dad","observation_id":"bdbe497a-305f-4c6d-b1ac-76f8b8651731","resolution":{"observed_at":"2026-08-05T21:58:56.343470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:56.038457Z","title":"MelGAN: Generative adversarial networks for conditional waveform synthesis,","venue":null,"work_id":"e966135b-344d-4d6d-b551-a26a87810635","year":2019},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:48.199904Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:ad7165b356dd744804d1203caf882dc61cfeb10d26679f53986b548073f52038","observation_id":"7b5a78d5-8e5f-4864-9cca-8a72ef46549e","resolution":{"observed_at":"2026-08-05T21:58:56.134580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:55.814044Z","title":"HiFi-GAN: Generative adversarial networks for efficient and high fidelity speech synthesis,","venue":null,"work_id":"70a23de7-ef48-4ba1-a1e8-eced1dbc0548","year":2020},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:48.372358Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:ace76b5fbc5b1d02db9b4ae92424bcf509fce0ff0c838e77c5149bbad90fb2b4","observation_id":"254e1a0d-9d38-4bce-b1ea-764644abeff4","resolution":{"observed_at":"2026-08-05T21:58:55.920649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:55.527873Z","title":"APNet: An all-frame-level neural vocoder incor- porating direct prediction of amplitude and phase spectra,","venue":null,"work_id":"fa2390ef-41ee-488c-99fb-9eb47a6266c3","year":2023},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:48.463847Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:ccb87acb6462276bcb89ccc9390c59ae43305ca016c1cc417f9096d097212b74","observation_id":"e8f3c741-69fb-41d1-abd6-73f169422a50","resolution":{"observed_at":"2026-08-05T21:58:55.680449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:55.223874Z","title":"BigVGAN: A universal neural vocoder with large-scale training,","venue":null,"work_id":"4e73cf5a-cf15-4f21-abfc-4af545b1b056","year":2023},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:48.589426Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:b76c1f286aed030fe82768cfbe0582cfb7f5d658eb69578a205625c28415337f","observation_id":"94c36a69-1ea9-4611-a696-2e278550d523","resolution":{"observed_at":"2026-08-05T21:58:55.399417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:54.946629Z","title":"iSTFTNet: Fast and lightweight mel-spectrogram vocoder incorporating inverse short-time Fourier transform,","venue":null,"work_id":"f8fb1d75-e0ba-4eb8-ac4b-7a7391308045","year":2022},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:48.708391Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:4100f5420bc0ff2b3951d12e8fdc35f84887505e109996a1f90770ad8d6c19a0","observation_id":"115a6e55-e11a-43e7-b292-8f02af07eeab","resolution":{"observed_at":"2026-08-05T21:58:55.077091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:54.670783Z","title":"Parallel WaveGAN: A fast waveform generation model based on generative adversarial networks with multi-resolution spectrogram,","venue":null,"work_id":"927941e9-de0d-44ff-9132-29fc780e8c4c","year":2020},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:48.845689Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:ec0c521792a6dad131ddcae6bc07e2e78042de70700cc9205c59bd2446609972","observation_id":"38c7f07d-8d42-41fe-beb0-6676aa8258ef","resolution":{"observed_at":"2026-08-05T21:58:54.814850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:54.451723Z","title":"Fregrad: Lightweight and fast frequency-aware diffusion vocoder,","venue":null,"work_id":"a9efcacd-ec96-43b1-8c2c-6e172b81dca7","year":2024},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:49.006439Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:ff2dbc1bf94551bdfd2e65b24c898b4e93e8b7a771e16494b56f5acaf6e30b19","observation_id":"28687172-ca52-44e9-887c-a76e5d49c206","resolution":{"observed_at":"2026-08-05T21:58:54.542648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:54.171356Z","title":"Direct modelling of magnitude and phase spectra for statistical parametric speech synthesis","venue":null,"work_id":"c8b52654-5e73-4d04-909a-e6794775b438","year":2017},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:49.147748Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:aab6b565bb495ac711b8504beb6985e524f5877c98304494823408ed43ea066d","observation_id":"b8f34bdf-ef2d-4b52-9b49-6d0701806c76","resolution":{"observed_at":"2026-08-05T21:58:54.277199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:53.873949Z","title":"Speech acoustic modelling from raw phase spectrum,","venue":null,"work_id":"2170d020-ce83-413d-8b72-e1ad31d74e95","year":2021},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:49.292810Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:112fa118241f05e910291fb03ae65a3f8611b4ba0c385900c8d2c953e06044cf","observation_id":"ab62aa9a-d5ab-447a-a9a7-5280d9b793bf","resolution":{"observed_at":"2026-08-05T21:58:53.987870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:53.628215Z","title":"APNet2: High-quality and high-efficiency neural vocoder with direct prediction of amplitude and phase spectra,","venue":null,"work_id":"019d32e5-8315-471d-a4ab-e34e3f28b637","year":2023},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:49.417300Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:b15dec03f9a9962d85471ff98d46da33373ed0591b811fbc192f4eaf3322b715","observation_id":"5e2ca6bc-1f05-48e5-915b-90b616e60e60","resolution":{"observed_at":"2026-08-05T21:58:53.772031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:53.400127Z","title":"FreeV: Free lunch for vocoders through pseudo inversed mel filter,","venue":null,"work_id":"c7a7abd7-147e-4072-a720-75b8b3ce3626","year":2024},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:49.530583Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:0711ef70673a56df567a485d2dd8be479497236fccf913d0d22a8588676ca773","observation_id":"5c0d74ba-2e37-4f84-877e-94b112fbab59","resolution":{"observed_at":"2026-08-05T21:58:53.493921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:53.104348Z","title":"Neural speech phase prediction based on parallel estimation architecture and anti-wrapping losses,","venue":null,"work_id":"d0a4c09c-5023-4099-9de3-d5f7b80d140c","year":2023},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:49.649105Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:2cfdc6a65d717acfe59da00b4fc975337dc1878a082721a08fec267e72874ad3","observation_id":"0293fb8e-edd9-4b2b-9de5-e91bcf71ba63","resolution":{"observed_at":"2026-08-05T21:58:53.259170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:52.763759Z","title":"ConvNeXt v2: Co-designing and scaling convnets with masked autoencoders,","venue":null,"work_id":"1054aef8-cb95-47a1-9578-9ff86d7056a8","year":2023},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:49.788952Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:b381bf7f238e04031f2a4d38d39d4acbc5de91ffaf15f92e212290d974747c9c","observation_id":"632a1649-b4d6-4cc1-b186-05fc36d2c336","resolution":{"observed_at":"2026-08-05T21:58:52.945637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:52.519881Z","title":"MDCTCodec: A lightweight MDCT-based neural audio codec towards high sampling rate and low bitrate scenarios,","venue":null,"work_id":"6176459f-a3df-4f3d-918b-a07c11912c50","year":2024},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:49.940636Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:001f2c003d6b78dc153f69ba6ef7ea1e396421891c383bc9dc566162bc8dd01f","observation_id":"48a34773-d97d-4d6e-8d3a-4bcedd3889a5","resolution":{"observed_at":"2026-08-05T21:58:52.641348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:52.236539Z","title":"Bivocoder: A bidirectional neural vocoder integrating feature extraction and waveform generation,","venue":null,"work_id":"f33dbc39-1a51-4d6a-af47-95089753eb11","year":2024},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:50.101371Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:2532f0383523244770dc5aa4c44a61a2e7ac67ae68908d7b5aec8d49346027d1","observation_id":"e8942547-c246-4bea-aae6-1136e5146983","resolution":{"observed_at":"2026-08-05T21:58:52.386895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.08415","last_updated":"2023-06-06T01:53:32Z","snapshot_observed_at":"2026-07-06T05:01:27.910364Z","submitted_at":"2016-06-27T19:20:40Z","title":"Gaussian Error Linear Units (GELUs)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.08415","snapshot_observed_at":"2026-08-05T21:58:50.228558Z","title":"Gaussian error linear units (GELUs),","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:50.228558Z"},"links":{"cited_paper":"/paper/1606.08415","citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:f01ebc02752efcb61fc86214627eb51cf8e14c9f4711b715f3995345720c6f7f","observation_id":"2b208833-e7a9-4285-a7a7-0d981bf94520","resolution":{"observed_at":"2026-08-05T21:58:50.228558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:50.352825Z","title":"Neural networks fail to learn periodic functions and how to fix it,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:50.352825Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:bdacf4e7c356af1136873350553957bc6b0dc3952e01c904c3cf296c98f2326b","observation_id":"d0f2d758-53b3-4562-9572-65ee880f1d8e","resolution":{"observed_at":"2026-08-05T21:58:50.352825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:51.960142Z","title":"Superseded-CSTR VCTK corpus: English multi-speaker corpus for cstr voice cloning toolkit,","venue":null,"work_id":"e7bc5d92-5d2c-4bf0-b3b5-d858dc621518","year":2016},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:50.480425Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:58b065a6bc355835585361469f2974175d673f76e7beadc0d4f7c362b071560c","observation_id":"1057ac96-69d2-4b78-8ac8-0c41f81b4d00","resolution":{"observed_at":"2026-08-05T21:58:52.084052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:51.651169Z","title":"Adam: A method for stochastic optimization,","venue":null,"work_id":"b8dcd296-63c2-44c1-b8ef-ca97cc61e6cc","year":2015},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:50.632347Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:976856a991f7a0de02ef977c1db3985bd819930e5781bb6cab50a33e8de04065","observation_id":"1c07c425-2055-487d-9c9b-d4c5f4edf8eb","resolution":{"observed_at":"2026-08-05T21:58:51.815178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:51.441520Z","title":"V ocos: Closing the gap between time-domain and fourier- based neural vocoders for high-quality audio synthesis,","venue":null,"work_id":"87a27d1c-0e1d-4993-8289-bf138f062217","year":2024},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:50.828841Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:719dc012e93793167f0527bbc5e89e916d329754e04892d1ffb65be6d618b50b","observation_id":"36f32ae5-7a60-4379-abe0-51e776101ebd","resolution":{"observed_at":"2026-08-05T21:58:51.543909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:58:51.183470Z","title":"UTMOS: Utokyo-sarulab system for voiceMOS Chal- lenge 2022,","venue":null,"work_id":"c2bc34d7-15ca-4b7b-a533-c5843ea94511","year":2022},"citing_paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T21:58:50.975699Z"},"links":{"citing_paper":"/paper/2508.07711"},"observation_digest":"sha256:4195e2a547b79e8bf1c3355b196ec29859fa7f207e1c659dcad6335f64ac6817","observation_id":"3ff8ec59-cb1f-41ac-9a0f-fd7692d0d78d","resolution":{"observed_at":"2026-08-05T21:58:51.282181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.07711","last_updated":"2025-08-11T07:38:48Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-05T21:58:46.382160Z","submitted_at":"2025-08-11T07:38:48Z","title":"Is GAN Necessary for Mel-Spectrogram-based Neural Vocoder?"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":0,"verified_fuzzy":27},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 0 inbound Pith citation observations for arXiv:2508.07711."}