{"as_of":"2026-08-12T10:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7127c8e47ded1e6627099e6a03c79f07cf9a1caf5822d234ca51f3028ce1984b","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T19:27:35.376381Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T19:27:35.245680Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-10T19:27:35.596808Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"cited_work":{"arxiv_id":"2501.10045","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.10045","snapshot_observed_at":"2026-08-10T19:27:35.596808Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","venue":"cs.SD","work_id":"ed298264-3129-4f33-814b-e59bbc0cd5b7","year":2025},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.245680Z"},"links":{"cited_paper":"/paper/2501.10045","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:96eeaac56a56e03f1c0652badb2ef55d11cf4f2110b8139f94a4dd5a3055c5ca","observation_id":"f126c493-39a4-4aa4-893b-ef23f527b24c","resolution":{"observed_at":"2026-08-10T19:27:35.601398Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.10045/citation-record","integrity":"/paper/2501.10045/integrity","json":"/paper/2501.10045/citation-record.json","paper":"/paper/2501.10045"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"cited_work":{"arxiv_id":"2501.10045","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.10045","snapshot_observed_at":"2026-08-10T19:27:35.596808Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","venue":"cs.SD","work_id":"ed298264-3129-4f33-814b-e59bbc0cd5b7","year":2025},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.245680Z"},"links":{"cited_paper":"/paper/2501.10045","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:96eeaac56a56e03f1c0652badb2ef55d11cf4f2110b8139f94a4dd5a3055c5ca","observation_id":"f126c493-39a4-4aa4-893b-ef23f527b24c","resolution":{"observed_at":"2026-08-10T19:27:35.601398Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.947032Z","title":"However, SR requires not only waveform reconstruction but also precise high-resolution prediction","venue":null,"work_id":"934552f3-4a85-48e8-9c0b-20d65d860692","year":null},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.250859Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:745f89e3ad749b819bc8350b437642e75b176f761d9e3af856a1fcd44e0604a7","observation_id":"11868aff-0021-4c83-9240-33204f6451ea","resolution":{"observed_at":"2026-08-10T19:27:35.951117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.935856Z","title":null,"venue":null,"work_id":"efa8c1cc-aaeb-4ba8-8d75-2c02c3cace8a","year":null},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.255186Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:16e7c7d0752b5a7183477af4abaa6aa7f20b2cd76cb27c605e814a7abe8c13cd","observation_id":"0d2bf950-58bd-439a-8852-e111a31545df","resolution":{"observed_at":"2026-08-10T19:27:35.939444Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.925157Z","title":null,"venue":null,"work_id":"a525d259-ac32-46f7-94ba-0687452d83c0","year":null},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.259336Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:d7d595d7c003ba5709dc17ff09d3085e938198cbdecb3070ee728ef425405e23","observation_id":"c8a7e779-2ce3-4594-a98b-476dbbfbcf91","resolution":{"observed_at":"2026-08-10T19:27:35.928792Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.913538Z","title":"Speech en- hancement via frequency bandwidth extension using line spec- tral frequencies,","venue":null,"work_id":"3b57307a-6fc2-4043-a364-e3c196d8a853","year":2001},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.263536Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:0652970e31a9952a143e1dad891893c280a31e34fadef05f914500f9fa7846a8","observation_id":"94dc5d04-2d0c-4da9-924e-b263d8f306bc","resolution":{"observed_at":"2026-08-10T19:27:35.917541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.13731","last_updated":"2021-10-05T15:52:27Z","snapshot_observed_at":"2026-07-06T11:52:12.204724Z","submitted_at":"2021-09-28T13:51:16Z","title":"VoiceFixer: Toward General Speech Restoration with Neural Vocoder","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.13731","snapshot_observed_at":"2026-08-10T19:27:35.267557Z","title":"V oiceFixer: Toward general speech restoration with neural vocoder,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.267557Z"},"links":{"cited_paper":"/paper/2109.13731","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:efd2165eb1ac7b24e956cef5ca2b432d11b051d967373f472a6a15b01d8e5a5a","observation_id":"6d42754f-9c17-430d-bf76-2fadab36fe43","resolution":{"observed_at":"2026-08-10T19:27:35.267557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.901892Z","title":"A mel-cepstral analysis technique restoring high frequency components from low-sampling-rate speech,","venue":null,"work_id":"52960f79-aea7-4a8e-b844-31453fef9cae","year":2014},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.271484Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:e71bee80244fbd765232c7f2166494467d35f1e07842001e1de0f05bf332e49a","observation_id":"3674f96c-ff99-4b43-b9c6-f9f75e7322e6","resolution":{"observed_at":"2026-08-10T19:27:35.906069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.888923Z","title":"Statis- tical recovery of wideband speech from narrowband speech,","venue":null,"work_id":"45fc1039-0286-400d-8847-a5d23a4f69f4","year":1994},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.275385Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:b0d8e99361a5f7ec00b541834ffb4c3eba7e98964d4d7540ffe39886662739be","observation_id":"4728eb77-32c6-4f39-8b6c-9e301aef2452","resolution":{"observed_at":"2026-08-10T19:27:35.893744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.755161Z","title":"Speech bandwidth extension using gaussian mixture model- based estimation of the highband mel spectrum,","venue":null,"work_id":"ff822522-2b9f-42d3-8b30-535573f8bfd4","year":2011},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.278787Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:22cbaa8a7c44ba70a6d70b101e2bc460fc5fc41440234f7792f99db560594c12","observation_id":"40529da6-17bf-408f-836a-259066d7554c","resolution":{"observed_at":"2026-08-10T19:27:35.759802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.742855Z","title":"Memory-based approxima- tion of the gaussian mixture model framework for bandwidth extension of narrowband speech,","venue":null,"work_id":"801a5d91-2437-437a-a8f2-3a7e3af45ecb","year":2011},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.282920Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:663861cfc949af8ac1fe4c96de840e2e091e353197d9ad672c8c7a4f6608076d","observation_id":"fd2aa87e-686e-4dee-9e5a-de3f0ec514dc","resolution":{"observed_at":"2026-08-10T19:27:35.746978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.731414Z","title":"Synchronous overlap and add of spectra for enhancement of excitation in artificial bandwidth extension of speech,","venue":null,"work_id":"c56bcd67-2e75-41fc-aa26-2f074f31b868","year":2015},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.286401Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:5829a3f785fb7f31a8f0257840866533ccc0839c2abb59dd6f9e9b79a945d0c3","observation_id":"f8006935-b8c6-409e-a7a4-1f4a39980641","resolution":{"observed_at":"2026-08-10T19:27:35.735295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.718930Z","title":"Audio super resolu- tion using neural networks,","venue":null,"work_id":"b8dfc95b-2425-4ba9-957b-ff8decaf3e11","year":2017},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.290114Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:c4024564362045d2f79a4ca74ffcca1e49a466214ee4bb4f424154ed8d6f3e0e","observation_id":"11693ab4-d8b6-4656-8959-106c551b3972","resolution":{"observed_at":"2026-08-10T19:27:35.722653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.706791Z","title":"Time-frequency networks for audio super- resolution,","venue":null,"work_id":"40845506-5cd0-43f1-970a-d7bc29d45aa7","year":2017},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.294182Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:894fb46d491e3b5c5a6ebcf4b5e6db32c11378c116f9a61201035634850485b4","observation_id":"7ea5a7e0-fddf-4d98-88a6-ca150dc4165d","resolution":{"observed_at":"2026-08-10T19:27:35.711052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.694390Z","title":"Speech audio super-resolution for speech recognition,","venue":null,"work_id":"76db0417-4199-4def-9aaa-65cdafef41ba","year":2019},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.297867Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:0111e02e9e0d3558ba4cd9efa8981496172745bafc644128534b763de3448793","observation_id":"58e068f9-a004-44ff-a257-79873aab46c9","resolution":{"observed_at":"2026-08-10T19:27:35.699117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.678804Z","title":"Speaker and phoneme-aware speech bandwidth ex- tension with residual dual-path network,","venue":null,"work_id":"77672d31-61f5-4b4a-9127-ac67530610c2","year":2020},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.301188Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:8fea4e183a7f3afd861f84898dcfa13d7c3b3e89cf5d65e60c0059ad917a1fc0","observation_id":"e46b4b9f-415a-4664-a9ce-2d6f3a021c78","resolution":{"observed_at":"2026-08-10T19:27:35.684585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.662394Z","title":"Towards robust speech super- resolution,","venue":null,"work_id":"4ba8168c-486e-49c6-b05e-c1469cdb64f6","year":2021},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.304700Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:d49554ea719762067fc7d09fe20b3f5c3aa441d084847ed7dc316d98c2174fa3","observation_id":"bc4ccd97-9eae-437e-b0ec-1774ce7dfeca","resolution":{"observed_at":"2026-08-10T19:27:35.667501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.02321","last_updated":"2021-06-17T04:36:40Z","snapshot_observed_at":"2026-08-04T06:17:08.834380Z","submitted_at":"2021-04-06T06:52:53Z","title":"NU-Wave: A Diffusion Probabilistic Model for Neural Audio Upsampling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.02321","snapshot_observed_at":"2026-08-10T19:27:35.309153Z","title":"Nu-wave: A diffusion probabilistic model for neural audio upsampling,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.309153Z"},"links":{"cited_paper":"/paper/2104.02321","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:821c00e59656699b270b9a64658e72f1a973fe525080d78f289e45006a37692d","observation_id":"e5bcca4f-d093-44b9-ba0b-660b62e04e4c","resolution":{"observed_at":"2026-08-10T19:27:35.309153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.08507","last_updated":"2021-06-16T01:37:34Z","snapshot_observed_at":"2026-08-12T02:57:11.315428Z","submitted_at":"2021-06-16T01:37:34Z","title":"WSRGlow: A Glow-based Waveform Generative Model for Audio Super-Resolution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.08507","snapshot_observed_at":"2026-08-10T19:27:35.312915Z","title":"WSRGlow: A glow- based waveform generative model for audio super-resolution,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.312915Z"},"links":{"cited_paper":"/paper/2106.08507","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:bae9f45c6d7ebe84d7e43c9d072234d095e035c91bdb1444fd29999701f9e45d","observation_id":"9cd2db19-0a99-421f-a7fc-8ff0b0f527dc","resolution":{"observed_at":"2026-08-10T19:27:35.312915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.08545","last_updated":"2022-07-01T00:35:28Z","snapshot_observed_at":"2026-08-09T21:41:16.859850Z","submitted_at":"2022-06-17T04:40:14Z","title":"NU-Wave 2: A General Neural Audio Upsampling Model for Various Sampling Rates","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.08545","snapshot_observed_at":"2026-08-10T19:27:35.317049Z","title":"NUWave 2: A general neural au- dio upsampling model for various sampling rates,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.317049Z"},"links":{"cited_paper":"/paper/2206.08545","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:da7f1cbb79972e027aa5406b181f41bbbe98b3d48472afc67e77d7fa92a6a09f","observation_id":"fc0b52b2-a062-40e8-93b1-1fa37172bd93","resolution":{"observed_at":"2026-08-10T19:27:35.317049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.647470Z","title":"Neu- ral vocoder is all you need for speech super-resolution,","venue":null,"work_id":"cec6d5e3-eb39-4e28-99cf-d0a6121c85e2","year":2022},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.321167Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:81f3886e3c953a43e59a628a331bce677edd089e22081de6cd5c3d8c3445a4b2","observation_id":"e342141d-e632-4225-9fbb-2ef55e5d03ef","resolution":{"observed_at":"2026-08-10T19:27:35.652039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07314","last_updated":"2023-09-13T21:00:09Z","snapshot_observed_at":"2026-07-06T16:18:14.063635Z","submitted_at":"2023-09-13T21:00:09Z","title":"AudioSR: Versatile Audio Super-resolution at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07314","snapshot_observed_at":"2026-08-10T19:27:35.325429Z","title":"AudioSR: Versatile audio super-resolution at scale,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.325429Z"},"links":{"cited_paper":"/paper/2309.07314","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:70f1fd0e5fdf3456a6098cf32f6e6434b1cf6b89332348d654643c5493256774","observation_id":"d3b33b93-c2b9-4f7c-8fc3-189e12dc9eb6","resolution":{"observed_at":"2026-08-10T19:27:35.325429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11825","last_updated":"2024-11-28T02:44:32Z","snapshot_observed_at":"2026-07-06T17:05:02.853583Z","submitted_at":"2023-12-19T03:31:19Z","title":"MossFormer2: Combining Transformer and RNN-Free Recurrent Network for Enhanced Time-Domain Monaural Speech Separation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11825","snapshot_observed_at":"2026-08-10T19:27:35.329980Z","title":"MossFormer2: Combin- ing transformer and RNN-free recurrent network for enhanced time-domain monaural speech separation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.329980Z"},"links":{"cited_paper":"/paper/2312.11825","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:18da700de87937ea35bb3923147fdbdb76931ab98c7e0b72f3a237a16085b18a","observation_id":"c2162230-c407-4829-abc8-f2259cebb3e2","resolution":{"observed_at":"2026-08-10T19:27:35.329980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.05646","last_updated":"2020-10-23T09:12:04Z","snapshot_observed_at":"2026-07-06T10:03:33.857220Z","submitted_at":"2020-10-12T12:33:43Z","title":"HiFi-GAN: Generative Adversarial Networks for Efficient and High Fidelity Speech Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.05646","snapshot_observed_at":"2026-08-10T19:27:35.334307Z","title":"HiFi-GAN: Generative adversar- ial networks for efficient and high fidelity speech synthesis,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.334307Z"},"links":{"cited_paper":"/paper/2010.05646","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:a189c83ee951b650a66bec5d90763841c2c7c2371e63db6225800ba9d8d4f370","observation_id":"1cd59664-8011-4b3b-abdd-476fb2bea821","resolution":{"observed_at":"2026-08-10T19:27:35.334307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.06711","last_updated":"2019-12-09T01:17:32Z","snapshot_observed_at":"2026-07-06T08:29:37.057423Z","submitted_at":"2019-10-08T15:03:08Z","title":"MelGAN: Generative Adversarial Networks for Conditional Waveform Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.06711","snapshot_observed_at":"2026-08-10T19:27:35.338237Z","title":"MelGAN: Gen- erative adversarial networks for conditional waveform synthe- sis,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.338237Z"},"links":{"cited_paper":"/paper/1910.06711","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:3bd430ee4f4c1d8e64b2f0eea6e27ac79be3f9aa6b051a18b1219b5ed996c0cb","observation_id":"7915faf3-cfbe-4c63-85d2-564881084d29","resolution":{"observed_at":"2026-08-10T19:27:35.338237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.11824","last_updated":"2023-02-23T07:17:12Z","snapshot_observed_at":"2026-08-05T06:46:31.733569Z","submitted_at":"2023-02-23T07:17:12Z","title":"MossFormer: Pushing the Performance Limit of Monaural Speech Separation using Gated Single-Head Transformer with Convolution-Augmented Joint Self-Attentions","version":1},"cited_work":{"arxiv_id":"2302.11824","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.11824","snapshot_observed_at":"2026-08-10T19:27:35.481521Z","title":"MossFormer: Pushing the Performance Limit of Monaural Speech Separation using Gated Single-Head Transformer with Convolution-Augmented Joint Self-Attentions","venue":"cs.SD","work_id":"2b948e30-336c-462e-96f0-9424e6a13b20","year":2023},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.342470Z"},"links":{"cited_paper":"/paper/2302.11824","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:a5507917e04b557e8098cc4a7b3c412b034b5127ffdc0e1352495b16832fd408","observation_id":"46e5d25c-c395-4ca3-81c5-77e187215e08","resolution":{"observed_at":"2026-08-10T19:27:35.488238Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05030","last_updated":"2018-03-04T11:08:16Z","snapshot_observed_at":"2026-08-03T17:26:08.990525Z","submitted_at":"2018-03-04T11:08:16Z","title":"Deep-FSMN for Large Vocabulary Continuous Speech Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05030","snapshot_observed_at":"2026-08-10T19:27:35.346297Z","title":"Deepfsmn for large vo- cabulary continuous speech recognition,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.346297Z"},"links":{"cited_paper":"/paper/1803.05030","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:5485acb1e86b212003461d4130dbc8285f20ba08ae51b67e1c15866d03ecd922","observation_id":"a419540f-7fb6-4b75-8c5f-1b6086afdbd4","resolution":{"observed_at":"2026-08-10T19:27:35.346297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04658","last_updated":"2023-02-16T18:48:56Z","snapshot_observed_at":"2026-08-10T13:38:24.556897Z","submitted_at":"2022-06-09T17:56:10Z","title":"BigVGAN: A Universal Neural Vocoder with Large-Scale Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.04658","snapshot_observed_at":"2026-08-10T19:27:35.350513Z","title":"Bigvgan: A universal neural vocoder with large-scale train- ing,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.350513Z"},"links":{"cited_paper":"/paper/2206.04658","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:c54f765e2be6aef3ae6ff62a7622b1ffafe5aa8cc76ec53b9616ceb2894dfe8e","observation_id":"68d6507c-c793-4dc5-93ff-46f1ca205a62","resolution":{"observed_at":"2026-08-10T19:27:35.350513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.13438","last_updated":"2022-10-24T17:52:02Z","snapshot_observed_at":"2026-08-09T07:12:13.721596Z","submitted_at":"2022-10-24T17:52:02Z","title":"High Fidelity Neural Audio Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.13438","snapshot_observed_at":"2026-08-10T19:27:35.354237Z","title":"High fidelity neural audio compression,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.354237Z"},"links":{"cited_paper":"/paper/2210.13438","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:deaa0291c4182554e66e850f35cdfd8b3f1d7430a18fa6b0c0bc92e46df22cbc","observation_id":"44bdd52b-ef46-4d0f-91e2-8f33775bd92d","resolution":{"observed_at":"2026-08-10T19:27:35.354237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06546","last_updated":"2023-10-26T22:17:49Z","snapshot_observed_at":"2026-07-06T15:41:13.274608Z","submitted_at":"2023-06-11T00:13:00Z","title":"High-Fidelity Audio Compression with Improved RVQGAN","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.06546","snapshot_observed_at":"2026-08-10T19:27:35.358913Z","title":"High-fidelity audio compression with improved RVQGAN,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.358913Z"},"links":{"cited_paper":"/paper/2306.06546","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:4a2757e9ee2fffe66e13436768409e2d4a927811ffd6a19f2874449e5f950166","observation_id":"af746ae4-eecd-401a-8723-5f5a39208e55","resolution":{"observed_at":"2026-08-10T19:27:35.358913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.635303Z","title":"Least squares generative adversarial networks,","venue":null,"work_id":"2061fd3d-4568-47ce-b94e-d751718df3c4","year":2017},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.362788Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:643c603291da543ad040043725f9b419c93ccdd03362aee535a3f911a5043a34","observation_id":"4194de1d-8f93-40ce-8221-7218552ce846","resolution":{"observed_at":"2026-08-10T19:27:35.639488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.622174Z","title":"CSTR VCTK corpus: English multi-speaker corpus for cstr voice cloning toolkit,","venue":null,"work_id":"94123f51-0e38-4b49-96a4-c643b6e9c11e","year":2019},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.366283Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:da32cb5d44b4c2d2a1a31131a9bc522fba1084b53c9b754c26f8f0c4f8350a93","observation_id":"09c0e47e-604a-4065-bba3-0f5c9b7dc130","resolution":{"observed_at":"2026-08-10T19:27:35.626793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05725","last_updated":"2023-08-10T17:41:19Z","snapshot_observed_at":"2026-07-06T16:04:58.235073Z","submitted_at":"2023-08-10T17:41:19Z","title":"EXPRESSO: A Benchmark and Analysis of Discrete Expressive Speech Resynthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05725","snapshot_observed_at":"2026-08-10T19:27:35.369528Z","title":"Expresso: A benchmark and analysis of discrete expressive speech resynthesis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.369528Z"},"links":{"cited_paper":"/paper/2308.05725","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:8f9644f80a09fd35ddfe6b2eef0d7419c387720a79a00f87ca902d0720122adf","observation_id":"cbbfc07c-f8c8-4409-aeea-5b45fd9e2ecd","resolution":{"observed_at":"2026-08-10T19:27:35.369528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:27:35.609624Z","title":"V ocalset: A singing voice dataset,","venue":null,"work_id":"9427de9d-1161-4f41-a2ab-54c1143e34e7","year":2018},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.373009Z"},"links":{"citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:0885b80737f7f23c6ce5dd4a1407978ef9ea3bfe640a7264f674a152f76ee4e5","observation_id":"f1c3188b-a450-4871-be9e-d151da94c43c","resolution":{"observed_at":"2026-08-10T19:27:35.613607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-10T19:27:35.376381Z","title":"Decoupled weight decay regularization,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T19:27:35.376381Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2501.10045"},"observation_digest":"sha256:58d38ae89e7616d2675227902d5e86e21845cd958a0161f2f34f1d57be151fed","observation_id":"e2dcb97b-20ab-4b5d-a845-77a489d14512","resolution":{"observed_at":"2026-08-10T19:27:35.376381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.10045","last_updated":"2025-01-17T09:04:38Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-12T02:57:22.986961Z","submitted_at":"2025-01-17T09:04:38Z","title":"HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":16,"verified_exact":1,"verified_fuzzy":16},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 1 inbound Pith citation observation for arXiv:2501.10045."}