{"as_of":"2026-08-16T19:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2e40c9d62b2267bc156384cac5fbecfe4e2ac63919fdb4a272cbe70acdd66d28","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T15:04:32.900274Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T15:04:32.627267Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-14T15:04:33.320936Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"cited_work":{"arxiv_id":"1908.01919","doi":null,"metadata_source":"pith","pith_arxiv_id":"1908.01919","snapshot_observed_at":"2026-08-14T15:04:33.320936Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","venue":"cs.SD","work_id":"2e93f71a-90cd-47bd-96ad-b44e0f4af608","year":2019},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.627267Z"},"links":{"cited_paper":"/paper/1908.01919","citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:edbcfda6a4e05c2346d6eeb6beedbbf4da08aa326eb41dd981e88c6cfc01fa85","observation_id":"92949faf-371f-4e48-bda3-c872d050e3eb","resolution":{"observed_at":"2026-08-14T15:04:33.336154Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/1908.01919/citation-record","integrity":"/paper/1908.01919/integrity","json":"/paper/1908.01919/citation-record.json","paper":"/paper/1908.01919"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.958380Z","title":"For example, three SVS sys- tems based on DNN, LSTM, and Wavenet architecture were proposed, respectively [4, 5, 6]","venue":null,"work_id":"012af2c9-eb48-4b7d-8703-558f43da587e","year":null},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.611254Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:f393a5eb5baf192348884a8a4f7a4487058f13cc9d05e99cd0d149834cad9ee7","observation_id":"934fab5a-717e-438b-b020-d4f6cfbebe3d","resolution":{"observed_at":"2026-08-14T15:04:33.967134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.933518Z","title":"Recently, the end-to-end TTS system, which is trained as an autoregressive manner, such as Tacotron[8], Deep voice[9], is showing better performance than the conventional method","venue":null,"work_id":"1b62dfab-e9e1-4f01-9df6-948075332c3a","year":null},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.620446Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:f5c8f22fda8f7b183569e7ac4bcf36f0eb01b97c6567d588d9ea8bfb25bd5e92","observation_id":"3fb0fad9-ed63-4060-9cb4-6805beee4ee6","resolution":{"observed_at":"2026-08-14T15:04:33.941450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"cited_work":{"arxiv_id":"1908.01919","doi":null,"metadata_source":"pith","pith_arxiv_id":"1908.01919","snapshot_observed_at":"2026-08-14T15:04:33.320936Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","venue":"cs.SD","work_id":"2e93f71a-90cd-47bd-96ad-b44e0f4af608","year":2019},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.627267Z"},"links":{"cited_paper":"/paper/1908.01919","citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:edbcfda6a4e05c2346d6eeb6beedbbf4da08aa326eb41dd981e88c6cfc01fa85","observation_id":"92949faf-371f-4e48-bda3-c872d050e3eb","resolution":{"observed_at":"2026-08-14T15:04:33.336154Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.877778Z","title":"Dataset Since there is no publicly available Korean singing voice dataset, we created the dataset as follows","venue":null,"work_id":"0c8b8823-65eb-4289-a480-6a7c38bca7c4","year":null},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.644526Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:280f3b30325019f70e6c0a34a1a1153f12e308f586bddf32d534e1cec08dfcde","observation_id":"741b659e-30c1-4e2f-868a-8b3053bf6ae3","resolution":{"observed_at":"2026-08-14T15:04:33.884267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.824581Z","title":"We showed that using text information to model the phonetic enhancement mask actually worked, and produced more accurate pronunciation","venue":null,"work_id":"a44a4195-9ac4-42e5-bb7c-4cfb080262f2","year":null},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.666130Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:d35bd221f8321448693a3cc09b528459a57e7d30f567baae8face0e3f2ca7989","observation_id":"7aeed66b-7dba-4fe9-bc1c-61062e500dc4","resolution":{"observed_at":"2026-08-14T15:04:33.831986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.852894Z","title":"In the case of sound quality, methods 1 and 2 did not sig- niﬁcantly affect the improvement, but the applying method 3 Figure 3: Generated spectrograms","venue":null,"work_id":"628526c2-c9e5-4327-89a7-3327caec4ddb","year":null},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.651856Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:ecf8312ef03a620b222d41ddefb98d394cd41bc48221436f309e0f65f3875106","observation_id":"7531fb99-55f1-4da9-9a43-104570be3dd2","resolution":{"observed_at":"2026-08-14T15:04:33.861589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.902128Z","title":"First, in order to enter pitch information, we added pitch encoders with the same structure as text encoders","venue":null,"work_id":"94a17248-7898-4662-87ba-aaa79ab6e368","year":null},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.633847Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:c28c5ed0165af35ace716f25c7684a35afaefd6fa5d124ac69b08005ed548207","observation_id":"a1c2393c-8eda-45d1-a8fb-e5f515805a8f","resolution":{"observed_at":"2026-08-14T15:04:33.910285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.802406Z","title":null,"venue":null,"work_id":"8a7da32e-27cb-4cf2-a750-04f2c3763ef8","year":2019},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.676867Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:c1a4ff79efa362b843333381f96fbdc5c0348c2a2087252c2ef2bfe6e2604b73","observation_id":"f23577e3-7b8d-47f7-9906-f76174edb6b3","resolution":{"observed_at":"2026-08-14T15:04:33.809414Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.777751Z","title":"Concatenation-based midi-to-singing voice syn- thesis,","venue":null,"work_id":"f7b4f01a-8568-4e1e-ab20-d4e578a89844","year":1997},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.688904Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:c9633bc39bd38f24a725a7f126a5f78c7d15971a0c3bb8d380dd758786aa3f34","observation_id":"a24a3a0f-946f-4805-8aae-db02de1e9633","resolution":{"observed_at":"2026-08-14T15:04:33.785392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.740040Z","title":"Sample- based singing voice synthesizer using spectral models and source- ﬁlter decomposition,","venue":null,"work_id":"16414932-3193-4bf5-82dc-1d00ab54b6b5","year":2003},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.697292Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:809d76e74284040983476c41900c75397735075c4d6ad9e562cc79cf71331e6e","observation_id":"dcc44047-ebb8-4631-b94d-415def622cb0","resolution":{"observed_at":"2026-08-14T15:04:33.748347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.709132Z","title":"V ocaloid-commercial singing syn- thesizer based on sample concatenation,","venue":null,"work_id":"137bb1c7-8063-4f0e-96b9-39991feaeaba","year":2007},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.707465Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:cad278b590f223b5727f063c05aab710322f0447604b9fe3481bffd346753f77","observation_id":"3c900d7c-25d3-4f04-b803-982c108a5b2a","resolution":{"observed_at":"2026-08-14T15:04:33.717634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.675813Z","title":"Singing voice synthesis based on deep neural net- works","venue":null,"work_id":"9d23e098-0a0f-4cc2-b7ae-20529c14c9f0","year":2016},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.718522Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:26c8eabde0d2424a2f7f82cb0ceea14589bec76aa694bd9f4bb64f2f2db7fa97","observation_id":"69fa44f2-3c68-4a85-afbc-9284035ec4c4","resolution":{"observed_at":"2026-08-14T15:04:33.685795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.650487Z","title":"Korean singing voice synthesis system based on an lstm recurrent neural network,","venue":null,"work_id":"924720a2-77fa-4381-ae4b-84d480931b9c","year":2018},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.733260Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:cf1366c62f2f57b667a6c2b159c2f8676dd276585f121e755d2a58955d412247","observation_id":"5cb98ab3-756f-4131-9ce7-4f0ee8ea61ae","resolution":{"observed_at":"2026-08-14T15:04:33.656525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.627497Z","title":"A neural parametric singing synthe- sizer modeling timbre and expression from natural songs,","venue":null,"work_id":"0a54eb71-de9e-487e-97ca-94417d5ad29b","year":2017},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.744963Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:00baf018faa2cc1d168c58cede303bd7a026d4636d72a58ccc67459a4de030ef","observation_id":"54a0a82a-e11c-41a9-967b-08686ecc9f4e","resolution":{"observed_at":"2026-08-14T15:04:33.634598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.595781Z","title":"Efﬁciently train- able text-to-speech system based on deep convolutional networks with guided attention,","venue":null,"work_id":"d639249c-91e9-4949-b881-6f10084c2de3","year":2018},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.751267Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:5e63aefe1ea893a74c8a1da89a1aebbe7dfea9da96ef2b0ca19754b81de70749","observation_id":"8acdb953-2939-4c27-ba9b-86d6717b1f96","resolution":{"observed_at":"2026-08-14T15:04:33.604675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1703.10135","last_updated":"2017-04-06T21:20:34Z","snapshot_observed_at":"2026-08-14T21:09:20.948173Z","submitted_at":"2017-03-29T16:55:13Z","title":"Tacotron: Towards End-to-End Speech Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.10135","snapshot_observed_at":"2026-08-14T15:04:32.758890Z","title":"Tacotron: Towards end-to-end speech synthesis,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.758890Z"},"links":{"cited_paper":"/paper/1703.10135","citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:9d3d9ffd25e64c2eb427a74c611b5788569f995773f7f443546d8b7f15d4f72f","observation_id":"1faef748-c156-4efb-89a4-05875a5c9a7e","resolution":{"observed_at":"2026-08-14T15:04:32.758890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.568577Z","title":"Deep voice 2: Multi-speaker neural text- to-speech,","venue":null,"work_id":"f4b98940-48fc-402a-8bea-d288e2285ff8","year":2017},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.765387Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:e1f9fe5de28dd7cd5c19915deb8d9a24a92164dc06fb527d208671c6e280b1b0","observation_id":"6a2e93d7-0729-4df0-ae17-de1b5bb3d99c","resolution":{"observed_at":"2026-08-14T15:04:33.577183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.09047","last_updated":"2018-03-24T02:52:58Z","snapshot_observed_at":"2026-08-16T07:49:39.892869Z","submitted_at":"2018-03-24T02:52:58Z","title":"Towards End-to-End Prosody Transfer for Expressive Speech Synthesis with Tacotron","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.09047","snapshot_observed_at":"2026-08-14T15:04:32.775499Z","title":"Towards end-to-end prosody transfer for expressive speech synthesis with tacotron,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.775499Z"},"links":{"cited_paper":"/paper/1803.09047","citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:d18ba00223341cac65abd24854a159c79ef11cce5d3428da0b7ef8b352df6588","observation_id":"67ee3b95-5455-4daa-933c-9b9c381ee10e","resolution":{"observed_at":"2026-08-14T15:04:32.775499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.09017","last_updated":"2018-03-23T23:56:49Z","snapshot_observed_at":"2026-08-14T19:32:58.812371Z","submitted_at":"2018-03-23T23:56:49Z","title":"Style Tokens: Unsupervised Style Modeling, Control and Transfer in End-to-End Speech Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.09017","snapshot_observed_at":"2026-08-14T15:04:32.790427Z","title":"Style tokens: Unsupervised style modeling, control and transfer in end-to-end speech synthesis,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.790427Z"},"links":{"cited_paper":"/paper/1803.09017","citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:efc25fa3ae15a63f965ff7d9885d4e249b4e2b57eac48eeec6bb139f6dfe81ec","observation_id":"b152ab93-0151-4dc2-a6bd-3f3f2728a6cb","resolution":{"observed_at":"2026-08-14T15:04:32.790427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1808.10128","last_updated":"2018-08-30T05:51:30Z","snapshot_observed_at":"2026-08-16T07:51:28.399851Z","submitted_at":"2018-08-30T05:51:30Z","title":"Semi-Supervised Training for Improving Data Efficiency in End-to-End Speech Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1808.10128","snapshot_observed_at":"2026-08-14T15:04:32.798183Z","title":"Semi-supervised training for improving data efﬁciency in end-to- end speech synthesis,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.798183Z"},"links":{"cited_paper":"/paper/1808.10128","citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:66a773655c678ecb498aea53a9073b684c2ed4816ffa820d2d66858521622fa4","observation_id":"234074e7-8471-4005-86aa-21266d27950c","resolution":{"observed_at":"2026-08-14T15:04:32.798183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:32.807982Z","title":"Speech band- width extension using generative adversarial networks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.807982Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:97b4d4a16c173daf35879b2c4a436724efc3b8b61155feaf911a06c3b1e423c2","observation_id":"6a427ff8-e219-4f41-8973-21b2d699c21e","resolution":{"observed_at":"2026-08-14T15:04:32.807982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.05637","last_updated":"2018-08-15T00:02:46Z","snapshot_observed_at":"2026-08-14T19:45:30.944638Z","submitted_at":"2018-02-15T16:19:21Z","title":"cGANs with Projection Discriminator","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.05637","snapshot_observed_at":"2026-08-14T15:04:32.815332Z","title":"cgans with projection discriminator,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.815332Z"},"links":{"cited_paper":"/paper/1802.05637","citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:5e85dc306da438fb9ed89be3823e448a2007ffa2b35ef1482a41266e0c38ac94","observation_id":"41e18110-478a-4b03-a7a7-974243325b8a","resolution":{"observed_at":"2026-08-14T15:04:32.815332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.11096","last_updated":"2019-02-25T21:32:06Z","snapshot_observed_at":"2026-07-06T07:04:57.275371Z","submitted_at":"2018-09-28T15:38:49Z","title":"Large Scale GAN Training for High Fidelity Natural Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.11096","snapshot_observed_at":"2026-08-14T15:04:32.822440Z","title":"Large scale gan train- ing for high ﬁdelity natural image synthesis,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.822440Z"},"links":{"cited_paper":"/paper/1809.11096","citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:5b8716547e43056572289a49c99df02bc4a0bbdbd5caf14e37b22cdb74d46563","observation_id":"2bcf71f6-6ed7-4dd2-8aea-986e76cf7b17","resolution":{"observed_at":"2026-08-14T15:04:32.822440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.521243Z","title":"Signal estimation from modiﬁed short- time fourier transform,","venue":null,"work_id":"f53872fb-5acb-43af-a111-932cd98b10ab","year":1984},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.827979Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:3cad3726a9b471293199a09c644ff30b8275bcffe9b10314670ed7771b8b37cc","observation_id":"d2a14b5d-d811-4154-ae17-c8a4e63fc977","resolution":{"observed_at":"2026-08-14T15:04:33.530052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.03499","last_updated":"2016-09-19T18:04:35Z","snapshot_observed_at":"2026-08-16T05:39:41.727705Z","submitted_at":"2016-09-12T17:29:40Z","title":"WaveNet: A Generative Model for Raw Audio","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.03499","snapshot_observed_at":"2026-08-14T15:04:32.834775Z","title":"Wavenet: A generative model for raw audio,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.834775Z"},"links":{"cited_paper":"/paper/1609.03499","citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:91f17a695ff1913294545f6e5fd8ecd326242b866ab72c1db6e5a59eab4d9081","observation_id":"be5dc81e-362c-44c9-946a-0119c5b36307","resolution":{"observed_at":"2026-08-14T15:04:32.834775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.488163Z","title":"Dropout: a simple way to prevent neural net- works from overﬁtting,","venue":null,"work_id":"43a739b3-f6f8-4793-94bd-bac94c439400","year":1929},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.841481Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:51d54bab279cbd953439974b5bc8dc00cdabd86d5e0b8656a8fdd302eedfa578","observation_id":"ef683e37-81fe-411d-9374-eb236f08c699","resolution":{"observed_at":"2026-08-14T15:04:33.501667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.461738Z","title":"Improved training of wasserstein gans,","venue":null,"work_id":"562e705c-50e4-4cc9-b78f-ea88300a1344","year":2017},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.846895Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:91b637d3aff1e864b1fefdb9d9a66538df27180b78db0d4ea5674c1a5c223c92","observation_id":"c8b0ea22-3e8a-450b-ad4b-b4a82ea1975f","resolution":{"observed_at":"2026-08-14T15:04:33.470197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.05957","last_updated":"2018-02-16T14:41:39Z","snapshot_observed_at":"2026-08-15T15:47:46.409113Z","submitted_at":"2018-02-16T14:41:39Z","title":"Spectral Normalization for Generative Adversarial Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.05957","snapshot_observed_at":"2026-08-14T15:04:32.854952Z","title":"Spectral normalization for generative adversarial networks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.854952Z"},"links":{"cited_paper":"/paper/1802.05957","citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:a04d2161522ccc94f4bd5411811231fcc405417d7c6eb0f7eee8b9289177334c","observation_id":"b7d3dad6-f809-4d86-8709-8728d30bd4d5","resolution":{"observed_at":"2026-08-14T15:04:32.854952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.04406","last_updated":"2018-07-31T16:28:15Z","snapshot_observed_at":"2026-08-14T19:55:26.403928Z","submitted_at":"2018-01-13T09:42:26Z","title":"Which Training Methods for GANs do actually Converge?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.04406","snapshot_observed_at":"2026-08-14T15:04:32.867284Z","title":"Which train- ing methods for gans do actually converge?","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.867284Z"},"links":{"cited_paper":"/paper/1801.04406","citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:6c43282bc86236324ece6595fc9d8e02f65781f6b11e34e4f6f365a7d121e5f8","observation_id":"b670dd15-f368-41f3-afe7-c523ff48dde9","resolution":{"observed_at":"2026-08-14T15:04:32.867284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.428825Z","title":"Generative adver- sarial nets,","venue":null,"work_id":"2f4c49a9-18d2-4941-bd4b-a5d9a77d7d07","year":2014},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.876401Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:1c418bbb77676d49d80c58c7ca4ec8881c7c8a5d9c2b5652628b2ea61e33825b","observation_id":"e4eb64ee-8e14-48fe-b9c1-9f8bb0350c66","resolution":{"observed_at":"2026-08-14T15:04:33.439146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-14T18:51:16.666127Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-14T15:04:32.883317Z","title":"Adam: A method for stochastic opti- mization,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.883317Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:a516e85b4114d36889136f9bb2e9dc8e0e49171de183c76e96d1f6ce5bd7a987","observation_id":"86253747-3d7a-4b5a-9239-49c409716da6","resolution":{"observed_at":"2026-08-14T15:04:32.883317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:32.890770Z","title":"Understanding the difﬁculty of train- ing deep feedforward neural networks,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.890770Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:2bfa390318707a6539c983c8363b0d5eadfe58c3863c1ba1e8012b5c461778ef","observation_id":"4972dbcd-278c-4656-a3bc-3f6b8164bb5a","resolution":{"observed_at":"2026-08-14T15:04:32.890770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:04:33.354163Z","title":"World: a vocoder-based high-quality speech synthesis system for real-time applications,","venue":null,"work_id":"700ccf04-7eb4-4205-b081-45b441f6dba9","year":2016},"citing_paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T15:04:32.900274Z"},"links":{"citing_paper":"/paper/1908.01919"},"observation_digest":"sha256:643fe15a54cd4b9a547243c0724df72363bc8c3c954ef560b9b0637c375c0ae3","observation_id":"72259870-852f-4d7e-b8dc-92deaf44c5f9","resolution":{"observed_at":"2026-08-14T15:04:33.372021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1908.01919","last_updated":"2019-08-06T01:17:44Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-16T06:30:21.482173Z","submitted_at":"2019-08-06T01:17:44Z","title":"Adversarially Trained End-to-end Korean Singing Voice Synthesis System"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":13,"verified_exact":0,"verified_fuzzy":19},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 1 inbound Pith citation observation for arXiv:1908.01919."}