{"as_of":"2026-08-16T02:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bb2e212a1a6d5270f63e3114742afc24fd79f2b0ac6f2c02a4d7b0d26d0111b4","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T12:32:40.409378Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T12:29:51.973055Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1712.05884","last_updated":"2018-02-16T01:28:23Z","snapshot_observed_at":"2026-08-14T20:03:06.478622Z","submitted_at":"2017-12-16T00:51:40Z","title":"Natural TTS Synthesis by Conditioning WaveNet on Mel Spectrogram Predictions","version":2},"cited_work":{"arxiv_id":"1712.05884","doi":null,"metadata_source":"pith","pith_arxiv_id":"1712.05884","snapshot_observed_at":"2026-07-04T12:29:51.973055Z","title":"Natural TTS Synthesis by Conditioning WaveNet on Mel Spectrogram Predictions","venue":"cs.CL","work_id":"aa655405-6620-4384-a1b6-4a9f92421c00","year":2017},"citing_paper":{"arxiv_id":"1906.11645","last_updated":"2019-06-26T11:06:05Z","snapshot_observed_at":"2026-08-03T10:43:20.980826Z","submitted_at":"2019-06-26T11:06:05Z","title":"RUSLAN: Russian Spoken Language Corpus for Speech Synthesis","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-25T15:15:38.672352Z"},"links":{"cited_paper":"/paper/1712.05884","citing_paper":"/paper/1906.11645"},"observation_digest":"sha256:de00704b237198e73444f0180e68d112ab955ea3c3c30499563961de59b52f3d","observation_id":"e84fefc7-76fb-40d8-9646-0a3adc0e46da","resolution":{"observed_at":"2026-05-25T15:15:58.483819Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05884","last_updated":"2018-02-16T01:28:23Z","snapshot_observed_at":"2026-08-14T20:03:06.478622Z","submitted_at":"2017-12-16T00:51:40Z","title":"Natural TTS Synthesis by Conditioning WaveNet on Mel Spectrogram Predictions","version":2},"cited_work":{"arxiv_id":"1712.05884","doi":null,"metadata_source":"pith","pith_arxiv_id":"1712.05884","snapshot_observed_at":"2026-07-04T12:29:51.973055Z","title":"Natural TTS Synthesis by Conditioning WaveNet on Mel Spectrogram Predictions","venue":"cs.CL","work_id":"aa655405-6620-4384-a1b6-4a9f92421c00","year":2017},"citing_paper":{"arxiv_id":"1907.07769","last_updated":"2019-07-15T07:54:46Z","snapshot_observed_at":"2026-08-15T06:30:33.316335Z","submitted_at":"2019-07-15T07:54:46Z","title":"Hierarchical Sequence to Sequence Voice Conversion with Limited Data","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-24T21:30:16.923017Z"},"links":{"cited_paper":"/paper/1712.05884","citing_paper":"/paper/1907.07769"},"observation_digest":"sha256:492fd368c28f15bfb03151e97565df016d3529ce83cca4388f1c27344197d4b0","observation_id":"fe3e802c-472a-443e-8437-7637d6c83b45","resolution":{"observed_at":"2026-05-24T21:34:58.803771Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05884","last_updated":"2018-02-16T01:28:23Z","snapshot_observed_at":"2026-08-14T20:03:06.478622Z","submitted_at":"2017-12-16T00:51:40Z","title":"Natural TTS Synthesis by Conditioning WaveNet on Mel Spectrogram Predictions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05884","snapshot_observed_at":"2026-08-14T12:32:40.409378Z","title":"Weiss, Mike Schuster, Navdeep Jaitly, Zongheng Yang, Zhifeng Chen, Yu Zhang, Yuxuan Wang, R","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.07094","last_updated":"2019-08-19T22:52:59Z","snapshot_observed_at":"2026-08-14T12:24:36.415095Z","submitted_at":"2019-08-19T22:52:59Z","title":"Unpaired Image-to-Speech Synthesis with Multimodal Information Bottleneck","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-14T12:32:40.409378Z"},"links":{"cited_paper":"/paper/1712.05884","citing_paper":"/paper/1908.07094"},"observation_digest":"sha256:021b7f34904c5a9ba2fb518d6cce26719bffb80ec31431b35327ea97211db2ac","observation_id":"cc08e4ad-b405-4ca7-a066-d8804c3554de","resolution":{"observed_at":"2026-08-14T12:32:40.409378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05884","last_updated":"2018-02-16T01:28:23Z","snapshot_observed_at":"2026-08-14T20:03:06.478622Z","submitted_at":"2017-12-16T00:51:40Z","title":"Natural TTS Synthesis by Conditioning WaveNet on Mel Spectrogram Predictions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05884","snapshot_observed_at":"2026-08-11T22:51:49.890550Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.03074","last_updated":"2024-12-04T06:52:03Z","snapshot_observed_at":"2026-08-16T00:24:08.287167Z","submitted_at":"2024-12-04T06:52:03Z","title":"Analytic Study of Text-Free Speech Synthesis for Raw Audio using a Self-Supervised Learning Model","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T22:51:49.890550Z"},"links":{"cited_paper":"/paper/1712.05884","citing_paper":"/paper/2412.03074"},"observation_digest":"sha256:b48b926e762895055702483e1686a835ad400199be50275418dec85b5c2ef2a5","observation_id":"24e6162f-c0ef-409a-837a-d5076b57dfee","resolution":{"observed_at":"2026-08-11T22:51:49.890550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05884","last_updated":"2018-02-16T01:28:23Z","snapshot_observed_at":"2026-08-14T20:03:06.478622Z","submitted_at":"2017-12-16T00:51:40Z","title":"Natural TTS Synthesis by Conditioning WaveNet on Mel Spectrogram Predictions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05884","snapshot_observed_at":"2026-08-10T21:03:46.485385Z","title":"Weiss, Mike Schuster, Navdeep Jaitly, Zongheng Yang, Zhifeng Chen, Yu Zhang, Yuxuan Wang, RJ Skerry-Ryan, Rif A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.06497","last_updated":"2025-01-15T20:43:44Z","snapshot_observed_at":"2026-08-13T23:34:38.424746Z","submitted_at":"2025-01-11T10:22:04Z","title":"PASS: Presentation Automation for Slide Generation and Speech","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T21:03:46.485385Z"},"links":{"cited_paper":"/paper/1712.05884","citing_paper":"/paper/2501.06497"},"observation_digest":"sha256:9da471a946e46912af59c03413b1f28828d5c63c6d2aff24313ed34e97c32465","observation_id":"6e0926eb-cc97-40b3-9b3d-c95ecd11022c","resolution":{"observed_at":"2026-08-10T21:03:46.485385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05884","last_updated":"2018-02-16T01:28:23Z","snapshot_observed_at":"2026-08-14T20:03:06.478622Z","submitted_at":"2017-12-16T00:51:40Z","title":"Natural TTS Synthesis by Conditioning WaveNet on Mel Spectrogram Predictions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05884","snapshot_observed_at":"2026-08-06T15:14:30.947024Z","title":"Weiss, Mike Schuster, Navdeep Jaitly, Zongheng Yang, Zhifeng Chen, Yu Zhang, Yuxuan Wang, RJ Skerry-Ryan, Rif A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.16875","last_updated":"2025-07-22T09:38:30Z","snapshot_observed_at":"2026-08-14T19:25:32.616653Z","submitted_at":"2025-07-22T09:38:30Z","title":"Technical report: Impact of Duration Prediction on Speaker-specific TTS for Indian Languages","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T15:14:30.947024Z"},"links":{"cited_paper":"/paper/1712.05884","citing_paper":"/paper/2507.16875"},"observation_digest":"sha256:cd3fbbb18ac7acc50c282a5835d36bc19250e1958e7cfd0a5cbb0f2f1d6f0bcc","observation_id":"3eee1f02-b148-45ec-823e-ce31c42c0ba5","resolution":{"observed_at":"2026-08-06T15:14:30.947024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05884","last_updated":"2018-02-16T01:28:23Z","snapshot_observed_at":"2026-08-14T20:03:06.478622Z","submitted_at":"2017-12-16T00:51:40Z","title":"Natural TTS Synthesis by Conditioning WaveNet on Mel Spectrogram Predictions","version":2},"cited_work":{"arxiv_id":"1712.05884","doi":null,"metadata_source":"pith","pith_arxiv_id":"1712.05884","snapshot_observed_at":"2026-07-04T12:29:51.973055Z","title":"Natural TTS Synthesis by Conditioning WaveNet on Mel Spectrogram Predictions","venue":"cs.CL","work_id":"aa655405-6620-4384-a1b6-4a9f92421c00","year":2017},"citing_paper":{"arxiv_id":"2605.20299","last_updated":"2026-05-19T12:34:16Z","snapshot_observed_at":"2026-07-06T23:30:53.900592Z","submitted_at":"2026-05-19T12:34:16Z","title":"Mechanisms of Misgeneralization in Physical Sequence Modeling","version":1},"reference_index":135,"source":"arxiv_source","source_observed_at":"2026-05-21T07:44:37.810511Z"},"links":{"cited_paper":"/paper/1712.05884","citing_paper":"/paper/2605.20299"},"observation_digest":"sha256:b79c25cb288d57ea358ae35275c8f5a7dac0e914abc26228b1f51ecefa39cb0c","observation_id":"fece8a9d-292e-4c75-adf3-7a32f0a38a54","resolution":{"observed_at":"2026-05-21T07:44:48.678443Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05884","last_updated":"2018-02-16T01:28:23Z","snapshot_observed_at":"2026-08-14T20:03:06.478622Z","submitted_at":"2017-12-16T00:51:40Z","title":"Natural TTS Synthesis by Conditioning WaveNet on Mel Spectrogram Predictions","version":2},"cited_work":{"arxiv_id":"1712.05884","doi":null,"metadata_source":"pith","pith_arxiv_id":"1712.05884","snapshot_observed_at":"2026-07-04T12:29:51.973055Z","title":"Natural TTS Synthesis by Conditioning WaveNet on Mel Spectrogram Predictions","venue":"cs.CL","work_id":"aa655405-6620-4384-a1b6-4a9f92421c00","year":2017},"citing_paper":{"arxiv_id":"2606.23335","last_updated":"2026-08-10T11:30:45Z","snapshot_observed_at":"2026-08-13T23:39:48.382337Z","submitted_at":"2026-06-22T13:42:31Z","title":"The Watermark Shortcut: How Provenance Marking Sabotages Audio Deepfake Detection","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-26T06:45:08.471913Z"},"links":{"cited_paper":"/paper/1712.05884","citing_paper":"/paper/2606.23335"},"observation_digest":"sha256:770e3331aca9fb258a0d1e174f24140fc81165bf7fd41eb597d78def5b186e21","observation_id":"8ee4d21d-4367-4fff-b652-71fa6f57f589","resolution":{"observed_at":"2026-07-04T12:29:51.974202Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05884","last_updated":"2018-02-16T01:28:23Z","snapshot_observed_at":"2026-08-14T20:03:06.478622Z","submitted_at":"2017-12-16T00:51:40Z","title":"Natural TTS Synthesis by Conditioning WaveNet on Mel Spectrogram Predictions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05884","snapshot_observed_at":"2026-08-14T04:32:48.101601Z","title":"Natural TTS Synthesis by Conditioning WaveNet on Mel Spectrogram Predictions","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.08667","last_updated":"2026-08-09T12:21:54Z","snapshot_observed_at":"2026-08-14T09:18:48.936467Z","submitted_at":"2026-08-09T12:21:54Z","title":"A Unifying Perspective on Audio Generative Modeling: Latent Representations and Modeling Strategies","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-14T04:32:48.101601Z"},"links":{"cited_paper":"/paper/1712.05884","citing_paper":"/paper/2608.08667"},"observation_digest":"sha256:2917b044100ecbe2a4e63a1020cca4f76e48b908a5484a941ff4671ecbf4b35c","observation_id":"12333eaf-8c9b-4265-8eb5-e5a2924e9724","resolution":{"observed_at":"2026-08-14T04:32:48.101601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/1712.05884/citation-record","integrity":"/paper/1712.05884/integrity","json":"/paper/1712.05884/citation-record.json","paper":"/paper/1712.05884"},"outbound":[],"paper":{"arxiv_id":"1712.05884","last_updated":"2018-02-16T01:28:23Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-14T20:03:06.478622Z","submitted_at":"2017-12-16T00:51:40Z","title":"Natural TTS Synthesis by Conditioning WaveNet on Mel Spectrogram Predictions"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:1712.05884."}