{"as_of":"2026-08-20T17:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9d6fc48ed89ffd712ca17821235c547f0a85052a8a0eb9a549e3a06d4bbacc7d","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-24T19:27:54.013474Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-24T19:27:54.013474Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-05-24T19:29:50.880888Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","version":1},"cited_work":{"arxiv_id":"1907.09006","doi":null,"metadata_source":"pith","pith_arxiv_id":"1907.09006","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","venue":"eess.AS","work_id":"929507ae-fa74-4f01-b2e7-2be69b3a888c","year":2019},"citing_paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-24T19:27:54.013474Z"},"links":{"cited_paper":"/paper/1907.09006","citing_paper":"/paper/1907.09006"},"observation_digest":"sha256:6ba6a9e4e374a3830634c268b7624b89e6a671a63c7d773d39ec226989e90a46","observation_id":"25eba6bd-9dca-4abd-bb1b-2eb8a40f116a","resolution":{"observed_at":"2026-05-24T19:29:50.883888Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/1907.09006/citation-record","integrity":"/paper/1907.09006/integrity","json":"/paper/1907.09006/citation-record.json","paper":"/paper/1907.09006"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","version":1},"cited_work":{"arxiv_id":"1907.09006","doi":null,"metadata_source":"pith","pith_arxiv_id":"1907.09006","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","venue":"eess.AS","work_id":"929507ae-fa74-4f01-b2e7-2be69b3a888c","year":2019},"citing_paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-24T19:27:54.013474Z"},"links":{"cited_paper":"/paper/1907.09006","citing_paper":"/paper/1907.09006"},"observation_digest":"sha256:6ba6a9e4e374a3830634c268b7624b89e6a671a63c7d773d39ec226989e90a46","observation_id":"25eba6bd-9dca-4abd-bb1b-2eb8a40f116a","resolution":{"observed_at":"2026-05-24T19:29:50.883888Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"726d2b74-99d3-49f4-ab45-d0969b4a7d3a","year":null},"citing_paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-24T19:27:54.013474Z"},"links":{"citing_paper":"/paper/1907.09006"},"observation_digest":"sha256:fb6297e469d2397912c5dd12b539d51c1e5bfc40349f52eb2823d1d4141efa9e","observation_id":"65f3192d-8426-42db-9a93-6a2bcea48738","resolution":{"observed_at":"2026-05-24T19:29:51.722105Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"All the subjective tests are evaluated by at least 10 native judges from Microsoft crowdsourcing UHRS (Universal Human Relevance System) platform","venue":null,"work_id":"83e99ff7-ce4f-45e7-909d-dfe985134716","year":null},"citing_paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-24T19:27:54.013474Z"},"links":{"citing_paper":"/paper/1907.09006"},"observation_digest":"sha256:bc5537aed8ac10cc8dc3db16059e71e438eb77e4b663930363dd9f35f7023bfa","observation_id":"ae61b9b1-b943-4d77-8531-692645a1853b","resolution":{"observed_at":"2026-05-24T19:29:51.694820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"10fd9f4b-4698-4860-9fbb-156f70a8410e","year":null},"citing_paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-24T19:27:54.013474Z"},"links":{"citing_paper":"/paper/1907.09006"},"observation_digest":"sha256:4731dda9c739eb93449bc5464d51b364d61de3f1892779cdb5008b83a3ff2595","observation_id":"b1efa1a6-876a-4321-a858-423dd0f4090e","resolution":{"observed_at":"2026-05-24T19:29:51.730173Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b20a5e0e-16f3-47b1-91e6-6fab2a25eabf","year":null},"citing_paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-24T19:27:54.013474Z"},"links":{"citing_paper":"/paper/1907.09006"},"observation_digest":"sha256:73918a2fffe8216d17601563bbb093ff4c2c2c9b09caa61f2f53f7deee993f8a","observation_id":"1ab205bc-4623-4aab-8181-f70dfbc60d18","resolution":{"observed_at":"2026-05-24T19:29:51.726121Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tacotron: Towards end-to-end speech synthesis","venue":null,"work_id":"f989d4d2-96b1-4e8d-9347-05731f06d812","year":2017},"citing_paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-24T19:27:54.013474Z"},"links":{"citing_paper":"/paper/1907.09006"},"observation_digest":"sha256:ff4b0b0e69a7de3c5afe5266a7b5309e753259e29aae31ffa86817bbafc202fc","observation_id":"bbf39df3-e633-4747-9b2e-f79e97d0f69c","resolution":{"observed_at":"2026-05-24T19:29:51.733691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Natural tts synthesis by conditioning WaveNet on mel spectrogram pre- dictions","venue":null,"work_id":"15ccc003-2e41-4074-a0d6-89263001048d","year":2018},"citing_paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-24T19:27:54.013474Z"},"links":{"citing_paper":"/paper/1907.09006"},"observation_digest":"sha256:a1e807cf01784e304b6ae547e84b5e550c281ecaefef193ebfab54228d66e1d1","observation_id":"6dacdd47-c98f-4436-a361-1f77dddc71a6","resolution":{"observed_at":"2026-05-24T19:29:51.690391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1808.10128","last_updated":"2018-08-30T05:51:30Z","snapshot_observed_at":"2026-08-18T00:26:32.771187Z","submitted_at":"2018-08-30T05:51:30Z","title":"Semi-Supervised Training for Improving Data Efficiency in End-to-End Speech Synthesis","version":1},"cited_work":{"arxiv_id":"1808.10128","doi":null,"metadata_source":"pith","pith_arxiv_id":"1808.10128","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Semi-Supervised Training for Improving Data Efficiency in End-to-End Speech Synthesis","venue":"cs.CL","work_id":"d6db903f-bb47-47c2-8ee3-1210031c92e8","year":2018},"citing_paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-24T19:27:54.013474Z"},"links":{"cited_paper":"/paper/1808.10128","citing_paper":"/paper/1907.09006"},"observation_digest":"sha256:1ec8da3aff2ad7f13e5078c74927e7962f800aa3801843646061ccb54e29cc67","observation_id":"67a8fd5a-ac94-469b-81da-50dc146d1fb3","resolution":{"observed_at":"2026-05-24T19:29:50.911158Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.00520","last_updated":"2017-11-01T19:40:00Z","snapshot_observed_at":"2026-08-14T20:17:51.666334Z","submitted_at":"2017-11-01T19:40:00Z","title":"Uncovering Latent Style Factors for Expressive Speech Synthesis","version":1},"cited_work":{"arxiv_id":"1711.00520","doi":null,"metadata_source":"pith","pith_arxiv_id":"1711.00520","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Uncovering Latent Style Factors for Expressive Speech Synthesis","venue":"cs.CL","work_id":"2b2cbe98-ee7e-4b95-a7b5-4ddfef3e820c","year":2017},"citing_paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-24T19:27:54.013474Z"},"links":{"cited_paper":"/paper/1711.00520","citing_paper":"/paper/1907.09006"},"observation_digest":"sha256:2a5427eeca0f93e7d23d9cc74da26418dfcb360a4d05564ec1e9404d58d3e269","observation_id":"99636e87-cc07-4cbe-aee3-27889877e7a1","resolution":{"observed_at":"2026-05-24T19:29:50.860187Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Taylor, Text-to-Speech Synthesis","venue":null,"work_id":"972b0613-2b70-46ab-a45d-020e3427cfa5","year":2009},"citing_paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-24T19:27:54.013474Z"},"links":{"citing_paper":"/paper/1907.09006"},"observation_digest":"sha256:3c1e5b485bb1fed042374b4ea707131fcd4962cf20a24679acd778fee0fbd45f","observation_id":"cc18048b-5ef1-4449-b323-9df1fa878ed3","resolution":{"observed_at":"2026-05-24T19:29:51.718420Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Automatically clustering similar units for unit selection in speech synthesis","venue":null,"work_id":"f4e7c32a-e7ec-4e93-8bf4-8f37c371eae9","year":1997},"citing_paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-24T19:27:54.013474Z"},"links":{"citing_paper":"/paper/1907.09006"},"observation_digest":"sha256:23a09e6dc4baaf1cc6cc719b297233411dd105fffc73c9c483f96a3dc11ee530","observation_id":"bd23395f-7de0-469e-b627-eca96eacac20","resolution":{"observed_at":"2026-05-24T19:29:51.749096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Statistical parametric speech synthesis","venue":null,"work_id":"ca4ee0ad-5907-4aa0-bad1-f3e09e44e137","year":2009},"citing_paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-24T19:27:54.013474Z"},"links":{"citing_paper":"/paper/1907.09006"},"observation_digest":"sha256:33ab1626a58f157408777e5e54964d8feeb870a13f6483ee7ea68ba8636da2e9","observation_id":"63fa29b6-4909-4921-a623-5ba337cd0e03","resolution":{"observed_at":"2026-05-24T19:29:51.706859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Statistical parametric speech synthesis using deep neural networks","venue":null,"work_id":"590e52a3-83b3-4b81-8960-269e03f4b1ad","year":2013},"citing_paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-24T19:27:54.013474Z"},"links":{"citing_paper":"/paper/1907.09006"},"observation_digest":"sha256:7d493862ca7307a6cc6928bab3004dea8856d0967e4ffb7c73d2b9cbc2569363","observation_id":"f3772d13-76c9-4969-9736-7f04db05451d","resolution":{"observed_at":"2026-05-24T19:29:51.698979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.03499","last_updated":"2016-09-19T18:04:35Z","snapshot_observed_at":"2026-08-16T05:39:41.727705Z","submitted_at":"2016-09-12T17:29:40Z","title":"WaveNet: A Generative Model for Raw Audio","version":2},"cited_work":{"arxiv_id":"1609.03499","doi":"10.48550/arxiv.1609.03499","metadata_source":"pith","pith_arxiv_id":"1609.03499","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WaveNet: A Generative Model for Raw Audio","venue":"cs.SD","work_id":"05682736-8137-4a5f-a5b6-1127e99b0041","year":2016},"citing_paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-24T19:27:54.013474Z"},"links":{"cited_paper":"/paper/1609.03499","citing_paper":"/paper/1907.09006"},"observation_digest":"sha256:0999ccaa31897c5923f1ea72e7a67c082598a7f07663e4543154b652f4b02f1e","observation_id":"47f3f8a2-142b-4b20-a7d9-40c1996d44d2","resolution":{"observed_at":"2026-05-24T19:29:50.889655Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:14.288815+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:14.288815+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.0473","last_updated":"2016-05-19T21:53:22Z","snapshot_observed_at":"2026-08-18T12:17:42.484599Z","submitted_at":"2014-09-01T16:33:02Z","title":"Neural Machine Translation by Jointly Learning to Align and Translate","version":7},"cited_work":{"arxiv_id":"1409.0473","doi":"10.48550/arxiv.1409.0473","metadata_source":"pith","pith_arxiv_id":"1409.0473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Neural Machine Translation by Jointly Learning to Align and Translate","venue":"cs.CL","work_id":"d831e763-d530-4029-a65c-ac595d82cb2a","year":2014},"citing_paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-24T19:27:54.013474Z"},"links":{"cited_paper":"/paper/1409.0473","citing_paper":"/paper/1907.09006"},"observation_digest":"sha256:5b1c199c3f980696b2af01b0e69c7e5deafc855abce1a89ba5fed2050e56888b","observation_id":"eac24092-8161-40f2-a485-c318bf638d46","resolution":{"observed_at":"2026-05-24T19:29:50.916810Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-07-16T23:20:48.784513+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-16T23:20:48.784513+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Forward-backward atten- tion decoder","venue":null,"work_id":"5bbde627-a12f-4bf1-a2a4-004b11728df2","year":2018},"citing_paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-24T19:27:54.013474Z"},"links":{"citing_paper":"/paper/1907.09006"},"observation_digest":"sha256:dae18f84e345d0b8aba2507191acd92aad0d09ce2ae5c546af5be991b6d055c4","observation_id":"1c786981-ae60-4e10-810d-5642f416a2e7","resolution":{"observed_at":"2026-05-24T19:29:51.702727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05567","last_updated":"2018-06-29T19:16:39Z","snapshot_observed_at":"2026-08-14T19:36:00.860774Z","submitted_at":"2018-03-15T01:30:58Z","title":"Achieving Human Parity on Automatic Chinese to English News Translation","version":2},"cited_work":{"arxiv_id":"1803.05567","doi":null,"metadata_source":"pith","pith_arxiv_id":"1803.05567","snapshot_observed_at":"2026-07-04T03:39:31.111846Z","title":"Achieving Human Parity on Automatic Chinese to English News Translation","venue":"cs.CL","work_id":"c80c68b1-3b0a-482e-b79d-b02db29279d6","year":2018},"citing_paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-24T19:27:54.013474Z"},"links":{"cited_paper":"/paper/1803.05567","citing_paper":"/paper/1907.09006"},"observation_digest":"sha256:e60005129bf5ffa191366f3ef0894aa40d48e1dd95d4e53a85ec4b75ec5d3cc7","observation_id":"f77acb3b-f97f-45ee-ad37-a2b2619dc70e","resolution":{"observed_at":"2026-05-24T19:29:50.905504Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"De- liberation networks: Sequence generation beyond one-pass de- coding","venue":null,"work_id":"796160cc-0682-43f2-bfcd-66d317d662f8","year":2017},"citing_paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-24T19:27:54.013474Z"},"links":{"citing_paper":"/paper/1907.09006"},"observation_digest":"sha256:cd7535cd2dca9a59e2d89e015d9a15af67bba3dab3b2062a7a30b40f41bbc5c2","observation_id":"74ca6ffa-22a0-4061-97bd-93b099b6268c","resolution":{"observed_at":"2026-05-24T19:29:51.710864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.09047","last_updated":"2018-03-24T02:52:58Z","snapshot_observed_at":"2026-08-16T07:49:39.892869Z","submitted_at":"2018-03-24T02:52:58Z","title":"Towards End-to-End Prosody Transfer for Expressive Speech Synthesis with Tacotron","version":1},"cited_work":{"arxiv_id":"1803.09047","doi":null,"metadata_source":"pith","pith_arxiv_id":"1803.09047","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards End-to-End Prosody Transfer for Expressive Speech Synthesis with Tacotron","venue":"cs.CL","work_id":"aa277207-3aac-48d3-aaa6-7fc9a670c7f3","year":2018},"citing_paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-24T19:27:54.013474Z"},"links":{"cited_paper":"/paper/1803.09047","citing_paper":"/paper/1907.09006"},"observation_digest":"sha256:93f60f0085d86746f7717a90be0971e77a3327c1708c0fcf6528a6e742976e5c","observation_id":"54fa603d-d963-4774-a809-b48d68a77298","resolution":{"observed_at":"2026-05-24T19:29:50.900265Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.09017","last_updated":"2018-03-23T23:56:49Z","snapshot_observed_at":"2026-08-14T19:32:58.812371Z","submitted_at":"2018-03-23T23:56:49Z","title":"Style Tokens: Unsupervised Style Modeling, Control and Transfer in End-to-End Speech Synthesis","version":1},"cited_work":{"arxiv_id":"1803.09017","doi":null,"metadata_source":"pith","pith_arxiv_id":"1803.09017","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Style Tokens: Unsupervised Style Modeling, Control and Transfer in End-to-End Speech Synthesis","venue":"cs.CL","work_id":"b15a3841-4dd9-4bf5-b593-50ee31767c59","year":2018},"citing_paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-24T19:27:54.013474Z"},"links":{"cited_paper":"/paper/1803.09017","citing_paper":"/paper/1907.09006"},"observation_digest":"sha256:fc205e5576ca634e2c27901b436a05639f1fb28ce895e2521353949607502039","observation_id":"3de71d01-e2f8-4516-a3f5-acf8fa8edf3a","resolution":{"observed_at":"2026-05-24T19:29:50.870845Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1808.01410","last_updated":"2018-08-04T02:21:07Z","snapshot_observed_at":"2026-08-19T10:14:52.708038Z","submitted_at":"2018-08-04T02:21:07Z","title":"Predicting Expressive Speaking Style From Text In End-To-End Speech Synthesis","version":1},"cited_work":{"arxiv_id":"1808.01410","doi":null,"metadata_source":"pith","pith_arxiv_id":"1808.01410","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Predicting Expressive Speaking Style From Text In End-To-End Speech Synthesis","venue":"cs.CL","work_id":"cb92323c-340e-48b1-9f3e-9da6c9c0d138","year":2018},"citing_paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-24T19:27:54.013474Z"},"links":{"cited_paper":"/paper/1808.01410","citing_paper":"/paper/1907.09006"},"observation_digest":"sha256:3063421207426c6e58533751b2d73c91a3b7f652133d4683b261545e0f9c76f3","observation_id":"fca8ba92-640f-434e-90cf-2b7ef8510c18","resolution":{"observed_at":"2026-05-24T19:29:50.894800Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Transfer learning from speaker veriﬁcation to multispeaker text-to-speech synthesis","venue":null,"work_id":"eac786c0-9295-4c5d-81d7-902f70a0b864","year":2018},"citing_paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-24T19:27:54.013474Z"},"links":{"citing_paper":"/paper/1907.09006"},"observation_digest":"sha256:5881e247fe738fcaa3e01fff9f355a8b30905dc46b0f331bf0d5ee6a39391d94","observation_id":"acce3be6-6f49-4ef9-8af0-9517ba7e7940","resolution":{"observed_at":"2026-05-24T19:29:51.714622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scheduled sam- pling for sequence prediction with recurrent neural networks","venue":null,"work_id":"840008df-5fa0-40be-9c0b-79148a020353","year":2015},"citing_paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-24T19:27:54.013474Z"},"links":{"citing_paper":"/paper/1907.09006"},"observation_digest":"sha256:9de302b6ca9f1d131d890fce0f91ba2e17970f38b0b41adee46a9f193b1e6355","observation_id":"a2319585-7853-49ea-9fdf-316106519eb8","resolution":{"observed_at":"2026-05-24T19:29:51.737507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.08895","last_updated":"2019-01-30T12:40:57Z","snapshot_observed_at":"2026-08-19T19:19:52.523372Z","submitted_at":"2018-09-19T07:41:17Z","title":"Neural Speech Synthesis with Transformer Network","version":3},"cited_work":{"arxiv_id":"1809.08895","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.08895","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Neural Speech Synthesis with Transformer Network","venue":"cs.CL","work_id":"38520c67-5997-4eec-98e3-598c791b2353","year":2018},"citing_paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-24T19:27:54.013474Z"},"links":{"cited_paper":"/paper/1809.08895","citing_paper":"/paper/1907.09006"},"observation_digest":"sha256:0b07e673c818a6ad2eea25c3f8978fc62562c33a33915be097d24882e0079f25","observation_id":"d95bfb19-17fb-4ce5-b681-dea5cb8bf5e8","resolution":{"observed_at":"2026-05-24T19:29:50.877363Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Attention is all you need","venue":null,"work_id":"cb2cae84-4685-420c-9565-f47ee16f3340","year":2017},"citing_paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-24T19:27:54.013474Z"},"links":{"citing_paper":"/paper/1907.09006"},"observation_digest":"sha256:fb8754213ffa89d1ffe2d18babb3300b637fe14ad5379c4633ac58e1f5990b5c","observation_id":"faf2cc63-d093-4760-bb6a-985ca9f8417b","resolution":{"observed_at":"2026-05-24T19:29:51.740969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Attention-based models for speech recognition","venue":null,"work_id":"0d82781c-2d13-40f7-872c-2949488d186c","year":2015},"citing_paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-24T19:27:54.013474Z"},"links":{"citing_paper":"/paper/1907.09006"},"observation_digest":"sha256:a29faf9d77710ed81d7c8677f567e31175891976d1591b1321568078262d545c","observation_id":"d15d1f2c-2877-45f2-8a5c-ad5d145b94b6","resolution":{"observed_at":"2026-05-24T19:29:51.744664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Agreement on target-bidirectional neural machine translation","venue":null,"work_id":"25bfcb0b-ca67-41e6-9978-c40c89cbea4b","year":2016},"citing_paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-24T19:27:54.013474Z"},"links":{"citing_paper":"/paper/1907.09006"},"observation_digest":"sha256:f37a53dfc879e3a0239c13eaa36d01b24e38d11dd954dc6ccfce7311d931abeb","observation_id":"d9b790f0-7675-4a82-ae9b-4aaf28869929","resolution":{"observed_at":"2026-05-24T19:29:51.753028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.08947","last_updated":"2017-09-20T21:43:18Z","snapshot_observed_at":"2026-08-14T23:33:35.166544Z","submitted_at":"2017-05-24T19:53:13Z","title":"Deep Voice 2: Multi-Speaker Neural Text-to-Speech","version":2},"cited_work":{"arxiv_id":"1705.08947","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.08947","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep Voice 2: Multi-Speaker Neural Text-to-Speech","venue":"cs.CL","work_id":"74a7ca81-d39f-429c-878e-4fa240a2038e","year":2017},"citing_paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-24T19:27:54.013474Z"},"links":{"cited_paper":"/paper/1705.08947","citing_paper":"/paper/1907.09006"},"observation_digest":"sha256:e55ddbca48346e5d2b318cb70f134c2003f2007e51b6eaae5132a1ba98f2d69f","observation_id":"7e7bd2ff-cc0b-46bc-819f-cd517121408e","resolution":{"observed_at":"2026-05-24T19:29:50.865198Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":"1412.6980","doi":"10.1002/mrm.28086","metadata_source":"pith","pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Adam: A Method for Stochastic Optimization","venue":"cs.LG","work_id":"1910796d-9b52-4683-bf5c-de9632c1028b","year":2014},"citing_paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-24T19:27:54.013474Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/1907.09006"},"observation_digest":"sha256:592efd54f3c4adf9fbbc344af235997d4d7bf37a3554b467e379fd9a633dace6","observation_id":"0bca5f5b-ad5e-40f3-ae2f-89108705b3cd","resolution":{"observed_at":"2026-05-24T19:29:50.922792Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1907.09006","last_updated":"2019-07-18T12:24:30Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-16T07:50:31.158253Z","submitted_at":"2019-07-18T12:24:30Z","title":"Forward-Backward Decoding for Regularizing End-to-End TTS"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":12,"verified_fuzzy":14},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 1 inbound Pith citation observation for arXiv:1907.09006."}