PoDA pre-trains a Transformer plus pointer-generator seq2seq model as a denoising autoencoder and reports gains over non-pre-trained baselines on summarization and grammatical error correction.
Title resolution pending
1 Pith paper cite this work. Polarity classification is still indexing.
1
Pith paper citing it
fields
cs.CL 1years
2019 1verdicts
CONDITIONAL 1representative citing papers
citing papers explorer
-
Denoising based Sequence-to-Sequence Pre-training for Text Generation
PoDA pre-trains a Transformer plus pointer-generator seq2seq model as a denoising autoencoder and reports gains over non-pre-trained baselines on summarization and grammatical error correction.