Encoder-Decoder Models Can Benefit from Pre-trained Masked Language Models in Grammatical Error Correction

Benchmark Model Rank Results
grammatical-error-correction-on-bea-2019-testTransformer + Pre-train with Pseudo Data (+BERT)#15F0.5: 69.8
grammatical-error-correction-on-conll-2014-shared-taskTransformer + Pre-train with Pseudo Data (+BERT)#13F0.5: 65.2
grammatical-error-correction-on-jflegTransformer + Pre-train with Pseudo Data + BERT#2GLEU: 62.0