Improving Language Understanding by Generative Pre-Training

Benchmark Model Rank Results
natural-language-inference-on-multinliFinetuned Transformer LM#33Matched: 82.1Mismatched: 81.4
natural-language-inference-on-scitailFinetuned Transformer LM#3Accuracy: 88.3
natural-language-inference-on-snliFine-Tuned LM-Pretrained Transformer#11% Test Accuracy: 89.9% Train Accuracy: 96.6Parameters: 85m
question-answering-on-raceFinetuned Transformer LM#2RACE-m: 62.9RACE-h: 57.4RACE: 59.0
question-answering-on-storyclozeFinetuned Transformer LM#7Accuracy: 86.5