Adversarial Training for Large Neural Language Models

Benchmark Model Rank Results
natural-language-inference-on-anli-testALUM (RoBERTa-LARGE)#4A1: 72.3A2: 52.1A3: 48.4