| common-sense-reasoning-on-record | DeBERTa-1.5B | #2 | EM: 94.1F1: 94.5 |
| coreference-resolution-on-winograd-schema | DeBERTa-1.5B | #4 | Accuracy: 95.9 |
| linguistic-acceptability-on-cola-dev | DeBERTa (large) | #3 | Accuracy: 69.5 |
| math-word-problem-solving-on-paramawps | DeBERTa | #2 | Accuracy (%): 74.1 |
| natural-language-inference-on-commitmentbank | DeBERTa-1.5B | #4 | Accuracy: 97.2F1: 94.9 |
| natural-language-inference-on-multinli | DeBERTa (large) | #5 | Matched: 91.1Mismatched: 91.1 |
| natural-language-inference-on-qnli | DeBERTa (large) | #8 | Accuracy: 95.3% |
| natural-language-inference-on-rte | DeBERTa-1.5B | #3 | Accuracy: 93.2% |
| natural-language-inference-on-wnli | DeBERTa | #1 | Accuracy: 94.5 |
| question-answering-on-boolq | DeBERTa-1.5B | #7 | Accuracy: 90.4 |
| question-answering-on-copa | DeBERTa-Ensemble | #4 | Accuracy: 98.4 |
| question-answering-on-copa | DeBERTa-1.5B | #5 | Accuracy: 96.8 |
| question-answering-on-multirc | DeBERTa-1.5B | #3 | F1: 88.2EM: 63.7 |
| question-answering-on-quora-question-pairs | DeBERTa (large) | #2 | Accuracy: 92.3% |
| question-answering-on-squad20 | DeBERTalarge | #8 | EM: 88.0F1: 90.7 |
| reading-comprehension-on-race | DeBERTalarge | #4 | Accuracy: 86.8 |
| semantic-textual-similarity-on-sts-benchmark | DeBERTa (large) | #57 | Accuracy: 92.5 |
| sentence-completion-on-hellaswag | DeBERTa++ | #11 | Accuracy: 93 |
| sentiment-analysis-on-sst-2-binary | DeBERTa (large) | #14 | Accuracy: 96.5 |
| word-sense-disambiguation-on-words-in-context | DeBERTa-Ensemble | #4 | Accuracy: 77.5 |
| word-sense-disambiguation-on-words-in-context | DeBERTa-1.5B | #7 | Accuracy: 76.4 |