| Benchmark | Model | Rank | Results |
|---|---|---|---|
| question-answering-on-piqa | RoBERTa-large 355M (fine-tuned) | #40 | Accuracy: 77.1 |
| question-answering-on-piqa | GPT-2-small 124M (fine-tuned) | #56 | Accuracy: 69.2 |
| question-answering-on-piqa | BERT-large 340M (fine-tuned) | #58 | Accuracy: 66.8 |
| question-answering-on-piqa | Random chance baseline | #62 | Accuracy: 50 |