A Systematic Study and Comprehensive Evaluation of ChatGPT on Benchmark Datasets
Open paper
Benchmark
Model
Rank
Results
natural-language-inference-on-anli-test
ChatGPT
#6
A1: 62.3
A2: 52.6
A3: 54.1
Rank counts only results with a code link.