The Falcon Series of Open Language Models

Benchmark Model Rank Results
multi-task-language-understanding-on-mmluFalcon 40BAverage (%): 57.0
multi-task-language-understanding-on-mmluFalcon 7B (5-shot)Average (%): 28.0
sentence-completion-on-hellaswagFalcon-180B (0-shot)Accuracy: 85.9
sentence-completion-on-hellaswagFalcon-40B (0-shot)Accuracy: 82.7
sentence-completion-on-hellaswagFalcon-7B (0-shot)Accuracy: 76.3