Automatic Model Selection with Large Language Models for Reasoning

Benchmark Model Rank Results
math-word-problem-solving-on-svampGPT-4 (Model Selection)#2Execution Accuracy: 93.7