Language Agent Tree Search Unifies Reasoning Acting and Planning in Language Models
Open paper
Benchmark
Model
Rank
Results
code-generation-on-mbpp
o1-mini + Language Agent Tree Search (Hamming.ai)
#12
Accuracy: 82.3
code-generation-on-mbpp
GPT-3.5 Turbo + Language Agent Tree Search
#13
Accuracy: 81.1
Rank counts only results with a code link.