ToolLLM: Facilitating Large Language Models to Master 16000+ Real-world APIs
Open paper
Benchmark
Model
Rank
Results
trajectory-planning-on-toolbench
GPT4- DFSDT
#3
Win rate: 70.4
Rank counts only results with a code link.