Visual Agents as Fast and Slow Thinkers
Open paper
Benchmark
Model
Rank
Results
visual-question-answering-on-mm-vet
FAST (Vicuna-7B)
#145
GPT-4 score: 31.0
Rank counts only results with a code link.