MAmmoTH-VL: Eliciting Multimodal Reasoning with Instruction Tuning at Scale
Open paper
Benchmark
Model
Rank
Results
visual-question-answering-on-mm-vet
MAmmoTH-VL-8B
#24
GPT-4 score: 62.3
visual-question-answering-on-mm-vet
MAmmoTH-VL-8B (SI)
#29
GPT-4 score: 60.6
Rank counts only results with a code link.