MM1: Methods, Analysis & Insights from Multimodal LLM Pre-training
Open paper
Benchmark
Model
Rank
Results
visual-question-answering-on-mm-vet
MM1-30B-Chat
–
GPT-4 score: 48.7
visual-question-answering-on-mm-vet
MM1-3B-Chat
–
GPT-4 score: 43.7
visual-question-answering-on-mm-vet
MM1-7B-Chat
–
GPT-4 score: 42.1
Rank counts only results with a code link.