MM1: Methods, Analysis & Insights from Multimodal LLM Pre-training

Benchmark Model Rank Results
visual-question-answering-on-mm-vetMM1-30B-ChatGPT-4 score: 48.7
visual-question-answering-on-mm-vetMM1-3B-ChatGPT-4 score: 43.7
visual-question-answering-on-mm-vetMM1-7B-ChatGPT-4 score: 42.1