MM-Instruct: Generated Visual Instructions for Large Multimodal Model Alignment

Benchmark Model Rank Results
visual-question-answering-on-mm-vetLLaVA-Instruct (Vicuna-1.5-13B)#94GPT-4 score: 37.1
visual-question-answering-on-mm-vetLLaVA-Instruct (Vicuna-1.5-7B)#123GPT-4 score: 32.9