Strengthening Multimodal Large Language Model with Bootstrapped Preference Optimization

Benchmark Model Rank Results
visual-question-answering-on-mm-vetLLaVA1.5-7B-BPOGPT-4 score: 36.8Params: 7B
visual-question-answering-on-mm-vetLaVA1.5-13B-BPOGPT-4 score: 41.4Params: 13B