Calibrated Self-Rewarding Vision Language Models

Benchmark Model Rank Results
visual-question-answering-on-mm-vetLLaVA-1.5-13B (+CSR)#85GPT-4 score: 37.8Params: 13B
visual-question-answering-on-mm-vetLLaVA-1.5-7B (CSR)#118GPT-4 score: 33.9Params: 7B