CogVLM2: Visual Language Models for Image and Video Understanding

Benchmark Model Rank Results
visual-question-answering-on-mm-vetGLM-4V-Plus#5GPT-4 score: 71.1
visual-question-answering-on-mm-vetGLM-4V-9B#33GPT-4 score: 58.0