CogVLM2: Visual Language Models for Image and Video Understanding
Open paper
Benchmark
Model
Rank
Results
visual-question-answering-on-mm-vet
GLM-4V-Plus
#5
GPT-4 score: 71.1
visual-question-answering-on-mm-vet
GLM-4V-9B
#33
GPT-4 score: 58.0
Rank counts only results with a code link.