Xmodel-VLM: A Simple Baseline for Multimodal Vision Language Model
Open paper
Benchmark
Model
Rank
Results
visual-question-answering-on-mm-vet
Xmodel-VLM (Xmodel-LM 1.1B)
#166
GPT-4 score: 21.8
Rank counts only results with a code link.