Xmodel-VLM: A Simple Baseline for Multimodal Vision Language Model

Benchmark Model Rank Results
visual-question-answering-on-mm-vetXmodel-VLM (Xmodel-LM 1.1B)#166GPT-4 score: 21.8