VL-Mamba: Exploring State Space Models for Multimodal Learning
Open paper
Benchmark
Model
Rank
Results
visual-question-answering-on-mm-vet
VL-Mamba (Mamba LLM-2.8B)
–
GPT-4 score: 32.6
Rank counts only results with a code link.