Multi-modal Auto-regressive Modeling via Visual Words
Open paper
Benchmark
Model
Rank
Results
visual-question-answering-on-mm-vet
VW-LMM
#63
GPT-4 score: 44.0
Rank counts only results with a code link.