What If We Recaption Billions of Web Images with LLaMA-3?
Open paper
Benchmark
Model
Rank
Results
visual-question-answering-on-mm-vet
LLaVA-1.5-LLaMA3-8B
–
GPT-4 score: 37.8
Rank counts only results with a code link.