FocusLLaVA: A Coarse-to-Fine Approach for Efficient and Effective Visual Token Compression
Open paper
Benchmark
Model
Rank
Results
visual-question-answering-on-mm-vet
FocusLLaVA
–
GPT-4 score: 41.3
Rank counts only results with a code link.