Dragonfly: Multi-Resolution Zoom-In Encoding Enhances Vision-Language Models
Open paper
Benchmark
Model
Rank
Results
visual-question-answering-on-mm-vet
Dragonfly (Llama3-8B)
#106
GPT-4 score: 35.9
Rank counts only results with a code link.