INF-LLaVA: Dual-perspective Perception for High-Resolution Multimodal Large Language Model

Benchmark Model Rank Results
visual-question-answering-on-mm-vetINF-LLaVA#114GPT-4 score: 34.5