InternLM-XComposer2: Mastering Free-form Text-Image Composition and Comprehension in Vision-Language Large Model
Open paper
Benchmark
Model
Rank
Results
visual-question-answering-on-mm-vet
InternLM-XComposer2
#43
GPT-4 score: 51.2
visual-question-answering-on-mm-vet-v2
IXC2-VL-7B
#11
GPT-4 score: 42.5±0.3
Rank counts only results with a code link.