SEA: Supervised Embedding Alignment for Token-Level Visual-Textual Integration in MLLMs
Open paper
Benchmark
Model
Rank
Results
visual-question-answering-on-mm-vet
SEA-PRIME (Vicuna-13B)
–
GPT-4 score: 48.8
Rank counts only results with a code link.