Gemini: A Family of Highly Capable Multimodal Models

Benchmark Model Rank Results
arithmetic-reasoning-on-gsm8kGemini Pro (maj1@32)#28Accuracy: 86.5
chart-question-answering-on-chartqaGemini Ultra#11:1 Accuracy: 80.8
long-context-understanding-on-mmneedleGemini Pro 1.0#41 Image, 4*4 Stitching, Exact Accuracy: 24.78
math-word-problem-solving-on-mathGemini Ultra (4-shot)#32Accuracy: 53.2
math-word-problem-solving-on-mathGemini Pro (4-shot)#72Accuracy: 32.6
temporal-casual-qa-on-next-qaGemini Ultra (zero-shot)#4WUPS: 29.9
temporal-casual-qa-on-next-qaGemini Pro (zero-shot)#5WUPS: 28.0
visual-question-answering-on-mm-vetGemini 1.0 Pro Vision (gemini-pro-vision)#17GPT-4 score: 64.3±0.4
visual-question-answering-on-mm-vet-v2Gemini Pro Vision#7GPT-4 score: 57.2±0.2
visual-question-answering-vqa-on-ai2dGemini Ultra#1EM: 79.5
visual-question-answering-vqa-on-infographicvqaGemini Ultra (pixel only)#1ANLS: 80.3