PaLI-3 Vision Language Models: Smaller, Faster, Stronger

Benchmark Model Rank Results
chart-question-answering-on-chartqaPaLI-3#91:1 Accuracy: 70
chart-question-answering-on-chartqaPaLI-3 (w/ OCR)#101:1 Accuracy: 69.5
temporal-casual-qa-on-next-qaPaLI-3#2WUPS: 37.7
visual-question-answering-on-docvqa-testPaLI-3 (w/ OCR)#5ANLS: 0.886
visual-question-answering-on-docvqa-testPaLI-3#10ANLS: 0.876
visual-question-answering-vqa-on-infographicvqaPaLI-3 (w/ OCR)#4ANLS: 62.4
visual-question-answering-vqa-on-infographicvqaPaLI-3#6ANLS: 57.8