CaMML: Context-Aware Multimodal Learner for Large Models

Benchmark Model Rank Results
visual-question-answering-on-mm-vetCaMML-13B#97GPT-4 score: 36.4