Small Language Model Meets with Reinforced Vision Vocabulary

Benchmark Model Rank Results
visual-question-answering-on-mm-vetVary-toyGPT-4 score: 29.0Params: 1.8B