InternVideo2.5: Empowering Video MLLMs with Long and Rich Context Modeling

Benchmark Model Rank Results
referring-expression-segmentation-on-refer-1InternVideo2.5#26J&F: 34.2
referring-video-object-segmentation-on-mevisInternVideo2.5#11J&F: 32