Mitigating Query Selection Bias in Referring Video Object Segmentation

Benchmark Model Rank Results
referring-expression-segmentation-on-a2d-sentencesTQF–AP: 0.613IoU overall: 0.824IoU mean: 0.733
referring-video-object-segmentation-on-mevisTQF-B–J&F: 52.8J: 49.4F: 56.1
referring-video-object-segmentation-on-mevisTQF-T–J&F: 50.1J: 46.8F: 53.3