LAVT: Language-Aware Vision Transformer for Referring Image Segmentation

Benchmark Model Rank Results
generalized-referring-expression-segmentationLAVT#8gIoU: 58.40cIoU: 57.64
referring-expression-segmentation-on-refcoco-3LAVT#21Overall IoU: 62.14
referring-expression-segmentation-on-refcoco-4LAVT#17Overall IoU: 68.38
referring-expression-segmentation-on-refcoco-5LAVT#16Overall IoU: 55.1
referring-expression-segmentation-on-refcocogLAVT#17Overall IoU: 61.24
referring-expression-segmentation-on-refcocog-1LAVT (Swin-B)#13Overall IoU: 62.09