SeqFormer: Sequential Transformer for Video Instance Segmentation

Benchmark Model Rank Results
video-instance-segmentation-on-hq-ytvisSeqFormer (Swin-L)#2Tube-Boundary AP: 43.3
video-instance-segmentation-on-youtube-vis-1SeqFormer (Swin-L)#9mask AP: 59.3AP50: 82.1AP75: 66.4AR1: 51.7AR10: 64.4
video-instance-segmentation-on-youtube-vis-1SeqFormer (ResNet-101)#15mask AP: 49.0AP50: 71.1AP75: 55.7AR1: 46.8AR10: 56.9
video-instance-segmentation-on-youtube-vis-1SeqFormer (ResNet-50)#17mask AP: 47.4AP50: 69.8AP75: 51.8AR1: 45.5AR10: 54.8
video-instance-segmentation-on-youtube-vis-1SeqFormer (ResNet-50)#20mask AP: 45.1AP50: 66.9AP75: 50.5AR1: 45.6AR10: 54.6