Video Sparse Transformer With Attention-Guided Memory for Video Object Detection

Benchmark Model Rank Results
object-detection-on-ua-detracVSTAM#1mAP: 90.39
video-instance-segmentation-on-youtube-vis-1VSTAM#24mask AP: 39.0
video-object-detection-on-imagenet-vidVSTAM#4MAP: 91.1