Knowing Your Target: Target-Aware Transformer Makes Better Spatio-Temporal Video Grounding

Benchmark Model Rank Results
spatio-temporal-video-grounding-on-hc-stvg1TA-STVG#1m_vIoU: 39.1vIoU@0.3: 63.1vIoU@0.5: 36.8
spatio-temporal-video-grounding-on-hc-stvg2TA-STVG#1Val m_vIoU: 40.2Val vIoU@0.3: 65.8Val vIoU@0.5: 36.7
spatio-temporal-video-grounding-on-vidstgTA-STVG#1Declarative m_vIoU: 34.4Declarative vIoU@0.3: 48.2