Actor-Context-Actor Relation Network for Spatio-Temporal Action Localization

Benchmark Model Rank Results
action-recognition-in-videos-on-ava-v21ACAR-Net, SlowFast R-101 (Kinetics-400 pretraining)#1mAP (Val): 30.0
action-recognition-on-ava-v2-2ACAR-Net, SlowFast R-101 (Kinetics-700 pretraining)#22mAP: 31.72
spatio-temporal-action-localization-on-avaACAR (multi-scale, ensemble)#3val mAP: 40.49test mAP: 39.62
spatio-temporal-action-localization-on-avaACAR (multi-scale, R-101, 8 × 8)#4val mAP: 36.36