Video Violence Recognition and Localization Using a Semi-Supervised Hard Attention Model

Benchmark Model Rank Results
activity-recognition-on-rwf-2000Semi-Supervised Hard Attention (SSHA); pretrained on Deepmind Kinetics datasetAccuracy: 90.4