MeMViT: Memory-Augmented Multiscale Vision Transformer for Efficient Long-Term Video Recognition
Open paper
Benchmark
Model
Rank
Results
action-anticipation-on-epic-kitchens-100
MeMViT-24
#4
Recall@5: 17.7
action-recognition-on-ava-v2-2
MeMViT-24
#16
mAP: 35.4
action-recognition-on-epic-kitchens-100
MeMViT-24
#10
Action@1: 48.4
Verb@1: 71.4
Noun@1: 60.3
Rank counts only results with a code link.