Semantic-Aware Local-Global Vision Transformer

Benchmark Model Rank Results
image-classification-on-imagenetSALG-STTop 1 Accuracy: 75.9%Number of params: 6.5M