Visual Parser: Representing Part-whole Hierarchies with Transformers
Open paper
Benchmark
Model
Rank
Results
image-classification-on-imagenet
ViP-B|384
#328
Top 1 Accuracy: 84.2%
Rank counts only results with a code link.