Visual Parser: Representing Part-whole Hierarchies with Transformers

Benchmark Model Rank Results
image-classification-on-imagenetViP-B|384#328Top 1 Accuracy: 84.2%