| document-image-classification-on-rvl-cdip | BEiT-B | #22 | Accuracy: 91.09%Parameters: 87M |
| document-layout-analysis-on-publaynet-val | BEiT-B | #7 | Overall: 0.931Text: 0.934Title: 0.866List: 0.924Table: 0.973… |
| image-classification-on-imagenet | BEiT-L (ViT; ImageNet-22K pretrain) | #35 | Top 1 Accuracy: 88.60%Number of params: 331M |
| image-classification-on-imagenet | BEiT-L (ViT; ImageNet 1k pretrain) | #152 | Top 1 Accuracy: 86.3%Number of params: 86M |
| image-classification-on-omnibenchmark | BeiT | #22 | Average Top-1 Accuracy: 30.1 |
| self-supervised-image-classification-on-1 | BEiT-L (ViT) | #14 | Top 1 Accuracy: 86.3%Number of Params: 307M |
| self-supervised-image-classification-on-1 | BEiT-B (ViT) | #29 | Top 1 Accuracy: 84.6%Number of Params: 86M |
| semantic-segmentation-on-ade20k | BEiT-L (ViT+UperNet) | #33 | Validation mIoU: 57.0 |
| semantic-segmentation-on-ade20k-val | BEiT-L (ViT+UperNet, ImageNet-22k pretrain) | #21 | mIoU: 57.0 |