| 3d-human-pose-estimation-on-3dpw | Hulk(ViT-L) | #4 | MPVPE: 77.4PA-MPJPE: 38.5MPJPE: 66.3 |
| 3d-human-pose-estimation-on-3dpw | Hulk(ViT-B) | #9 | MPVPE: 79.8PA-MPJPE: 39.9MPJPE: 67 |
| human-part-segmentation-on-cihp | Hulk(Finetune, ViT-L) | #1 | Mean IoU: 72.68 |
| human-part-segmentation-on-cihp | Hulk(Finetune, ViT-B) | #2 | Mean IoU: 71.26 |
| human-part-segmentation-on-human3-6m | Hulk(Finetune, ViT-L) | #1 | mIoU: 69.89 |
| human-part-segmentation-on-human3-6m | Hulk(Finetune, ViT-B) | #2 | mIoU: 68.56 |
| object-detection-on-crowdhuman-full-body | Hulk(Finetune, ViT-L) | #6 | AP: 93mMR: 36.5 |
| object-detection-on-crowdhuman-full-body | Hulk(Finetune, ViT-B) | #9 | AP: 92.4mMR: 40.7 |
| pedestrian-attribute-recognition-on-pa-100k | Hulk(Finetune, ViT-L) | #2 | Accuracy: 88.97 |
| pedestrian-attribute-recognition-on-pa-100k | Hulk(Finetune, ViT-B) | #3 | Accuracy: 87.85 |
| pedestrian-attribute-recognition-on-rapv2 | Hulk(Finetune, ViT-L) | #1 | Accuracy: 85.86 |
| pedestrian-attribute-recognition-on-rapv2 | Hulk(Finetune, ViT-B) | #2 | Accuracy: 85.26 |
| pose-estimation-on-aic | Hulk(Finetune, ViT-L) | #1 | AP: 37.1 |
| pose-estimation-on-aic | Hulk(Finetune, ViT-B) | #2 | AP: 35.6 |
| pose-estimation-on-coco | Hulk(Finetune, ViT-L) | #3 | AP: 78.7 |
| pose-estimation-on-coco | Hulk(Finetune, ViT-B) | #5 | AP: 77.5 |
| semantic-segmentation-on-lip-val | Hulk(Finetune, ViT-L) | #1 | mIoU: 66.02% |
| semantic-segmentation-on-lip-val | Hulk(Finetune, ViT-B) | #2 | mIoU: 63.98% |
| skeleton-based-action-recognition-on-ntu-rgbd-60 | Hulk(Finetune, ViT-L) | #4 | Accuracy (CS): 94.3 |
| skeleton-based-action-recognition-on-ntu-rgbd-60 | Hulk(Finetune, ViT-B) | #6 | Accuracy (CS): 94 |