SgVA-CLIP: Semantic-guided Visual Adapting of Vision-Language Models for Few-shot Image Classification
Open paper
Benchmark
Model
Rank
Results
few-shot-image-classification-on-mini-imagenet-5-way-1-shot
SgVA-CLIP
#1
Accuracy: 97.95
few-shot-image-classification-on-mini-imagenet-5-way-5-shot
SgVA-CLIP
#1
Accuracy: 98.72
Rank counts only results with a code link.