SgVA-CLIP: Semantic-guided Visual Adapting of Vision-Language Models for Few-shot Image Classification

Benchmark Model Rank Results
few-shot-image-classification-on-mini-imagenet-5-way-1-shotSgVA-CLIP#1Accuracy: 97.95
few-shot-image-classification-on-mini-imagenet-5-way-5-shotSgVA-CLIP#1Accuracy: 98.72