ATST: Audio Representation Learning with Teacher-Student Transformer

Benchmark Model Rank Results
audio-classification-on-balanced-audio-setBase (ours)#5Mean AP: 37.4
speaker-identification-on-voxceleb1ATST Base (ours)#6Top-1 (%): 94.3Accuracy: 94.3