Wav2Seq: Pre-training Speech-to-Text Encoder-Decoder Models Using Pseudo Languages

Benchmark Model Rank Results
named-entity-recognition-on-slueWav2Seq (from HuBERT-large)#3F1 (%): 65.4