ByT5: Towards a token-free future with pre-trained byte-to-byte models

Benchmark Model Rank Results
cross-lingual-natural-language-inference-on-xnliByT5 XXL#1Accuracy: 83.7
cross-lingual-natural-language-inference-on-xnliByT5 Small#4Accuracy: 69.1
cross-lingual-question-answering-on-tydiqa-goldpByT5 (fine-tuned)#1EM: 81.9
cross-lingual-question-answering-on-tydiqa-goldpByT5 XXL#4EM: 60.0F1: 75.3
cross-lingual-question-answering-on-xquadByT5 XXL#1EM: 63.6F1: 79.7
extreme-summarization-on-gem-xsumByT5#4BLEU score: 15.3
extreme-summarization-on-gem-xsummT5#5BLEU score: 14.3