General-purpose, long-context autoregressive modeling with Perceiver AR

Benchmark Model Rank Results
language-modelling-on-wikitext-103Perceiver AR 358M#36Test perplexity: 18.4