Improving Neural Language Models with a Continuous Cache

Benchmark Model Rank Results
language-modelling-on-wikitext-103Neural cache model (size = 2,000)#73Test perplexity: 40.8
language-modelling-on-wikitext-103Neural cache model (size = 100)#74Test perplexity: 44.8
language-modelling-on-wikitext-103LSTM#77Test perplexity: 48.7
language-modelling-on-wikitext-2Grave et al. (2016) - LSTM + continuous cache pointer#32Test perplexity: 68.9
language-modelling-on-wikitext-2Grave et al. (2016) - LSTM#36Test perplexity: 99.3