Learning Longer-term Dependencies in RNNs with Auxiliary Losses
Open paper
Benchmark
Model
Rank
Results
sequential-image-classification-on-sequential-1
Transformer (self-attention) (Trinh et al., 2018)
#13
Unpermuted Accuracy: 62.2%
Rank counts only results with a code link.