Learning to Encode Position for Transformer with Continuous Dynamical Model

Benchmark Model Rank Results
linguistic-acceptability-on-colaFLOATER-large#11Accuracy: 69%
machine-translation-on-wmt2014-english-frenchFLOATER-large#16BLEU score: 42.7
machine-translation-on-wmt2014-english-germanFLOATER-large#27BLEU score: 29.2
semantic-textual-similarity-on-mrpcFLOATER-large#4Accuracy: 91.4%
sentiment-analysis-on-sst-2-binaryFLOATER-large#11Accuracy: 96.7