Calibrating Sequence likelihood Improves Conditional Language Generation

Benchmark Model Rank Results
abstractive-text-summarization-on-cnn-dailyPegasusROUGE-1: 47.36ROUGE-2: 24.02ROUGE-L: 44.45
text-summarization-on-reddit-tifuPEGASUS 2B + SLiCROUGE-1: 32.03ROUGE-2: 11.13ROUGE-L: 25.51
text-summarization-on-samsum-corpusPEGASUS 2B + SliCROUGE-1: 54.37ROUGE-2: 29.88ROUGE-L: 45.89