Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks

Benchmark Model Rank Results
fact-verification-on-feverRAG#5Accuracy: 72.5
question-answering-on-natural-questionsRAG#13EM: 44.5
question-answering-on-triviaqaRAG#26EM: 56.1
question-answering-on-webquestionsRAG#5EM: 45.2