| answerability-prediction-on-peerqa | Llama-3-IT-8B-8k | #3 | Macro F1: 0.3112 |
| answerability-prediction-on-peerqa | Llama-3-IT-8B-32k | #5 | Macro F1: 0.2881 |
| multi-task-language-understanding-on-mmlu | DBRX Instruct 132B (5-shot) | #3 | Average (%): 73.7 |
| multi-task-language-understanding-on-mmlu | Llama 3.1 8B (CoT) | #5 | Average (%): 73.0 |
| question-answering-on-peerqa | Llama-3-IT-8B-32k | #3 | Prometheus-2 Answer Correctness: 3.1673Rouge-L: 0.2286… |
| question-answering-on-peerqa | Llama-3-IT-8B-8k | #4 | Prometheus-2 Answer Correctness: 3.1102Rouge-L: 0.2295… |