Measuring Coding Challenge Competence With APPS

Benchmark Model Rank Results
code-generation-on-appsGPT-Neo 2.7B#14Introductory Pass@1: 3.90%Interview Pass@1: 0.57%