SOEN-101: Code Generation by Emulating Software Process Models Using Large Language Model Agents

Benchmark Model Rank Results
code-generation-on-mbppGPT-3.5 Turbo + FlowGenScrum + TestAccuracy: 83.8±0.6