AFlow: Automating Agentic Workflow Generation
Open paper
Benchmark
Model
Rank
Results
code-generation-on-mbpp
AFlow(GPT-4o-mini)
#9
Accuracy: 83.4
Rank counts only results with a code link.