Measuring Compositional Generalization: A Comprehensive Method on Realistic Data
Open paper
Benchmark
Model
Rank
Results
semantic-parsing-on-cfq
Universal Transformer
#3
Exact Match: 18.9
Rank counts only results with a code link.