Prompting for explanations improves Adversarial NLI. Is this true? {Yes} it is {true} because {it weakens superficial cues}
Open paper
Benchmark
Model
Rank
Results
natural-language-inference-on-anli-test
T0-11B (explanation prompting)
–
A1: 75.6
A2: 60.6
A3: 59.9
natural-language-inference-on-anli-test
T5-3B (explanation prompting)
–
A1: 81.8
A2: 72.5
A3: 74.8
Rank counts only results with a code link.