OpenCodePapers
image-sentence-alignment-on-valse-foil-it-noun-phrases
Vision-Language Understanding
Image-Sentence Alignment
Dataset Link
Results over time
Click legend items to toggle metrics. Hover points for model names.
Leaderboard
Show papers without code
Paper
Code
pairwise accuracy
↕
Accuracy (%)
↕
ModelName
ReleaseDate
↕
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
✓ Link
88.8
CLIP
2021-12-14
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
✓ Link
87.1
70.8
LXMERT
2021-12-14
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
✓ Link
86.9
71.5
ViLBERT 12-in-1
2021-12-14
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
✓ Link
86.9
55.9
ViLBERT
2021-12-14
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
✓ Link
80.7
GPT2
2021-12-14
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
✓ Link
77.5
GPT1
2021-12-14
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena
✓ Link
48.5
46.6
VisualBERT
2021-12-14
×