OpenCodePapers

image-sentence-alignment-on-valse-counting-balanced

Vision-Language UnderstandingImage-Sentence Alignment
Dataset Link
Results over time
Click legend items to toggle metrics. Hover points for model names.
Leaderboard
PaperCodepairwise accuracyAccuracy (%)ModelNameReleaseDate
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena✓ Link76.764.9ViLBERT 12-in-12021-12-14
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena✓ Link62.252.0LXMERT2021-12-14
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena✓ Link62.1CLIP2021-12-14
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena✓ Link58.650.7ViLBERT2021-12-14
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena✓ Link51.6GPT22021-12-14
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena✓ Link51.2GPT12021-12-14
VALSE: A Task-Independent Benchmark for Vision and Language Models Centered on Linguistic Phenomena✓ Link48.248.3VisualBERT2021-12-14