Revamping Cross-Modal Recipe Retrieval with Hierarchical Transformers and Self-supervised Learning
Open paper
Benchmark
Model
Rank
Results
cross-modal-retrieval-on-recipe1m
H-T
#5
Image-to-text R@1: 60.0
Text-to-image R@1: 60.3
Rank counts only results with a code link.