Cross-Modal Retrieval in the Cooking Context: Learning Semantic Text-Image Embeddings

Benchmark Model Rank Results
cross-modal-retrieval-on-recipe1mAdaMine#7Image-to-text R@1: 39.8Text-to-image R@1: 40.2