Cross-Modal Food Retrieval: Learning a Joint Embedding of Food Images and Recipes with Semantic Consistency and Attention Mechanism

Benchmark Model Rank Results
cross-modal-retrieval-on-recipe1mSCANImage-to-text R@1: 54.0Text-to-image R@1: 54.9