LILE: Look In-Depth before Looking Elsewhere -- A Dual Attention Network using Transformers for Cross-Modal Information Retrieval in Histopathology Archives

Benchmark Model Rank Results
cross-modal-retrieval-on-coco-2014LILEText-to-image R@1: 41.5Text-to-image R@5: 72.1