AudioCaps: Generating Captions for Audios in The Wild
Open paper
Benchmark
Model
Rank
Results
audio-captioning-on-audiocaps
TopDown-AlignedAtt (1NN)
–
SPIDEr: 0.369
CIDEr: 0.593
SPICE: 0.144
Rank counts only results with a code link.