Retrieving-to-Answer: Zero-Shot Video Question Answering with Frozen Large Language Models

Benchmark Model Rank Results
temporal-casual-qa-on-next-qaR2AWUPS: 34.7