LITA: Language Instructed Temporal-Localization Assistant

Benchmark Model Rank Results
video-based-generative-performanceLITA-13B#12mean: 3.04Correctness of Information: 2.94Detail Orientation: 2.98
video-question-answering-on-ovbenchLITA (7B)#12AVG: 20.4