| video-based-generative-performance | LLaMA-VID-13B (2 Token) | #14 | mean: 2.99Correctness of Information: 3.07Detail Orientation: 3.05… |
| video-based-generative-performance | LLaMA-VID-7B (2 Token) | #16 | mean: 2.89Correctness of Information: 2.96Detail Orientation: 3.00… |
| video-question-answering-on-activitynet-qa | LLaMA-VID-13B (2 Token) | #7 | Accuracy: 47.5Confidence score: 3.3 |
| video-question-answering-on-activitynet-qa | LLaMA-VID-7B (2 Token) | #8 | Accuracy: 47.4Confidence score: 3.3 |
| video-question-answering-on-ovbench | LLaMA-VID (7B) | #8 | AVG: 41.9 |
| zeroshot-video-question-answer-on-activitynet | LLaMA-VID-13B (2 Token) | #15 | Accuracy: 47.5Confidence Score: 3.3 |
| zeroshot-video-question-answer-on-activitynet | LLaMA-VID-7B (2 Token) | #16 | Accuracy: 47.4Confidence Score: 3.3 |
| zeroshot-video-question-answer-on-msrvtt-qa | LLaMA-VID-13B (2 Token) | #17 | Accuracy: 58.9Confidence Score: 3.3 |
| zeroshot-video-question-answer-on-msrvtt-qa | LLaMA-VID-7B (2 Token) | #18 | Accuracy: 57.7Confidence Score: 3.2 |
| zeroshot-video-question-answer-on-msvd-qa | LLaMA-VID-13B (2 Token) | #19 | Accuracy: 70.0Confidence Score: 3.7 |
| zeroshot-video-question-answer-on-msvd-qa | LLaMA-VID-7B (2 Token) | #20 | Accuracy: 69.7Confidence Score: 3.7 |