MMIE: Massive Multimodal Interleaved Comprehension Benchmark for Large Vision-Language Models
Peng Xia, Siwei Han, Shi Qiu +9 authors
MMIE is a large-scale benchmark for evaluating interleaved multimodal comprehension and generation in Large Vision-Language Models using diverse data and reliable automated evaluation metrics.