Fetching the paper…

CODIS: Benchmarking Context-Dependent Visual Comprehension for Multimodal Large Language Models · Around