Fetching the paper…

Large Language Models as Automated Aligners for benchmarking Vision-Language Models · Around