Fetching the paper…

TaskCLIP: Extend Large Vision-Language Model for Task Oriented Object Detection · Around