Fetching the paper…
Reading the bibliography…
In this paper, we introduce a novel multimodal camo-perceptive framework (MMCPF) aimed at handling zero-shot Camouflaged Object Detection (COD) by leveraging the powerful capabilities of Multimodal Large Language Models (MLLMs).
Structure-Measure: A New Way to Evaluate Foreground Maps. In IEEE International Conference on Computer Vision, ICCV 2017, Venice, Italy, October 22-29, 2017 . IEEE Computer Society, 4558–4567
Deng-Ping Fan, Ming-Ming Cheng, Yun Liu, Tao Li, and Ali Borji. 2017 · 2017
Earlier work this paper cites.
BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding. In NAACL-HLT (1) . Association for Computational Linguistics, 4171–4186
Jacob Devlin, Ming-Wei Chang, Kenton Lee, and Kristina Toutanova. 2019 · 2019
Earlier work this paper cites.
Anabranch network for camouflaged object segmentation
Trung-Nghia Le, Tam V. Nguyen, Zhongliang Nie, Minh-Triet Tran, and Akihiro Sugimoto. 2019 · 2019
Earlier work this paper cites.
Co-saliency Detection Based on Hierarchical Consistency. In ACM Multimedia . ACM, 1392–1400
Bo Li, Zhengxing Sun, Quan Wang, and Qian Li. 2019 · 2019
Earlier work this paper cites.
ViLBERT: Pretraining Task-Agnostic Visiolinguistic Representations for Vision-and-Language Tasks. In NeurIPS . 13–23
Jiasen Lu, Dhruv Batra, Devi Parikh, and Stefan Lee. 2019 · 2019
Earlier work this paper cites.
Language Models are Few-Shot Learners. In NeurIPS
Tom B. Brown, Benjamin Mann, Nick Ryder, Melanie Subbiah, Jared Kaplan, Prafulla Dhariwal, Arvind Neelakantan, Pranav Shyam, Girish Sastry, Amanda Askell, Sandhini Agarwal, Ariel Herbert-Voss, Gretchen Krueger, Tom Henighan, Rewon Child, Aditya Ramesh, Daniel M. Ziegler, Jeffrey Wu, Clemens Winter, Christopher Hesse, Mark Chen, Eric Sigler, Mateusz Litwin, Scott Gray, Benjamin Chess, Jack Clark, Christopher Berner, Sam McCandlish, Alec Radford, Ilya Sutskever, and Dario Amodei. 2020 · 2020
Earlier work this paper cites.
Camouflaged Object Detection. In CVPR . IEEE, 2774–2784
Deng-Ping Fan, Ge-Peng Ji, Guolei Sun, Ming-Ming Cheng, Jianbing Shen, and Ling Shao. 2020 · 2020
Earlier work this paper cites.
Camouflaged Object Detection and Tracking: A Survey
Ajoy Mondal. 2020 · 2020
Earlier work this paper cites.
Simultaneously Localize, Segment and Rank the Camouflaged Objects. In CVPR . IEEE, 11591–11601
Yunqiu Lv, Jing Zhang, Yuchao Dai, Aixuan Li, Bowen Liu, Nick Barnes, and Deng-Ping Fan. 2021 · 2021
Earlier work this paper cites.
Learning Transferable Visual Models From Natural Language Supervision. In ICML , Vol. 139. PMLR, 8748–8763
Alec Radford, Jong Wook Kim, Chris Hallacy, Aditya Ramesh, Gabriel Goh, Sandhini Agarwal, Girish Sastry, Amanda Askell, Pamela Mishkin, Jack Clark, Gretchen Krueger, and Ilya Sutskever. 2021 · 2021
Earlier work this paper cites.
Warp Consistency for Unsupervised Learning of Dense Correspondences. In ICCV . IEEE
Prune Truong, Martin Danelljan, Fisher Yu, and Luc Van Gool. 2021 · 2021
Earlier work this paper cites.
Mutual Graph Learning for Camouflaged Object Detection. In CVPR . IEEE, 12997–13007
Qiang Zhai, Xin Li, Fan Yang, Chenglizhao Chen, Hong Cheng, and Deng-Ping Fan. 2021 · 2021
Earlier work this paper cites.
Rethinking Camouflaged Object Detection: Models and Datasets
Hongbo Bi, Cong Zhang, Kang Wang, Jinghui Tong, and Feng Zheng. 2022 · 2022
Earlier work this paper cites.
Implicit Motion Handling for Video Camouflaged Object Detection. In CVPR . IEEE, 13854–13863
Xuelian Cheng, Huan Xiong, Deng-Ping Fan, Yiran Zhong, Mehrtash Harandi, Tom Drummond, and Zongyuan Ge. 2022 · 2022
Earlier work this paper cites.
A survey for in-context learning
Qingxiu Dong, Lei Li, Damai Dai, Ce Zheng, Zhiyong Wu, Baobao Chang, Xu Sun, Jingjing Xu, and Zhifang Sui. 2022 · 2022
Earlier work this paper cites.
Concealed Object Detection
Deng-Ping Fan, Ge-Peng Ji, Ming-Ming Cheng, and Ling Shao. 2022 · 2022
Earlier work this paper cites.
Fast Camouflaged Object Detection via Edge-based Reversible Re-calibration Network
Ge-Peng Ji, Lei Zhu, Mingchen Zhuge, and Keren Fu. 2022 · 2022
Earlier work this paper cites.
Large Language Models are Zero-Shot Reasoners. In NeurIPS
Takeshi Kojima, Shixiang Shane Gu, Machel Reid, Yutaka Matsuo, and Yusuke Iwasawa. 2022 · 2022
Earlier work this paper cites.
BLIP: Bootstrapping Language-Image Pre-training for Unified Vision-Language Understanding and Generation. In ICML , Vol. 162. PMLR, 12888–12900
Junnan Li, Dongxu Li, Caiming Xiong, and Steven C. H. Hoi. 2022 · 2022
Earlier work this paper cites.
Zoom In and Out: A Mixed-scale Triplet Network for Camouflaged Object Detection. In CVPR . IEEE, 2150–2160
Youwei Pang, Xiaoqi Zhao, Tian-Zhu Xiang, Lihe Zhang, and Huchuan Lu. 2022 · 2022
Cited alongside, same era.
Chain-of-Thought Prompting Elicits Reasoning in Large Language Models. In NeurIPS
Jason Wei, Xuezhi Wang, Dale Schuurmans, Maarten Bosma, Brian Ichter, Fei Xia, Ed H. Chi, Quoc V. Le, and Denny Zhou. 2022 · 2022
Cited alongside, same era.
Camouflaged object detection via Neighbor Connection and Hierarchical Information Transfer
Cong Zhang, Kang Wang, Hongbo Bi, Ziqi Liu, and Lina Yang. 2022b · 2022
Cited alongside, same era.
TPRNet: camouflaged object detection via transformer-induced progressive refinement network
Qiao Zhang, Yanliang Ge, Cong Zhang, and Hongbo Bi. 2022a · 2022
Cited alongside, same era.
Detecting Camouflaged Object in Frequency Domain. In CVPR . IEEE, 4494–4503
Yijie Zhong, Bo Li, Lv Tang, Senyun Kuang, Shuang Wu, and Shouhong Ding. 2022 · 2022
Cited alongside, same era.
CLIP Surgery for Better Explainability with Enhancement in Open-Vocabulary Tasks
Yi Li, Hualiang Wang, Yiqun Duan, and Xiaomeng Li. 2023c · 2023
Closest in time.
Haotian Liu, Chunyuan Li, Qingyang Wu, and Yong Jae Lee. 2023a · 2023
Closest in time.
Matcher: Segment Anything with One Shot Using All-Purpose Feature Matching
Yang Liu, Muzhi Zhu, Hengtao Li, Hao Chen, Xinlong Wang, and Chunhua Shen. 2023b · 2023
Closest in time.
Segment Anything in Medical Images
Jun Ma and Bo Wang. 2023 · 2023
Closest in time.
GPT-4V(ision) System Card. In https://openai.com
OpenAI. 2023 · 2023
Closest in time.
alphaXiv searches the wider corpus for related work and actual follow-ups.
alphaXiv is searching for related work…
Yunkang Cao, Xiaohao Xu, Chen Sun, Xiaonan Huang, and Weiming Shen. 2023 · 2023
Cited alongside, same era.
Shikra: Unleashing Multimodal LLM’s Referential Dialogue Magic
Keqin Chen, Zhao Zhang, Weili Zeng, Richong Zhang, Feng Zhu, and Rui Zhao. 2023 · 2023
Cited alongside, same era.
InstructBLIP: Towards General-purpose Vision-Language Models with Instruction Tuning
Wenliang Dai, Junnan Li, Dongxu Li, Anthony Meng Huat Tiong, Junqi Zhao, Weisheng Wang, Boyang Li, Pascale Fung, and Steven C. H. Hoi. 2023 · 2023
Cited alongside, same era.
Complexity-Based Prompting for Multi-step Reasoning. In ICLR . OpenReview.net
Yao Fu, Hao Peng, Ashish Sabharwal, Peter Clark, and Tushar Khot. 2023 · 2023
Cited alongside, same era.
Weakly-Supervised Camouflaged Object Detection with Scribble Annotations. In AAAI . AAAI Press, 781–789
Ruozhen He, Qihua Dong, Jiaying Lin, and Rynson W. H. Lau. 2023 · 2023
Cited alongside, same era.
High-Resolution Iterative Feedback Network for Camouflaged Object Detection. In AAAI . AAAI Press, 881–889
Xiaobin Hu, Shuo Wang, Xuebin Qin, Hang Dai, Wenqi Ren, Donghao Luo, Ying Tai, and Ling Shao. 2023 · 2023
Cited alongside, same era.
Language Is Not All You Need: Aligning Perception with Language Models
Shaohan Huang, Li Dong, Wenhui Wang, Yaru Hao, Saksham Singhal, Shuming Ma, Tengchao Lv, Lei Cui, Owais Khan Mohammed, Barun Patra, Qiang Liu, Kriti Aggarwal, Zewen Chi, Johan Bjorck, Vishrav Chaudhary, Subhojit Som, Xia Song, and Furu Wei. 2023b · 2023
Cited alongside, same era.
DINOv2: Learning Robust Visual Features without Supervision
Maxime Oquab, Timothée Darcet, Théo Moutakanni, Huy Vo, Marc Szafraniec, Vasil Khalidov, Pierre Fernandez, Daniel Haziza, Francisco Massa, Alaaeldin El-Nouby, Mahmoud Assran, Nicolas Ballas, Wojciech Galuba, Russell Howes, Po-Yao Huang, Shang-Wen Li, Ishan Misra, Michael G. Rabbat, Vasu Sharma, Gabriel Synnaeve, Hu Xu, Hervé Jégou, Julien Mairal, Patrick Labatut, Armand Joulin, and Piotr Bojanowski. 2023 · 2023
Closest in time.
Open-Vocabulary Camouflaged Object Segmentation
Youwei Pang, Xiaoqi Zhao, Jiaming Zuo, Lihe Zhang, and Huchuan Lu. 2023 · 2023
Closest in time.
Kosmos-2: Grounding Multimodal Large Language Models to the World
Zhiliang Peng, Wenhui Wang, Li Dong, Yaru Hao, Shaohan Huang, Shuming Ma, and Furu Wei. 2023 · 2023
Closest in time.
DetGPT: Detect What You Need via Reasoning
Renjie Pi, Jiahui Gao, Shizhe Diao, Rui Pan, Hanze Dong, Jipeng Zhang, Lewei Yao, Jianhua Han, Hang Xu, Lingpeng Kong, and Tong Zhang. 2023 · 2023
Closest in time.
Customized Segment Anything Model for Medical Image Segmentation
Kaidong Zhang and Dong Liu. 2023 · 2023
Closest in time.
LLaMA-Adapter: Efficient Fine-tuning of Language Models with Zero-init Attention
Renrui Zhang, Jiaming Han, Aojun Zhou, Xiangfei Hu, Shilin Yan, Pan Lu, Hongsheng Li, Peng Gao, and Yu Qiao. 2023a · 2023
Closest in time.
Personalize Segment Anything Model with One Shot
Renrui Zhang, Zhengkai Jiang, Ziyu Guo, Shilin Yan, Junting Pan, Hao Dong, Peng Gao, and Hongsheng Li. 2023b · 2023
Closest in time.
GPT4RoI: Instruction Tuning Large Language Model on Region-of-Interest
Shilong Zhang, Peize Sun, Shoufa Chen, Min Xiao, Wenqi Shao, Wenwei Zhang, Kai Chen, and Ping Luo. 2023c · 2023
Closest in time.
ChatSpot: Bootstrapping Multimodal LLMs via Precise Referring Instruction Tuning
Liang Zhao, En Yu, Zheng Ge, Jinrong Yang, Haoran Wei, Hongyu Zhou, Jianjian Sun, Yuang Peng, Runpei Dong, Chunrui Han, and Xiangyu Zhang. 2023 · 2023
Closest in time.
MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models
Deyao Zhu, Jun Chen, Xiaoqian Shen, Xiang Li, and Mohamed Elhoseiny. 2023 · 2023
Closest in time.
Salient Object Detection via Integrity Learning
Mingchen Zhuge, Deng-Ping Fan, Nian Liu, Dingwen Zhang, Dong Xu, and Ling Shao. 2023 · 2023
Closest in time.
Relax Image-Specific Prompt Requirement in SAM: A Single Generic Prompt for Segmenting Camouflaged Objects. In AAAI . AAAI Press, 12511–12518
Jian Hu, Jiayi Lin, Shaogang Gong, and Weitong Cai. 2024 · 2024
Closest in time.
Xinyang Pu, Hecheng Jia, Linghao Zheng, Feng Wang, and Feng Xu. 2024 · 2024
Closest in time.