On improving adversarial transferability of vision transformers
Original
Naseer, M., Ranasinghe, K., Khan, S., Khan, F. S., and Porikli, F · 2021
Cited alongside, same era.
Universal and transferable adversarial attacks on aligned language models
Original
Zou, A., Wang, Z., Kolter, J. Z., and Fredrikson, M · 2021
Cited alongside, same era.
Flamingo: a visual language model for few-shot learning
Alayrac, J.-B., Donahue, J., Luc, P., Miech, A., Barr, I., Hasson, Y., Lenc, K., Mensch, A., Millican, K., Reynolds, M., et al · 2022
Cited alongside, same era.
Patch-fool: Are vision transformers always robust against adversarial perturbations?
Original
Fu, Y., Zhang, S., Wu, S., Wan, C., and Lin, Y · 2022
Cited alongside, same era.
Training language models to follow instructions with human feedback
Ouyang, L., Wu, J., Jiang, X., Almeida, D., Wainwright, C., Mishkin, P., Zhang, C., Agarwal, S., Slama, K., Ray, A., et al · 2022
Cited alongside, same era.
Red teaming language models with language models
Original
Perez, E., Huang, S., Song, F., Cai, T., Ring, R., Aslanides, J., Glaese, A., McAleese, N., and Irving, G · 2022
Cited alongside, same era.
Lamda: Language models for dialog applications
Original
Thoppilan, R., De Freitas, D., Hall, J., Shazeer, N., Kulshreshtha, A., Cheng, H.-T., Jin, A., Bos, T., Baker, L., Du, Y., et al · 2022
Cited alongside, same era.
Towards transferable adversarial attacks on vision transformers
Wei, Z., Chen, J., Goldblum, M., Wu, Z., Goldstein, T., and Jiang, Y.-G · 2022
Cited alongside, same era.
Qwen-vl: A versatile vision-language model for understanding, localization, text reading, and beyond
Original
Bai, J., Bai, S., Yang, S., Wang, S., Tan, S., Wang, P., Lin, J., Zhou, C., and Zhou, J · 2023
Cited alongside, same era.
Image hijacks: Adversarial images can control generative models at runtime
Original
Bailey, L., Ong, E., Russell, S., and Emmons, S · 2023
Cited alongside, same era.
Are aligned neural networks adversarially aligned?
Original
Carlini, N., Nasr, M., Choquette-Choo, C. A., Jagielski, M., Gao, I., Awadalla, A., Koh, P. W., Ippolito, D., Lee, K., Tramer, F., et al · 2023
Cited alongside, same era.
Minigpt-v2: large language model as a unified interface for vision-language multi-task learning
Original
Chen, J., Zhu, D., Shen, X., Li, X., Liu, Z., Zhang, P., Krishnamoorthi, R., Chandra, V., Xiong, Y., and Elhoseiny, M · 2023
Cited alongside, same era.