Instant research discovery
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Adversarial Robustness for Visual Grounding of Multimodal Large Language Models Jiawang Bai, Kuofeng Gao, Shu-Tao Xia, Yang Bai Published: 2024-05-16Area: Multimodal SafetyCitations: 26 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2024-05-16 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (93%) | 26 |
| Safeguarding Vision-Language Models Against Patched Visual Prompt Injectors Changsheng Wang, Chaowei Xiao, Jiachen Sun, Jiongxiao Wang Published: 2024-05-17Area: Multimodal SafetyCitations: 16 Tags: ai-safety, empirical, multimodal-safety | 2024-05-17 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | 16 |
| Safety Alignment for Vision Language Models Bo Zheng, Chongjun Wang, Qiushi Cui, Xiangyu Yue Published: 2024-05-22Area: Multimodal SafetyCitations: 20 Tags: ai-safety, alignment-training, empirical, multimodal-safety | 2024-05-22 | Multimodal Safety | ai-safety, alignment-training, empirical, multimodal-safety | E6 / R3 (96%) | 20 |
| Visual-RolePlay: Universal Jailbreak Attack on MultiModal Large Language Models via Role-playing Image Character Bo Li, Chaowei Xiao, Muhao Chen, Siyuan Ma Published: 2024-05-25Area: Multimodal SafetyCitations: 59 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2024-05-25 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E7 / R3 (97%) | 59 |
| Medical MLLM Is Vulnerable: Cross-Modality Jailbreak and Mismatched Attacks on Medical Multimodal Large Language Models Chengwei Pan, Hantao Zhang, Hao Wang, Jiawen Xi Published: 2024-05-26Area: Multimodal SafetyCitations: 15 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2024-05-26 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | 15 |
| Pruning for Robust Concept Erasing in Diffusion Models Chang Xu, Juan Cao, Tianyun Yang Published: 2024-05-26Area: Multimodal SafetyCitations: 25 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2024-05-26 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (95%) | 25 |
| Cross-Modal Safety Alignment: Is textual unlearning all you need? Amit K. Roy-Chowdhury, Chengyu Song, Erfan Shayegani, M. Salman Asif Published: 2024-05-27Area: Multimodal SafetyCitations: 25 Tags: ai-safety, alignment-training, empirical, multimodal-safety | 2024-05-27 | Multimodal Safety | ai-safety, alignment-training, empirical, multimodal-safety | E5 / R3 (94%) | 25 |
| White-box Multimodal Jailbreaks Against Large Vision-Language Models Chuanjun Ji, Guangnan Ye, Hanxu Zhou, Ruofan Wang Published: 2024-05-28Area: Multimodal SafetyCitations: 47 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2024-05-28 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | 47 |
| Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt Aishan Liu, Dacheng Tao, Siyuan Liang, Tianyuan Zhang Published: 2024-06-06Area: Multimodal SafetyCitations: 83 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2024-06-06 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E6 / R3 (96%) | 83 |
| SPA-VL: A Comprehensive Safety Preference Alignment Dataset for Vision Language Models Feng Zhao, Guodong Zheng, Jing Shao, Jinlan Fu Published: 2024-06-17Area: Multimodal SafetyCitations: 68 Tags: ai-safety, alignment-training, dataset, multimodal-safety | 2024-06-17 | Multimodal Safety | ai-safety, alignment-training, dataset, multimodal-safety | E6 / R3 (95%) | 68 |
| Unaligning Everything: Or Aligning Any Text to Any Image in Multimodal Models Md Montasir Bin Shams, Shaeke Salman, Xiuwen Liu Published: 2024-07-01Area: Multimodal SafetyCitations: 2 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2024-07-01 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (94%) | 2 |
| T2VSafetyBench: Evaluating the Safety of Text-to-Video Generative Models Jun Zhu, Lijia Yu, Xiao-Shan Gao, Yibo Miao Published: 2024-07-08Area: Multimodal SafetyCitations: 45 Tags: ai-safety, benchmark, multimodal-safety | 2024-07-08 | Multimodal Safety | ai-safety, benchmark, multimodal-safety | E7 / R3 (98%) | 45 |
| A Survey of Attacks on Large Vision-Language Models: Resources, Advances, and Future Trends Daizong Liu, Mingyu Yang, Pan Zhou, Wei Hu Published: 2024-07-10Area: Multimodal SafetyCitations: 81 Tags: adversarial-robustness, ai-safety, multimodal-safety, survey | 2024-07-10 | Multimodal Safety | adversarial-robustness, ai-safety, multimodal-safety, survey | E7 / R5 (96%) | 81 |
| Refusing Safe Prompts for Multi-modal Large Language Models Hongbin Liu, Neil Zhenqiang Gong, Yuepeng Hu, Zedian Shao Published: 2024-07-12Area: Multimodal SafetyCitations: 5 Tags: ai-safety, empirical, multimodal-safety | 2024-07-12 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E7 / R3 (94%) | 5 |
| Self-interpreting Adversarial Images Collin Zhang, Eugene Bagdasaryan, John X. Morris, Tingwei Zhang Published: 2024-07-12Area: Multimodal SafetyCitations: 5 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2024-07-12 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | 5 |
| Arondight: Red Teaming Large Vision Language Models with Auto-generated Multi-modal Jailbreak Prompts Chengjun Cai, Cong Wang, Xiaoli Zhang, Xingliang Yuan Published: 2024-07-21Area: Multimodal SafetyCitations: 38 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety, red-teaming | 2024-07-21 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety, red-teaming | E5 / R3 (96%) | 38 |
| Can Large Language Models Automatically Jailbreak GPT-4V? Lichao Sun, Pan Zhou, Xiang Li, Yixin Liu Published: 2024-07-23Area: Multimodal SafetyCitations: 3 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2024-07-23 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | 3 |
| Cross-modality Information Check for Detecting Jailbreaking in Multimodal Large Language Models Wenjie Wang, Xiuyuan Qi, Yue Xu, Zhan Qin Published: 2024-07-31Area: Multimodal SafetyCitations: 10 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2024-07-31 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | 10 |
| MMJ-Bench: A Comprehensive Study on Jailbreak Attacks and Defenses for Vision Language Models Chengyan Fu, Fenghua Weng, Wenjie Wang, Yue Xu Published: 2024-08-16Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, benchmark, multimodal-safety | 2024-08-16 | Multimodal Safety | adversarial-robustness, ai-safety, benchmark, multimodal-safety | E8 / R3 (98%) | - |
| PIP: Detecting Adversarial Examples in Large Vision-Language Models via Attention Patterns of Irrelevant Probe Questions Jiansheng Chen, Ruobing Xie, Xingwu Sun, Yudong Zhang Published: 2024-09-08Area: Multimodal SafetyCitations: 9 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2024-09-08 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E4 / R3 (97%) | 9 |
| Securing Vision-Language Models with a Robust Encoder Against Jailbreak and Adversarial Attacks Ahmed Imteaj, Md Zarif Hossain Published: 2024-09-11Area: Multimodal SafetyCitations: 14 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2024-09-11 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E6 / R3 (95%) | 14 |
| Understanding Implosion in Text-to-Image Generative Models Ben Y. Zhao, Cathy Y. Li, Haitao Zheng, Shawn Shan Published: 2024-09-18Area: Multimodal SafetyCitations: 6 Tags: ai-safety, alignment-training, empirical, multimodal-safety | 2024-09-18 | Multimodal Safety | ai-safety, alignment-training, empirical, multimodal-safety | E5 / R4 (96%) | 6 |
| Multimodal Pragmatic Jailbreak on Text-to-image Models Gengyuan Zhang, Jindong Gu, Philip Torr, Tong Liu Published: 2024-09-27Area: Multimodal SafetyCitations: 12 Tags: adversarial-robustness, ai-safety, benchmark, multimodal-safety | 2024-09-27 | Multimodal Safety | adversarial-robustness, ai-safety, benchmark, multimodal-safety | E5 / R3 (95%) | 12 |
| VLMGuard: Defending VLMs against Malicious Prompts via Unlabeled Data Ahmed Salem, Emily Lawton, Jack W. Stokes, Reshmi Ghosh Published: 2024-10-01Area: Multimodal SafetyCitations: 16 Tags: ai-safety, empirical, multimodal-safety | 2024-10-01 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E4 / R3 (95%) | 16 |
| Interpreting and Editing Vision-Language Representations to Mitigate Hallucinations Anish Kachinthaya, Nick Jiang, Suzie Petryk, Yossi Gandelsman Published: 2024-10-03Area: Multimodal SafetyCitations: 69 Tags: ai-safety, empirical, multimodal-safety | 2024-10-03 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (97%) | 69 |
| SteerDiff: Steering towards Safe Text-to-Image Diffusion Models Hao Chen, Hongxiang Zhang, Yifeng He Published: 2024-10-03Area: Multimodal SafetyCitations: 7 Tags: ai-safety, empirical, multimodal-safety | 2024-10-03 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (94%) | 7 |
| AnyAttack: Towards Large-scale Self-supervised Generation of Targeted Adversarial Examples for Vision-Language Models Dit-Yan Yeung, Jiaming Zhang, Jitao Sang, Junhong Ye Published: 2024-10-07Area: Multimodal SafetyCitations: 17 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2024-10-07 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E7 / R3 (96%) | 17 |
| ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time Bolian Li, Ruqi Zhang, Yi Ding Published: 2024-10-09Area: Multimodal SafetyCitations: 44 Tags: ai-safety, alignment-training, empirical, multimodal-safety | 2024-10-09 | Multimodal Safety | ai-safety, alignment-training, empirical, multimodal-safety | E5 / R3 (95%) | 44 |
| How Does Vision-Language Adaptation Impact the Safety of Vision Language Models? Geewook Kim, Hoyeon Chang, Hyunji Lee, Jiyeon Kim Published: 2024-10-10Area: Multimodal SafetyCitations: 4 Tags: ai-safety, empirical, multimodal-safety | 2024-10-10 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E6 / R3 (94%) | 4 |
| Unraveling and Mitigating Safety Alignment Degradation of Vision-Language Models Chao Shang, Jie Ma, Ling Liu, Llu铆s M脿rquez Published: 2024-10-11Area: Multimodal SafetyCitations: 16 Tags: ai-safety, alignment-training, empirical, multimodal-safety | 2024-10-11 | Multimodal Safety | ai-safety, alignment-training, empirical, multimodal-safety | E5 / R3 (95%) | 16 |