Instant research discovery
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Showing 1-30 of 274 papers (page 1 of 10)路 33 ms
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Red-Teaming the Stable Diffusion Safety Filter Daniel Paleka, David Lindner, Florian Tram猫r, Javier Rando Published: 2022-10-03Area: Multimodal SafetyCitations: 262 Tags: ai-safety, empirical, multimodal-safety | 2022-10-03 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (97%) | 262 |
| Safe Latent Diffusion: Mitigating Inappropriate Degeneration in Diffusion Models Bj枚rn Deiseroth, Kristian Kersting, Manuel Brack, Patrick Schramowski Published: 2022-11-09Area: Multimodal SafetyCitations: 480 Tags: ai-safety, empirical, multimodal-safety | 2022-11-09 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E4 / R3 (97%) | 480 |
| On Evaluating Adversarial Robustness of Large Vision-Language Models Chao Du, Chongxuan Li, Min Lin, Ngai-Man Cheung Published: 2023-05-26Area: Multimodal SafetyCitations: 287 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2023-05-26 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E8 / R3 (97%) | 287 |
| Visual Adversarial Examples Jailbreak Aligned Large Language Models Ashwinee Panda, Kaixuan Huang, Mengdi Wang, Peter Henderson Published: 2023-06-22Area: Multimodal SafetyCitations: 295 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2023-06-22 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E6 / R3 (96%) | 295 |
| (Ab)using Images and Sounds for Indirect Instruction Injection in Multi-Modal LLMs Ben Nassi, Eugene Bagdasaryan, Tsung-Yin Hsieh, Vitaly Shmatikov Published: 2023-07-19Area: Multimodal SafetyCitations: 121 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2023-07-19 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (95%) | 121 |
| Jailbreak in Pieces: Compositional Adversarial Attacks on Multi-Modal Language Models Erfan Shayegani, Nael Abu-Ghazaleh, Yue Dong Published: 2023-07-26Area: Multimodal SafetyCitations: 240 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2023-07-26 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E4 / R2 (93%) | 240 |
| Adversarial Illusions in Multi-Modal Embeddings Eugene Bagdasaryan, Rishi Jha, Tingwei Zhang, Vitaly Shmatikov Published: 2023-08-22Area: Multimodal SafetyCitations: 30 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2023-08-22 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | 30 |
| Image Hijacks: Adversarial Images can Control Generative Models at Runtime Euan Ong, Luke Bailey, Scott Emmons, Stuart Russell Published: 2023-09-01Area: Multimodal SafetyCitations: 146 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2023-09-01 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E6 / R5 (99%) | 146 |
| How Robust is Google's Bard to Adversarial Image Attacks? Hang Su, Huanran Chen, Jiawei Chen, Jun Zhu Published: 2023-09-21Area: Multimodal SafetyCitations: 174 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2023-09-21 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E7 / R4 (95%) | 174 |
| Misusing Tools in Large Language Models With Visual Adversarial Examples Earlence Fernandes, Niloofar Mireshghallah, Rajesh K. Gupta, Shuheng Li Published: 2023-10-04Area: Multimodal SafetyCitations: 35 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2023-10-04 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E4 / R3 (94%) | 35 |
| FigStep: Jailbreaking Large Vision-Language Models via Typographic Visual Prompts Anyu Wang, Conglei Wang, Delong Ran, Jinyuan Liu Published: 2023-11-09Area: Multimodal SafetyCitations: 306 Tags: adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | 2023-11-09 | Multimodal Safety | adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | E5 / R3 (95%) | 306 |
| Jailbreaking GPT-4V via Self-Adversarial Attacks with System Prompts Lichao Sun, Pan Zhou, Xiang Li, Yixin Liu Published: 2023-11-15Area: Multimodal SafetyCitations: 78 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2023-11-15 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E4 / R3 (94%) | 78 |
| How Many Unicorns Are in This Image? A Safety Evaluation Benchmark for Vision LLMs Bingchen Zhao, Chenhang Cui, Cihang Xie, Haoqin Tu Published: 2023-11-27Area: Multimodal SafetyCitations: 108 Tags: ai-safety, alignment-training, benchmark, multimodal-safety, safety-evaluation | 2023-11-27 | Multimodal Safety | ai-safety, alignment-training, benchmark, multimodal-safety, safety-evaluation | E5 / R3 (95%) | 108 |
| MM-SafetyBench: A Benchmark for Safety Evaluation of Multimodal Large Language Models Chao Yang, Jindong Gu, Xin Liu, Yichen Zhu Published: 2023-11-29Area: Multimodal SafetyCitations: 201 Tags: ai-safety, benchmark, multimodal-safety, safety-evaluation | 2023-11-29 | Multimodal Safety | ai-safety, benchmark, multimodal-safety, safety-evaluation | E5 / R3 (95%) | 201 |
| Divide-and-Conquer Attack: Harnessing the Power of LLM to Bypass the Censorship of Text-to-Image Generation Model Huangxun Chen, Yimo Deng Published: 2023-12-12Area: Multimodal SafetyCitations: 5 Tags: ai-safety, empirical, multimodal-safety | 2023-12-12 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (97%) | 5 |
| Safety of Multimodal Large Language Models on Images and Text Chao Yang, Xin Liu, Yichen Zhu, Yunshi Lan Published: 2024-02-01Area: Multimodal SafetyCitations: 65 Tags: ai-safety, multimodal-safety, survey | 2024-02-01 | Multimodal Safety | ai-safety, multimodal-safety, survey | E7 / R3 (95%) | 65 |
| Safety Fine-Tuning at (Almost) No Cost: A Baseline for Vision Large Language Models Ondrej Bohdal, Timothy Hospedales, Tingyang Yu, Yongshuo Zong Published: 2024-02-03Area: Multimodal SafetyCitations: 125 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2024-02-03 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E6 / R3 (94%) | 125 |
| Jailbreaking Attack against Multimodal Large Language Model Gang Hua, Haodong Ren, Rong Jin, Xinbo Gao Published: 2024-02-04Area: Multimodal SafetyCitations: 128 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2024-02-04 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E8 / R3 (95%) | 128 |
| Shadowcast: Stealthy Data Poisoning Attacks Against Vision-Language Models Furong Huang, Jiarui Yao, Manli Shu, Ning Yu Published: 2024-02-05Area: Multimodal SafetyCitations: 42 Tags: ai-safety, empirical, multimodal-safety | 2024-02-05 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (95%) | 42 |
| Agent Smith: A Single Image Can Jailbreak One Million Multimodal LLM Agents Exponentially Fast Chao Du, Jing Jiang, Min Lin, Qian Liu Published: 2024-02-13Area: Multimodal SafetyCitations: 106 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2024-02-13 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E4 / R3 (95%) | 106 |
| Test-Time Backdoor Attacks on Multimodal Large Language Models Chao Du, Dong Lu, Min Lin, Qian Liu Published: 2024-02-13Area: Multimodal SafetyCitations: 39 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2024-02-13 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E6 / R5 (98%) | 39 |
| AdaShield: Safeguarding Multimodal Large Language Models from Structure-based Attack via Adaptive Shield Prompting Chaowei Xiao, Muhao Chen, Xiaogeng Liu, Yu Li Published: 2024-03-14Area: Multimodal SafetyCitations: 106 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2024-03-14 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E6 / R3 (95%) | 106 |
| B-AVIBench: Toward Evaluating the Robustness of Large Vision-Language Model on Black-Box Adversarial Visual-Instructions Hao Zhang, Hong Liu, Kaipeng Zhang, Ping Luo Published: 2024-03-14Area: Multimodal SafetyCitations: 28 Tags: adversarial-robustness, ai-safety, benchmark, multimodal-safety | 2024-03-14 | Multimodal Safety | adversarial-robustness, ai-safety, benchmark, multimodal-safety | E5 / R3 (98%) | 28 |
| Eyes Closed, Safety On: Protecting Multimodal LLMs via Image-to-Text Transformation Dit-Yan Yeung, Hang Xu, James T. Kwok, Kai Chen Published: 2024-03-14Area: Multimodal SafetyCitations: 110 Tags: ai-safety, empirical, multimodal-safety | 2024-03-14 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (97%) | 110 |
| Images are Achilles' Heel of Alignment: Exploiting Visual Vulnerabilities for Jailbreaking Multimodal Large Language Models Hangyu Guo, Ji-Rong Wen, Kun Zhou, Wayne Xin Zhao Published: 2024-03-14Area: Multimodal SafetyCitations: 101 Tags: adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | 2024-03-14 | Multimodal Safety | adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | E5 / R3 (94%) | 101 |
| FMM-Attack: A Flow-based Multi-modal Adversarial Attack on Video-based LLMs Jingyun Zhang, Jinmin Li, Kuofeng Gao, Shu-tao Xia Published: 2024-03-20Area: Multimodal SafetyCitations: 12 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2024-03-20 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R4 (94%) | 12 |
| Jailbreaking Prompt Attack: A Controllable Adversarial Attack against Diffusion Models Anda Cao, Chao Ye, Jiachen Ma, Jie Zhang Published: 2024-04-02Area: Multimodal SafetyCitations: 64 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2024-04-02 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E6 / R3 (97%) | 64 |
| JailBreakV-28K: A Benchmark for Assessing the Robustness of MultiModal Large Language Models against Jailbreak Attacks Chaowei Xiao, Siyuan Ma, Weidi Luo, Xiaogeng Liu Published: 2024-04-03Area: Multimodal SafetyCitations: 182 Tags: adversarial-robustness, ai-safety, benchmark, multimodal-safety | 2024-04-03 | Multimodal Safety | adversarial-robustness, ai-safety, benchmark, multimodal-safety | E4 / R3 (98%) | 182 |
| Unbridled Icarus: A Survey of the Potential Perils of Image Inputs in Multimodal Large Language Model Security Shaofeng Li, Yihe Fan, Yuxin Cao, Ziyao Liu Published: 2024-04-08Area: Multimodal SafetyCitations: 21 Tags: ai-safety, multimodal-safety, survey | 2024-04-08 | Multimodal Safety | ai-safety, multimodal-safety, survey | E6 / R3 (95%) | 21 |
| Latent Guard: a Safety Framework for Text-to-image Generation Ashkan Khakzar, Fabio Pizzati, Jindong Gu, Philip Torr Published: 2024-04-11Area: Multimodal SafetyCitations: 56 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2024-04-11 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R4 (96%) | 56 |