Instant research discovery
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Unveiling the Attribute Misbinding Threat in Identity-Preserving Models Baoying Chen, Jianquan Yang, Jishen Zeng, Junming Fu Published: 2025-12-17Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2025-12-17 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | - |
| Adversarial Robustness of Vision in Open Foundation Models Jonathan Fox, Pavlos Papadopoulos, William J Buchanan Published: 2025-12-19Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-12-19 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E4 / R3 (97%) | - |
| Few Tokens Matter: Entropy Guided Attacks on Vision-Language Models Jing Zhang, Jinhong Ni, Mengqi He, Shu Zou Published: 2025-12-26Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-12-26 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (95%) | - |
| Look Closer! An Adversarial Parametric Editing Framework for Hallucination Mitigation in VLMs Beibei Li, Bing Ji, Jiangwei Xia, Jiayu Hu Published: 2025-12-26Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-12-26 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (98%) | - |
| Crafting Adversarial Inputs for Large Vision-Language Models Using Black-Box Optimization Haibo Jin, Haohan Wang, Jiwei Guan Published: 2026-01-05Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2026-01-05 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R4 (98%) | - |
| GAMBIT: A Gamified Jailbreak Framework for Multimodal Large Language Models Qin Hu, Xiangdong Hu, Xiaojun Jia, Yangyang Jiang Published: 2026-01-06Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2026-01-06 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E6 / R3 (97%) | - |
| When Helpers Become Hazards: A Benchmark for Analyzing Multimodal LLM-Powered Safety in Daily Life Fengran Mo, Jinan Xu, Jingyi Yin, Kaiyu Huang Published: 2026-01-07Area: Multimodal SafetyCitations: - Tags: ai-safety, alignment-training, benchmark, multimodal-safety | 2026-01-07 | Multimodal Safety | ai-safety, alignment-training, benchmark, multimodal-safety | E4 / R2 (94%) | - |
| AM3Safety: Towards Data Efficient Alignment of Multi-modal Multi-turn Safety for MLLMs Chengkun Cai, Chi-Min Chan, Han Zhu, Haoran Li Published: 2026-01-08Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | 2026-01-08 | Multimodal Safety | adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | E5 / R3 (97%) | - |
| Mechanisms of Prompt-Induced Hallucination in Vision-Language Models Carsten Eickhoff, Dana Arad, Kyle Mahowald, Michal Golovanevsky Published: 2026-01-08Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2026-01-08 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (95%) | - |
| PII-VisBench: Evaluating Personally Identifiable Information Safety in Vision Language Models Along a Continuum of Visibility G M Shahariar, Md Olid Hasan Bhuiyan, Zabir Al Nazi, Zhouxing Shi Published: 2026-01-09Area: Multimodal SafetyCitations: - Tags: ai-safety, benchmark, multimodal-safety | 2026-01-09 | Multimodal Safety | ai-safety, benchmark, multimodal-safety | E5 / R3 (98%) | - |
| Beyond Visual Safety: Jailbreaking Multimodal Large Language Models for Harmful Image Generation via Semantic-Agnostic Inputs Lana Liu, Mingyu Yu, Sujuan Qin, Wei Wang Published: 2026-01-22Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2026-01-22 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (97%) | - |
| Feature-Space Adversarial Robustness Certification for Multimodal Large Language Models Chenqi Kong, Meiwen Ding, Song Xia, Wenhan Yang Published: 2026-01-22Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, multimodal-safety, theoretical | 2026-01-22 | Multimodal Safety | adversarial-robustness, ai-safety, multimodal-safety, theoretical | E4 / R3 (95%) | - |
| Physical Prompt Injection Attacks on Large Vision-Language Models Changhai Ou, Chen Ling, Hangcheng Liu, Kai Hu Published: 2026-01-24Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2026-01-24 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E4 / R2 (96%) | - |
| From Sparse Decisions to Dense Reasoning: A Multi-attribute Trajectory Paradigm for Multimodal Moderation Kexin Huang, Lingyu Li, Ruilin Luo, Shiyang Huang Published: 2026-01-28Area: Multimodal SafetyCitations: 1 Tags: ai-safety, empirical, multimodal-safety | 2026-01-28 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (98%) | 1 |
| Lingua-SafetyBench: A Benchmark for Safety Evaluation of Multilingual Vision-Language Models Chenhang Cui, Enyi Shi, Fei Shen, Jiayi Lyu Published: 2026-01-30Area: Multimodal SafetyCitations: - Tags: ai-safety, benchmark, multimodal-safety, safety-evaluation | 2026-01-30 | Multimodal Safety | ai-safety, benchmark, multimodal-safety, safety-evaluation | E5 / R4 (92%) | - |
| The Alignment Curse: Cross-Modality Jailbreak Transfer in Omni-Models Adel Bibi, Aoxi Liu, Junchi Yu, Philip Torr Published: 2026-01-30Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | 2026-01-30 | Multimodal Safety | adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | E5 / R3 (92%) | - |
| Steering to Say No: Configurable Refusal via Activation Steering in Vision Language Models Dongwon Lee, Jiaxi Yang, Shicheng Liu, Yuchen Yang Published: 2026-01-31Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2026-01-31 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | - |
| Text is All You Need for Vision-Language Model Jailbreaking Cho-Jui Hsieh, Tianle Zheng, Yihang Chen, Youyuan Jiang Published: 2026-01-31Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2026-01-31 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E6 / R3 (96%) | - |
| Towards Interpretable Hallucination Analysis and Mitigation in LVLMs via Contrastive Neuron Steering Cheng Deng, Chenghao Xu, Fen Fang, Guangtao Lyu Published: 2026-01-31Area: Multimodal SafetyCitations: 1 Tags: ai-safety, empirical, multimodal-safety | 2026-01-31 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (95%) | 1 |
| Toward Universal and Transferable Jailbreak Attacks on Vision-Language Models Christopher Leckie, Hanxun Huang, Kaiyuan Cui, Sarah Erfani Published: 2026-02-01Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2026-02-01 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (95%) | - |
| Risk Awareness Injection: Calibrating Vision-Language Models for Safety without Compromising Utility Gang Xu, Hongjie Jiang, Mengxuan Wang, Ming Li Published: 2026-02-03Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2026-02-03 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (95%) | - |
| Robustness of Vision Language Models Against Split-Image Harmful Input Attacks Md Rafi Ur Rashid, MD Sadik Hossain Shanto, Shagufta Mehnaz, Vishnu Asutosh Dasu Published: 2026-02-08Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | 2026-02-08 | Multimodal Safety | adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | E5 / R3 (96%) | - |
| Omni-Safety under Cross-Modality Conflict: Vulnerabilities, Dynamics Mechanisms and Efficient Alignment Junhao Dong, Kun Wang, Kun Yang, Qiankun Li Published: 2026-02-10Area: Multimodal SafetyCitations: - Tags: ai-safety, alignment-training, empirical, multimodal-safety | 2026-02-10 | Multimodal Safety | ai-safety, alignment-training, empirical, multimodal-safety | E5 / R3 (96%) | - |
| When the Prompt Becomes Visual: Vision-Centric Jailbreak Attacks for Large Image Editing Models Alex Jinpeng Wang, Fangming Liu, Haochen Han, Jiacheng Hou Published: 2026-02-10Area: Multimodal SafetyCitations: 1 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2026-02-10 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (95%) | 1 |
| Adversarial Attacks on Vision-Language Model-Empowered Chatbots in Consumer Electronics Jiawen Kang, M. Shamim Hossain, Yingjia Shang, Yi Wu Published: -Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | - | Multimodal Safety | adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | E4 / R3 (93%) | - |
| A pen mark is all you need - Incidental prompt injection attacks on Vision Language Models in real-life histopathology Aurelie Fernandez, Carolin V. Schneider, Daniel Truhn, Dyke Ferber Published: -Area: Multimodal SafetyCitations: 2 Tags: ai-safety, empirical, multimodal-safety | - | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | 2 |
| Attack as Defense: Safeguarding Large Vision-Language Models from Jailbreaking by Adversarial Attacks Chongxin Li, Hanzhang Wang, Yuchun Fang Published: -Area: Multimodal SafetyCitations: 2 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | - | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (97%) | 2 |
| ColJailBreak: Collaborative Generation and Editing for Jailbreaking Text-to-Image Deep Generation Qi Guo, Qing Guo, Shanmin Pang, Tianyu Wei Published: -Area: Multimodal SafetyCitations: 12 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | - | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (94%) | 12 |
| DEO: Jailbreak a Black-box Multimodal Large Language Model with Dual-Embedding Alignment Kai Chen, Lijie Zhang, Mingsi Wang, Yue Zhao Published: -Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | - | Multimodal Safety | adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | E4 / R3 (94%) | - |
| Evaluating MLLM Security for the Arabic and French Languages Majed Sanan, Mohamad Nassar, Razane Abdallah Published: -Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, benchmark, multimodal-safety | - | Multimodal Safety | adversarial-robustness, ai-safety, benchmark, multimodal-safety | E2 / R1 (96%) | - |