Instant research discovery
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Showing 1-30 of 274 papers (page 1 of 10)路 37 ms
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Omni-Safety under Cross-Modality Conflict: Vulnerabilities, Dynamics Mechanisms and Efficient Alignment Junhao Dong, Kun Wang, Kun Yang, Qiankun Li Published: 2026-02-10Area: Multimodal SafetyCitations: - Tags: ai-safety, alignment-training, empirical, multimodal-safety | 2026-02-10 | Multimodal Safety | ai-safety, alignment-training, empirical, multimodal-safety | E5 / R3 (96%) | - |
| When the Prompt Becomes Visual: Vision-Centric Jailbreak Attacks for Large Image Editing Models Alex Jinpeng Wang, Fangming Liu, Haochen Han, Jiacheng Hou Published: 2026-02-10Area: Multimodal SafetyCitations: 1 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2026-02-10 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (95%) | 1 |
| Robustness of Vision Language Models Against Split-Image Harmful Input Attacks Md Rafi Ur Rashid, MD Sadik Hossain Shanto, Shagufta Mehnaz, Vishnu Asutosh Dasu Published: 2026-02-08Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | 2026-02-08 | Multimodal Safety | adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | E5 / R3 (96%) | - |
| Risk Awareness Injection: Calibrating Vision-Language Models for Safety without Compromising Utility Gang Xu, Hongjie Jiang, Mengxuan Wang, Ming Li Published: 2026-02-03Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2026-02-03 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (95%) | - |
| Toward Universal and Transferable Jailbreak Attacks on Vision-Language Models Christopher Leckie, Hanxun Huang, Kaiyuan Cui, Sarah Erfani Published: 2026-02-01Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2026-02-01 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (95%) | - |
| Steering to Say No: Configurable Refusal via Activation Steering in Vision Language Models Dongwon Lee, Jiaxi Yang, Shicheng Liu, Yuchen Yang Published: 2026-01-31Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2026-01-31 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | - |
| Text is All You Need for Vision-Language Model Jailbreaking Cho-Jui Hsieh, Tianle Zheng, Yihang Chen, Youyuan Jiang Published: 2026-01-31Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2026-01-31 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E6 / R3 (96%) | - |
| Towards Interpretable Hallucination Analysis and Mitigation in LVLMs via Contrastive Neuron Steering Cheng Deng, Chenghao Xu, Fen Fang, Guangtao Lyu Published: 2026-01-31Area: Multimodal SafetyCitations: 1 Tags: ai-safety, empirical, multimodal-safety | 2026-01-31 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (95%) | 1 |
| Lingua-SafetyBench: A Benchmark for Safety Evaluation of Multilingual Vision-Language Models Chenhang Cui, Enyi Shi, Fei Shen, Jiayi Lyu Published: 2026-01-30Area: Multimodal SafetyCitations: - Tags: ai-safety, benchmark, multimodal-safety, safety-evaluation | 2026-01-30 | Multimodal Safety | ai-safety, benchmark, multimodal-safety, safety-evaluation | E5 / R4 (92%) | - |
| The Alignment Curse: Cross-Modality Jailbreak Transfer in Omni-Models Adel Bibi, Aoxi Liu, Junchi Yu, Philip Torr Published: 2026-01-30Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | 2026-01-30 | Multimodal Safety | adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | E5 / R3 (92%) | - |
| From Sparse Decisions to Dense Reasoning: A Multi-attribute Trajectory Paradigm for Multimodal Moderation Kexin Huang, Lingyu Li, Ruilin Luo, Shiyang Huang Published: 2026-01-28Area: Multimodal SafetyCitations: 1 Tags: ai-safety, empirical, multimodal-safety | 2026-01-28 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (98%) | 1 |
| Physical Prompt Injection Attacks on Large Vision-Language Models Changhai Ou, Chen Ling, Hangcheng Liu, Kai Hu Published: 2026-01-24Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2026-01-24 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E4 / R2 (96%) | - |
| Beyond Visual Safety: Jailbreaking Multimodal Large Language Models for Harmful Image Generation via Semantic-Agnostic Inputs Lana Liu, Mingyu Yu, Sujuan Qin, Wei Wang Published: 2026-01-22Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2026-01-22 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (97%) | - |
| Feature-Space Adversarial Robustness Certification for Multimodal Large Language Models Chenqi Kong, Meiwen Ding, Song Xia, Wenhan Yang Published: 2026-01-22Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, multimodal-safety, theoretical | 2026-01-22 | Multimodal Safety | adversarial-robustness, ai-safety, multimodal-safety, theoretical | E4 / R3 (95%) | - |
| PII-VisBench: Evaluating Personally Identifiable Information Safety in Vision Language Models Along a Continuum of Visibility G M Shahariar, Md Olid Hasan Bhuiyan, Zabir Al Nazi, Zhouxing Shi Published: 2026-01-09Area: Multimodal SafetyCitations: - Tags: ai-safety, benchmark, multimodal-safety | 2026-01-09 | Multimodal Safety | ai-safety, benchmark, multimodal-safety | E5 / R3 (98%) | - |
| AM3Safety: Towards Data Efficient Alignment of Multi-modal Multi-turn Safety for MLLMs Chengkun Cai, Chi-Min Chan, Han Zhu, Haoran Li Published: 2026-01-08Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | 2026-01-08 | Multimodal Safety | adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | E5 / R3 (97%) | - |
| Mechanisms of Prompt-Induced Hallucination in Vision-Language Models Carsten Eickhoff, Dana Arad, Kyle Mahowald, Michal Golovanevsky Published: 2026-01-08Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2026-01-08 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (95%) | - |
| When Helpers Become Hazards: A Benchmark for Analyzing Multimodal LLM-Powered Safety in Daily Life Fengran Mo, Jinan Xu, Jingyi Yin, Kaiyu Huang Published: 2026-01-07Area: Multimodal SafetyCitations: - Tags: ai-safety, alignment-training, benchmark, multimodal-safety | 2026-01-07 | Multimodal Safety | ai-safety, alignment-training, benchmark, multimodal-safety | E4 / R2 (94%) | - |
| GAMBIT: A Gamified Jailbreak Framework for Multimodal Large Language Models Qin Hu, Xiangdong Hu, Xiaojun Jia, Yangyang Jiang Published: 2026-01-06Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2026-01-06 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E6 / R3 (97%) | - |
| Crafting Adversarial Inputs for Large Vision-Language Models Using Black-Box Optimization Haibo Jin, Haohan Wang, Jiwei Guan Published: 2026-01-05Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2026-01-05 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R4 (98%) | - |
| Few Tokens Matter: Entropy Guided Attacks on Vision-Language Models Jing Zhang, Jinhong Ni, Mengqi He, Shu Zou Published: 2025-12-26Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-12-26 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (95%) | - |
| Look Closer! An Adversarial Parametric Editing Framework for Hallucination Mitigation in VLMs Beibei Li, Bing Ji, Jiangwei Xia, Jiayu Hu Published: 2025-12-26Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-12-26 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (98%) | - |
| Adversarial Robustness of Vision in Open Foundation Models Jonathan Fox, Pavlos Papadopoulos, William J Buchanan Published: 2025-12-19Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-12-19 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E4 / R3 (97%) | - |
| Unveiling the Attribute Misbinding Threat in Identity-Preserving Models Baoying Chen, Jianquan Yang, Jishen Zeng, Junming Fu Published: 2025-12-17Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2025-12-17 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | - |
| Rethinking Jailbreak Detection of Large Vision Language Models with Representational Contrastive Scoring Hao Li, Ning Zhang, Peichun Hua, Shanghao Shi Published: 2025-12-12Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-12-12 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | - |
| SAVE: Sparse Autoencoder-Driven Visual Information Enhancement for Mitigating Object Hallucination Jisoo Mok, Sangha Park, Seungryong Yoo, Sungroh Yoon Published: 2025-12-08Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2025-12-08 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (95%) | - |
| Think-Reflect-Revise: A Policy-Guided Reflective Framework for Safety Alignment in Large Vision Language Models Chaochao Lu, Fenghua Weng, Wenjie Wang, Wenqi Shao Published: 2025-12-08Area: Multimodal SafetyCitations: - Tags: ai-safety, alignment-training, empirical, multimodal-safety | 2025-12-08 | Multimodal Safety | ai-safety, alignment-training, empirical, multimodal-safety | E5 / R3 (97%) | - |
| OmniSafeBench-MM: A Unified Benchmark and Toolbox for Multimodal Jailbreak Attack-Defense Evaluation Dongxian Wu, Jie Liao, Qi Guo, Ranjie Duan Published: 2025-12-06Area: Multimodal SafetyCitations: 3 Tags: adversarial-robustness, ai-safety, benchmark, multimodal-safety, safety-evaluation | 2025-12-06 | Multimodal Safety | adversarial-robustness, ai-safety, benchmark, multimodal-safety, safety-evaluation | E4 / R3 (98%) | 3 |
| VRSA: Jailbreaking Multimodal Large Language Models through Visual Reasoning Sequential Attack Hui Xue, Jialing Tao, Jin Yan, Jiyang Guan Published: 2025-12-05Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-12-05 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E6 / R3 (98%) | - |
| Aetheria: A multimodal interpretable content safety framework based on multi-agent debate and collaboration Chi Zhang, Haichuan Tang, Haojie Cheng, Jian Zhao Published: 2025-12-02Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2025-12-02 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E7 / R4 (96%) | - |