Instant research discovery
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Towards Effective MLLM Jailbreaking Through Balanced On-Topicness and OOD-Intensity Bernhard Kainz, Jingyuan Zhang, Mengyun Qiao, Shuyuan Zhang Published: 2025-08-11Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | 2025-08-11 | Multimodal Safety | adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | E5 / R3 (95%) | - |
| VISOR: Visual Input-based Steering for Output Redirection in Vision-Language Models Mansi Phute, Ravi Balakrishnan Published: 2025-08-11Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2025-08-11 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (94%) | - |
| Unveiling Trust in Multimodal Large Language Models: Evaluation, Analysis, and Mitigation Chang Liu, Hang Su, Huanran Chen, Jun Zhu Published: 2025-08-21Area: Multimodal SafetyCitations: 1 Tags: ai-safety, alignment-training, benchmark, multimodal-safety, safety-evaluation | 2025-08-21 | Multimodal Safety | ai-safety, alignment-training, benchmark, multimodal-safety, safety-evaluation | E5 / R3 (96%) | 1 |
| PRISM: Robust VLM Alignment with Principled Reasoning for Integrated Safety in Multimodality Chaowei Xiao, Nanxi Li, Zhengyue Zhao Published: 2025-08-26Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | 2025-08-26 | Multimodal Safety | adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | E6 / R4 (97%) | - |
| Beyond the Safety Tax: Mitigating Unsafe Text-to-Image Generation via External Safety Rectification Li Wang, Ning Yu, Shanqing Guo, Xiangtao Meng Published: 2025-08-28Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2025-08-28 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (93%) | - |
| Towards Mechanistic Defenses Against Typographic Attacks in CLIP Constantin Venhoff, Lorenz Hufe, Maximilian Dreyer, Sebastian Lapuschkin Published: 2025-08-28Area: Multimodal SafetyCitations: 2 Tags: ai-safety, empirical, multimodal-safety | 2025-08-28 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (94%) | 2 |
| Activation Steering Meets Preference Optimization: Defense Against Jailbreaks in Vision Language Models Gaojie Jin, Jianhong Wang, Sihao Wu, Wei Huang Published: 2025-08-30Area: Multimodal SafetyCitations: 1 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-08-30 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | 1 |
| Phi: Preference Hijacking in Multi-modal Large Language Models at Inference Time Jinghui Chen, Lu Lin, Weitong Zhang, Yifan Lan Published: 2025-09-15Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2025-09-15 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (95%) | - |
| When Safe Unimodal Inputs Collide: Optimizing Reasoning Chains for Cross-Modal Safety in Multimodal Large Language Models Chi Zhang, Jian Zhao, Shujuan Liu, Tianle Zhang Published: 2025-09-15Area: Multimodal SafetyCitations: 3 Tags: ai-safety, empirical, multimodal-safety | 2025-09-15 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E4 / R3 (96%) | 3 |
| Defense-to-Attack: Bypassing Weak Defenses Enables Stronger Jailbreaks in Vision-Language Models Xiang Zheng, Xingjun Ma, Yunhan Zhao Published: 2025-09-16Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-09-16 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E8 / R5 (97%) | - |
| Steering Multimodal Large Language Models Decoding for Context-Aware Safety Guangyao Dou, Meng Jiang, Radha Poovendran, Xiangchi Yuan Published: 2025-09-23Area: Multimodal SafetyCitations: 2 Tags: ai-safety, empirical, multimodal-safety | 2025-09-23 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R4 (96%) | 2 |
| JaiLIP: Jailbreaking Vision-Language Models via Loss Guided Image Perturbation Md Jueal Mia, M. Hadi Amini Published: 2025-09-24Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-09-24 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E6 / R4 (97%) | - |
| SafeSteer: Adaptive Subspace Steering for Efficient Jailbreak Defense in Vision-Language Models Enguang Liu, Haotian Zhu, Jisheng Dang, Liming Lu Published: 2025-09-24Area: Multimodal SafetyCitations: 1 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-09-24 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | 1 |
| A Single Neuron Works: Precise Concept Erasure in Text-to-Image Diffusion Models Hui Xue, Jialing Tao, Jiaqi Weng, Qinqin He Published: 2025-09-25Area: Multimodal SafetyCitations: 3 Tags: ai-safety, empirical, multimodal-safety | 2025-09-25 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | 3 |
| Falcon: A Cross-Modal Evaluation Dataset for Comprehensive Safety Perception Guisong Liu, Minrui Jiang, Pei Ke, Qi Xue Published: 2025-09-28Area: Multimodal SafetyCitations: - Tags: ai-safety, dataset, multimodal-safety, safety-evaluation | 2025-09-28 | Multimodal Safety | ai-safety, dataset, multimodal-safety, safety-evaluation | E5 / R3 (96%) | - |
| VISOR++: Universal Visual Inputs based Steering for Large Vision Language Models Mansi Phute, Ravikumar Balakrishnan Published: 2025-09-29Area: Multimodal SafetyCitations: 1 Tags: ai-safety, alignment-training, empirical, multimodal-safety | 2025-09-29 | Multimodal Safety | ai-safety, alignment-training, empirical, multimodal-safety | E5 / R3 (96%) | 1 |
| CHAI: Command Hijacking against embodied AI Alvaro A Cardenas, Cihang Xie, Diego Ortiz, Haoqin Tu Published: 2025-09-30Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2025-09-30 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (95%) | - |
| STaR-Attack: A Spatio-Temporal and Narrative Reasoning Attack Framework for Unified Multimodal Understanding and Generation Models Jie Li, Jing Shao, Lijun Li, Shaoxiong Guo Published: 2025-09-30Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-09-30 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (98%) | - |
| SaFeR-VLM: Toward Safety-aware Fine-grained Reasoning in Multimodal Models Gongli Xi, Hao Wu, Huahui Yi, Kang Li Published: 2025-10-08Area: Multimodal SafetyCitations: 3 Tags: ai-safety, empirical, multimodal-safety | 2025-10-08 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | 3 |
| Multimodal Safety Evaluation in Generative Agent Social Simulations Alhim Vera, Bernard Ghanem, Carlos Hinojosa, Donghoon Kim Published: 2025-10-09Area: Multimodal SafetyCitations: 1 Tags: ai-safety, benchmark, multimodal-safety, safety-evaluation | 2025-10-09 | Multimodal Safety | ai-safety, benchmark, multimodal-safety, safety-evaluation | E6 / R3 (96%) | 1 |
| VisualDAN: Exposing Vulnerabilities in VLMs with Visual-Driven DAN Commands Aofan Liu, Lulu Tang Published: 2025-10-09Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-10-09 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E7 / R5 (97%) | - |
| Text Prompt Injection of Vision Language Models Ruizhe Zhu Published: 2025-10-10Area: Multimodal SafetyCitations: 2 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-10-10 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (97%) | 2 |
| VisuoAlign: Safety Alignment of LVLMs with Multimodal Tree Search Guangze Zhao, MingSheng Li, Sichen Liu Published: 2025-10-10Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | 2025-10-10 | Multimodal Safety | adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | E5 / R3 (97%) | - |
| DUAL-Bench: Measuring Over-Refusal and Robustness in Vision-Language Models Kaixuan Ren, Preslav Nakov, Usman Naseem Published: 2025-10-12Area: Multimodal SafetyCitations: 1 Tags: ai-safety, benchmark, multimodal-safety | 2025-10-12 | Multimodal Safety | ai-safety, benchmark, multimodal-safety | E6 / R3 (95%) | 1 |
| SafeMT: Multi-turn Safety for Multimodal Language Models Boyuan Chen, Chengkun Cai, Chi-Min Chan, Han Zhu Published: 2025-10-14Area: Multimodal SafetyCitations: 3 Tags: adversarial-robustness, ai-safety, benchmark, multimodal-safety | 2025-10-14 | Multimodal Safety | adversarial-robustness, ai-safety, benchmark, multimodal-safety | E4 / R3 (98%) | 3 |
| Risk-adaptive Activation Steering for Safe Multimodal Large Language Models Jonghyun Choi, Jonghyun Park, Minhyuk Seo Published: 2025-10-15Area: Multimodal SafetyCitations: 1 Tags: ai-safety, empirical, multimodal-safety, safety-evaluation | 2025-10-15 | Multimodal Safety | ai-safety, empirical, multimodal-safety, safety-evaluation | E5 / R3 (95%) | 1 |
| SHIELD: Classifier-Guided Prompting for Robust and Safer LVLMs Juan Ren, Mark Dras, Usman Naseem Published: 2025-10-15Area: Multimodal SafetyCitations: 4 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-10-15 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (95%) | 4 |
| Sequential Comics for Jailbreaking Multimodal Large Language Models via Structured Visual Storytelling Deyue Zhang, Dongdong Yang, Junjie Mu, Quancheng Zou Published: 2025-10-16Area: Multimodal SafetyCitations: 1 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-10-16 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (97%) | 1 |
| Patronus: Safeguarding Text-to-Image Models against White-Box Adversaries Huanlong Zhong, Jialin Wu, Jiangyi Deng, Jie Zhang Published: 2025-10-18Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2025-10-18 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R4 (96%) | - |
| CrossGuard: Safeguarding MLLMs against Joint-Modal Implicit Malicious Attacks Hao Li, Xu Zhang, Zhichao Lu Published: 2025-10-20Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2025-10-20 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | - |