Instant research discovery
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| DUAL-Bench: Measuring Over-Refusal and Robustness in Vision-Language Models Kaixuan Ren, Preslav Nakov, Usman Naseem Published: 2025-10-12Area: Multimodal SafetyCitations: 1 Tags: ai-safety, benchmark, multimodal-safety | 2025-10-12 | Multimodal Safety | ai-safety, benchmark, multimodal-safety | E6 / R3 (95%) | 1 |
| Text Prompt Injection of Vision Language Models Ruizhe Zhu Published: 2025-10-10Area: Multimodal SafetyCitations: 2 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-10-10 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (97%) | 2 |
| VisuoAlign: Safety Alignment of LVLMs with Multimodal Tree Search Guangze Zhao, MingSheng Li, Sichen Liu Published: 2025-10-10Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | 2025-10-10 | Multimodal Safety | adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | E5 / R3 (97%) | - |
| Multimodal Safety Evaluation in Generative Agent Social Simulations Alhim Vera, Bernard Ghanem, Carlos Hinojosa, Donghoon Kim Published: 2025-10-09Area: Multimodal SafetyCitations: 1 Tags: ai-safety, benchmark, multimodal-safety, safety-evaluation | 2025-10-09 | Multimodal Safety | ai-safety, benchmark, multimodal-safety, safety-evaluation | E6 / R3 (96%) | 1 |
| VisualDAN: Exposing Vulnerabilities in VLMs with Visual-Driven DAN Commands Aofan Liu, Lulu Tang Published: 2025-10-09Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-10-09 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E7 / R5 (97%) | - |
| SaFeR-VLM: Toward Safety-aware Fine-grained Reasoning in Multimodal Models Gongli Xi, Hao Wu, Huahui Yi, Kang Li Published: 2025-10-08Area: Multimodal SafetyCitations: 3 Tags: ai-safety, empirical, multimodal-safety | 2025-10-08 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | 3 |
| CHAI: Command Hijacking against embodied AI Alvaro A Cardenas, Cihang Xie, Diego Ortiz, Haoqin Tu Published: 2025-09-30Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2025-09-30 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (95%) | - |
| STaR-Attack: A Spatio-Temporal and Narrative Reasoning Attack Framework for Unified Multimodal Understanding and Generation Models Jie Li, Jing Shao, Lijun Li, Shaoxiong Guo Published: 2025-09-30Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-09-30 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (98%) | - |
| VISOR++: Universal Visual Inputs based Steering for Large Vision Language Models Mansi Phute, Ravikumar Balakrishnan Published: 2025-09-29Area: Multimodal SafetyCitations: 1 Tags: ai-safety, alignment-training, empirical, multimodal-safety | 2025-09-29 | Multimodal Safety | ai-safety, alignment-training, empirical, multimodal-safety | E5 / R3 (96%) | 1 |
| Falcon: A Cross-Modal Evaluation Dataset for Comprehensive Safety Perception Guisong Liu, Minrui Jiang, Pei Ke, Qi Xue Published: 2025-09-28Area: Multimodal SafetyCitations: - Tags: ai-safety, dataset, multimodal-safety, safety-evaluation | 2025-09-28 | Multimodal Safety | ai-safety, dataset, multimodal-safety, safety-evaluation | E5 / R3 (96%) | - |
| A Single Neuron Works: Precise Concept Erasure in Text-to-Image Diffusion Models Hui Xue, Jialing Tao, Jiaqi Weng, Qinqin He Published: 2025-09-25Area: Multimodal SafetyCitations: 3 Tags: ai-safety, empirical, multimodal-safety | 2025-09-25 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | 3 |
| JaiLIP: Jailbreaking Vision-Language Models via Loss Guided Image Perturbation Md Jueal Mia, M. Hadi Amini Published: 2025-09-24Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-09-24 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E6 / R4 (97%) | - |
| SafeSteer: Adaptive Subspace Steering for Efficient Jailbreak Defense in Vision-Language Models Enguang Liu, Haotian Zhu, Jisheng Dang, Liming Lu Published: 2025-09-24Area: Multimodal SafetyCitations: 1 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-09-24 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | 1 |
| Steering Multimodal Large Language Models Decoding for Context-Aware Safety Guangyao Dou, Meng Jiang, Radha Poovendran, Xiangchi Yuan Published: 2025-09-23Area: Multimodal SafetyCitations: 2 Tags: ai-safety, empirical, multimodal-safety | 2025-09-23 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R4 (96%) | 2 |
| Defense-to-Attack: Bypassing Weak Defenses Enables Stronger Jailbreaks in Vision-Language Models Xiang Zheng, Xingjun Ma, Yunhan Zhao Published: 2025-09-16Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-09-16 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E8 / R5 (97%) | - |
| Phi: Preference Hijacking in Multi-modal Large Language Models at Inference Time Jinghui Chen, Lu Lin, Weitong Zhang, Yifan Lan Published: 2025-09-15Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2025-09-15 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (95%) | - |
| When Safe Unimodal Inputs Collide: Optimizing Reasoning Chains for Cross-Modal Safety in Multimodal Large Language Models Chi Zhang, Jian Zhao, Shujuan Liu, Tianle Zhang Published: 2025-09-15Area: Multimodal SafetyCitations: 3 Tags: ai-safety, empirical, multimodal-safety | 2025-09-15 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E4 / R3 (96%) | 3 |
| Activation Steering Meets Preference Optimization: Defense Against Jailbreaks in Vision Language Models Gaojie Jin, Jianhong Wang, Sihao Wu, Wei Huang Published: 2025-08-30Area: Multimodal SafetyCitations: 1 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-08-30 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | 1 |
| Beyond the Safety Tax: Mitigating Unsafe Text-to-Image Generation via External Safety Rectification Li Wang, Ning Yu, Shanqing Guo, Xiangtao Meng Published: 2025-08-28Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2025-08-28 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (93%) | - |
| Towards Mechanistic Defenses Against Typographic Attacks in CLIP Constantin Venhoff, Lorenz Hufe, Maximilian Dreyer, Sebastian Lapuschkin Published: 2025-08-28Area: Multimodal SafetyCitations: 2 Tags: ai-safety, empirical, multimodal-safety | 2025-08-28 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (94%) | 2 |
| PRISM: Robust VLM Alignment with Principled Reasoning for Integrated Safety in Multimodality Chaowei Xiao, Nanxi Li, Zhengyue Zhao Published: 2025-08-26Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | 2025-08-26 | Multimodal Safety | adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | E6 / R4 (97%) | - |
| Unveiling Trust in Multimodal Large Language Models: Evaluation, Analysis, and Mitigation Chang Liu, Hang Su, Huanran Chen, Jun Zhu Published: 2025-08-21Area: Multimodal SafetyCitations: 1 Tags: ai-safety, alignment-training, benchmark, multimodal-safety, safety-evaluation | 2025-08-21 | Multimodal Safety | ai-safety, alignment-training, benchmark, multimodal-safety, safety-evaluation | E5 / R3 (96%) | 1 |
| Towards Effective MLLM Jailbreaking Through Balanced On-Topicness and OOD-Intensity Bernhard Kainz, Jingyuan Zhang, Mengyun Qiao, Shuyuan Zhang Published: 2025-08-11Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | 2025-08-11 | Multimodal Safety | adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | E5 / R3 (95%) | - |
| VISOR: Visual Input-based Steering for Output Redirection in Vision-Language Models Mansi Phute, Ravi Balakrishnan Published: 2025-08-11Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2025-08-11 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (94%) | - |
| Omni-SafetyBench: A Benchmark for Safety Evaluation of Audio-Visual Large Language Models Aiwei Liu, Bolin Ding, Felix Henry, Leyi Pan Published: 2025-08-10Area: Multimodal SafetyCitations: 2 Tags: ai-safety, benchmark, multimodal-safety, safety-evaluation | 2025-08-10 | Multimodal Safety | ai-safety, benchmark, multimodal-safety, safety-evaluation | E5 / R3 (96%) | 2 |
| JPS: Jailbreak Multimodal Large Language Models with Collaborative Visual Perturbation and Textual Steering Chengwei Pan, Hongning Wang, Minlie Huang, QingLin Zhang Published: 2025-08-07Area: Multimodal SafetyCitations: 3 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-08-07 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R4 (95%) | 3 |
| The Emotional Baby Is Truly Deadly: Does your Multimodal Large Reasoning Model Have Emotional Flattery towards Humans? Hua Zhang, Xiaojun Jia, Xinwei Liu, Yuan Xun Published: 2025-08-06Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2025-08-06 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E6 / R3 (95%) | - |
| Simulated Ensemble Attack: Transferring Jailbreaks Across Fine-tuned Vision-Language Models Ruofan Wang, Xingjun Ma, Xin Wang, Xuan Tong Published: 2025-08-03Area: Multimodal SafetyCitations: 1 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-08-03 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (95%) | 1 |
| Universally Unfiltered and Unseen: Input-Agnostic Multimodal Jailbreaks against Text-to-Image Model Safeguards Guoliang Yang, Hui Wei, Jinlong Fei, Song Yan Published: 2025-07-30Area: Multimodal SafetyCitations: 1 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-07-30 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | 1 |
| PRISM: Programmatic Reasoning with Image Sequence Manipulation for LVLM Jailbreaking Deyue Zhang, Dongdong Yang, Moyang Chen, Quanchen Zou Published: 2025-07-29Area: Multimodal SafetyCitations: 3 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-07-29 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E16 / R15 (95%) | 3 |