Instant research discovery
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Contextual Image Attack: How Visual Context Exposes Multimodal Safety Vulnerabilities Chen Qian, Jie Li, Jing Shao, Lijun Li Published: 2025-12-02Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-12-02 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (98%) | - |
| OmniGuard: Unified Omni-Modal Guardrails with Deliberate Reasoning Boyu Zhu, Muhao Chen, Peng Qi, Tinghui Zhu Published: 2025-12-02Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2025-12-02 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (94%) | - |
| DefenSee: Dissecting Threat from Sight and Text - A Multi-View Defensive Pipeline for Multi-modal Jailbreaks Kar-Wai Fok, Vrizlynn L. L. Thing, Zihao Wang Published: 2025-12-01Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-12-01 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (95%) | - |
| Debate with Images: Detecting Deceptive Behaviors in Multimodal Large Language Models Boyuan Chen, Donghai Hong, Jiaming Ji, Jiayi Zhou Published: 2025-11-29Area: Multimodal SafetyCitations: - Tags: ai-safety, benchmark, multimodal-safety | 2025-11-29 | Multimodal Safety | ai-safety, benchmark, multimodal-safety | E4 / R3 (96%) | - |
| GuardTrace-VL: Detecting Unsafe Multimodel Reasoning via Iterative Safety Supervision Changtao Miao, Haojie Yuan, Junchi Chen, Nenghai Yu Published: 2025-11-26Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2025-11-26 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | - |
| TEAR: Temporal-aware Automated Red-teaming for Text-to-Video Models Guanyu Hou, Guowen Xu, Hongwei Li, Jiaming He Published: 2025-11-26Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2025-11-26 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E7 / R3 (96%) | - |
| On the Feasibility of Hijacking MLLMs' Decision Chain via One Perturbation Changyue Li, Jiaming He, Jiaying Li, Pinjia He Published: 2025-11-25Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-11-25 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | - |
| Multi-Faceted Attack: Exposing Cross-Model Vulnerabilities in Defense-Equipped Vision-Language Models Chi Harold Liu, Jianping Zhang, Lanqing Hong, Lichao Wang Published: 2025-11-20Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2025-11-20 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E6 / R3 (98%) | - |
| Q-MLLM: Vector Quantization for Robust Multimodal Large Language Model Security Jun Sun, Wei Zhao, Yige Li, Zhe Li Published: 2025-11-20Area: Multimodal SafetyCitations: 1 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-11-20 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R4 (97%) | 1 |
| SafeR-CLIP: Mitigating NSFW Content in Vision-Language Models While Preserving Pre-Trained Knowledge Adeel Yousaf, Amrit Singh Bedi, James Beetham, Joseph Fioresi Published: 2025-11-20Area: Multimodal SafetyCitations: - Tags: ai-safety, alignment-training, empirical, multimodal-safety | 2025-11-20 | Multimodal Safety | ai-safety, alignment-training, empirical, multimodal-safety | E5 / R3 (97%) | - |
| SafeGRPO: Self-Rewarded Multimodal Safety Alignment via Rule-Governed Policy Optimization Bo Du, Daiguo Zhou, Mang Ye, Tingfeng Wang Published: 2025-11-17Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | 2025-11-17 | Multimodal Safety | adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | E5 / R3 (95%) | - |
| Speech-Audio Compositional Attacks on Multimodal LLMs and Their Mitigation with SALMONN-Guard Chao Zhang, Guangzhi Sun, Jimin Zhuang, Jing Shao Published: 2025-11-13Area: Multimodal SafetyCitations: 3 Tags: ai-safety, benchmark, multimodal-safety | 2025-11-13 | Multimodal Safety | ai-safety, benchmark, multimodal-safety | E4 / R3 (96%) | 3 |
| Why does weak-OOD help? A Further Step Towards Understanding Jailbreaking VLMs Kuofeng Gao, Shu-Tao Xia, Tao Dai, Tao Yu Published: 2025-11-11Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-11-11 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (95%) | - |
| Reimagining Safety Alignment with An Image Guorui Chen, Jindong Gu, Philip Torr, Wenqian Yu Published: 2025-11-01Area: Multimodal SafetyCitations: 1 Tags: adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | 2025-11-01 | Multimodal Safety | adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | E6 / R3 (95%) | 1 |
| Agentic Moderation: Multi-Agent Design for Safer Vision-Language Models Juan Ren, Mark Dras, Usman Naseem Published: 2025-10-29Area: Multimodal SafetyCitations: 1 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-10-29 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E6 / R3 (97%) | 1 |
| SmoothGuard: Defending Multimodal Large Language Models with Noise Perturbation and Clustering Aggregation Guangzhi Su, Kaizhu Huang, Long Qian, Shuchang Huang Published: 2025-10-29Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2025-10-29 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E6 / R3 (97%) | - |
| AutoPrompt: Automated Red-Teaming of Text-to-Image Models via LLM-Driven Adversarial Prompts Huashan Chen, Lin Wang, Wanqian Zhang, Weiping Wang Published: 2025-10-28Area: Multimodal SafetyCitations: 1 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-10-28 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | 1 |
| SafeEditor: Unified MLLM for Efficient Post-hoc T2I Safety Editing Jiahao Luo, Juntao Dai, Qiufan Pang, Ruiyang Zhang Published: 2025-10-28Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2025-10-28 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | - |
| SafeVision: Efficient Image Guardrail with Robust Policy Adherence and Explainability Bo Li, Chaowei Xiao, Minzhou Pan, Peiyang Xu Published: 2025-10-28Area: Multimodal SafetyCitations: 1 Tags: ai-safety, empirical, multimodal-safety | 2025-10-28 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E4 / R4 (97%) | 1 |
| OFFSIDE: Benchmarking Unlearning Misinformation in Multimodal Large Language Models Hao Zheng, Jiaheng Wei, Ling Li, Xiaobo Xia Published: 2025-10-26Area: Multimodal SafetyCitations: - Tags: ai-safety, benchmark, multimodal-safety | 2025-10-26 | Multimodal Safety | ai-safety, benchmark, multimodal-safety | E4 / R3 (98%) | - |
| Enhanced MLLM Black-Box Jailbreaking Attacks and Defenses Kar Wai Fok, Vrizlynn L.L. Thing, Xingwei Zhong Published: 2025-10-24Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-10-24 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E6 / R3 (95%) | - |
| VLSU: Mapping the Limits of Joint Multimodal Understanding for AI Safety Charles Maalouf, Gunnar Lund, Jeffrey Bigham, Joseph Yitan Cheng Published: 2025-10-21Area: Multimodal SafetyCitations: - Tags: ai-safety, benchmark, multimodal-safety | 2025-10-21 | Multimodal Safety | ai-safety, benchmark, multimodal-safety | E5 / R3 (96%) | - |
| CrossGuard: Safeguarding MLLMs against Joint-Modal Implicit Malicious Attacks Hao Li, Xu Zhang, Zhichao Lu Published: 2025-10-20Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2025-10-20 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | - |
| Multimodal Safety Is Asymmetric: Cross-Modal Exploits Unlock Black-Box MLLMs Jailbreaks Ao Liu, Beibei Li, Shouling Ji, Xinkai Wang Published: 2025-10-20Area: Multimodal SafetyCitations: 1 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-10-20 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E6 / R3 (96%) | 1 |
| SARSteer: Safeguarding Large Audio Language Models via Safe-Ablated Refusal Steering Hui Xiong, Jianze Li, Li Liu, Weilin Lin Published: 2025-10-20Area: Multimodal SafetyCitations: 1 Tags: ai-safety, empirical, multimodal-safety | 2025-10-20 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | 1 |
| Patronus: Safeguarding Text-to-Image Models against White-Box Adversaries Huanlong Zhong, Jialin Wu, Jiangyi Deng, Jie Zhang Published: 2025-10-18Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2025-10-18 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R4 (96%) | - |
| Sequential Comics for Jailbreaking Multimodal Large Language Models via Structured Visual Storytelling Deyue Zhang, Dongdong Yang, Junjie Mu, Quancheng Zou Published: 2025-10-16Area: Multimodal SafetyCitations: 1 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-10-16 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (97%) | 1 |
| Risk-adaptive Activation Steering for Safe Multimodal Large Language Models Jonghyun Choi, Jonghyun Park, Minhyuk Seo Published: 2025-10-15Area: Multimodal SafetyCitations: 1 Tags: ai-safety, empirical, multimodal-safety, safety-evaluation | 2025-10-15 | Multimodal Safety | ai-safety, empirical, multimodal-safety, safety-evaluation | E5 / R3 (95%) | 1 |
| SHIELD: Classifier-Guided Prompting for Robust and Safer LVLMs Juan Ren, Mark Dras, Usman Naseem Published: 2025-10-15Area: Multimodal SafetyCitations: 4 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-10-15 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (95%) | 4 |
| SafeMT: Multi-turn Safety for Multimodal Language Models Boyuan Chen, Chengkun Cai, Chi-Min Chan, Han Zhu Published: 2025-10-14Area: Multimodal SafetyCitations: 3 Tags: adversarial-robustness, ai-safety, benchmark, multimodal-safety | 2025-10-14 | Multimodal Safety | adversarial-robustness, ai-safety, benchmark, multimodal-safety | E4 / R3 (98%) | 3 |