Instant research discovery
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Multimodal Safety Is Asymmetric: Cross-Modal Exploits Unlock Black-Box MLLMs Jailbreaks Ao Liu, Beibei Li, Shouling Ji, Xinkai Wang Published: 2025-10-20Area: Multimodal SafetyCitations: 1 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-10-20 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E6 / R3 (96%) | 1 |
| SARSteer: Safeguarding Large Audio Language Models via Safe-Ablated Refusal Steering Hui Xiong, Jianze Li, Li Liu, Weilin Lin Published: 2025-10-20Area: Multimodal SafetyCitations: 1 Tags: ai-safety, empirical, multimodal-safety | 2025-10-20 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | 1 |
| VLSU: Mapping the Limits of Joint Multimodal Understanding for AI Safety Charles Maalouf, Gunnar Lund, Jeffrey Bigham, Joseph Yitan Cheng Published: 2025-10-21Area: Multimodal SafetyCitations: - Tags: ai-safety, benchmark, multimodal-safety | 2025-10-21 | Multimodal Safety | ai-safety, benchmark, multimodal-safety | E5 / R3 (96%) | - |
| Enhanced MLLM Black-Box Jailbreaking Attacks and Defenses Kar Wai Fok, Vrizlynn L.L. Thing, Xingwei Zhong Published: 2025-10-24Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-10-24 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E6 / R3 (95%) | - |
| OFFSIDE: Benchmarking Unlearning Misinformation in Multimodal Large Language Models Hao Zheng, Jiaheng Wei, Ling Li, Xiaobo Xia Published: 2025-10-26Area: Multimodal SafetyCitations: - Tags: ai-safety, benchmark, multimodal-safety | 2025-10-26 | Multimodal Safety | ai-safety, benchmark, multimodal-safety | E4 / R3 (98%) | - |
| AutoPrompt: Automated Red-Teaming of Text-to-Image Models via LLM-Driven Adversarial Prompts Huashan Chen, Lin Wang, Wanqian Zhang, Weiping Wang Published: 2025-10-28Area: Multimodal SafetyCitations: 1 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-10-28 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | 1 |
| SafeEditor: Unified MLLM for Efficient Post-hoc T2I Safety Editing Jiahao Luo, Juntao Dai, Qiufan Pang, Ruiyang Zhang Published: 2025-10-28Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2025-10-28 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | - |
| SafeVision: Efficient Image Guardrail with Robust Policy Adherence and Explainability Bo Li, Chaowei Xiao, Minzhou Pan, Peiyang Xu Published: 2025-10-28Area: Multimodal SafetyCitations: 1 Tags: ai-safety, empirical, multimodal-safety | 2025-10-28 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E4 / R4 (97%) | 1 |
| Agentic Moderation: Multi-Agent Design for Safer Vision-Language Models Juan Ren, Mark Dras, Usman Naseem Published: 2025-10-29Area: Multimodal SafetyCitations: 1 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-10-29 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E6 / R3 (97%) | 1 |
| SmoothGuard: Defending Multimodal Large Language Models with Noise Perturbation and Clustering Aggregation Guangzhi Su, Kaizhu Huang, Long Qian, Shuchang Huang Published: 2025-10-29Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2025-10-29 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E6 / R3 (97%) | - |
| Reimagining Safety Alignment with An Image Guorui Chen, Jindong Gu, Philip Torr, Wenqian Yu Published: 2025-11-01Area: Multimodal SafetyCitations: 1 Tags: adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | 2025-11-01 | Multimodal Safety | adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | E6 / R3 (95%) | 1 |
| Why does weak-OOD help? A Further Step Towards Understanding Jailbreaking VLMs Kuofeng Gao, Shu-Tao Xia, Tao Dai, Tao Yu Published: 2025-11-11Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-11-11 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (95%) | - |
| Speech-Audio Compositional Attacks on Multimodal LLMs and Their Mitigation with SALMONN-Guard Chao Zhang, Guangzhi Sun, Jimin Zhuang, Jing Shao Published: 2025-11-13Area: Multimodal SafetyCitations: 3 Tags: ai-safety, benchmark, multimodal-safety | 2025-11-13 | Multimodal Safety | ai-safety, benchmark, multimodal-safety | E4 / R3 (96%) | 3 |
| SafeGRPO: Self-Rewarded Multimodal Safety Alignment via Rule-Governed Policy Optimization Bo Du, Daiguo Zhou, Mang Ye, Tingfeng Wang Published: 2025-11-17Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | 2025-11-17 | Multimodal Safety | adversarial-robustness, ai-safety, alignment-training, empirical, multimodal-safety | E5 / R3 (95%) | - |
| Multi-Faceted Attack: Exposing Cross-Model Vulnerabilities in Defense-Equipped Vision-Language Models Chi Harold Liu, Jianping Zhang, Lanqing Hong, Lichao Wang Published: 2025-11-20Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2025-11-20 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E6 / R3 (98%) | - |
| Q-MLLM: Vector Quantization for Robust Multimodal Large Language Model Security Jun Sun, Wei Zhao, Yige Li, Zhe Li Published: 2025-11-20Area: Multimodal SafetyCitations: 1 Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-11-20 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R4 (97%) | 1 |
| SafeR-CLIP: Mitigating NSFW Content in Vision-Language Models While Preserving Pre-Trained Knowledge Adeel Yousaf, Amrit Singh Bedi, James Beetham, Joseph Fioresi Published: 2025-11-20Area: Multimodal SafetyCitations: - Tags: ai-safety, alignment-training, empirical, multimodal-safety | 2025-11-20 | Multimodal Safety | ai-safety, alignment-training, empirical, multimodal-safety | E5 / R3 (97%) | - |
| On the Feasibility of Hijacking MLLMs' Decision Chain via One Perturbation Changyue Li, Jiaming He, Jiaying Li, Pinjia He Published: 2025-11-25Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-11-25 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | - |
| GuardTrace-VL: Detecting Unsafe Multimodel Reasoning via Iterative Safety Supervision Changtao Miao, Haojie Yuan, Junchi Chen, Nenghai Yu Published: 2025-11-26Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2025-11-26 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | - |
| TEAR: Temporal-aware Automated Red-teaming for Text-to-Video Models Guanyu Hou, Guowen Xu, Hongwei Li, Jiaming He Published: 2025-11-26Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2025-11-26 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E7 / R3 (96%) | - |
| Debate with Images: Detecting Deceptive Behaviors in Multimodal Large Language Models Boyuan Chen, Donghai Hong, Jiaming Ji, Jiayi Zhou Published: 2025-11-29Area: Multimodal SafetyCitations: - Tags: ai-safety, benchmark, multimodal-safety | 2025-11-29 | Multimodal Safety | ai-safety, benchmark, multimodal-safety | E4 / R3 (96%) | - |
| DefenSee: Dissecting Threat from Sight and Text - A Multi-View Defensive Pipeline for Multi-modal Jailbreaks Kar-Wai Fok, Vrizlynn L. L. Thing, Zihao Wang Published: 2025-12-01Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-12-01 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (95%) | - |
| Aetheria: A multimodal interpretable content safety framework based on multi-agent debate and collaboration Chi Zhang, Haichuan Tang, Haojie Cheng, Jian Zhao Published: 2025-12-02Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2025-12-02 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E7 / R4 (96%) | - |
| Contextual Image Attack: How Visual Context Exposes Multimodal Safety Vulnerabilities Chen Qian, Jie Li, Jing Shao, Lijun Li Published: 2025-12-02Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-12-02 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (98%) | - |
| OmniGuard: Unified Omni-Modal Guardrails with Deliberate Reasoning Boyu Zhu, Muhao Chen, Peng Qi, Tinghui Zhu Published: 2025-12-02Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2025-12-02 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (94%) | - |
| VRSA: Jailbreaking Multimodal Large Language Models through Visual Reasoning Sequential Attack Hui Xue, Jialing Tao, Jin Yan, Jiyang Guan Published: 2025-12-05Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-12-05 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E6 / R3 (98%) | - |
| OmniSafeBench-MM: A Unified Benchmark and Toolbox for Multimodal Jailbreak Attack-Defense Evaluation Dongxian Wu, Jie Liao, Qi Guo, Ranjie Duan Published: 2025-12-06Area: Multimodal SafetyCitations: 3 Tags: adversarial-robustness, ai-safety, benchmark, multimodal-safety, safety-evaluation | 2025-12-06 | Multimodal Safety | adversarial-robustness, ai-safety, benchmark, multimodal-safety, safety-evaluation | E4 / R3 (98%) | 3 |
| SAVE: Sparse Autoencoder-Driven Visual Information Enhancement for Mitigating Object Hallucination Jisoo Mok, Sangha Park, Seungryong Yoo, Sungroh Yoon Published: 2025-12-08Area: Multimodal SafetyCitations: - Tags: ai-safety, empirical, multimodal-safety | 2025-12-08 | Multimodal Safety | ai-safety, empirical, multimodal-safety | E5 / R3 (95%) | - |
| Think-Reflect-Revise: A Policy-Guided Reflective Framework for Safety Alignment in Large Vision Language Models Chaochao Lu, Fenghua Weng, Wenjie Wang, Wenqi Shao Published: 2025-12-08Area: Multimodal SafetyCitations: - Tags: ai-safety, alignment-training, empirical, multimodal-safety | 2025-12-08 | Multimodal Safety | ai-safety, alignment-training, empirical, multimodal-safety | E5 / R3 (97%) | - |
| Rethinking Jailbreak Detection of Large Vision Language Models with Representational Contrastive Scoring Hao Li, Ning Zhang, Peichun Hua, Shanghao Shi Published: 2025-12-12Area: Multimodal SafetyCitations: - Tags: adversarial-robustness, ai-safety, empirical, multimodal-safety | 2025-12-12 | Multimodal Safety | adversarial-robustness, ai-safety, empirical, multimodal-safety | E5 / R3 (96%) | - |