Instant research discovery
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| SkillSieve: A Hierarchical Triage Framework for Detecting Malicious AI Agent Skills Yinghan Hou, Zongyou Yang Published: 2026-04-08Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-08 | cs.CR | ai-safety, cscr, preprint | E5 / R3 (96%) | - |
| SkillTrojan: Backdoor Attacks on Skill-Based Agent Systems Boren Zheng, Kun Zhai, Wenke Huang, Xiaolong Li Published: 2026-04-08Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-08 | cs.CR | ai-safety, cscr, preprint | E5 / R3 (96%) | - |
| Towards Privacy-Preserving Large Language Model: Text-free Inference Through Alignment and Adaptation Chanhee Park, Heuiseok Lim, Hyeonseok Moon, Jeongho Yoon Published: 2026-04-08Area: cs.CRCitations: - Tags: ai-safety, alignment-training, cscr, preprint | 2026-04-08 | cs.CR | ai-safety, alignment-training, cscr, preprint | E5 / R3 (95%) | - |
| TraceSafe: A Systematic Assessment of LLM Guardrails on Multi-Step Tool-Calling Trajectories Cheng-Lin Yang, Sian-Yao Huang, Yen-Shan Chen, Yun-Nung Chen Published: 2026-04-08Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-08 | cs.CR | ai-safety, cscr, preprint | E4 / R3 (95%) | - |
| Validated Intent Compilation for Constrained Routing in LEO Mega-Constellations Yuanhang Li Published: 2026-04-08Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-08 | cs.CR | ai-safety, cscr, preprint | E5 / R3 (99%) | - |
| AITH: A Post-Quantum Continuous Delegation Protocol for Human-AI Trust Establishment Zhaoliang Chen Published: 2026-04-09Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-09 | cs.CR | ai-safety, cscr, preprint | E5 / R3 (98%) | - |
| Building Better Environments for Autonomous Cyber Defence Ahmad Ridley, Ankita Samaddar, Chris Hicks, Ed Chapman Published: 2026-04-09Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-09 | cs.CR | ai-safety, cscr, preprint | E5 / R3 (95%) | - |
| Multimodal Reasoning with LLM for Encrypted Traffic Interpretation: A Benchmark Fuxiang Huang, Lei Zhang, Longgang Zhang, Xiaowei Fu Published: 2026-04-09Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-09 | cs.CR | ai-safety, cscr, preprint | E5 / R3 (94%) | - |
| PIArena: A Platform for Prompt Injection Evaluation Chenlong Yin, Jinyuan Jia, Runpeng Geng, Yanting Wang Published: 2026-04-09Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint, safety-evaluation | 2026-04-09 | cs.CR | ai-safety, cscr, preprint, safety-evaluation | E4 / R3 (95%) | - |
| PrivFedTalk: Privacy-Aware Federated Diffusion with Identity-Stable Adapters for Personalized Talking-Head Generation Soumya Mazumdar, Tapas Samanta, Vineet Kumar Rakesh Published: 2026-04-09Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-09 | cs.CR | ai-safety, cscr, preprint | E5 / R3 (96%) | - |
| Retrieval Augmented Classification for Confidential Documents Byunghoon Oh, Jaewoo Lee, Rahul Kailasa, Simon Shim Published: 2026-04-09Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-09 | cs.CR | ai-safety, cscr, preprint | E5 / R3 (96%) | - |
| Securing Retrieval-Augmented Generation: A Taxonomy of Attacks, Defenses, and Future Directions Haoyang Li, Jason Chen Zhang, Lei Chen, Mingtao Zhang Published: 2026-04-09Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-09 | cs.CR | ai-safety, cscr, preprint | E6 / R3 (94%) | - |
| TADP-RME: A Trust-Adaptive Differential Privacy Framework for Enhancing Reliability of Data-Driven Systems Labani Halder, Payel Sadhukhan, Sarbani Palit Published: 2026-04-09Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-09 | cs.CR | ai-safety, cscr, preprint | E5 / R3 (95%) | - |
| TrajGuard: Streaming Hidden-state Trajectory Detection for Decoding-time Jailbreak Defense Bangzhou Xin, Cheng Liu, Kangyi Ding, Xiaolei Liu Published: 2026-04-09Area: cs.CRCitations: - Tags: adversarial-robustness, ai-safety, cscr, preprint | 2026-04-09 | cs.CR | adversarial-robustness, ai-safety, cscr, preprint | E5 / R4 (96%) | - |
| ADAM: A Systematic Data Extraction Attack on Agent Memory via Adaptive Querying Danjue Chen, Jianfeng He, Ning Wang, Shixiong Li Published: 2026-04-10Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-10 | cs.CR | ai-safety, cscr, preprint | E4 / R3 (95%) | - |
| Backdoors in RLVR: Jailbreak Backdoors in LLMs From Verifiable Reward Jing Li, Min Zhang, Weiyang Guo, Yuan Zhou Published: 2026-04-10Area: cs.CRCitations: - Tags: adversarial-robustness, ai-safety, cscr, preprint | 2026-04-10 | cs.CR | adversarial-robustness, ai-safety, cscr, preprint | E4 / R3 (95%) | - |
| BadSkill: Backdoor Attacks on Agent Skills via Model-in-Skill Poisoning Guiyao Tie, Jiawen Shi, Lichao Sun, Pan Zhou Published: 2026-04-10Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-10 | cs.CR | ai-safety, cscr, preprint | E5 / R3 (93%) | - |
| CLIP-Inspector: Model-Level Backdoor Detection for Prompt-Tuned CLIP via OOD Trigger Inversion Akshit Jindal, Chetan Arora, Saket Anand, Vikram Goyal Published: 2026-04-10Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-10 | cs.CR | ai-safety, cscr, preprint | E5 / R3 (95%) | - |
| Conflicts Make Large Reasoning Models Vulnerable to Attacks Cehao Yang, Chengjin Xu, Honghao Liu, Jian Guo Published: 2026-04-10Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-10 | cs.CR | ai-safety, cscr, preprint | E6 / R3 (95%) | - |
| XFED: Non-Collusive Model Poisoning Attack Against Byzantine-Robust Federated Classifiers Israt Jahan Mouri, Muhammad Abdullah Adnan, Muhammad Ridowan Published: 2026-04-10Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-10 | cs.CR | ai-safety, cscr, preprint | E4 / R2 (96%) | - |
| Jailbreaking the Matrix: Nullspace Steering for Controlled Model Subversion Maisha Maliha, Sumit Kumar Jha, Susmit Jha, Vishal Pramanik Published: 2026-04-11Area: cs.CRCitations: - Tags: adversarial-robustness, ai-safety, cscr, preprint | 2026-04-11 | cs.CR | adversarial-robustness, ai-safety, cscr, preprint | E4 / R3 (97%) | - |
| Like a Hammer, It Can Build, It Can Break: Large Language Model Uses, Perceptions, and Adoption in Cybersecurity Operations on Reddit Aditi Ganapathi, Chih-Yi Huang, Gail-Joon Ahn, Jaron Mink Published: 2026-04-11Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-11 | cs.CR | ai-safety, cscr, preprint | E5 / R3 (94%) | - |
| A Queueing-Theoretic Framework for Dynamic Attack Surfaces: Data-Integrated Risk Analysis and Adaptive Defense Abdullah Yasin Etcibasi, C. Emre Koksal, Jihyeon Yun, Ming Shi Published: 2026-04-12Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-12 | cs.CR | ai-safety, cscr, preprint | E5 / R3 (94%) | - |
| A Queueing-Theoretic Framework for Dynamic Attack Surfaces: Data-Integrated Risk Analysis and Adaptive Defense Abdullah Yasin Etcibasi, C. Emre Koksal, Jihyeon Yun, Ming Shi Published: 2026-04-12Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-12 | cs.CR | ai-safety, cscr, preprint | E5 / R3 (97%) | - |
| Beyond Static Sandboxing: Learned Capability Governance for Autonomous AI Agents Bronislav Sidik, Lior Rokach Published: 2026-04-12Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-12 | cs.CR | ai-safety, cscr, preprint | E6 / R3 (95%) | - |
| Critical-CoT: A Robust Defense Framework against Reasoning-Level Backdoor Attacks in Large Language Models Long Bao Le, Vu Tuan Truong Published: 2026-04-12Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-12 | cs.CR | ai-safety, cscr, preprint | E5 / R3 (96%) | - |
| Critical-CoT: A Robust Defense Framework against Reasoning-Level Backdoor Attacks in Large Language Models Long Bao Le, Vu Tuan Truong Published: 2026-04-12Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-12 | cs.CR | ai-safety, cscr, preprint | E6 / R3 (97%) | - |
| Detecting RAG Extraction Attack via Dual-Path Runtime Integrity Game Liya Su, Shouyou Song, Tingwen Liu, Xiaokun Chen Published: 2026-04-12Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-12 | cs.CR | ai-safety, cscr, preprint | E5 / R3 (94%) | - |
| Machine Learning-Based Detection of MCP Attacks Anton Borg, Ricardo Britto, Samuel Nyberg, Tobias Mattsson Published: 2026-04-12Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-12 | cs.CR | ai-safety, cscr, preprint | E6 / R3 (95%) | - |
| The Blind Spot of Agent Safety: How Benign User Instructions Expose Critical Vulnerabilities in Computer-Use Agents Jian Kang, Jiate Li, Jieyu Zhao, Linxin Song Published: 2026-04-12Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-12 | cs.CR | ai-safety, cscr, preprint | E5 / R3 (96%) | - |