Instant research discovery
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| DeepStage: Learning Autonomous Defense Policies Against Multi-Stage APT Campaigns Thomas Bauschert, Tri Gia Nguyen, Trung V. Phan Published: 2026-03-17Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-03-17 | cs.CR | ai-safety, cscr, preprint | E5 / R4 (98%) | - |
| Detecting Data Poisoning in Code Generation LLMs via Black-Box, Vulnerability-Oriented Scanning Shan Jin, Shenao Yan, Shimaa Ahmed, Sunpreet S. Arora Published: 2026-03-17Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-03-17 | cs.CR | ai-safety, cscr, preprint | E5 / R3 (96%) | - |
| Detecting Sentiment Steering Attacks on RAG-enabled Large Language Models Isha Andrade, Mithun Mukherjee, Pranav M Pawar, Raja Muthalagu Published: 2026-03-17Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-03-17 | cs.CR | ai-safety, cscr, preprint | E5 / R3 (95%) | - |
| Learning Communication Between Heterogeneous Agents in Multi-Agent Reinforcement Learning for Autonomous Cyber Defence Adrian Taylor, Alex Popa, Ranwa Al Mallah Published: 2026-03-17Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-03-17 | cs.CR | ai-safety, cscr, preprint | E32 / R18 (94%) | - |
| Malicious Or Not: Adding Repository Context to Agent Skill Classification David Schmidt, Florian Holzbauer, Gabriel Gegenhuber, Johanna Ullrich Published: 2026-03-17Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-03-17 | cs.CR | ai-safety, cscr, preprint | E7 / R3 (95%) | - |
| PAuth - Precise Task-Scoped Authorization For Agents Linxi Jiang, Reshabh K Sharma, Shuo Chen, Zhiqiang Lin Published: 2026-03-17Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-03-17 | cs.CR | ai-safety, cscr, preprint | E5 / R4 (98%) | - |
| Resource Consumption Threats in Large Language Models Kun Wang, Li Sun, Sen Su, Weiliu Wang Published: 2026-03-17Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-03-17 | cs.CR | ai-safety, cscr, preprint | E7 / R3 (93%) | - |
| Security Assessment and Mitigation Strategies for Large Language Models: A Comprehensive Defensive Framework Iman Vakilinia, Taiwo Onitiju Published: 2026-03-17Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-03-17 | cs.CR | ai-safety, cscr, preprint | E6 / R2 (95%) | - |
| Towards Unsupervised Adversarial Document Detection in Retrieval Augmented Generation Systems Patrick Levi Published: 2026-03-17Area: cs.CRCitations: - Tags: adversarial-robustness, ai-safety, cscr, preprint | 2026-03-17 | cs.CR | adversarial-robustness, ai-safety, cscr, preprint | E5 / R3 (95%) | - |
| $p^2$RAG: Privacy-Preserving RAG Service Supporting Arbitrary Top-$k$ Retrieval Cong Wang, Jijia Yang, Mingyue Wang, Xiaohua Jia Published: 2026-03-16Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-03-16 | cs.CR | ai-safety, cscr, preprint | E5 / R3 (96%) | - |
| Architecture-Agnostic Feature Synergy for Universal Defense Against Heterogeneous Generative Threats Bingxue Zhang, Feida Zhu, Yang Gao, Yang Shi Published: 2026-03-16Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-03-16 | cs.CR | ai-safety, cscr, preprint | E5 / R4 (94%) | - |
| BadLLM-TG: A Backdoor Defender powered by LLM Trigger Generator Haifang Zhou, Heng Gao, Ruyi Zhang, Songlei Jian Published: 2026-03-16Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-03-16 | cs.CR | ai-safety, cscr, preprint | E5 / R3 (97%) | - |
| ClawWorm: Self-Propagating Attacks Across LLM Agent Ecosystems Chengcan Wu, Haolin Wu, Huanran Chen, Jiangrong Wu Published: 2026-03-16Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-03-16 | cs.CR | ai-safety, cscr, preprint | E5 / R3 (96%) | - |
| Evasive Intelligence: Lessons from Malware Analysis for Evaluating AI Agents Aur茅lien Francillon, Daniele Perito, Merve Sahin, Simone Aonzo Published: 2026-03-16Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-03-16 | cs.CR | ai-safety, cscr, preprint | E6 / R3 (92%) | - |
| How Vulnerable Are AI Agents to Indirect Prompt Injections? Insights from a Large-Scale Public Competition Andy Zou, Arman Zharmagambetov, Benjamin L. Edelman, Eliot Jones Published: 2026-03-16Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-03-16 | cs.CR | ai-safety, cscr, preprint | E5 / R3 (96%) | - |
| SFCoT: Safer Chain-of-Thought via Active Safety Evaluation and Calibration Bin Wu, Guangquan Xu, Qiannan Si, Tiejun Wu Published: 2026-03-16Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint, safety-evaluation | 2026-03-16 | cs.CR | ai-safety, cscr, preprint, safety-evaluation | E4 / R3 (94%) | - |
| TrinityGuard: A Unified Framework for Safeguarding Multi-Agent Systems Biaojie Zeng, Chang Jin, Chao Yang, Hefeng Zhou Published: 2026-03-16Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-03-16 | cs.CR | ai-safety, cscr, preprint | E4 / R3 (98%) | - |
| AEX: Non-Intrusive Multi-Hop Attestation and Provenance for LLM APIs Yongjie Guan Published: 2026-03-15Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-03-15 | cs.CR | ai-safety, cscr, preprint | E5 / R3 (95%) | - |
| Cryptographic Runtime Governance for Autonomous AI Systems: The Aegis Architecture for Verifiable Policy Enforcement Adam Massimo Mazzocchetti Published: 2026-03-15Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-03-15 | cs.CR | ai-safety, cscr, preprint | E6 / R4 (96%) | - |
| Membership Inference for Contrastive Pre-training Models with Text-only PII Queries Hongyi Zhang, Ruoxi Cheng, Yiyan Huang, Yizhong Ding Published: 2026-03-15Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-03-15 | cs.CR | ai-safety, cscr, preprint | E5 / R3 (95%) | - |
| State-Dependent Safety Failures in Multi-Turn Language Model Interaction Han Qiu, Jie Zhang, Nenghai Yu, Pengcheng Li Published: 2026-03-15Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-03-15 | cs.CR | ai-safety, cscr, preprint | E5 / R3 (95%) | - |
| Towards Agentic Honeynet Configuration Danilo Giordano, Federico Mirra, Idilio Drago, Marco Mellia Published: 2026-03-14Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-03-14 | cs.CR | ai-safety, cscr, preprint | E5 / R4 (95%) | - |
| Cascade: Composing Software-Hardware Attack Gadgets for Adversarial Threat Amplification in Compound AI Systems Anjo Vahldiek-Oberwagner, Jose Sanchez Vicarte, Mohit Tiwari, Prateek Sahu Published: 2026-03-12Area: cs.CRCitations: - Tags: adversarial-robustness, ai-safety, cscr, preprint | 2026-03-12 | cs.CR | adversarial-robustness, ai-safety, cscr, preprint | E5 / R3 (94%) | - |
| Delayed Backdoor Attacks: Exploring the Temporal Dimension as a New Attack Surface in Pre-Trained Models Dusit Niyato, Haomiao Yang, Kunlan Xiang, Meng Hao Published: 2026-03-12Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-03-12 | cs.CR | ai-safety, cscr, preprint | E4 / R3 (97%) | - |
| Taming OpenClaw: Security Analysis and Mitigation of Autonomous LLM Agent Threats Changhua Meng, Jialuo Chen, Jianan Ma, Jiaqi Bai Published: 2026-03-12Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-03-12 | cs.CR | ai-safety, cscr, preprint | E8 / R3 (95%) | - |
| The Mirror Design Pattern: Strict Data Geometry over Model Scale for Prompt Injection Detection J Alex Corll Published: 2026-03-12Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-03-12 | cs.CR | ai-safety, cscr, preprint | E5 / R3 (94%) | - |
| Understanding LLM Behavior When Encountering User-Supplied Harmful Content in Harmless Tasks Junjie Chu, Michael Backes, Savvas Zannettou, Yang Zhang Published: 2026-03-12Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-03-12 | cs.CR | ai-safety, cscr, preprint | E6 / R3 (93%) | - |
| You Told Me to Do It: Measuring Instructional Text-induced Private Data Leakage in LLM Agents Ching-Yu Kao, Eric Hanchen Jiang, Pengcheng Zhou, Philip Sperl Published: 2026-03-12Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-03-12 | cs.CR | ai-safety, cscr, preprint | E4 / R3 (97%) | - |
| Detecting and Eliminating Neural Network Backdoors Through Active Paths with Application to Intrusion Detection David Aspinall, Eirik H酶yheim, Gudmund Grov, Magnus Wiik Eckhoff Published: 2026-03-11Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-03-11 | cs.CR | ai-safety, cscr, preprint | E5 / R3 (94%) | - |
| Enhancing Network Intrusion Detection Systems: A Multi-Layer Ensemble Approach to Mitigate Adversarial Attacks Anderson R. Avila, Kelton A. P. Costa, Nasim Soltani, Raphael Khoury Published: 2026-03-11Area: cs.CRCitations: - Tags: adversarial-robustness, ai-safety, cscr, preprint | 2026-03-11 | cs.CR | adversarial-robustness, ai-safety, cscr, preprint | E6 / R4 (97%) | - |