Instant research discovery
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| GAMMAF: A Common Framework for Graph-Based Anomaly Monitoring Benchmarking in LLM Multi-Agent Systems Alfonso S谩nchez-Maci谩n, Pablo Mateo-Torrej贸n Published: 2026-04-27Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-27 | cs.CR | ai-safety, cscr, preprint | E8 / R5 (98%) | - |
| Jailbreaking Frontier Foundation Models Through Intention Deception Katia Sycara, Xinhe Wang, Yaqi Xie Published: 2026-04-27Area: cs.CRCitations: - Tags: adversarial-robustness, ai-safety, cscr, preprint | 2026-04-27 | cs.CR | adversarial-robustness, ai-safety, cscr, preprint | E7 / R5 (97%) | - |
| Layerwise Convergence Fingerprints for Runtime Misbehavior Detection in Large Language Models Jun Sun, Long H. Pham, Nay Myat Min Published: 2026-04-27Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-27 | cs.CR | ai-safety, cscr, preprint | E11 / R6 (100%) | - |
| Poster: ClawdGo: Endogenous Security Awareness Training for Autonomous AI Agents Bin Sun, Jian Chang, Jiaqi Li, Lidong Zhai Published: 2026-04-27Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-27 | cs.CR | ai-safety, cscr, preprint | E9 / R5 (98%) | - |
| X-NegoBox: An Explainable Privacy-Budget Negotiation Framework for Secure Peer-to-Peer Energy Data Exchange Frank Eliassen, Poushali Sengupta, Sabita Maharjan, Yan Zhang Published: 2026-04-27Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-27 | cs.CR | ai-safety, cscr, preprint | E8 / R5 (96%) | - |
| An AI-Based Supervisory Measurement Integrity Validation Layer for Cyber-Resilient AC/DC Protection in Inverter-Based Microgrids Ahmad Mohammad Saber, Ahmed Saber Refae, Amr Youssef, Davor Svetinovic Published: 2026-04-26Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-26 | cs.CR | ai-safety, cscr, preprint | E6 / R4 (97%) | - |
| Breaking the Secret: Economic Interventions for Combating Collusion in Embodied Multi-Agent Systems Dan Yu, Limin Sun, Qi Liu, Xiaohui Chen Published: 2026-04-26Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-26 | cs.CR | ai-safety, cscr, preprint | E7 / R4 (96%) | - |
| CyberCane: Neuro-Symbolic RAG for Privacy-Preserving Phishing Detection with Formal Ontology Reasoning Aniqa Afzal, Houbing Herbert Song, Pawel Sloboda, Qi Zhao Published: 2026-04-26Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-26 | cs.CR | ai-safety, cscr, preprint | E6 / R4 (97%) | - |
| Evaluation of Prompt Injection Defenses in Large Language Models Amy Fox, Kelley McAllister, Krisztian Flautner, Kyle Bacon Published: 2026-04-26Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint, safety-evaluation | 2026-04-26 | cs.CR | ai-safety, cscr, preprint, safety-evaluation | E8 / R4 (98%) | - |
| SMSI: System Model Security Inference: Automated Threat Modeling for Cyber-Physical Systems Ali Khreis, Ro脻ah Radaideh Published: 2026-04-26Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-26 | cs.CR | ai-safety, cscr, preprint | E9 / R6 (98%) | - |
| Evaluating Jailbreaking Vulnerabilities in LLMs Deployed as Assistants for Smart Grid Operations: A Benchmark Against NERC Standards Ahmad Mohammad Saber, Amr Youssef, Deepa Kundur, Lucas Rea Published: 2026-04-25Area: cs.CRCitations: - Tags: adversarial-robustness, ai-safety, cscr, preprint | 2026-04-25 | cs.CR | adversarial-robustness, ai-safety, cscr, preprint | E9 / R4 (98%) | - |
| Protecting the Trace: A Principled Black-Box Approach Against Distillation Attacks Lav R. Varshney, Max Hartman, Moulik Choraria, Vidhata Jayaraman Published: 2026-04-25Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-25 | cs.CR | ai-safety, cscr, preprint | E7 / R5 (95%) | - |
| Toward Polymorphic Backdoor against Semantic Communication via Intensity-Based Poisoning Gaolei Li, Jianhua Li, Jun Wu, Kai Zhou Published: 2026-04-25Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-25 | cs.CR | ai-safety, cscr, preprint | E6 / R4 (96%) | - |
| Training Machine Learning Models on Encrypted Data: A Privacy-Preserving Framework using Homomorphic Encryption Alexandre Marques, Beatriz S谩, Pedro Pinto, Rui Botelho Published: 2026-04-25Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-25 | cs.CR | ai-safety, cscr, preprint | E7 / R4 (94%) | - |
| UNSEEN: A Cross-Stack LLM Unlearning Defense against AR-LLM Social Engineering Attacks Fudu Xing, Gaoyang Liu, Kailong Wang, Lihong Liu Published: 2026-04-25Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-25 | cs.CR | ai-safety, cscr, preprint | E11 / R8 (98%) | - |
| ArmSSL: Adversarial Robust Black-Box Watermarking for Self-Supervised Learning Pre-trained Encoders Anmin Fu, Boyu Kuang, Chunyi Zhou, Liquan Chen Published: 2026-04-24Area: cs.CRCitations: - Tags: adversarial-robustness, ai-safety, cscr, preprint | 2026-04-24 | cs.CR | adversarial-robustness, ai-safety, cscr, preprint | E10 / R6 (97%) | - |
| DeepSignature: Digitally Signed, Content-Encoding Watermarks for Robust and Transparent Image Authentication Christian Schwarzer, Marco Willi, Martin Melchior, Mathias Graf Published: 2026-04-24Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-24 | cs.CR | ai-safety, cscr, preprint | E6 / R4 (99%) | - |
| PrivSTRUCT: Untangling Data Purpose Compliance of Privacy Policies in Google Play Store Anirban Mahanti, Aruna Seneviratne, Bhanuka Silva, Suranga Senevirante Published: 2026-04-24Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-24 | cs.CR | ai-safety, cscr, preprint | E7 / R4 (97%) | - |
| Reconstructive Authority Model: Runtime Execution Validity Under Partial Observability Marcelo Fernandez - TraslaIA Published: 2026-04-24Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-24 | cs.CR | ai-safety, cscr, preprint | E7 / R5 (97%) | - |
| RouteGuard: Internal-Signal Detection of Skill Poisoning in LLM Agents Biyu Zhou, Jizhong Han, Songlin Hu, Wenjie Xiao Published: 2026-04-24Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-24 | cs.CR | ai-safety, cscr, preprint | E6 / R4 (96%) | - |
| SSG: Logit-Balanced Vocabulary Partitioning for LLM Watermarking Chenxi Gu, John Grundy, Xiaoning Du Published: 2026-04-24Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-24 | cs.CR | ai-safety, cscr, preprint | E8 / R4 (96%) | - |
| Adversarial Evasion in Non-Stationary Malware Detection: Minimizing Drift Signals through Similarity-Constrained Perturbations Lan Zhang, Pawan Acharya Published: 2026-04-23Area: cs.CRCitations: - Tags: adversarial-robustness, ai-safety, cscr, preprint | 2026-04-23 | cs.CR | adversarial-robustness, ai-safety, cscr, preprint | E9 / R4 (97%) | - |
| AutoRISE: Agent-Driven Strategy Evolution for Red-Teaming Large Language Models Alireza Bahramali, Sandeep Atluri, Tanmay Gautam Published: 2026-04-23Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-23 | cs.CR | ai-safety, cscr, preprint | E8 / R4 (97%) | - |
| CSC: Turning the Adversary's Poison against Itself Bo Liu, Huajie Chen, Tianqing Zhu, Wanlei Zhou Published: 2026-04-23Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-23 | cs.CR | ai-safety, cscr, preprint | E15 / R4 (98%) | - |
| Differentially Private De-identification of Dutch Clinical Notes: A Comparative Evaluation Ameen Abu-Hanna, Iacer Calixto, Michele Miranda, Nishant Mishra Published: 2026-04-23Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint, safety-evaluation | 2026-04-23 | cs.CR | ai-safety, cscr, preprint, safety-evaluation | E10 / R4 (98%) | - |
| Stealthy Backdoor Attacks against LLMs Based on Natural Style Triggers Guoheng Sun, Haijun Wang, Jiali Wei, Ming Fan Published: 2026-04-23Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-23 | cs.CR | ai-safety, cscr, preprint | E10 / R5 (98%) | - |
| TraceScope: Interactive URL Triage via Decoupled Checklist Adjudication Guofei Gu, Haolin Zhang, Jeff Huang, William Reber Published: 2026-04-23Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-23 | cs.CR | ai-safety, cscr, preprint | E7 / R5 (98%) | - |
| Transient Turn Injection: Exposing Stateless Multi-Turn Vulnerabilities in Large Language Models Naheed Rayhan, Sohely Jahan Published: 2026-04-23Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-23 | cs.CR | ai-safety, cscr, preprint | E9 / R4 (97%) | - |
| Adaptive Defense Orchestration for RAG: A Sentinel-Strategist Architecture against Multi-Vector Attacks Bharath Vemula, Charan Ramtej Kodi, Pranav Pallerla, Wilson Naik Bhukya Published: 2026-04-22Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-22 | cs.CR | ai-safety, cscr, preprint | E10 / R6 (95%) | - |
| Adaptive Instruction Composition for Automated LLM Red-Teaming Andy Luo, Emily Chen, Jesse Zymet, Sahil Wadhwa Published: 2026-04-22Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-04-22 | cs.CR | ai-safety, cscr, preprint | E9 / R5 (97%) | - |