Instant research discovery
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Beyond Attack-Success Rate: Action-Graded Severity Scale for Tool-Using AI Agents Harry Owiredu-Ashley Published: 2026-07-08Area: cs.CRCitations: 15 Tags: ai-safety, cscr, preprint | 2026-07-08 | cs.CR | ai-safety, cscr, preprint | E13 / R10 (89%) | 15 |
| Closed-Loop Dynamic Validator Node Scaling in Private Substrate Blockchains Using Takagi-Sugeno Fuzzy Inference Ayinde M. Usman, Clement N. Nyirenda, Thandile Nododile Published: 2026-07-08Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-07-08 | cs.CR | ai-safety, cscr, preprint | E10 / R9 (92%) | - |
| Large Language Models (LLMs) and Generative AI in Cybersecurity and Privacy: A Survey of Dual-Use Risks, AI-Generated Malware, Explainability, and Defensive Strategies Kiarash Ahi, Saeed Valizadeh Published: 2026-07-08Area: cs.CRCitations: 70 Tags: ai-safety, cscr, preprint | 2026-07-08 | cs.CR | ai-safety, cscr, preprint | E8 / R7 (92%) | 70 |
| Mechanistic Interpretability of LLM Jailbreaks via Internal Attribution Graphs Anupam Wagle, Chaowei Zhang, Ifrat Ikhtear Uddin, Longwei Wang Published: 2026-07-08Area: cs.CRCitations: - Tags: adversarial-robustness, ai-safety, cscr, interpretability, preprint | 2026-07-08 | cs.CR | adversarial-robustness, ai-safety, cscr, interpretability, preprint | E6 / R6 (91%) | - |
| Who Broke the System? Failure Localization in LLM-Based Multi-Agent Systems Anjun Gao, Minghong Fang, Yueyang Quan, Yufei Xia Published: 2026-07-08Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-07-08 | cs.CR | ai-safety, cscr, preprint | E8 / R8 (89%) | - |
| Beware What You Autocomplete: Forensic Attribution of Backdoored Code Completions Anjun Gao, Minghong Fang, Yueyang Quan, Zhuqing Liu Published: 2026-07-09Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-07-09 | cs.CR | ai-safety, cscr, preprint | E24 / R8 (88%) | - |
| From Legacy Documentation to OSCAL: An MCP-Based Agent Pipeline for Threat-Informed Continuous Compliance in Critical Infrastructure Lea Roxanne Muth, Marian Margraf Published: 2026-07-09Area: cs.CRCitations: 26 Tags: ai-safety, cscr, preprint | 2026-07-09 | cs.CR | ai-safety, cscr, preprint | E10 / R10 (94%) | 26 |
| Multi-Agent Firewall Architecture for Privacy Protection of Sensitive Data in Interactions with Language Models Alfonso S谩nchez-Maci谩n, Hugo Garc铆a Cuesta, Pablo Mateo Torrej贸n Published: 2026-07-09Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-07-09 | cs.CR | ai-safety, cscr, preprint | E9 / R9 (94%) | - |
| Out of Sight: Compression-Aware Content Protection against Agentic Crawlers Xuefei Wang Published: 2026-07-09Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-07-09 | cs.CR | ai-safety, cscr, preprint | E10 / R8 (89%) | - |
| Prismata: Confining Cross-Site Prompt Injection in Web Agents Alp Eren Ozdarendeli, Corban Villa, Raluca Ada Popa, Sijun Tan Published: 2026-07-09Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-07-09 | cs.CR | ai-safety, cscr, preprint | E10 / R9 (91%) | - |
| Reverse Engineering Compliance: A Dual-Graph Verification Framework for Auditing Legacy IT Security Concepts Lea Roxanne Muth, Marian Margraf Published: 2026-07-09Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-07-09 | cs.CR | ai-safety, cscr, preprint | E12 / R7 (90%) | - |
| TRACE: A Two-Channel Robust Attribution Watermark via Complementary Embeddings for LLM-Agent Trajectories Jiaojiao Jiang, Liming Zhu, Xiaoyan Feng, Xiaoyu Li Published: 2026-07-09Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-07-09 | cs.CR | ai-safety, cscr, preprint | E15 / R15 (96%) | - |
| Trivial Prompt Reframing Bypasses Safety Guardrails in Google艣 MedGemma-4B Avi-ad Avraam Buskila Published: 2026-07-09Area: cs.CRCitations: 19 Tags: ai-safety, cscr, preprint | 2026-07-09 | cs.CR | ai-safety, cscr, preprint | E10 / R7 (93%) | 19 |
| Blockchain-Linked Auditable Decision Management for Telecom/IoT Fraud-Control Requests Mohammad Shojafar, Nasibeh Mohammadzadeh, Rahim Tafazolli, Saviz Changizi Published: 2026-07-10Area: cs.CRCitations: 28 Tags: ai-safety, cscr, preprint | 2026-07-10 | cs.CR | ai-safety, cscr, preprint | E9 / R6 (89%) | 28 |
| Secret Scanner Agent: Extracting Secrets and Access Context from Unstructured Documents Charlotte Siska, Mariko Wakabayashi, Zixiao Chen Published: 2026-07-10Area: cs.CRCitations: 12 Tags: ai-safety, cscr, preprint | 2026-07-10 | cs.CR | ai-safety, cscr, preprint | E12 / R8 (89%) | 12 |
| VEXAIoT: Autonomous IoT Vulnerability EXploitation using AI Agents Katherine Swinea, Kshitiz Aryal, Lopamudra Praharaj, Maanak Gupta Published: 2026-07-10Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-07-10 | cs.CR | ai-safety, cscr, preprint | E10 / R9 (87%) | - |
| Large Language Models in Misinformation Ecosystems: Misuse, Defense, and Vulnerability Dou Hu, Lingwei Wei, Philip S. Yu, Songlin Hu Published: 2026-07-11Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-07-11 | cs.CR | ai-safety, cscr, preprint | E14 / R13 (93%) | - |
| Minionese: Comprehensive Benchmark and Mechanistic Study of Multilingual LLM Safety Ayushi Mehrotra, Brent Kong, Chigozirim Ifebi Published: 2026-07-11Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-07-11 | cs.CR | ai-safety, cscr, preprint | E13 / R12 (92%) | - |
| Temporary Authority, Permanent Effects: Commit-Time Authorization for LLM Agents Igor Santos-Grueiro Published: 2026-07-11Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-07-11 | cs.CR | ai-safety, cscr, preprint | E9 / R7 (93%) | - |
| Distributed Denial of Science: How Indirect Data Poisoning of AI Systems Can Industrialize Scientific Fraud Atoosa Kasirzadeh, B谩lint Gyevn谩r, Nihar B. Shah Published: 2026-07-12Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-07-12 | cs.CR | ai-safety, cscr, preprint | E10 / R7 (92%) | - |
| Operational Evidence Gaps for LLMs in Fraud Detection and Trust-and-Safety Workflows Keyur Gabani Published: 2026-07-12Area: cs.CRCitations: 69 Tags: ai-safety, cscr, preprint | 2026-07-12 | cs.CR | ai-safety, cscr, preprint | E5 / R5 (93%) | 69 |
| PromptGraph: Graph-Guided Prompt Sanitization for Balancing Privacy and Utility in LLM Inference Chen Gu, Donghui Hu, Hui Wan, Hui Wang Published: 2026-07-12Area: cs.CRCitations: 29 Tags: ai-safety, cscr, preprint | 2026-07-12 | cs.CR | ai-safety, cscr, preprint | E14 / R12 (93%) | 29 |
| The Entanglement Wall: Activation-Space Probes as Risk Detectors, Not Context Adjudicators Dominik Schwarz Published: 2026-07-12Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-07-12 | cs.CR | ai-safety, cscr, preprint | E8 / R7 (90%) | - |
| Agent Hacks Agent: Autoresearch for Production-Agent Red-Teaming Cong Wang, Xiang Zheng, Xutao Mao Published: 2026-07-13Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-07-13 | cs.CR | ai-safety, cscr, preprint | E9 / R6 (91%) | - |
| AMT-X: Phase-Structured Multi-Turn Red-Teaming with Checklist-Gated Evaluation Alex Leung, Kentaroh Toyoda, Yi Ting Shen Published: 2026-07-13Area: cs.CRCitations: 45 Tags: ai-safety, cscr, preprint, safety-evaluation | 2026-07-13 | cs.CR | ai-safety, cscr, preprint, safety-evaluation | E16 / R8 (89%) | 45 |
| Baselines Before Architecture: Evaluating Coding Agents for Autonomous Penetration Testing Aarjan Chaudhary, Ananda Dhakal, Krish Neupane Published: 2026-07-13Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-07-13 | cs.CR | ai-safety, cscr, preprint | E10 / R10 (93%) | - |
| Closing the Loop: An Access-Control Architecture for Automated, Anomaly-Driven Network Revocation in IoT Deployments Kemal Bicakci, Muhammet Emir Korkmaz, Yusuf Uzunay Published: 2026-07-13Area: cs.CRCitations: 14 Tags: ai-safety, cscr, preprint | 2026-07-13 | cs.CR | ai-safety, cscr, preprint | E12 / R10 (94%) | 14 |
| Mako: A Self-Evolving Agentic Operating System (SE-AOS) for Autonomous Web Exploitation Praneeth Narisetty, Shiva Nagendra Babu Kore Published: 2026-07-13Area: cs.CRCitations: 25 Tags: ai-safety, cscr, preprint | 2026-07-13 | cs.CR | ai-safety, cscr, preprint | E8 / R7 (91%) | 25 |
| SingGuard-NSFA: Extensible Guardrails for Agentic AI via Generative Reasoning and Real-Time Classification SingGuard Team Published: 2026-07-13Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-07-13 | cs.CR | ai-safety, cscr, preprint | E10 / R10 (92%) | - |
| When Local Monitors Miss Compositional Harm: Diagnosing Distributed Backdoors in Multi-Agent Systems Ren Wang, Yibo Hu Published: 2026-07-13Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-07-13 | cs.CR | ai-safety, cscr, preprint | E6 / R6 (89%) | - |