Instant research discovery
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Showing 1-30 of 884 papers (page 1 of 30)路 47 ms
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Beyond F1: Evaluating Coverage and Failure Recovery in AI Model Security Scanners Anuj Kaul, Indranil Sanyal, Qianlong Lan, Vinothini Pandurangan Published: 2026-08-27Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-27 | cs.CR | ai-safety, cscr, preprint | E8 / R8 (93%) | - |
| Daydreaming: Stealing Hidden Agent Skills through Black-Box Task Interaction Chia-Mu Yu, Ci-Yang Tsai, Muxi Lyu, Raluca Ada Popa Published: 2026-08-27Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-27 | cs.CR | ai-safety, cscr, preprint | E10 / R9 (91%) | - |
| PLCBench: Can Autonomous LLM Agents Turn PLC Access into Sustained Physical Impact? Haoming Liu, Jingyu Zheng, Lichao Wu, Linkang Du Published: 2026-08-27Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-27 | cs.CR | ai-safety, cscr, preprint | E8 / R6 (90%) | - |
| RedEvoAgent: Automatic Red-Teaming Agent with Experience-Driven Skill Evolution Changsheng Chen, Haoliang Li, Hui Liu, Junjie Zhang Published: 2026-08-27Area: cs.CRCitations: 15 Tags: ai-safety, cscr, preprint | 2026-08-27 | cs.CR | ai-safety, cscr, preprint | E13 / R12 (90%) | 15 |
| Safety Does Not Compose: Non-Decaying Loop State for Autonomous LLM Agents Bin Chong, Chenhao Wu, Chongyang Zhang, Haoxuan Jia Published: 2026-08-27Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-27 | cs.CR | ai-safety, cscr, preprint | E27 / R20 (94%) | - |
| AI Slop and Hallucinations in Vulnerability Assessment: A Survey on Reasoning Failures and Trustworthy Mitigation Gelei Deng, Jialiang Dong, Junchen Ding, Siqi Ma Published: 2026-08-26Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-26 | cs.CR | ai-safety, cscr, preprint | E11 / R10 (90%) | - |
| EVOMAL: Self-Poisoning in Self-Evolving Coding Agents Ahmed E. Hassan, Bram Adams, Jianbing Ni, Qi Li Published: 2026-08-26Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-26 | cs.CR | ai-safety, cscr, preprint | E9 / R6 (93%) | - |
| How Do LLM Agents Actually Get the Flag? Trace-Level Provenance for Agentic Offensive Security Evaluation Farshad Khorrami, Haoran Xi, Kimberly Milner, Meet Udeshi Published: 2026-08-26Area: cs.CRCitations: 15 Tags: ai-safety, cscr, preprint, safety-evaluation | 2026-08-26 | cs.CR | ai-safety, cscr, preprint, safety-evaluation | E18 / R17 (94%) | 15 |
| LLMscope: Extracting LLM Assets from Edge AI Chips via Optical Probing Dev Mehta, Fatemeh Ganji, Lily Dukette, Noah Solomon Published: 2026-08-26Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-26 | cs.CR | ai-safety, cscr, preprint | E6 / R6 (94%) | - |
| MACGen: Toward Functionally Correct and Secure Code Generation via Multi-Agent Collaboration Jaehoon Choi, Miseon Yu, Younghan Lee, Yunheung Paek Published: 2026-08-26Area: cs.CRCitations: 15 Tags: ai-safety, cscr, preprint | 2026-08-26 | cs.CR | ai-safety, cscr, preprint | E12 / R10 (92%) | 15 |
| MACGen: Toward Functionally Correct and Secure Code Generation via Multi-Agent Collaboration Jaehoon Choi, Miseon Yu, Younghan Lee, Yunheung Paek Published: 2026-08-26Area: cs.CRCitations: 15 Tags: ai-safety, cscr, preprint | 2026-08-26 | cs.CR | ai-safety, cscr, preprint | E12 / R10 (92%) | 15 |
| MeMark: Membrane-Space Watermarking for Spiking Neural Networks Aitor Urbieta, Gorka Abad, Roberto Ria帽o, Stjepan Picek Published: 2026-08-26Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-26 | cs.CR | ai-safety, cscr, preprint | E6 / R7 (93%) | - |
| MMJailBench: A Factorized Benchmark for Disentangling Multimodal Jailbreak Vulnerabilities Fengling Li, Jingsong Wang, Lei Zhu, Tianshi Wang Published: 2026-08-26Area: cs.CRCitations: - Tags: adversarial-robustness, ai-safety, cscr, preprint | 2026-08-26 | cs.CR | adversarial-robustness, ai-safety, cscr, preprint | E13 / R8 (90%) | - |
| Pointing the Way, Hiding the Destination: Practical Private Dense Retrieval at Scale Danyang Chen, Diwen Xue, Haifeng Sun, Jingyu Wang Published: 2026-08-26Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-26 | cs.CR | ai-safety, cscr, preprint | E10 / R8 (92%) | - |
| ADeptS-Bench: Measuring the Trustworthiness of Computer Use Agents Across Devices Alejandro Castillejo Munoz, Chloe Evans, Joseph Tighe, Joy Chen Published: 2026-08-25Area: cs.CRCitations: 15 Tags: ai-safety, cscr, preprint | 2026-08-25 | cs.CR | ai-safety, cscr, preprint | E11 / R8 (94%) | 15 |
| NeuronGuard: Robust LLM Safety Alignment via Ablation-Aware Safety Signal Redistribution Anjun Gao, Minghong Fang, Yueyang Quan, Yufei Xia Published: 2026-08-25Area: cs.CRCitations: - Tags: ai-safety, alignment-training, cscr, preprint | 2026-08-25 | cs.CR | ai-safety, alignment-training, cscr, preprint | E8 / R8 (93%) | - |
| Not All Tokens Are Equal: Region-Aware Consistency Repair of Backdoors in MLLMs Guoheng Sun, Haijun Wang, Haoyu Wang, Jiali Wei Published: 2026-08-25Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-25 | cs.CR | ai-safety, cscr, preprint | E10 / R7 (93%) | - |
| RAGSentinel: Certifiable Geometric Consensus for Robust Retrieval-Augmented Generation Anjun Gao, Minghong Fang, Yueyang Quan, Yufei Xia Published: 2026-08-25Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-25 | cs.CR | ai-safety, cscr, preprint | E10 / R7 (93%) | - |
| STAIN-FL: Stealthy Targeted Attack Injection with Contextual Triggers in Federated Learning Ashlinder Kaur, Purnima Murali Mohan, Tram Truong-Huu, Zengxiang Li Published: 2026-08-25Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-25 | cs.CR | ai-safety, cscr, preprint | E11 / R9 (96%) | - |
| WebMCP-Phalanx: Enforcing and Characterizing Trust Boundaries for Browser-Integrated LLM Agents Kuo-Hui Yeh, Lin-Fa Lee, YI-YU Chang Published: 2026-08-25Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-25 | cs.CR | ai-safety, cscr, preprint | E9 / R8 (93%) | - |
| What Guides the Agent? Adjudicating Unauthorized Behavior via Localizing Behavior-Guiding Instructions Haohua Du, Puhan Luo, Ruiqi Li, Yichao Gao Published: 2026-08-25Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-25 | cs.CR | ai-safety, cscr, preprint | E8 / R6 (92%) | - |
| Adapter-Based Few-Shot Continual Learning for Malicious Packet Recognition Andrew Arash Mahyari, Guillermo Francia, III Eman El-Sheikh, Kyle Stein Published: 2026-08-24Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-24 | cs.CR | ai-safety, cscr, preprint | - | - |
| Adversarial Entropy Inflation Against Gumbel-Based Inference Verification Nikita Kezins Published: 2026-08-24Area: cs.CRCitations: - Tags: adversarial-robustness, ai-safety, cscr, preprint | 2026-08-24 | cs.CR | adversarial-robustness, ai-safety, cscr, preprint | - | - |
| Beyond the Mandate: A Systematic Security Analysis of the Agent Payments Protocol (AP2) Asaf Shabtai, Avital Aviv, Parth A. Gandh, Ron Bitton Published: 2026-08-24Area: cs.CRCitations: 15 Tags: ai-safety, cscr, preprint | 2026-08-24 | cs.CR | ai-safety, cscr, preprint | E13 / R10 (92%) | 15 |
| FIDES: A Concordance Protocol for LLM-Generated Trading Strategies Aaron Chan, Alex Ding, Arther Tian, Simon Wu Published: 2026-08-24Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-24 | cs.CR | ai-safety, cscr, preprint | - | - |
| InjecMEM: Memory Injection Attack on LLM Agent Memory Systems Gengyu Zhang, Hanling Tian, Jingying Wang, Kun Yang Published: 2026-08-24Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-24 | cs.CR | ai-safety, cscr, preprint | - | - |
| TEE-X: TEE-aware Acceleration Framework for Large Vision Models at the Edge Abdullah Al Arafat, Abeer Matar A. Almalky, Adnan Siraj Rakin, Kurt M Wilson Published: 2026-08-24Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-24 | cs.CR | ai-safety, cscr, preprint | - | - |
| TrustShiftProbe: Characterizing, Benchmarking, and Defending Staged Trust Attacks on MCP Servers Daniel Takabi, Mehrdad Rostamzadeh, Mohammad Ghasemigol, Sidhant Narula Published: 2026-08-24Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-24 | cs.CR | ai-safety, cscr, preprint | E11 / R9 (93%) | - |
| KONTOGRAPH: Verified Point-in-Time Feature Consistency and Amortised Explanation for Real-Time Anti-Money Laundering under a 200 ms Decision Budget Ahmed Abolfadl Published: 2026-08-23Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-23 | cs.CR | ai-safety, cscr, preprint | - | - |
| Breaking the Assumptions: Auditing Input-Side Jailbreak Defenses Against Semantic Attacks Aaditya Pratap, Harsh Kasyap, Somanath Tripathy Published: 2026-08-22Area: cs.CRCitations: - Tags: adversarial-robustness, ai-safety, cscr, preprint | 2026-08-22 | cs.CR | adversarial-robustness, ai-safety, cscr, preprint | E13 / R10 (94%) | - |