Instant research discovery
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| ASTELD: A Six-Axis Classification Framework for Autonomous AI Agents - Design, Evaluation, and an OpenClaw Case Study Arif Hassan Zidan, Bowen Guo, Churan Yu, Haixing Dai Published: 2026-08-05Area: cs.CRCitations: 39 Tags: ai-safety, cscr, preprint, safety-evaluation | 2026-08-05 | cs.CR | ai-safety, cscr, preprint, safety-evaluation | E33 / R34 (91%) | 39 |
| Breadcrumbing Search Agents Dacheng Tao, Hanqing Zhao, Kejiang Chen, Nenghai Yu Published: 2026-08-05Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-05 | cs.CR | ai-safety, cscr, preprint | - | - |
| Combating Knowledge Corruption in Agent Systems: A Byzantine-Tolerant Secure Collaborative RAG Framework Daqing He, Hongwei Yao, Jiamou Liu, Jincheng An Published: 2026-08-05Area: cs.CRCitations: 33 Tags: ai-safety, cscr, preprint | 2026-08-05 | cs.CR | ai-safety, cscr, preprint | E11 / R8 (90%) | 33 |
| Gradient Immunity: Null-Space Resistance to Malicious Fine-Tuning Chaochao Lu, Tianhang Zheng, Xingyu Zeng, Yuxuan Huang Published: 2026-08-05Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-05 | cs.CR | ai-safety, cscr, preprint | - | - |
| Hardware Design and Security in the Era of Chiplets and LLMs Johann Knechtel, Ozgur Sinanoglu, Paul V. Gratz, Ramesh Karri Published: 2026-08-05Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-05 | cs.CR | ai-safety, cscr, preprint | - | - |
| PURPOSE: Poisoning Conflict Resolution in RAG via Proxy-Fact-Grounded Updates Jingyu Hua, Muzhi Dong, Sheng Zhong, Wei Tong Published: 2026-08-05Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-05 | cs.CR | ai-safety, cscr, preprint | - | - |
| Trident : How to Break Deep Reinforcement Learning Cyber Defenses (Agentic) Armita Kazeminajafabadi, Hyunwoo Oh, Ian Bryant, Mahdi Imani Published: 2026-08-05Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-05 | cs.CR | ai-safety, cscr, preprint | E11 / R10 (91%) | - |
| When Does Latent Communication Pay? A Causal Audit of Relayed KV Caches in Multi-Agent LLMs Jiaming Cheng, Rajiv Ramnath, Subhransu Das Published: 2026-08-05Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-05 | cs.CR | ai-safety, cscr, preprint | - | - |
| WorldMark: A Plug-and-Play World Knowledge Interface for Cross-Host Language Model Watermarking Kejun Zhang, Song Xiao, Yanshuo Zhang, Yuqi Yuan Published: 2026-08-05Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-05 | cs.CR | ai-safety, cscr, preprint | E10 / R7 (88%) | - |
| ABC: Numerical Data Collection under Local Differential Privacy without Prior Knowledge Hyungbin Kim, Incheol Baek, Yon Dohn Chung Published: 2026-08-06Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-06 | cs.CR | ai-safety, cscr, preprint | E9 / R9 (92%) | - |
| CyberForge: Verified Vulnerability Injection at Repository Level for Cybersecurity Agent Training Amine Lbath, Aurelien Delaitre, Dinesh Manocha, Manan Suri Published: 2026-08-06Area: cs.CRCitations: 15 Tags: ai-safety, cscr, preprint | 2026-08-06 | cs.CR | ai-safety, cscr, preprint | E8 / R6 (94%) | 15 |
| Hardware Keystores for AI Agent Signing Workflows: A Zero-Trust MCP Enforcement Architecture Leo Sambrook, Sampo Sovio Published: 2026-08-06Area: cs.CRCitations: 15 Tags: ai-safety, cscr, preprint | 2026-08-06 | cs.CR | ai-safety, cscr, preprint | E10 / R9 (93%) | 15 |
| StepJack: Benchmarking Computer-Use Agent Safety Against Multi-Step Indirect Prompt Injection Akbar Rafiey, Avery Ma, Layla El Asri, Leila Pishdad Published: 2026-08-06Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-06 | cs.CR | ai-safety, cscr, preprint | E13 / R13 (90%) | - |
| When Experience Becomes Instruction: Trajectory Poisoning in Self-Evolving Agent Skill Systems Jialuo Chen, Jianan Ma, Jingyi Wang, Lingqi Jiang Published: 2026-08-06Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-06 | cs.CR | ai-safety, cscr, preprint | E8 / R6 (91%) | - |
| When Experience Becomes Instruction: Trajectory Poisoning in Self-Evolving Agent Skill Systems Jialuo Chen, Jianan Ma, Jingyi Wang, Lingqi Jiang Published: 2026-08-06Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-06 | cs.CR | ai-safety, cscr, preprint | E10 / R8 (90%) | - |
| Adversarial Attacks on Deep OCR Systems Hongzong LI, Jiahao MA, Rong Feng, Shiqin Tang Published: 2026-08-07Area: cs.CRCitations: - Tags: adversarial-robustness, ai-safety, cscr, preprint | 2026-08-07 | cs.CR | adversarial-robustness, ai-safety, cscr, preprint | E9 / R8 (91%) | - |
| HarnessSafe: Evaluating Safety Across Persistent Carriers in Agent Harnesses Dongyuan Li, Hongxun Gu, Liuyu Xiang, Xiao Zhang Published: 2026-08-07Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-07 | cs.CR | ai-safety, cscr, preprint | E14 / R7 (91%) | - |
| LoRAScan: Detecting Backdoor Prompts in Low-Rank Adapters for Large Language Models via Down-Projection Activation Spikes Doniyorkhon Obidov, Honggang Yu, Kaichen Yang, Xiaolong Guo Published: 2026-08-07Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-07 | cs.CR | ai-safety, cscr, preprint | E8 / R6 (88%) | - |
| Policy-Masked Private Experts: Auditable and Reversible Capability Access Control in Sparse MoE Models Mukesh Singh, Zhuoheng Huang Published: 2026-08-07Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-07 | cs.CR | ai-safety, cscr, preprint | E9 / R7 (93%) | - |
| Policy-Masked Private Experts: Auditable and Reversible Capability Access Control in Sparse MoE Models Mukesh Singh, Zhuoheng Huang Published: 2026-08-07Area: cs.CRCitations: 23 Tags: ai-safety, cscr, preprint | 2026-08-07 | cs.CR | ai-safety, cscr, preprint | E9 / R7 (91%) | 23 |
| Soft Redaction of Image Provenance via Zero-Knowledge Proofs John Collomosse, Muhammad Awan Published: 2026-08-07Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-07 | cs.CR | ai-safety, cscr, preprint | E9 / R9 (91%) | - |
| The Anatomy of a Prompt Injection: A Component Model for Structured Analysis Jeremy McHugh Published: 2026-08-07Area: cs.CRCitations: 22 Tags: ai-safety, cscr, preprint | 2026-08-07 | cs.CR | ai-safety, cscr, preprint | E13 / R14 (90%) | 22 |
| Compositional Threat Analysis of Latent Compromise in LLM Agent Systems: The Order 66 Scenario Satoshi Matsuoka Published: 2026-08-08Area: cs.CRCitations: 47 Tags: ai-safety, cscr, preprint | 2026-08-08 | cs.CR | ai-safety, cscr, preprint | E12 / R9 (88%) | 47 |
| Defending Retrieval-Augmented Intrusion Detection Against Knowledge Poisoning and Prompt Injection Atsuo Inomata, Kaysarul Anas Apurba, Mahedee Zaman Moon, Md. Hasibul Hasan Published: 2026-08-08Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-08 | cs.CR | ai-safety, cscr, preprint | E10 / R8 (92%) | - |
| Privacy-Preserving Data Drift Detection and Recovery for Large-Scale LLM Applications via Proxy Representations Eyal Kolman, Haoyu Dong, Josh Ledgard, Michael Levit Published: 2026-08-08Area: cs.CRCitations: 15 Tags: ai-safety, cscr, preprint | 2026-08-08 | cs.CR | ai-safety, cscr, preprint | E6 / R5 (94%) | 15 |
| Private Anytime Selective-Risk Certification for Federated Retrieval-Augmented Generation: Guarantees and Empirical Limits Anuj Sharma, Ibne Farabi Shihab, Sanjeda Akter Published: 2026-08-08Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-08 | cs.CR | ai-safety, cscr, preprint | E7 / R6 (92%) | - |
| Targeted Counterfactual Fingerprinting for Black-Box LLM Ownership Verification Bin Benjamin Zhu, Dongmei Zhang, Jin Xuan, Pingyi Hu Published: 2026-08-08Area: cs.CRCitations: 33 Tags: ai-safety, cscr, preprint | 2026-08-08 | cs.CR | ai-safety, cscr, preprint | E7 / R5 (93%) | 33 |
| SkillsMetric: Mapping the Detection Boundary of Static Analysis for Malicious Agent Skills Chi Zhang, Ping Ji, Xinze Chen, Yimin Liu Published: 2026-08-09Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-09 | cs.CR | ai-safety, cscr, preprint | E9 / R7 (90%) | - |
| ActBench: Self-Evolving Benchmark of Behavioral Safety in Cowork Agents Cong Wang, Hongwei Yao, Jieling Chen, Kui Ren Published: 2026-08-10Area: cs.CRCitations: - Tags: ai-safety, cscr, preprint | 2026-08-10 | cs.CR | ai-safety, cscr, preprint | - | - |
| ColluSkill: Adversarial Cross-Skill Composition for Evading Agent Skill Scanners Jingzhi Li, Ju Jia, Puyu Zeng, Simeng Qin Published: 2026-08-10Area: cs.CRCitations: - Tags: adversarial-robustness, ai-safety, cscr, preprint | 2026-08-10 | cs.CR | adversarial-robustness, ai-safety, cscr, preprint | - | - |