Instant research discovery
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Showing 181-194 of 194 papers (page 7 of 7)路 37 ms
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Agentic Uncertainty Reveals Agentic Overconfidence Gb猫tondji Dovonon, Jean Kaddour, Leo Richter, Matt J. Kusner Published: 2026-02-06Area: Agent SafetyCitations: - Tags: adversarial-robustness, agent-safety, ai-safety, empirical | 2026-02-06 | Agent Safety | adversarial-robustness, agent-safety, ai-safety, empirical | E5 / R3 (96%) | - |
| TrajAD: Trajectory Anomaly Detection for Trustworthy LLM Agents Chong Zhang, Hansong Liu, Xiaoyan Wang, Yang Yu Published: 2026-02-06Area: Agent SafetyCitations: - Tags: agent-safety, ai-safety, empirical | 2026-02-06 | Agent Safety | agent-safety, ai-safety, empirical | E5 / R3 (96%) | - |
| AgentSys: Secure and Dynamic LLM Agents Through Explicit Hierarchical Memory Management Chaowei Xiao, Hao Li, Ning Zhang, Ruoyao Wen Published: 2026-02-07Area: Agent SafetyCitations: - Tags: agent-safety, ai-safety, empirical | 2026-02-07 | Agent Safety | agent-safety, ai-safety, empirical | E5 / R3 (96%) | - |
| A Behavioural and Representational Evaluation of Goal-Directedness in Language Model Agents Angelos Nalmpantis, Calum McNamara, Evgenii Kortukov, Fade Chen Published: 2026-02-09Area: Agent SafetyCitations: - Tags: agent-safety, ai-safety, empirical, safety-evaluation | 2026-02-09 | Agent Safety | agent-safety, ai-safety, empirical, safety-evaluation | E4 / R3 (94%) | - |
| When Actions Go Off-Task: Detecting and Correcting Misaligned Actions in Computer-Use Agents Chentao Ye, Huan Sun, Jaylen Jones, Junyi Li Published: 2026-02-09Area: Agent SafetyCitations: - Tags: agent-safety, ai-safety, benchmark | 2026-02-09 | Agent Safety | agent-safety, ai-safety, benchmark | E6 / R3 (94%) | - |
| The Devil Behind Moltbook: Anthropic Safety is Always Vanishing in Self-Evolving AI Societies Chaozhuo Li, Chenxu Wang, Jinyu Hou, Ji Qi Published: 2026-02-10Area: Agent SafetyCitations: - Tags: agent-safety, ai-safety, alignment-training, empirical | 2026-02-10 | Agent Safety | agent-safety, ai-safety, alignment-training, empirical | E4 / R3 (95%) | - |
| Trustworthy Agentic AI Requires Deterministic Architectural Boundaries Manish Bhattarai, Minh Vu Published: 2026-02-10Area: Agent SafetyCitations: - Tags: agent-safety, ai-safety, alignment-training, theoretical | 2026-02-10 | Agent Safety | agent-safety, ai-safety, alignment-training, theoretical | E5 / R4 (97%) | - |
| Authenticated Workflows: A Systems Approach to Protecting Agentic AI Mohan Rajagopalan, Vinay Rao Published: 2026-02-11Area: Agent SafetyCitations: - Tags: agent-safety, ai-safety, theoretical | 2026-02-11 | Agent Safety | agent-safety, ai-safety, theoretical | E5 / R4 (96%) | - |
| AgentLeak: A Full-Stack Benchmark for Privacy Leakage in Multi-Agent LLM Systems Faouzi El Yagoubi, Godwin Badu-Marfo, Ranwa Al Mallah Published: 2026-02-12Area: Agent SafetyCitations: - Tags: agent-safety, ai-safety, benchmark | 2026-02-12 | Agent Safety | agent-safety, ai-safety, benchmark | E5 / R3 (95%) | - |
| AIR: Improving Agent Safety through Incident Response Junjie Chen, Jun Sun, Zibo Xiao Published: 2026-02-12Area: Agent SafetyCitations: - Tags: agent-safety, ai-safety, empirical | 2026-02-12 | Agent Safety | agent-safety, ai-safety, empirical | E5 / R3 (95%) | - |
| Aversion to external feedback suffices to ensure agent alignment Paulo Garcia Published: -Area: Agent SafetyCitations: 1 Tags: agent-safety, ai-safety, alignment-training, theoretical | - | Agent Safety | agent-safety, ai-safety, alignment-training, theoretical | E5 / R3 (93%) | 1 |
| ControlArena: A Library for Running AI Control Experiments Adam Hanson, Alan Cooney, Arathi Mani, Asa Cooper Stickland Published: -Area: Agent SafetyCitations: - Tags: agent-safety, ai-safety, tool | - | Agent Safety | agent-safety, ai-safety, tool | E5 / R3 (98%) | - |
| Security Debt in LLM Agent Applications: A Measurement Study of Vulnerabilities and Mitigation Trade-offs Jiarun Dai, Min Yang, Yuan Zhang, Zhuoxiang Shen Published: -Area: Agent SafetyCitations: - Tags: agent-safety, ai-safety, empirical | - | Agent Safety | agent-safety, ai-safety, empirical | E4 / R3 (98%) | - |
| Toward Constitutional Autonomy in AI Systems: A Theoretical Framework for Aligned Agentic Intelligence William Torgbi Agbemabiese Published: -Area: Agent SafetyCitations: 1 Tags: agent-safety, ai-safety, alignment-training, theoretical | - | Agent Safety | agent-safety, ai-safety, alignment-training, theoretical | E4 / R3 (93%) | 1 |