Instant research discovery
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Transplanting, inverting, and preventing a misalignment persona: method-conditional emergent misalignment in Qwen2.5 Lyndon Drake, Zandi Eberstadt Published: 2026-07-05Area: cs.CLCitations: - Tags: ai-safety, alignment-training, cscl, preprint | 2026-07-05 | cs.CL | ai-safety, alignment-training, cscl, preprint | E8 / R6 (95%) | - |
| Turning Off-Policy Tokens On-Policy: A Plug-in Approach for Improving LLM Alignment Jiaxing Wang, Mingyang Yi, Xiuyu Li, Yu Li Published: 2026-07-06Area: cs.CLCitations: - Tags: ai-safety, alignment-training, cscl, preprint | 2026-07-06 | cs.CL | ai-safety, alignment-training, cscl, preprint | E12 / R10 (88%) | - |
| Bridging Physical Reasoning and Task Generalization via Visual Action Outcome Reasoning Alignment Han-Jun Ko, Haobo Yuan, Hsin-Ying Lee, Jr-Jen Chen Published: 2026-07-07Area: cs.AICitations: - Tags: ai-safety, alignment-training, csai, preprint | 2026-07-07 | cs.AI | ai-safety, alignment-training, csai, preprint | E11 / R11 (95%) | - |
| Gradient-Based Speech-to-Text Alignment for Any ASR Model: From CTC to Speech LLMs Albert Zeyer, Hermann Ney, Ralf Schl眉ter Published: 2026-07-07Area: cs.CLCitations: - Tags: ai-safety, alignment-training, cscl, preprint | 2026-07-07 | cs.CL | ai-safety, alignment-training, cscl, preprint | E10 / R10 (96%) | - |
| Alignment Plausibility: A New Standard for Assuring AI in Healthcare Bilal A Mateen, Gwydion Williams, Sara Zannone Published: 2026-07-08Area: cs.AICitations: 62 Tags: ai-safety, alignment-training, csai, preprint | 2026-07-08 | cs.AI | ai-safety, alignment-training, csai, preprint | E8 / R9 (92%) | 62 |
| Efficient Safety Alignment of Language Models via Latent Personality Traits Adam Oberman, Damiano Fornasiere, David Williams-King, Linh Le Published: 2026-07-08Area: cs.LGCitations: - Tags: ai-safety, alignment-training, cslg, preprint | 2026-07-08 | cs.LG | ai-safety, alignment-training, cslg, preprint | E10 / R8 (93%) | - |
| Feedback Manipulation Regularization: Enabling Offline Agent Alignment for Imitation Learning Benjamin Poole, Minwoo Lee Published: 2026-07-08Area: cs.AICitations: - Tags: ai-safety, alignment-training, csai, preprint | 2026-07-08 | cs.AI | ai-safety, alignment-training, csai, preprint | E11 / R10 (90%) | - |
| Aleena: Alignment Agent for Research Software Engineering Collaborations Anant Mittal, Anshul Tambay, Carlos Garcia Jurado Suarez, Cordero Core Published: 2026-07-09Area: cs.SECitations: - Tags: ai-safety, alignment-training, csse, preprint | 2026-07-09 | cs.SE | ai-safety, alignment-training, csse, preprint | E18 / R15 (90%) | - |
| Best-of-$N$ TTS Evaluation is Confounded by ASR Family Alignment Seongjae Kang, Taehyung Yu Published: 2026-07-09Area: cs.CLCitations: - Tags: ai-safety, alignment-training, cscl, preprint, safety-evaluation | 2026-07-09 | cs.CL | ai-safety, alignment-training, cscl, preprint, safety-evaluation | E9 / R6 (94%) | - |
| Large-Language-Models-as-a-Judge in Theory-Agnostic Adaptive Metric-Alignment for Prototypical Networks in Personality Recognition Anissa Mokraoui, Ban-Hoe Kwan, Danny Wee-Kiat Ng, Jing Jie Tan Published: 2026-07-09Area: cs.CLCitations: - Tags: ai-safety, alignment-training, cscl, preprint | 2026-07-09 | cs.CL | ai-safety, alignment-training, cscl, preprint | E14 / R13 (89%) | - |
| PLURAL: A Global Dataset for Value Alignment Aditya Vashistha, Anya Shukla, Dhruv Agarwal, Tanya Goyal Published: 2026-07-09Area: cs.CLCitations: - Tags: ai-safety, alignment-training, cscl, preprint | 2026-07-09 | cs.CL | ai-safety, alignment-training, cscl, preprint | E12 / R10 (92%) | - |
| Geopolitical alignment: Endorsement effects in large language models Maxim Chupilkin Published: 2026-07-10Area: cs.CYCitations: - Tags: ai-safety, alignment-training, cscy, preprint | 2026-07-10 | cs.CY | ai-safety, alignment-training, cscy, preprint | E12 / R12 (90%) | - |
| SMETA-ZSL:Semantic Meta-Alignment for Zero-Shot Threat Classification Anantaa Kotal, Aritran Piplai, Ivan Alejandro Montoya Sanchez Published: 2026-07-10Area: cs.LGCitations: - Tags: ai-safety, alignment-training, cslg, preprint | 2026-07-10 | cs.LG | ai-safety, alignment-training, cslg, preprint | E23 / R24 (93%) | - |
| ANCHOR: Automated Alignment Auditing for CLI Agents on Real-World Harm Kefan Song, Yanjun Qi Published: 2026-07-11Area: cs.AICitations: 12 Tags: ai-safety, alignment-training, csai, preprint | 2026-07-11 | cs.AI | ai-safety, alignment-training, csai, preprint | E10 / R6 (91%) | 12 |
| Cross-Layer Misalignment Detection in Agent Skills: A Progressive Loading-Aware Contrastive Learning Approach Chengjun Zhang, Jianna Hur, Jingjing Zhang, Sagar Samtani Published: 2026-07-12Area: cs.AICitations: - Tags: ai-safety, alignment-training, csai, preprint | 2026-07-12 | cs.AI | ai-safety, alignment-training, csai, preprint | E5 / R6 (90%) | - |
| Toward Contemplative LLM: A Modular Framework for Evaluating and Enhancing LLM Alignment in Mental Health Asher Sprigler, David Kinney, Iftach Amir, Jonathan E. Bogard Published: 2026-07-12Area: cs.AICitations: 13 Tags: ai-safety, alignment-training, csai, preprint | 2026-07-12 | cs.AI | ai-safety, alignment-training, csai, preprint | E13 / R9 (92%) | 13 |
| Forgetting Our Way to Shared Meaning: Effects of Forgetting on Conceptual Alignment in a Non-Partnership Coordination Game Alan Tsang, Landon Liu, Mary Kelly Published: 2026-07-13Area: cs.MACitations: - Tags: ai-safety, alignment-training, csma, preprint | 2026-07-13 | cs.MA | ai-safety, alignment-training, csma, preprint | E10 / R6 (90%) | - |
| The Refusal Residue: When Probes Catch Alignment Faking and When They Don't Aman Mehta Published: 2026-07-15Area: cs.CRCitations: 1 Tags: ai-safety, alignment-training, cscr, preprint | 2026-07-15 | cs.CR | ai-safety, alignment-training, cscr, preprint | E8 / R6 (92%) | 1 |
| ToolAlignBench: Investigating Alignment Conflicts in Tool-Calling Enabled LLMs Amrita Bhattacharjee, Aryan Keluskar, Huan Liu Published: 2026-07-15Area: cs.SECitations: - Tags: ai-safety, alignment-training, csse, preprint | 2026-07-15 | cs.SE | ai-safety, alignment-training, csse, preprint | E8 / R6 (94%) | - |
| Stop Thinking, Start Looking: Efficient Post-Training for Multimodal Document Question Answering via Reasoning-Free Alignment Ganesh Parab, Goutham Vignesh, Harikrishnan P M, Rohit Agrawal Published: 2026-07-16Area: cs.AICitations: - Tags: ai-safety, alignment-training, csai, preprint | 2026-07-16 | cs.AI | ai-safety, alignment-training, csai, preprint | E9 / R9 (91%) | - |
| Symbal: Detecting Systematic Misalignments in Model-Generated Captions Akshay Chaudhari, Curtis Langlotz, Jean-Benoit Delbrouck, Maya Varma Published: 2026-07-16Area: cs.CVCitations: - Tags: ai-safety, alignment-training, cscv, preprint | 2026-07-16 | cs.CV | ai-safety, alignment-training, cscv, preprint | E9 / R9 (94%) | - |
| Debiasing Text-to-Image Evaluation via Implicit Cultural Alignment Reward Modeling Bo-An Chang, Yu-Chih Chen Published: 2026-07-17Area: cs.CVCitations: 34 Tags: ai-safety, alignment-training, cscv, preprint, safety-evaluation | 2026-07-17 | cs.CV | ai-safety, alignment-training, cscv, preprint, safety-evaluation | E12 / R12 (91%) | 34 |
| Interactive Task Alignment as a POMDP Alex Pentland, Andy Dai, Jiaxin Pei, Zexue He Published: 2026-07-17Area: cs.AICitations: - Tags: ai-safety, alignment-training, csai, preprint | 2026-07-17 | cs.AI | ai-safety, alignment-training, csai, preprint | E10 / R7 (92%) | - |
| A Research Prototype for Closed-Loop Generative Design of Customized Foot Orthoses via Semantic-Physics Alignment Byungwon Min, Rui Wang, Suxing Liu Published: 2026-07-18Area: cs.AICitations: 45 Tags: ai-safety, alignment-training, csai, preprint | 2026-07-18 | cs.AI | ai-safety, alignment-training, csai, preprint | E9 / R7 (92%) | 45 |
| Alignment of a Total Automation Economy David McAllester Published: 2026-07-19Area: physics.soc-phCitations: 5 Tags: ai-safety, alignment-training, physicssoc-ph, preprint | 2026-07-19 | physics.soc-ph | ai-safety, alignment-training, physicssoc-ph, preprint | E16 / R15 (91%) | 5 |
| Alignment of a Total Automation Economy David McAllester Published: 2026-07-19Area: physics.soc-phCitations: 5 Tags: ai-safety, alignment-training, physicssoc-ph, preprint | 2026-07-19 | physics.soc-ph | ai-safety, alignment-training, physicssoc-ph, preprint | E7 / R5 (91%) | 5 |
| Is Your Model Thinking or Just Stagnating? PUMA: Diagnosing Reasoning Pathology via Phase-Momentum Alignment Cheng Yan, Fan Xu, Guangyang Ye, Wuyang Zhang Published: 2026-07-19Area: cs.AICitations: - Tags: ai-safety, alignment-training, csai, preprint | 2026-07-19 | cs.AI | ai-safety, alignment-training, csai, preprint | E10 / R9 (90%) | - |
| STAR: Skeletal Token Alignment and Rearrangement for Interaction Recognition Beichen Ding, Junsong Yuan, Mengyuan Liu, Sirui Li Published: 2026-07-19Area: cs.CVCitations: - Tags: ai-safety, alignment-training, cscv, preprint | 2026-07-19 | cs.CV | ai-safety, alignment-training, cscv, preprint | E10 / R10 (93%) | - |
| Toward Anthropomorphic Dialogue: A Closed-Loop Framework for Human-Like Chat Generation, Evaluation, and Preference Alignment Ji Wang, Min Ji, Siyu Song, Wentao Liu Published: 2026-07-19Area: cs.AICitations: - Tags: ai-safety, alignment-training, csai, preprint, safety-evaluation | 2026-07-19 | cs.AI | ai-safety, alignment-training, csai, preprint, safety-evaluation | E8 / R6 (91%) | - |
| Toward Anthropomorphic Dialogue: A Closed-Loop Framework for Human-Like Chat Generation, Evaluation, and Preference Alignment Ji Wang, Min Ji, Siyu Song, Wentao Liu Published: 2026-07-19Area: cs.AICitations: - Tags: ai-safety, alignment-training, csai, preprint, safety-evaluation | 2026-07-19 | cs.AI | ai-safety, alignment-training, csai, preprint, safety-evaluation | E10 / R8 (90%) | - |