Instant research discovery
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| ARAC: Benchmarking Auto-Research's Alignment and Completeness on End-to-End Researchs Jiafei Wu, Jiale Cui, Kaixi Zhong, Xiaogang Xu Published: 2026-08-13Area: cs.AICitations: 36 Tags: ai-safety, alignment-training, csai, preprint | 2026-08-13 | cs.AI | ai-safety, alignment-training, csai, preprint | E14 / R13 (90%) | 36 |
| Behavioral Reprogramming of Open-Weights Models: Cognitive Plasticity and Alignment Bounds Lucia Mal铆膷kov谩 Published: 2026-08-13Area: cs.AICitations: - Tags: ai-safety, alignment-training, csai, preprint | 2026-08-13 | cs.AI | ai-safety, alignment-training, csai, preprint | E8 / R5 (93%) | - |
| StateBridge: Training-free Hidden-state Alignment for Latent Communication in LLM Multi-Agent Systems Delvin Ce Zhang, Nikolaos Aletras, Xi Wang, Yanwen Peng Published: 2026-08-13Area: cs.AICitations: 42 Tags: ai-safety, alignment-training, csai, preprint | 2026-08-13 | cs.AI | ai-safety, alignment-training, csai, preprint | E16 / R17 (92%) | 42 |
| Synthetic Persona Pretraining: Alignment from Token Zero Andy Arditi, Ashton Anderson, Difan Jiao, Harsh Raj Published: 2026-08-13Area: cs.LGCitations: - Tags: ai-safety, alignment-training, cslg, preprint | 2026-08-13 | cs.LG | ai-safety, alignment-training, cslg, preprint | E7 / R7 (91%) | - |
| Generative Semantic Segmentation via an Observable Semantic-Image Interface and Hierarchical Generator Evidence Alignment Weize Cai, Yongqi Dong, Zhida Shao, Zixin Fu Published: 2026-08-12Area: cs.CVCitations: - Tags: ai-safety, alignment-training, cscv, preprint | 2026-08-12 | cs.CV | ai-safety, alignment-training, cscv, preprint | - | - |
| How China-Origin Vision-Language Models Move from Refusal to Reframing in State Alignment Alex Wang, Amir Ghasemian, Fengchen Liu, Guang Yang Published: 2026-08-12Area: cs.CRCitations: - Tags: ai-safety, alignment-training, cscr, preprint | 2026-08-12 | cs.CR | ai-safety, alignment-training, cscr, preprint | - | - |
| Instruction Alignment for Binary Code Representation Learning Huaijin Wang, Shuai Wang Published: 2026-08-12Area: cs.SECitations: - Tags: ai-safety, alignment-training, csse, preprint | 2026-08-12 | cs.SE | ai-safety, alignment-training, csse, preprint | - | - |
| Localizing Safety Alignment: MLP Layers and Mid-Network Blocks Encode Refusal Behavior in Large Language Models Bhaskar Krishnamachari, Mingyu Zong, Sampad Mohanty Published: 2026-08-12Area: cs.AICitations: - Tags: ai-safety, alignment-training, csai, preprint | 2026-08-12 | cs.AI | ai-safety, alignment-training, csai, preprint | - | - |
| From Prompting to Behavioral Alignment: Personalized LLM Judges for Recommendation Evaluation Alireza S. Ziabari, Colleen Chan, Ding Tong, Kat Ellis Published: 2026-08-11Area: cs.AICitations: - Tags: ai-safety, alignment-training, csai, preprint, safety-evaluation | 2026-08-11 | cs.AI | ai-safety, alignment-training, csai, preprint, safety-evaluation | - | - |
| CIDER: A Dataset of Contextual Disclosure Boundaries for Privacy Preference Alignment Bingcan Guo, Eryue Xu, Jijie Zhou, Tianshi Li Published: 2026-08-10Area: cs.AICitations: - Tags: ai-safety, alignment-training, csai, preprint | 2026-08-10 | cs.AI | ai-safety, alignment-training, csai, preprint | E8 / R6 (90%) | - |
| CIDER: A Dataset of Contextual Disclosure Boundaries for Privacy Preference Alignment Bingcan Guo, Eryue Xu, Jijie Zhou, Tianshi Li Published: 2026-08-10Area: cs.AICitations: - Tags: ai-safety, alignment-training, csai, preprint | 2026-08-10 | cs.AI | ai-safety, alignment-training, csai, preprint | - | - |
| Dual-Adversarial Safety Alignment: Cultivating Intrinsic Threat Comprehension in LRMs Di Wang, Hongli Shen, Jian Li, Qinbo Zhang Published: 2026-08-10Area: cs.LGCitations: - Tags: adversarial-robustness, ai-safety, alignment-training, cslg, preprint | 2026-08-10 | cs.LG | adversarial-robustness, ai-safety, alignment-training, cslg, preprint | - | - |
| GRASP: Granularity-Aware Region Alignment and Semantic Prototype Learning for Fine-Grained Cross-Modal Understanding in Drone Views Enze Zhu, Jiahui Cui, Kan Wei, Lei Wang Published: 2026-08-10Area: cs.CVCitations: - Tags: ai-safety, alignment-training, cscv, preprint | 2026-08-10 | cs.CV | ai-safety, alignment-training, cscv, preprint | - | - |
| Toward a Theory of Value in AI Alignment Abeba Birhane, Andrew Smart, Jackie Kay, Jimmy Tobin Published: 2026-08-10Area: cs.AICitations: - Tags: ai-safety, alignment-training, csai, preprint | 2026-08-10 | cs.AI | ai-safety, alignment-training, csai, preprint | E10 / R7 (87%) | - |
| DoGMA: A Central-Dogma-Guided Foundation Model for Multi-Omics Alignment and Multi-Task Learning in Oncology Bangzheng Pu, Bingsen Xue, Cheng Jin, Junfei Ling Published: 2026-08-08Area: cs.LGCitations: - Tags: ai-safety, alignment-training, cslg, preprint | 2026-08-08 | cs.LG | ai-safety, alignment-training, cslg, preprint | E15 / R12 (91%) | - |
| Harmful Content Is Not Enough: Continuation Framing Moderates In-Context Emergent Misalignment Di Liang, Peiyang Liu, Wei Ye, Xi Wang Published: 2026-08-08Area: cs.AICitations: - Tags: ai-safety, alignment-training, csai, preprint | 2026-08-08 | cs.AI | ai-safety, alignment-training, csai, preprint | E9 / R6 (92%) | - |
| Illusion of Alignment: Detecting Hidden Disagreement in Collaborative Dialogue Fuwen Luo, Jinrui Ju, Kaiming Liu, Peng Li Published: 2026-08-08Area: cs.AICitations: - Tags: ai-safety, alignment-training, csai, preprint | 2026-08-08 | cs.AI | ai-safety, alignment-training, csai, preprint | E7 / R5 (92%) | - |
| REIN: Bridging the Gap between Reasoning and Reliability via Reflection and Abstention Alignment Di Hong, Luyang Yu, Tianhang Zheng, Wanyu Lin Published: 2026-08-08Area: cs.AICitations: - Tags: ai-safety, alignment-training, csai, preprint | 2026-08-08 | cs.AI | ai-safety, alignment-training, csai, preprint | E13 / R11 (91%) | - |
| Contextual Value Alignment via Multilayer Combinatorial Fusion D. Frank Hsu, Djallel Bouneffouf, Yuanhong Wu Published: 2026-08-07Area: cs.AICitations: - Tags: ai-safety, alignment-training, csai, preprint | 2026-08-07 | cs.AI | ai-safety, alignment-training, csai, preprint | E15 / R17 (89%) | - |
| MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents Chenghao Liu, Songfang Huang, Tinghong Ye, Yizhuo Li Published: 2026-08-07Area: cs.AICitations: - Tags: ai-safety, alignment-training, csai, preprint | 2026-08-07 | cs.AI | ai-safety, alignment-training, csai, preprint | E7 / R5 (91%) | - |
| People Are Not Just Their Countries. Disentangling Social Determinants of LLM Value Alignment Across Europe Guillaume Bied, Maria-Louisa Wightman, Tijl De Bie Published: 2026-08-07Area: cs.AICitations: - Tags: ai-safety, alignment-training, csai, preprint | 2026-08-07 | cs.AI | ai-safety, alignment-training, csai, preprint | - | - |
| Progressive Alignment of Recommender Foundation Model through Multi-Phase Post-Training Byungsoo Kang, Hoeinn Kim, Jihoon Lee, Oseong Choi Published: 2026-08-07Area: cs.IRCitations: 15 Tags: ai-safety, alignment-training, csir, preprint | 2026-08-07 | cs.IR | ai-safety, alignment-training, csir, preprint | E9 / R7 (94%) | 15 |
| Representation-driven Endoscopic Visual Embedding Alignment for Latent Generation Albert J. de Groof, Floor Slooter, Fons van der Sommen, Francisco Caetano Published: 2026-08-07Area: cs.CVCitations: - Tags: ai-safety, alignment-training, cscv, preprint | 2026-08-07 | cs.CV | ai-safety, alignment-training, cscv, preprint | - | - |
| SkillConsist: Detecting Inconsistencies in Agent Skills via Bidirectional Graph Alignment Chaofan Meng, Sihan Xu, Yingnan Zhou, Yuhang Zheng Published: 2026-08-07Area: cs.LGCitations: - Tags: ai-safety, alignment-training, cslg, preprint | 2026-08-07 | cs.LG | ai-safety, alignment-training, cslg, preprint | E10 / R8 (91%) | - |
| DistMedVL: Distributional Vision-Language Alignment for Uncertainty-Aware Medical Image Segmentation Daokun Zhang, Fiseha B. Tesema, Jiaxuan Li, Qing Xu Published: 2026-08-06Area: cs.CVCitations: - Tags: ai-safety, alignment-training, cscv, preprint | 2026-08-06 | cs.CV | ai-safety, alignment-training, cscv, preprint | E9 / R8 (93%) | - |
| Temporal Bridges for Spatial Resolution: Enhancing Climate Data Super-Resolution with Bidirectional Alignment Congxi Xiao, Jingbo Zhou, Yichen Zhang, Yixiong Xiao Published: 2026-08-06Area: cs.AICitations: 15 Tags: ai-safety, alignment-training, csai, preprint | 2026-08-06 | cs.AI | ai-safety, alignment-training, csai, preprint | E10 / R9 (91%) | 15 |
| EndoVLM: An Endoscopy Vision-Language Pre-training Model via Anatomy-Guided Sparsity and Progressive Alignment Bin Lv, Jianwei Xu, Liang Huang, Ling Zhang Published: 2026-08-05Area: cs.CVCitations: - Tags: ai-safety, alignment-training, cscv, preprint | 2026-08-05 | cs.CV | ai-safety, alignment-training, cscv, preprint | - | - |
| Policy Fragmentation or Institutional Alignment? Institutional Governance of AI in Universities and Business Schools Dominique Outlaw, Lydia Manikonda Published: 2026-08-04Area: cs.AICitations: - Tags: ai-safety, alignment-training, csai, preprint | 2026-08-04 | cs.AI | ai-safety, alignment-training, csai, preprint | - | - |
| The Evolutionary Origin of Values: implications for AI alignment, sentience and existential risk Francis Heylighen Published: 2026-08-04Area: cs.CYCitations: - Tags: ai-safety, alignment-training, cscy, preprint | 2026-08-04 | cs.CY | ai-safety, alignment-training, cscy, preprint | - | - |
| A Blind Spot in Alignment: Quantifying Biosecurity Risks in Large Language Models Boyuan Chen, Donghai Hong, He Geng, Jiaming Ji Published: 2026-08-03Area: q-bio.QMCitations: 15 Tags: ai-safety, alignment-training, preprint, q-bioqm | 2026-08-03 | q-bio.QM | ai-safety, alignment-training, preprint, q-bioqm | E12 / R9 (93%) | 15 |