Instant research discovery
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Critic-Free Pretraining for Efficient Online Reinforcement Learning Fine-Tuning Chao Yu, Daoyi Li, Wenbo Ding, Yixian Zhang Published: 2026-08-11Area: cs.LGCitations: - Tags: ai-safety, cslg, preprint | 2026-08-11 | cs.LG | ai-safety, cslg, preprint | E8 / R6 (95%) | - |
| Critic-Free Pretraining for Efficient Online Reinforcement Learning Fine-Tuning Chao Yu, Daoyi Li, Wenbo Ding, Yixian Zhang Published: 2026-08-11Area: cs.LGCitations: - Tags: ai-safety, cslg, preprint | 2026-08-11 | cs.LG | ai-safety, cslg, preprint | E9 / R7 (90%) | - |
| Dynamics Models for Offline Hyperparameter Selection in Real-World RL Adam White, Han Wang, Jordan Coblin, Martha White Published: 2026-08-11Area: cs.LGCitations: - Tags: ai-safety, cslg, preprint | 2026-08-11 | cs.LG | ai-safety, cslg, preprint | - | - |
| Efficient Reinforcement Learning for Long-Horizon Tool-Use Agentic Tasks Amritansh Mishra, Sambit Sahu, William Campbell, Zelei Cheng Published: 2026-08-11Area: cs.LGCitations: 15 Tags: ai-safety, cslg, preprint | 2026-08-11 | cs.LG | ai-safety, cslg, preprint | E8 / R6 (92%) | 15 |
| ELVAE: Evidential Learning-Based Variational Autoencoder for Uncertainty-Aware Generation Ge Wang Published: 2026-08-11Area: cs.LGCitations: - Tags: ai-safety, cslg, preprint | 2026-08-11 | cs.LG | ai-safety, cslg, preprint | E6 / R5 (93%) | - |
| Exploration-Driven Personalized Federated Reinforcement Learning via Intrinsic Motivation Md Rafid Islam, Rafsan Jany, Ratun Rahman, Zahid Hasan Published: 2026-08-11Area: cs.LGCitations: 12 Tags: ai-safety, cslg, preprint | 2026-08-11 | cs.LG | ai-safety, cslg, preprint | E10 / R9 (91%) | 12 |
| Federated Learning for Distributed CNC Tool Wear Prediction Afsana Khan, Anna Wilbik, Charis Kouzinopoulos, Marcin Pietrasik Published: 2026-08-11Area: cs.LGCitations: - Tags: ai-safety, cslg, preprint | 2026-08-11 | cs.LG | ai-safety, cslg, preprint | E10 / R7 (91%) | - |
| HyperFix: Combinatorial Nonlinear Correction for Task Vector Merging Hyo Seo Kim, Ren Wang Published: 2026-08-11Area: cs.LGCitations: - Tags: ai-safety, cslg, preprint | 2026-08-11 | cs.LG | ai-safety, cslg, preprint | - | - |
| Let it Cook: Learning to Wait in Sequential Decision Making Arjun Krishna, Christopher Watson, Dinesh Jayaraman, Rajeev Alur Published: 2026-08-11Area: cs.LGCitations: - Tags: ai-safety, cslg, preprint | 2026-08-11 | cs.LG | ai-safety, cslg, preprint | - | - |
| Optimize Cheap, Deploy Strong: Cost-Aware Cross-Tier Transfer for Evolutionary Optimization Oshri Naparstek, Roi Pony, Tal Oved, Udi barzelay Published: 2026-08-11Area: cs.LGCitations: - Tags: ai-safety, cslg, preprint | 2026-08-11 | cs.LG | ai-safety, cslg, preprint | E14 / R14 (91%) | - |
| PAC-Bayes Beyond Parameter Space: Behavioral Equivalence, Z-Information, and Exact Complexity Decomposition Neil Ashtekar, Satish Kumar Keshri, Vasant G. Honavar, Zehao Liu Published: 2026-08-11Area: cs.LGCitations: - Tags: ai-safety, cslg, preprint | 2026-08-11 | cs.LG | ai-safety, cslg, preprint | - | - |
| ProTAGAD: A Foundation Model for TAG Anomaly Detection with Decoupled Topological and Textual Prototypes Cheng Xie, Liwen Wu, Song Gao, Xin Jin Published: 2026-08-11Area: cs.LGCitations: - Tags: ai-safety, cslg, preprint | 2026-08-11 | cs.LG | ai-safety, cslg, preprint | E11 / R10 (94%) | - |
| Retrieval-Corrected Conformal Prediction for Time Series Junhyeong Lee, Kangmin Kim, Sangjin Jin, Yongjae Lee Published: 2026-08-11Area: cs.LGCitations: 15 Tags: ai-safety, cslg, preprint | 2026-08-11 | cs.LG | ai-safety, cslg, preprint | E17 / R14 (90%) | 15 |
| Robust Multi-Agent Bandits with Heavy-Tailed Rewards and Information Asymmetry Daphne Feng, Lily Jiang, Ricardo Parada, Sophia Yi Published: 2026-08-11Area: cs.LGCitations: - Tags: ai-safety, cslg, preprint | 2026-08-11 | cs.LG | ai-safety, cslg, preprint | E10 / R6 (94%) | - |
| TACTICL: Task-Aware Compression of Tabular ICL Models Katharina Eggensperger, Matthias Feurer, Mykhailo Koshil Published: 2026-08-11Area: cs.LGCitations: 47 Tags: ai-safety, cslg, preprint | 2026-08-11 | cs.LG | ai-safety, cslg, preprint | E9 / R6 (90%) | 47 |
| Terminal Symmetry as a Decision Resource: Statewise Refinement for Anytime Verified Construction Yi Liu Published: 2026-08-11Area: cs.LGCitations: - Tags: ai-safety, cslg, preprint | 2026-08-11 | cs.LG | ai-safety, cslg, preprint | - | - |
| Two-stage Odd Residual Flows for Mean-Preserving Probabilistic Time Series Forecasting Christian Kl枚tergens, Kiran Madhusudhanan, Lars Schmidt-Thieme, Vijaya Krishna Yalavarthi Published: 2026-08-11Area: cs.LGCitations: 15 Tags: ai-safety, cslg, preprint | 2026-08-11 | cs.LG | ai-safety, cslg, preprint | E10 / R7 (90%) | 15 |
| Your LLM, Your Style: Behavioral Mode Axes for LLM Behavioral Control Guanchu Wang, Haiying Xu, Haoze Liu, Huiqi Deng Published: 2026-08-11Area: cs.LGCitations: - Tags: ai-safety, cslg, preprint | 2026-08-11 | cs.LG | ai-safety, cslg, preprint | E12 / R10 (94%) | - |
| Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training Daoyuan Chen, Qianli Shen, Ting Zhou, Yaliang Li Published: 2026-08-10Area: cs.LGCitations: - Tags: ai-safety, cslg, preprint | 2026-08-10 | cs.LG | ai-safety, cslg, preprint | - | - |
| Confusion-Geometry Rebalancing for Long-Tailed Adversarial Training Geyong Min, Jie Cui, Lihe Zhang, Mengnan Zhao Published: 2026-08-10Area: cs.LGCitations: - Tags: adversarial-robustness, ai-safety, cslg, preprint | 2026-08-10 | cs.LG | adversarial-robustness, ai-safety, cslg, preprint | - | - |
| Distill Skills into Weights, Not Prompts: Abstract Skills as Privileged Signals for On-Policy Self-Distillation Fengying Xie, Haopeng Zhang, Yubo Jiang, Zhiguo Jiang Published: 2026-08-10Area: cs.LGCitations: - Tags: ai-safety, cslg, preprint | 2026-08-10 | cs.LG | ai-safety, cslg, preprint | - | - |
| DOCSCHISEL: Adaptive Tool Documentation Optimization Framework for LLM Agents Bihuan Chen, Kun Zhang, Xin Peng, You Lu Published: 2026-08-10Area: cs.LGCitations: 60 Tags: ai-safety, cslg, preprint | 2026-08-10 | cs.LG | ai-safety, cslg, preprint | E10 / R7 (91%) | 60 |
| Dual-Adversarial Safety Alignment: Cultivating Intrinsic Threat Comprehension in LRMs Di Wang, Hongli Shen, Jian Li, Qinbo Zhang Published: 2026-08-10Area: cs.LGCitations: - Tags: adversarial-robustness, ai-safety, alignment-training, cslg, preprint | 2026-08-10 | cs.LG | adversarial-robustness, ai-safety, alignment-training, cslg, preprint | - | - |
| ELMER: Evolutionary Language Model that Explores and Refines Ahmed Khalifa, Julian Togelius, Matthew Siper Published: 2026-08-10Area: cs.LGCitations: 25 Tags: ai-safety, cslg, preprint | 2026-08-10 | cs.LG | ai-safety, cslg, preprint | E8 / R7 (91%) | 25 |
| Evaluating Generative Time-Series Models on Data with Point Masses Jian Xu Published: 2026-08-10Area: cs.LGCitations: - Tags: ai-safety, cslg, preprint | 2026-08-10 | cs.LG | ai-safety, cslg, preprint | - | - |
| FedA2L: Adaptive layer-wise learning rate adjustment in decentralized federated learning Khoa Nguyen, Taehong Kim, Van Truong Vo Published: 2026-08-10Area: cs.LGCitations: - Tags: ai-safety, cslg, preprint | 2026-08-10 | cs.LG | ai-safety, cslg, preprint | - | - |
| FedTVD: Balancing Data Quality and Quantity for Robust Federated Learning Majid Kundroo, Radwan Selo, Taehong Kim Published: 2026-08-10Area: cs.LGCitations: - Tags: ai-safety, cslg, preprint | 2026-08-10 | cs.LG | ai-safety, cslg, preprint | - | - |
| Finding the Signal in the Spam: Jointly Learning Rewards and Worker Reliability from Pairwise Comparisons Arpit Agarwal, Avishek Ghosh, Kaustubh Shivshankar Shejole, Tanish Agarwal Published: 2026-08-10Area: cs.LGCitations: - Tags: ai-safety, cslg, preprint | 2026-08-10 | cs.LG | ai-safety, cslg, preprint | E12 / R9 (94%) | - |
| From Prediction to Incrementality: Causal Optimization for Large-Scale Targeting and Recommendation Andre Assuncao Silva T Ribeiro, Benjamin Zelditch, Changshuai Wei, John Bencina Published: 2026-08-10Area: cs.LGCitations: - Tags: ai-safety, cslg, preprint | 2026-08-10 | cs.LG | ai-safety, cslg, preprint | E8 / R6 (91%) | - |
| How Simple Can It Get? From Interpretable Equations to Readable Rules for Financial Decision Making Adia Lumadjeng, Erman Acar, Ilker Birbil Published: 2026-08-10Area: cs.LGCitations: - Tags: ai-safety, cslg, preprint | 2026-08-10 | cs.LG | ai-safety, cslg, preprint | - | - |