Instant research discovery
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Showing 1-30 of 261 papers (page 1 of 9)路 303 ms
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| MAEB: Massive Audio Embedding Benchmark Aditya Shrivastava, Adnan El Assadi, Alan Xiao, Ali Sartaz Khan Published: 2026-02-17Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-02-17 | cs.SD | ai-safety, cssd, preprint | E12 / R9 (93%) | - |
| The Equalizer: Introducing Shape-Gain Decomposition in Neural Audio Codecs Laurent Girin, Samir Sadok, Xavier Alameda-Pineda Published: 2026-02-17Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-02-17 | cs.SD | ai-safety, cssd, preprint | E10 / R9 (92%) | - |
| Spatial Audio Question Answering and Reasoning on Dynamic Source Movements Arvind Krishna Sridhar, Erik Visser, Yinyi Guo Published: 2026-02-18Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-02-18 | cs.SD | ai-safety, cssd, preprint | E9 / R6 (90%) | - |
| Fairness-Aware Partial-label Domain Adaptation for Voice Classification of Parkinson's and ALS Arianna Francesconi, Arthur Stefano Moscheni, Donato Cappetta, Fabio Rebecchi Published: 2026-02-20Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-02-20 | cs.SD | ai-safety, cssd, preprint | E11 / R11 (93%) | - |
| MeanVoiceFlow: One-step Nonparallel Voice Conversion with Mean Flows Hirokazu Kameoka, Kou Tanaka, Takuhiro Kaneko, Yuto Kondo Published: 2026-02-20Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-02-20 | cs.SD | ai-safety, cssd, preprint | E15 / R12 (90%) | - |
| Continuous Telemonitoring of Heart Failure using Personalised Speech Dynamics Changxin Li, Gang Yang, Hanyue Zhang, Liwei Liu Published: 2026-02-23Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-02-23 | cs.SD | ai-safety, cssd, preprint | E10 / R7 (92%) | - |
| Depth-Structured Music Recurrence: Budgeted Recurrent Attention for Full-Piece Symbolic Music Modeling Catherine Shi, Matthew Kuo, Quan Bai, Weihua Li Published: 2026-02-23Area: cs.SDCitations: 45 Tags: ai-safety, cssd, preprint | 2026-02-23 | cs.SD | ai-safety, cssd, preprint | E6 / R5 (91%) | 45 |
| StyleStream: Real-Time Zero-Shot Voice Style Conversion Gopala Anumanchipalli, Nicholas Lee, Yisi Liu Published: 2026-02-23Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-02-23 | cs.SD | ai-safety, cssd, preprint | E10 / R8 (91%) | - |
| Voices of the Mountains: Deep Learning-Based Vocal Error Detection System for Kurdish Maqams Darvan Shvan Khairaldeen, Hossein Hassani Published: 2026-02-24Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-02-24 | cs.SD | ai-safety, cssd, preprint | E9 / R6 (92%) | - |
| Evaluation of Audio Language Models for Fairness, Safety, and Security Battista Biggio, Lea Sch枚nherr, Ranya Aloufi, Soumya Shaw Published: 2026-02-25Area: cs.SDCitations: 15 Tags: ai-safety, cssd, preprint, safety-evaluation | 2026-02-25 | cs.SD | ai-safety, cssd, preprint, safety-evaluation | E14 / R13 (90%) | 15 |
| UniWhisper: Efficient Continual Multi-task Training for Robust Universal Audio Representation Haoyuan Yu, Junzi Zhang, Peize He, Yuxuan Chen Published: 2026-02-25Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-02-25 | cs.SD | ai-safety, cssd, preprint | E12 / R13 (91%) | - |
| A Holistic Framework for Robust Bangla ASR and Speaker Diarization with Optimized VAD and CTC Alignment Md. Ishtiak Moin, Shafnan Wasif, Zarif Ishmam, Zarif Mahir Published: 2026-02-26Area: cs.SDCitations: 14 Tags: ai-safety, alignment-training, cssd, preprint | 2026-02-26 | cs.SD | ai-safety, alignment-training, cssd, preprint | E11 / R7 (91%) | 14 |
| Make It Hard to Hear, Easy to Learn: Long-Form Bengali ASR and Speaker Diarization via Extreme Augmentation and Perfect Alignment A H M Fuad, Bayazid Hasan, Risalat Labib, Sanjid Hasan Published: 2026-02-26Area: cs.SDCitations: 8 Tags: ai-safety, alignment-training, cssd, preprint | 2026-02-26 | cs.SD | ai-safety, alignment-training, cssd, preprint | E19 / R10 (91%) | 8 |
| Same Words, Different Judgments: How Preferences Vary Across Modalities Aaron Broukhim, Eshin Jolly, Nadir Weibel Published: 2026-02-26Area: cs.SDCitations: 30 Tags: ai-safety, cssd, preprint | 2026-02-26 | cs.SD | ai-safety, cssd, preprint | E13 / R9 (94%) | 30 |
| AudioCapBench: Quick Evaluation on Audio Captioning across Sound, Music, and Speech Akshara Prabhakar, Caiming, Haolin Chen, Huan Wang Published: 2026-02-27Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint, safety-evaluation | 2026-02-27 | cs.SD | ai-safety, cssd, preprint, safety-evaluation | E14 / R15 (91%) | - |
| MEBM-Phoneme: Multi-scale Enhanced BrainMagic for End-to-End MEG Phoneme Classification Liang Jinghua, Li Songyi, Zhang Zifeng, Zheng Linze Published: 2026-02-27Area: cs.SDCitations: 6 Tags: ai-safety, cssd, preprint | 2026-02-27 | cs.SD | ai-safety, cssd, preprint | E8 / R7 (91%) | 6 |
| MEBM-Speech: Multi-scale Enhanced BrainMagic for Robust MEG Speech Detection Liang Jinghua, Li Songyi, Zhang Zifeng, Zheng Linze Published: 2026-02-27Area: cs.SDCitations: 6 Tags: ai-safety, cssd, preprint | 2026-02-27 | cs.SD | ai-safety, cssd, preprint | E6 / R5 (92%) | 6 |
| SHINE: Sequential Hierarchical Integration Network for EEG and MEG Jing Chen, Xihong Wu, Xiran Xu, Yujie Yan Published: 2026-02-27Area: cs.SDCitations: 28 Tags: ai-safety, cssd, preprint | 2026-02-27 | cs.SD | ai-safety, cssd, preprint | E11 / R10 (90%) | 28 |
| ACES: Accent Subspaces for Coupling, Explanations, and Stress-Testing in Automatic Speech Recognition Swapnil Parekh Published: 2026-02-28Area: cs.SDCitations: 27 Tags: ai-safety, cssd, preprint | 2026-02-28 | cs.SD | ai-safety, cssd, preprint | E8 / R6 (91%) | 27 |
| CMI-RewardBench: Evaluating Music Reward Models with Compositional Multimodal Instruction Emmanouil Benetos, Haiwen Xia, Hewei Gao, Mingshuo Ding Published: 2026-02-28Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-02-28 | cs.SD | ai-safety, cssd, preprint | E12 / R10 (90%) | - |
| Efficient Long-Sequence Diffusion Modeling for Symbolic Music Generation Guangli Xiang, Haoran Zhang, Houpeng Yang, Jiaojiao Yu Published: 2026-02-28Area: cs.SDCitations: 40 Tags: ai-safety, cssd, preprint | 2026-02-28 | cs.SD | ai-safety, cssd, preprint | E10 / R7 (90%) | 40 |
| When Scaling Fails: Mitigating Audio Perception Decay of LALMs via Multi-Step Perception-Aware Reasoning Aokai Hao, Chenglong Wang, Dan Chen, Haishu Zhao Published: 2026-02-28Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-02-28 | cs.SD | ai-safety, cssd, preprint | E8 / R5 (93%) | - |
| Whisper-MLA: Reducing GPU Memory Consumption of ASR Models based on MHA2MLA Conversion Jianguo Wei, Luo Si, Ming Cai, Pengcheng Zhao Published: 2026-02-28Area: cs.SDCitations: 18 Tags: ai-safety, cssd, preprint | 2026-02-28 | cs.SD | ai-safety, cssd, preprint | E10 / R8 (93%) | 18 |
| AG-REPA: Causal Layer Selection for Representation Alignment in Audio Flow Matching Li Liu, Minghao Yang, Pengfei Zhang, Tianxin Xie Published: 2026-03-01Area: cs.SDCitations: - Tags: ai-safety, alignment-training, cssd, preprint | 2026-03-01 | cs.SD | ai-safety, alignment-training, cssd, preprint | E21 / R17 (91%) | - |
| SyncTrack: Rhythmic Stability and Synchronization in Multi-Track Music Generation Can Yang, Fan Zhang, Hongrui Wang, Xi Chen Published: 2026-03-01Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-03-01 | cs.SD | ai-safety, cssd, preprint | E19 / R17 (90%) | - |
| Are Audio-Language Models Listening? Audio-Specialist Heads for Adaptive Audio Steering Ethan Fetaya, Lenny Aharon, Neta Glazer Published: 2026-03-06Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-03-06 | cs.SD | ai-safety, cssd, preprint | E5 / R3 (96%) | - |
| Do Compact SSL Backbones Matter for Audio Deepfake Detection? A Controlled Study with RAPTOR Ajinkya Kulkarni, Atharva Kulkarni, Mathew Magimai Doss, Sandipana Dowerah Published: 2026-03-06Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-03-06 | cs.SD | ai-safety, cssd, preprint | E6 / R3 (97%) | - |
| Prosodic Boundary-Aware Streaming Generation for LLM-Based TTS with Streaming Text Input Changsong Liu, Eng Siong Chng, Tianrui Wang, Ye Ni Published: 2026-03-06Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-03-06 | cs.SD | ai-safety, cssd, preprint | E5 / R3 (96%) | - |
| RAMoEA-QA: Hierarchical Specialization for Robust Respiratory Audio Question Answering Cecilia Mascolo, Domenico Talia, Gaia A. Bertolino, Tong Xia Published: 2026-03-06Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-03-06 | cs.SD | ai-safety, cssd, preprint | E5 / R3 (96%) | - |
| Whisper-CD: Accurate Long-Form Speech Recognition using Multi-Negative Contrastive Decoding Hoseong Ahn, Jeongyun Chae, Kyuhong Shim, Yoonji Park Published: 2026-03-06Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-03-06 | cs.SD | ai-safety, cssd, preprint | E7 / R3 (96%) | - |