Instant research discovery
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Proteus: Automated Adversarial Robustness Testing for Audio Deepfake Detectors Aditya Tirumala Bukkapatnam, Nicolas M. M眉ller, Zohaib Ahmed Published: 2026-06-28Area: cs.SDCitations: - Tags: adversarial-robustness, ai-safety, cssd, preprint | 2026-06-28 | cs.SD | adversarial-robustness, ai-safety, cssd, preprint | E8 / R5 (97%) | - |
| TF-MoE: Time-Frequency Mixture-of-Experts for Efficient Speech Separation Chenda Li, Qinzhe Hu, Shujie Liu, Wangyou Zhang Published: 2026-06-28Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-06-28 | cs.SD | ai-safety, cssd, preprint | E8 / R5 (98%) | - |
| BEST-RQ-2: Contextualize-Then-Predict, a Two-Step Approach for Self-Supervised Audio Representations Etienne Labb茅, Ludovic K. Tuncay, Thomas Pellegrini Published: 2026-06-29Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-06-29 | cs.SD | ai-safety, cssd, preprint | E8 / R6 (98%) | - |
| Child-Centric Voice Anonymization in Single and Multi-Speaker Speech via Domain-Adapted SSL Models Pranav Tushar, Rong Tong, Xiao Xiao Miao Published: 2026-06-29Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-06-29 | cs.SD | ai-safety, cssd, preprint | E10 / R4 (98%) | - |
| LeVo 2: Stable and Melodious Song Generation via Hierarchical Representation Modeling and Progressive Post-Training Dapeng Wu, Dong Yu, Guangzheng Li, Hangting Chen Published: 2026-06-29Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-06-29 | cs.SD | ai-safety, cssd, preprint | E8 / R5 (97%) | - |
| Adaptive Perturbation Selection for Contrastive Audio Decoding Aaron Isidore Grace, Weiran Wang, Zhouyuan Huo Published: 2026-06-30Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-06-30 | cs.SD | ai-safety, cssd, preprint | E8 / R4 (96%) | - |
| Beyond Binary Instrument QA: Probing Instrument Grounding in Music Audio-Language Models Hyoeun Kim, Joonhyeok Shin, Kyuhong Shim, Yujun Lee Published: 2026-06-30Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-06-30 | cs.SD | ai-safety, cssd, preprint | E9 / R4 (99%) | - |
| SwiftAudio: Data-Efficient Caption-Only Distillation for One-Step Text-to-Audio Diffusion-based Generation Binh Mai, Cong Tran, Hung Dinh, Tran Quoc Bao Le Published: 2026-06-30Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-06-30 | cs.SD | ai-safety, cssd, preprint | E7 / R5 (98%) | - |
| UniSAE: Unified Speech Attribute Editing on Speaker, Emotion and Low-Level Content via Discrete Phonetic Posteriorgram Modelling Chuanbo Zhu, Kun Qian, Rongxiu Zhong, Shilei Zhang Published: 2026-06-30Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-06-30 | cs.SD | ai-safety, cssd, preprint | E8 / R5 (97%) | - |
| ZEBRA: Zero-Shot Entropy-Regularized Prompt Learning for Base-to-Novel Generalization in Audio-Language Models Asif Hanif, Mohammad Yaqub Published: 2026-06-30Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-06-30 | cs.SD | ai-safety, cssd, preprint | E9 / R5 (97%) | - |
| Enhancing Flow Matching with A Unified Guidance Framework for Efficient and Robust Speech Synthesis Hongjiang Yu, Junhui Zhang, Qiangqing Wang, Qianhui Xu Published: 2026-07-01Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-07-01 | cs.SD | ai-safety, cssd, preprint | E7 / R5 (97%) | - |
| A Multi-Branch Hierarchy-Aware Framework for Heterogeneous Audio Classification Beile Ning, Gongping Huang, Jiayi Yu, Wenjun Xu Published: 2026-07-02Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-07-02 | cs.SD | ai-safety, cssd, preprint | E10 / R4 (98%) | - |
| Metronome: Bound the Cache, Keep the Beat for Real-Time Interaction Model Serving Bojie Li, Jiaying Meng Published: 2026-07-02Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-07-02 | cs.SD | ai-safety, cssd, preprint | E8 / R6 (94%) | - |
| SelectTSL: Prompt-Guided Selective Target Sound Localization in Complex Scenarios Bowen Xing, Haizhou Li, Ivor W. Tsang, Xinyuan Qian Published: 2026-07-02Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-07-02 | cs.SD | ai-safety, cssd, preprint | E6 / R4 (97%) | - |
| DETECT-3B-Omni is Agnostic of Content and Demographics Aditya Tirumala Bukkapatnam, Dominik Schnieders, Nicolas M. M眉ller, Zohaib Ahmed Published: 2026-07-03Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-07-03 | cs.SD | ai-safety, cssd, preprint | E12 / R14 (92%) | - |
| TokAN: Accent Normalization Using Self-Supervised Speech Tokens Bohan Li, Haizhou Li, Qibing Bai, Shuai Wang Published: 2026-07-04Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-07-04 | cs.SD | ai-safety, cssd, preprint | E13 / R15 (90%) | - |
| Auto-AEG: Scalable Data Construction for Open-Vocabulary Audio Event Grounding Boyun Zhang, Dongjie Fu, Tao Jin, Tong Zhang Published: 2026-07-05Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-07-05 | cs.SD | ai-safety, cssd, preprint | E12 / R9 (90%) | - |
| Information-Geometric Superposed Vowel Evaluation: Part 1. Moraic Syllabary (Japanese) Ken Ito, Shigekazu Ishihara, Yusei Tamura Published: 2026-07-05Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint, safety-evaluation | 2026-07-05 | cs.SD | ai-safety, cssd, preprint, safety-evaluation | E8 / R8 (93%) | - |
| Training-Free Model Selection and Domain-Aware Score Calibration for First-Shot Anomalous Sound Detection Grach Mkrtchian Published: 2026-07-05Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-07-05 | cs.SD | ai-safety, cssd, preprint | E10 / R8 (96%) | - |
| SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation Carsten Maple, Linxi Li, Liwei Jin, Qianwei Guo Published: 2026-07-06Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint, safety-evaluation | 2026-07-06 | cs.SD | ai-safety, cssd, preprint, safety-evaluation | E13 / R13 (94%) | - |
| Designing Maintainable Hybrid Generative Systems: A Quantum-Inspired Approach to Automated Music Harmony Generation Josef Pavlicek Published: 2026-07-07Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-07-07 | cs.SD | ai-safety, cssd, preprint | E11 / R9 (88%) | - |
| From Textural Counterpoint to Feature Encoding: A Multi-Dimensional Machine Representation Study of Haydn's "The Lark" Integrating Electroacoustic Analysis Dong Liu, Hai Luan, Xiaonan Li, Yakun Liu Published: 2026-07-07Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-07-07 | cs.SD | ai-safety, cssd, preprint | E9 / R8 (94%) | - |
| MADB: A Large-Scale Music Aesthetics Dataset with Professional and Multi-Dimensional Annotations Duo Xu, Feng Yu, Haoxin Zhang, Jishang Chen Published: 2026-07-08Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-07-08 | cs.SD | ai-safety, cssd, preprint | E15 / R12 (94%) | - |
| PS4: Proxy-Supervised Joint Training for Real Target Speaker Extraction Haitao Qian, Wanyi Ning, Wei Zhou, Yiming Cheng Published: 2026-07-09Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-07-09 | cs.SD | ai-safety, cssd, preprint | E11 / R8 (92%) | - |
| A Production-Oriented Framework for Evaluation of SFX Generation Eric Granger, M茅lodie Desbos, Mohammadhadi Shateri, Yara Bahram Published: 2026-07-10Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint, safety-evaluation | 2026-07-10 | cs.SD | ai-safety, cssd, preprint, safety-evaluation | E11 / R15 (94%) | - |
| ReGen: Hierarchical Multi-Prompt Representation Generation for Efficient Waveform Diffusion Models Ha-Yeong Choi, Sang-Hoon Lee Published: 2026-07-10Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-07-10 | cs.SD | ai-safety, cssd, preprint | E6 / R5 (92%) | - |
| What You Train Is What You Get: Gender Bias, Training Composition, and Post-Hoc Mitigation in Audio Deepfake Detection Aishwarya R. Fursule, Anderson R. Avila, Shruti Kshirsagar, Vamshi Nallaguntla Published: 2026-07-10Area: cs.SDCitations: 60 Tags: ai-safety, cssd, preprint | 2026-07-10 | cs.SD | ai-safety, cssd, preprint | E6 / R4 (94%) | 60 |
| Breaking the Quality--Intelligibility Trade-off in Streaming Target Speaker Extraction via Deep-Feature-Anchored Preference Optimization Guiping Zhong, Hui Lu, Jiakui Li, Jinjiang Liu Published: 2026-07-11Area: cs.SDCitations: 15 Tags: ai-safety, cssd, preprint | 2026-07-11 | cs.SD | ai-safety, cssd, preprint | E11 / R7 (92%) | 15 |
| Transcript-Free Lightweight Detection of Alzheimer's Disease from Spontaneous Speech Using Handcrafted MFCC-Dominant Acoustic Biomarkers Azam Bastanfard, Rashin Gholijani Farahani Published: 2026-07-11Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-07-11 | cs.SD | ai-safety, cssd, preprint | E12 / R12 (91%) | - |
| BeatEdit: Symbolic Music Generation as Explicit Editing Haowu Zhou, Haoyu Gu, Lekai Qian, Qi Liu Published: 2026-07-13Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-07-13 | cs.SD | ai-safety, cssd, preprint | E10 / R9 (92%) | - |