Instant research discovery
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| From Textural Counterpoint to Feature Encoding: A Multi-Dimensional Machine Representation Study of Haydn's "The Lark" Integrating Electroacoustic Analysis Dong Liu, Hai Luan, Xiaonan Li, Yakun Liu Published: 2026-07-07Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-07-07 | cs.SD | ai-safety, cssd, preprint | E9 / R8 (94%) | - |
| SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation Carsten Maple, Linxi Li, Liwei Jin, Qianwei Guo Published: 2026-07-06Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint, safety-evaluation | 2026-07-06 | cs.SD | ai-safety, cssd, preprint, safety-evaluation | E13 / R13 (94%) | - |
| Auto-AEG: Scalable Data Construction for Open-Vocabulary Audio Event Grounding Boyun Zhang, Dongjie Fu, Tao Jin, Tong Zhang Published: 2026-07-05Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-07-05 | cs.SD | ai-safety, cssd, preprint | E12 / R9 (90%) | - |
| Information-Geometric Superposed Vowel Evaluation: Part 1. Moraic Syllabary (Japanese) Ken Ito, Shigekazu Ishihara, Yusei Tamura Published: 2026-07-05Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint, safety-evaluation | 2026-07-05 | cs.SD | ai-safety, cssd, preprint, safety-evaluation | E8 / R8 (93%) | - |
| Training-Free Model Selection and Domain-Aware Score Calibration for First-Shot Anomalous Sound Detection Grach Mkrtchian Published: 2026-07-05Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-07-05 | cs.SD | ai-safety, cssd, preprint | E10 / R8 (96%) | - |
| TokAN: Accent Normalization Using Self-Supervised Speech Tokens Bohan Li, Haizhou Li, Qibing Bai, Shuai Wang Published: 2026-07-04Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-07-04 | cs.SD | ai-safety, cssd, preprint | E13 / R15 (90%) | - |
| DETECT-3B-Omni is Agnostic of Content and Demographics Aditya Tirumala Bukkapatnam, Dominik Schnieders, Nicolas M. M眉ller, Zohaib Ahmed Published: 2026-07-03Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-07-03 | cs.SD | ai-safety, cssd, preprint | E12 / R14 (92%) | - |
| A Multi-Branch Hierarchy-Aware Framework for Heterogeneous Audio Classification Beile Ning, Gongping Huang, Jiayi Yu, Wenjun Xu Published: 2026-07-02Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-07-02 | cs.SD | ai-safety, cssd, preprint | E10 / R4 (98%) | - |
| Metronome: Bound the Cache, Keep the Beat for Real-Time Interaction Model Serving Bojie Li, Jiaying Meng Published: 2026-07-02Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-07-02 | cs.SD | ai-safety, cssd, preprint | E8 / R6 (94%) | - |
| SelectTSL: Prompt-Guided Selective Target Sound Localization in Complex Scenarios Bowen Xing, Haizhou Li, Ivor W. Tsang, Xinyuan Qian Published: 2026-07-02Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-07-02 | cs.SD | ai-safety, cssd, preprint | E6 / R4 (97%) | - |
| Enhancing Flow Matching with A Unified Guidance Framework for Efficient and Robust Speech Synthesis Hongjiang Yu, Junhui Zhang, Qiangqing Wang, Qianhui Xu Published: 2026-07-01Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-07-01 | cs.SD | ai-safety, cssd, preprint | E7 / R5 (97%) | - |
| Adaptive Perturbation Selection for Contrastive Audio Decoding Aaron Isidore Grace, Weiran Wang, Zhouyuan Huo Published: 2026-06-30Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-06-30 | cs.SD | ai-safety, cssd, preprint | E8 / R4 (96%) | - |
| Beyond Binary Instrument QA: Probing Instrument Grounding in Music Audio-Language Models Hyoeun Kim, Joonhyeok Shin, Kyuhong Shim, Yujun Lee Published: 2026-06-30Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-06-30 | cs.SD | ai-safety, cssd, preprint | E9 / R4 (99%) | - |
| SwiftAudio: Data-Efficient Caption-Only Distillation for One-Step Text-to-Audio Diffusion-based Generation Binh Mai, Cong Tran, Hung Dinh, Tran Quoc Bao Le Published: 2026-06-30Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-06-30 | cs.SD | ai-safety, cssd, preprint | E7 / R5 (98%) | - |
| UniSAE: Unified Speech Attribute Editing on Speaker, Emotion and Low-Level Content via Discrete Phonetic Posteriorgram Modelling Chuanbo Zhu, Kun Qian, Rongxiu Zhong, Shilei Zhang Published: 2026-06-30Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-06-30 | cs.SD | ai-safety, cssd, preprint | E8 / R5 (97%) | - |
| ZEBRA: Zero-Shot Entropy-Regularized Prompt Learning for Base-to-Novel Generalization in Audio-Language Models Asif Hanif, Mohammad Yaqub Published: 2026-06-30Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-06-30 | cs.SD | ai-safety, cssd, preprint | E9 / R5 (97%) | - |
| BEST-RQ-2: Contextualize-Then-Predict, a Two-Step Approach for Self-Supervised Audio Representations Etienne Labb茅, Ludovic K. Tuncay, Thomas Pellegrini Published: 2026-06-29Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-06-29 | cs.SD | ai-safety, cssd, preprint | E8 / R6 (98%) | - |
| Child-Centric Voice Anonymization in Single and Multi-Speaker Speech via Domain-Adapted SSL Models Pranav Tushar, Rong Tong, Xiao Xiao Miao Published: 2026-06-29Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-06-29 | cs.SD | ai-safety, cssd, preprint | E10 / R4 (98%) | - |
| LeVo 2: Stable and Melodious Song Generation via Hierarchical Representation Modeling and Progressive Post-Training Dapeng Wu, Dong Yu, Guangzheng Li, Hangting Chen Published: 2026-06-29Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-06-29 | cs.SD | ai-safety, cssd, preprint | E8 / R5 (97%) | - |
| Proteus: Automated Adversarial Robustness Testing for Audio Deepfake Detectors Aditya Tirumala Bukkapatnam, Nicolas M. M眉ller, Zohaib Ahmed Published: 2026-06-28Area: cs.SDCitations: - Tags: adversarial-robustness, ai-safety, cssd, preprint | 2026-06-28 | cs.SD | adversarial-robustness, ai-safety, cssd, preprint | E8 / R5 (97%) | - |
| TF-MoE: Time-Frequency Mixture-of-Experts for Efficient Speech Separation Chenda Li, Qinzhe Hu, Shujie Liu, Wangyou Zhang Published: 2026-06-28Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-06-28 | cs.SD | ai-safety, cssd, preprint | E8 / R5 (98%) | - |
| Hybrid Diffusion Transformer for Instruction-Guided Audio Editing via Rectified Flow Dongyu Wang, Jean-Yves Guillemaut, Liting Gao, Shubin Zhang Published: 2026-06-18Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-06-18 | cs.SD | ai-safety, cssd, preprint | E6 / R4 (97%) | - |
| Closing the Loop: PID Feedback Control for Interpretable Activation Steering in Symbolic Music Generation Ioannis Prokopiou, Maximos Kaliakatsos-Papakostas, Pantelis Vikatos, Themos Stafylakis Published: 2026-06-17Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-06-17 | cs.SD | ai-safety, cssd, preprint | E7 / R5 (98%) | - |
| Exploring Feature Extraction Technique Parameters for Acoustic Gunshot Classification Ryan Quinn, Sinclair Gurny Published: 2026-06-17Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-06-17 | cs.SD | ai-safety, cssd, preprint | E8 / R4 (97%) | - |
| FlowFake: Liquid Networks for Audio Deepfake Detection Dinesh Kumar Vishwakarma, Divyansh Sharma, Shivaay Dhondiyal Published: 2026-06-17Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-06-17 | cs.SD | ai-safety, cssd, preprint | E10 / R5 (98%) | - |
| NeuralMUSIC: A Hybrid Neural-Subspace Framework for Robot Sound Source Localization Junqiao Fan, Lihua Xie, Shenghai Yuan, Yizhuo Yang Published: 2026-06-17Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-06-17 | cs.SD | ai-safety, cssd, preprint | E6 / R4 (97%) | - |
| PrefSQA: Pairwise Preference Prediction for Speech Quality Assessment and the Critical Role of High Quality Datasets Donald S. Williamson, Junyi Fan Published: 2026-06-17Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-06-17 | cs.SD | ai-safety, cssd, preprint | E13 / R5 (97%) | - |
| QC-GAN: A Parameter-Efficient Quaternion Conformer GAN for High-Fidelity Speech Enhancement Hideaki Tamori, Makoto Sakai, Shogo Yamauchi, Tohru Nitta Published: 2026-06-17Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-06-17 | cs.SD | ai-safety, cssd, preprint | E9 / R5 (97%) | - |
| Reference-Driven Multi-Speaker Audio Scene Generation from In-the-Wild Priors Benjamin Brazowski, Daniel Segal, Eitan Richardson, Michael Finkelson Published: 2026-06-17Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-06-17 | cs.SD | ai-safety, cssd, preprint | E8 / R4 (97%) | - |
| RIVET: Robust Idempotent Voice Attribute Editing Bhiksha Raj, Bhuvan Koduru, Dareen Alharthi, Rita Singh Published: 2026-06-17Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-06-17 | cs.SD | ai-safety, cssd, preprint | E7 / R5 (97%) | - |