Instant research discovery
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Augmenting Dysarthric Speech Severity Assessment with MOS Supervision Chao Zhang, Kaimeng Jia, Minzhu Tu, Siyin Wang Published: 2026-06-17Area: eess.ASCitations: - Tags: ai-safety, eessas, preprint | 2026-06-17 | eess.AS | ai-safety, eessas, preprint | E8 / R4 (96%) | - |
| Cross-Dataset, Age, and Gender Generalization: A Comprehensive Analysis of Fine-Tuning Strategies for Low-Resource Children's ASR Hemant Kumar Kathania, Mikko Kurimo, Paban Sapkota, Shrikanth Narayanan Published: 2026-06-18Area: eess.ASCitations: - Tags: ai-safety, eessas, preprint | 2026-06-18 | eess.AS | ai-safety, eessas, preprint | E8 / R6 (96%) | - |
| Improving End-to-End Speech Recognition for Dysarthric Speech through In-Domain Data Augmentation Hemant Kumar Kathania, Paban Sapkota, Shrikanth Narayanan, Sudarsana Reddy Kadiri Published: 2026-06-18Area: eess.ASCitations: - Tags: ai-safety, eessas, preprint | 2026-06-18 | eess.AS | ai-safety, eessas, preprint | E11 / R7 (96%) | - |
| Repurposing a Speech Classifier for Guided Diffusion-Based Speech Generation Rostislav Makarov, Timo Gerkmann Published: 2026-06-18Area: eess.ASCitations: - Tags: ai-safety, eessas, preprint | 2026-06-18 | eess.AS | ai-safety, eessas, preprint | E7 / R4 (97%) | - |
| Systematic Study of Dysarthric Speech Recognition: Spectral Features and Acoustic Models Hemant Kumar Kathania, Mikko Kurimo, Paban Sapkota, Shrikanth Narayanan Published: 2026-06-18Area: eess.ASCitations: - Tags: ai-safety, eessas, preprint | 2026-06-18 | eess.AS | ai-safety, eessas, preprint | E11 / R5 (98%) | - |
| Phoneme-Level Mispronunciation Screening in Polish-Speaking Children with an Explainable Assistant Anna-Mariia Vitkovska, Daria Hemmerling, Kamil Kwarciak, Leonid Pavlovskyi Published: 2026-06-23Area: eess.ASCitations: - Tags: ai-safety, eessas, preprint | 2026-06-23 | eess.AS | ai-safety, eessas, preprint | E8 / R6 (90%) | - |
| Detecting Audio Deepfakes on the Edge:Lightweight SSL-Based Detection in a Browser Plugin Dan Oneata, Horia Cucu, Nicolas M. Muller, Octavian Pascu Published: 2026-06-29Area: eess.ASCitations: - Tags: ai-safety, eessas, preprint | 2026-06-29 | eess.AS | ai-safety, eessas, preprint | E8 / R4 (97%) | - |
| Semi-Supervised Sound Event Detection with Conditional Mixup and Embedding-Level Contrastive Loss Nian Shao, Xian Li, Xiaofei Li Published: 2026-06-29Area: eess.ASCitations: - Tags: ai-safety, eessas, preprint | 2026-06-29 | eess.AS | ai-safety, eessas, preprint | E9 / R6 (98%) | - |
| Improving multichannel speech enhancement through accurate room-acoustic simulations Alessia Milo, Daniel Gert Nielsen, Finnur Pind, Georg G枚tz Published: 2026-06-30Area: eess.ASCitations: - Tags: ai-safety, eessas, preprint | 2026-06-30 | eess.AS | ai-safety, eessas, preprint | E8 / R5 (96%) | - |
| An Efficient vLLM-Based Inference Pipeline for Unified Audio Understanding and Generation Haoran Wang, Jinchuan Tian, Shinji Watanabe, Siddhant Arora Published: 2026-07-02Area: eess.ASCitations: - Tags: ai-safety, eessas, preprint | 2026-07-02 | eess.AS | ai-safety, eessas, preprint | E9 / R5 (98%) | - |
| NouveauVoice: Generating Novel Pseudo Speakers for Voice Anonymization Anastasia Kuznetsova, Meiying Melissa Chen, Zhenyu Wang, Zhiyao Duan Published: 2026-07-04Area: eess.ASCitations: - Tags: ai-safety, eessas, preprint | 2026-07-04 | eess.AS | ai-safety, eessas, preprint | E10 / R8 (91%) | - |
| Probing Low-Level Acoustic Attribute Encoding in CLAP Audio Embeddings H茅ctor Martel, Joe Hennessy-Priest, Taemin Cho Published: 2026-07-04Area: eess.ASCitations: - Tags: ai-safety, eessas, preprint | 2026-07-04 | eess.AS | ai-safety, eessas, preprint | E13 / R9 (94%) | - |
| ProPS: Prompted Profile Synthesis for Natural Language-Conditioned Speaker Embedding Distributions Jesus Villalba Lopez, Junhyeok Lee, Laureano Moro-Velazquez, Najim Dehak Published: 2026-07-06Area: eess.ASCitations: - Tags: ai-safety, eessas, preprint | 2026-07-06 | eess.AS | ai-safety, eessas, preprint | E11 / R10 (92%) | - |
| TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios Hong Lyu, Jinxin Huang, Mingru Yang, Qianhua He Published: 2026-07-07Area: eess.ASCitations: - Tags: ai-safety, eessas, preprint | 2026-07-07 | eess.AS | ai-safety, eessas, preprint | E12 / R11 (94%) | - |
| On the Role of Conversational Timing in Synthetic Training Data for ASR M谩t茅 Gedeon, P茅ter Mihajlik Published: 2026-07-09Area: eess.ASCitations: - Tags: ai-safety, eessas, preprint | 2026-07-09 | eess.AS | ai-safety, eessas, preprint | E12 / R10 (92%) | - |
| Phone Segmentation and Recognition through Phonological Activation Mapping Chin-Jou Li, Daisuke Saito, David Harwath, David R. Mortensen Published: 2026-07-10Area: eess.ASCitations: 65 Tags: ai-safety, eessas, preprint | 2026-07-10 | eess.AS | ai-safety, eessas, preprint | E10 / R9 (90%) | 65 |
| Efficient Text-to-Audio Generation via Pruning Arshdeep Singh, Mark D. Plumbley, Wenwu Wang, Yi Yuan Published: 2026-07-14Area: eess.ASCitations: 26 Tags: ai-safety, eessas, preprint | 2026-07-14 | eess.AS | ai-safety, eessas, preprint | E16 / R16 (88%) | 26 |
| The Sound of Absence: Audio-Language Embedding Models Struggle with Negation Chun-Yi Kuan, Hung-yi Lee Published: 2026-07-14Area: eess.ASCitations: - Tags: ai-safety, eessas, preprint | 2026-07-14 | eess.AS | ai-safety, eessas, preprint | E10 / R14 (95%) | - |
| Cover First, Disagree Softly: Rethinking Mismatch-First Active Learning for Frame-Level Audio Classification Shiqi Zhang, Tuomas Virtanen Published: 2026-07-15Area: eess.ASCitations: 35 Tags: ai-safety, eessas, preprint | 2026-07-15 | eess.AS | ai-safety, eessas, preprint | E9 / R7 (92%) | 35 |
| Greedy Volume Maximization of Gradient Embeddings for Long-Tailed Frame-Level Bioacoustic Active Learning Ariana Strandburg-Peshkin, Marius Fai脽, Shiqi Zhang, Tuomas Virtanen Published: 2026-07-15Area: eess.ASCitations: - Tags: ai-safety, eessas, preprint | 2026-07-15 | eess.AS | ai-safety, eessas, preprint | E9 / R7 (91%) | - |
| Improving Text-to-Audio Instruction Following via Fine-Grained Feedback from Audio-Aware Large Language Models Ankur Gandhe, Bo-Ru Lu, Byeonggeun Kim, Chao Wang Published: 2026-07-15Area: eess.ASCitations: - Tags: ai-safety, eessas, preprint | 2026-07-15 | eess.AS | ai-safety, eessas, preprint | E10 / R10 (91%) | - |
| RealDESED: A Real-World Domestic Sound Event Detection Benchmark Alexander Fichtinger, Florian Schmid, Gerhard Widmer, Paul Primus Published: 2026-07-18Area: eess.ASCitations: 25 Tags: ai-safety, eessas, preprint | 2026-07-18 | eess.AS | ai-safety, eessas, preprint | E12 / R10 (92%) | 25 |
| Depression Markers in Speech: An Approach based on Tract Variables Dynamics Alessandro Vinciarelli, Sahar Altalhi, Tanaya Guha Published: 2026-07-28Area: eess.ASCitations: - Tags: ai-safety, eessas, preprint | 2026-07-28 | eess.AS | ai-safety, eessas, preprint | - | - |
| Device Invariance using Domain Adaptation on Acoustic Scene Classification Abhishek dileep, Padmanabhan Rajan, Shubham Sharma Published: 2026-07-28Area: eess.ASCitations: - Tags: ai-safety, eessas, preprint | 2026-07-28 | eess.AS | ai-safety, eessas, preprint | - | - |
| Zero-Shot Face-to-Speech Synthesis via Latent Space Adaptation of a Style-Diffusion TTS Model Carlos Mu帽oz-Romero, Jose A. Gonzalez-Lopez Published: 2026-07-29Area: eess.ASCitations: - Tags: ai-safety, eessas, preprint | 2026-07-29 | eess.AS | ai-safety, eessas, preprint | E10 / R8 (92%) | - |
| Stable Autoregressive Speech Generation with Low-Frame-Rate High-Dimensional Continuous Tokens Jixun Yao, Rongzhi Gu, Yi Luo Published: 2026-07-31Area: eess.ASCitations: - Tags: ai-safety, eessas, preprint | 2026-07-31 | eess.AS | ai-safety, eessas, preprint | E11 / R9 (92%) | - |
| REIMU: Efficient Heterogeneous Hierarchical Reasoning for SSL-Based Speech Deepfake Detection Bingwen Feng, Kwok-Ho Ng, Peiya Li, Tingting Song Published: 2026-08-01Area: eess.ASCitations: - Tags: ai-safety, eessas, preprint | 2026-08-01 | eess.AS | ai-safety, eessas, preprint | E12 / R11 (91%) | - |
| Music Restoration via Latent Operator Optimization and Diffusion Model Priors Eloi Moliner, Lauri Juvela, Michal 艩vento, Pavel Rajmic Published: 2026-08-03Area: eess.ASCitations: - Tags: ai-safety, eessas, preprint | 2026-08-03 | eess.AS | ai-safety, eessas, preprint | - | - |
| GROW: Group-Relative Advantage-Weighted On-Policy Reinforcement Learning of Autoregressive-Diffusion Text-to-Speech model Guanrou Yang, Haitao Li, Qian Chen, Qi Chen Published: 2026-08-04Area: eess.ASCitations: - Tags: ai-safety, eessas, preprint | 2026-08-04 | eess.AS | ai-safety, eessas, preprint | - | - |
| Teaching Nemotron Greek: Mining a Corpus, Adapting Retrieval, and Grounding Generation for Modern Greek across Specialist Domains Ayoub Kirouane, Christos Petrocheilos Published: 2026-08-05Area: eess.ASCitations: - Tags: ai-safety, eessas, preprint | 2026-08-05 | eess.AS | ai-safety, eessas, preprint | - | - |