Instant research discovery
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
Search and browse arXiv CS/AI/ML papers, enriched with AI-generated insights.
Generate novel research ideas grounded in real arXiv papers with Brainstorm.
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| Paper | Published | Area | Tags | Intel | Citations |
|---|---|---|---|---|---|
| What Counts as Real? Speech Restoration and Voice Quality Conversion Pose New Challenges to Deepfake Detection 脡va Sz茅kely, Harm Lameris, Joakim Gustafson, Shree Harsha Bokkahalli Satish Published: 2026-03-14Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-03-14 | cs.SD | ai-safety, cssd, preprint | E6 / R3 (93%) | - |
| Causal Prosody Mediation for Text-to-Speech:Counterfactual Training of Duration, Pitch, and Energy in FastSpeech2 Suvendu Sekhar Mohanty Published: 2026-03-12Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-03-12 | cs.SD | ai-safety, cssd, preprint | E5 / R3 (94%) | - |
| Toward Complex-Valued Neural Networks for Waveform Generation Deok-Hyeon Cho, Hyung-Seok Oh, Seong-Whan Lee, Seung-Bin Kim Published: 2026-03-12Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-03-12 | cs.SD | ai-safety, cssd, preprint | E5 / R4 (96%) | - |
| AlphaFlowTSE: One-Step Generative Target Speaker Extraction via Conditional AlphaFlow Duojia Li, Haizhou Li, Lin Li, Qingyang Hong Published: 2026-03-11Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-03-11 | cs.SD | ai-safety, cssd, preprint | E5 / R3 (95%) | - |
| Probabilistic Verification of Voice Anti-Spoofing Models Alexandr Kozodaev, Dmitrii Korzh, Evgeny Kushnir, Mikhail Pautov Published: 2026-03-11Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-03-11 | cs.SD | ai-safety, cssd, preprint | E4 / R3 (95%) | - |
| Speaker Verification with Speech-Aware LLMs: Evaluation and Augmentation Jesus Villalba-Lopez, Laureano Moro-Velazquez, Najim Dehak, Thomas Thebaud Published: 2026-03-11Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint, safety-evaluation | 2026-03-11 | cs.SD | ai-safety, cssd, preprint, safety-evaluation | E5 / R3 (96%) | - |
| Towards Robust Speech Deepfake Detection via Human-Inspired Reasoning Artem Dvirniak, Artem Iudin, Dmitrii Korzh, Dmitrii Tarasov Published: 2026-03-11Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-03-11 | cs.SD | ai-safety, cssd, preprint | E5 / R3 (95%) | - |
| When Fine-Tuning Fails and when it Generalises: Role of Data Diversity and Mixed Training in LLM-based TTS Aditya Choudhary, Anupam Purwar Published: 2026-03-11Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-03-11 | cs.SD | ai-safety, cssd, preprint | E5 / R3 (95%) | - |
| MUGEN: Evaluating and Improving Multi-audio Understanding of Large Audio-Language Models Chih-Kai Yang, Hung-Wei Chen, Hung-yi Lee, Ke-Han Lu Published: 2026-03-10Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-03-10 | cs.SD | ai-safety, cssd, preprint | E5 / R3 (99%) | - |
| Physics-Informed Neural Engine Sound Modeling with Differentiable Pulse-Train Synthesis Lonce Wyse, Robin Doerfler Published: 2026-03-10Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-03-10 | cs.SD | ai-safety, cssd, preprint | E4 / R3 (95%) | - |
| SCENEBench: An Audio Understanding Benchmark Grounded in Assistive and Industrial Use Cases Angelina Wang, Laya Iyer, Sanmi Koyejo Published: 2026-03-10Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-03-10 | cs.SD | ai-safety, cssd, preprint | E7 / R5 (99%) | - |
| TimberAgent: Gram-Guided Retrieval for Executable Music Effect Control Fang Liu, Shengli Zhang, Shihao He, Taotao Wang Published: 2026-03-10Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-03-10 | cs.SD | ai-safety, cssd, preprint | E5 / R3 (95%) | - |
| Benchmarking Language Modeling for Lossless Compression of Full-Fidelity Audio Chris Donahue, Phillip Long, Zachary Novack Published: 2026-03-09Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-03-09 | cs.SD | ai-safety, cssd, preprint | E5 / R3 (95%) | - |
| Disentangling Reasoning in Large Audio-Language Models for Ambiguous Emotion Prediction Abhirup Ghosh, Hong Jia, Jean Honorio, Jiaheng Dong Published: 2026-03-09Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-03-09 | cs.SD | ai-safety, cssd, preprint | E7 / R3 (95%) | - |
| Evolution Strategy-Based Calibration for Low-Bit Quantization of Speech Models Lucas Rakotoarivony Published: 2026-03-09Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-03-09 | cs.SD | ai-safety, cssd, preprint | E6 / R4 (96%) | - |
| Fish Audio S2 Technical Report Dawei Han, Jiahua Liu, Qingzheng Wang, Ruoyi Zhang Published: 2026-03-09Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-03-09 | cs.SD | ai-safety, cssd, preprint | E5 / R4 (94%) | - |
| Gender Fairness in Audio Deepfake Detection: Performance and Disparity Analysis Aishwarya Fursule, Anderson R. Avila, Shruti Kshirsagar Published: 2026-03-09Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-03-09 | cs.SD | ai-safety, cssd, preprint | E7 / R3 (96%) | - |
| VoxEmo: Benchmarking Speech Emotion Recognition with Speech LLMs Hezhao Zhang, Huang-Cheng Chou, Shrikanth Narayanan, Thomas Hain Published: 2026-03-09Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-03-09 | cs.SD | ai-safety, cssd, preprint | E5 / R3 (95%) | - |
| EDMFormer: Genre-Specific Self-Supervised Learning for Music Structure Segmentation Joel Song Bae, Krish Patel, Oscar Chung, Sahal Sajeer Published: 2026-03-08Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-03-08 | cs.SD | ai-safety, cssd, preprint | E6 / R4 (96%) | - |
| Targeted Speaker Poisoning Framework in Zero-Shot Text-to-Speech Sai Praneeth Karimireddy, Shrikanth Narayanan, Thanapat Trachu, Thanathai Lertpetchpun Published: 2026-03-08Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-03-08 | cs.SD | ai-safety, cssd, preprint | E6 / R4 (95%) | - |
| VoiceSHIELD-Small: Real-Time Malicious Speech Detection and Transcription Puneeth N Ail, Sugandha Sharma, Sumit Ranjan, Ubaid Abbas Published: 2026-03-08Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-03-08 | cs.SD | ai-safety, cssd, preprint | E4 / R3 (97%) | - |
| Are Audio-Language Models Listening? Audio-Specialist Heads for Adaptive Audio Steering Ethan Fetaya, Lenny Aharon, Neta Glazer Published: 2026-03-06Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-03-06 | cs.SD | ai-safety, cssd, preprint | E5 / R3 (96%) | - |
| Do Compact SSL Backbones Matter for Audio Deepfake Detection? A Controlled Study with RAPTOR Ajinkya Kulkarni, Atharva Kulkarni, Mathew Magimai Doss, Sandipana Dowerah Published: 2026-03-06Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-03-06 | cs.SD | ai-safety, cssd, preprint | E6 / R3 (97%) | - |
| Prosodic Boundary-Aware Streaming Generation for LLM-Based TTS with Streaming Text Input Changsong Liu, Eng Siong Chng, Tianrui Wang, Ye Ni Published: 2026-03-06Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-03-06 | cs.SD | ai-safety, cssd, preprint | E5 / R3 (96%) | - |
| RAMoEA-QA: Hierarchical Specialization for Robust Respiratory Audio Question Answering Cecilia Mascolo, Domenico Talia, Gaia A. Bertolino, Tong Xia Published: 2026-03-06Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-03-06 | cs.SD | ai-safety, cssd, preprint | E5 / R3 (96%) | - |
| Whisper-CD: Accurate Long-Form Speech Recognition using Multi-Negative Contrastive Decoding Hoseong Ahn, Jeongyun Chae, Kyuhong Shim, Yoonji Park Published: 2026-03-06Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-03-06 | cs.SD | ai-safety, cssd, preprint | E7 / R3 (96%) | - |
| AG-REPA: Causal Layer Selection for Representation Alignment in Audio Flow Matching Li Liu, Minghao Yang, Pengfei Zhang, Tianxin Xie Published: 2026-03-01Area: cs.SDCitations: - Tags: ai-safety, alignment-training, cssd, preprint | 2026-03-01 | cs.SD | ai-safety, alignment-training, cssd, preprint | E21 / R17 (91%) | - |
| SyncTrack: Rhythmic Stability and Synchronization in Multi-Track Music Generation Can Yang, Fan Zhang, Hongrui Wang, Xi Chen Published: 2026-03-01Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-03-01 | cs.SD | ai-safety, cssd, preprint | E19 / R17 (90%) | - |
| ACES: Accent Subspaces for Coupling, Explanations, and Stress-Testing in Automatic Speech Recognition Swapnil Parekh Published: 2026-02-28Area: cs.SDCitations: 27 Tags: ai-safety, cssd, preprint | 2026-02-28 | cs.SD | ai-safety, cssd, preprint | E8 / R6 (91%) | 27 |
| CMI-RewardBench: Evaluating Music Reward Models with Compositional Multimodal Instruction Emmanouil Benetos, Haiwen Xia, Hewei Gao, Mingshuo Ding Published: 2026-02-28Area: cs.SDCitations: - Tags: ai-safety, cssd, preprint | 2026-02-28 | cs.SD | ai-safety, cssd, preprint | E12 / R10 (90%) | - |