ASMSP-P2: Automatic Speech Recognition and Speech Emotion Recognition
Tue, 1 Sep, 14:00 - 15:40 Belgium Time (UTC +2)
Location: Balcony I West
Session Type: Poster
Track: ASMSP - Acoustic, Speech and Music Signal Processing

ASMSP-P2.2: PHONEME-FIRST PREDICTION FOR LLM-BASED SPEECH RECOGNITION

Jakob Poncelet, Hugo Van hamme, KU Leuven, Belgium

ASMSP-P2.4: Pruning as Regularization: Sensitivity-Aware One-Shot Pruning in ASR

Julian Irigoyen, Danske Bank, Denmark; Arthur Söhler, Copenhagen Business School, Denmark; Andreas Søeborg Kirkedal, Jabra (GN Group), Denmark

ASMSP-P2.5: Differential Gated Conformer

Rajul Acharya, Atharva Suryawanshi, Yash Saravane, Cerence AI, India

ASMSP-P2.7: BLIND, MICROSCOPIC METRICS OF HUMAN SPEECH INTELLIGIBILITY USING END-TO-END SPEECH RECOGNITION

Alexander Wißmann, Technische Universität Berlin, Germany; Jasmin Riegel, Friedrich-Alexander-Universität Erlangen-Nürnberg, Germany; Steffen Zeiler, Technische Universität Berlin, Germany; Tobias Reichenbach, Friedrich-Alexander-Universität Erlangen-Nürnberg, Germany; Dorothea Kolossa, Technische Universtät Berlin, Germany

ASMSP-P2.9: COLOR-BASED EMOTION REPRESENTATION FOR SPEECH EMOTION RECOGNITION

Ryotaro Nagase, Ryoichi Takashima, Yoichi Yamashita, Ritsumeikan University, Japan

ASMSP-P2.10: Multiclass Fairness Analysis of Qwen2-Audio in Speech Emotion Recognition

Federico D'Asaro, Politecnico di Torino, Italy; Juan Jose Marquez Villacis, LINKS Foundation, Italy; Andrea Bottino, Politecnico di Torino, Italy; Giuseppe Rizzo, LINKS Foundation, Italy