ASMSP-P9.8
EUROPEANIZING MODULAR ZERO-SHOT TTS: A COMPONENT-LEVEL ADAPTATION FRAMEWORK FOR FRENCH AND GERMAN
Tim Luka Horstmann, Nassima Ould Ouali, Hi! PARIS Research Center, France; Mohamed Amine Arous, ENSTA Paris, France; Awais Hussain Sani, Hi! PARIS Research Center, France; Eric Moulines, École Polytechnique, France
Session:
ASMSP-P9: Speech Analysis and Synthesis Poster
Track:
ASMSP - Acoustic, Speech and Music Signal Processing
Location:
Balcony II East
Presentation Time:
Fri, 4 Sep, 10:30 - 12:30 Belgium Time (UTC +2)
Presentation
Discussion
Resources
No resources available.
Session ASMSP-P9
ASMSP-P9.1: CONNECTING SPEECH TO WORDS THROUGH IMAGES
Gabriel Pirlogeanu, Dan Oneata, Horia Cucu, POLITEHNICA Bucharest, Romania; Herman Kamper, Stellenbosch University, South Africa
ASMSP-P9.2: Dynamic Frame Length for Speech Spectral Magnitude Features
Guolin Fang, Reykjavik University, Iceland; Mike Brookes, Imperial College London, United Kingdom; Lauri Juvela, Aalto University, Finland; Jon Gudnason, Reykjavik University, Iceland
ASMSP-P9.3: BREAKING THE CHAIN: EVALUATING COT AND SLOT FILLING FOR SPEECH CAPTIONING AND UNDERSTANDING AND RELEASING CAPTIONS FOR 5,000 HOURS OF SPEECH
Dimitrios Bountouridis, Filip Packań, Shahin Amiriparian, Huawei, Netherlands
ASMSP-P9.4: Trimodal Fusion with N-gram Repetition for Automatic Fluency Assessment
Papa Séga WADE, Orange / IMT Atlantique, France; Mihai ANDRIES, Ioannis KANELLOS, IMT Atlantique, France; Thierry MOUDENC, Orange Innovation, France
ASMSP-P9.5: FEATURE SELECTION FOR PLACE OF ARTICULATION CLASSIFICATION IN VOICED FRICATIVES PRODUCED BY POLISH CHILDREN
Oliwia Skórzewska, Maria Filipek, Wojciech Pieniążek, Zuzanna Miodońska, Silesian University of Technology, Poland
ASMSP-P9.6: Evaluating Speech Articulation Synthesis with Articulatory Phoneme Recognition
Vinicius Ribeiro, Yves Laprie, Université de Lorraine, CNRS, Inria, LORIA, France
ASMSP-P9.7: EVALUATING VAE-SIFIGAN UNDER LARGE-SCALE TRAINING AND NOISY CONDITIONS WITH DATA SELECTION USING F0 EXTRACTION ERROR ESTIMATION
Kenichi Ogita, Reo Yoneyama, Wen-Chin Huang, Tomoki Toda, Nagoya University, Japan
ASMSP-P9.8: EUROPEANIZING MODULAR ZERO-SHOT TTS: A COMPONENT-LEVEL ADAPTATION FRAMEWORK FOR FRENCH AND GERMAN
Tim Luka Horstmann, Nassima Ould Ouali, Hi! PARIS Research Center, France; Mohamed Amine Arous, ENSTA Paris, France; Awais Hussain Sani, Hi! PARIS Research Center, France; Eric Moulines, École Polytechnique, France
ASMSP-P9.9: SeamlessEdit: Background Noise Aware Zero-Shot Speech Editing with in-Context Enhancement
Kuan-Yu Chen, National Taiwan University, Taiwan; Jeng-Lin Li, Inventec Corporation, Taiwan; De-Yan Lu, Jian-Jiun Ding, National Taiwan University, Taiwan
ASMSP-P9.10: GROUP DELAY PRODUCT SPECTROGRAMS EMPLOYED AS CONDITIONING IN SPEECH SYNTHESIS
EIRINI SISAMAKI, UNIVERSITY OF CRETE, Greece; YANNIS PANTAZIS, Foundation for Research and Technology Hellas, Greece; VASSILIS TSIARAS, YANNIS STYLIANOU, UNIVERSITY OF CRETE, Greece