Emotion transplantation approach for VLSP 2022
Tác giả: Van Thang Nguyen, Thanh Long Luong, Huan Vu
Số trang:
P. 369-380
Số phát hành:
Tập 39 - Số 4
Kiểu tài liệu:
Tạp chí trong nước
Nơi lưu trữ:
03 Quang Trung
Mã phân loại:
005
Ngôn ngữ:
Tiếng Anh
Từ khóa:
Emotional speech synthesis, emotion transplantation, text-to-speech
Chủ đề:
Data conversion
Tóm tắt:
This paper presents our approach that addresses the problem of transplanting a source speaker's emotional expression to a target speaker, one of the Vietnamese Language and Speech Processsing (VLSP) 2022 TTS tasks. Our approach includes a complete data pre-processing pipeline and two training algorithms. We first train a source speaker's expressive TTS model, then adapt the voice characteristics for the target speaker. Empirical results have shown the efficacy of our method in generating the expressive speech of a speaker under a limited training data regime.
Tạp chí liên quan
- Phân hạng nguy hiểm cháy và cháy nổ cho nhà sản xuất có nguy cơ nổ bụi tại Việt Nam
- Ảnh hưởng của đường quan hệ lực cắt - chuyển vị ngang của gối cách chấn đa lớp đến hiệu quả giảm chấn của nhà cách chấn đáy có kết cấu tường gạch
- Nâng cao hiệu quả nhận dạng các tham số dao động dựa trên kỹ thuật tách nguồn mù
- Ảnh hưởng của sườn đứng đến khả năng chịu nén đúng tâm của khối xây bằng gạch đất không nung
- Nguyên nhân phá hủy bề mặt gạch tháp Khương Mỹ và giải pháp hạn chế hư hỏng gạch phục chế, sử dụng gia cường khối xây tháp trong môi trường biển