Indonesian Voice Cloning Text-to-Speech System With Vall-E-Based Model and Speech Enhancement
In recent years, Text-to-Speech (TTS) technology has advanced, with research focusing on multi-speaker TTS capable of voice cloning. In 2023, Wang et al. introduced Vall-E, a Transformer-based neural codec language model, achieving state-of-the-art results in voice cloning. However, limited research...
Đã lưu trong:
| Những tác giả chính: | , , |
|---|---|
| Định dạng: | Artigo |
| Ngôn ngữ: | Inglês |
| Được phát hành: |
IEEE
2024-01-01
|
| Loạt: | IEEE Access |
| Những chủ đề: | |
| Truy cập trực tuyến: | https://ieeexplore.ieee.org/document/10806715/ |
| Các nhãn: |
Không có thẻ, Là người đầu tiên thẻ bản ghi này!
|
