EmoV-DB
EmoV-DB是一个专为情感语音合成设计的开源数据集。它收录了四位说话人(两男两女)的录音,包括中性、困倦、愤怒、厌恶和愉悦五种情感风格。数据集基于CMU arctic文本,包含超过5000条录音样本,音频采用16位WAV格式。EmoV-DB还集成了强制对齐功能,可分离语音中的语言和非语言成分。这一资源旨在增强语音生成系统的情感表达控制,为相关研究提供重要支持。