GigaSpeech
GigaSpeech是一个开源的多领域英语语音识别数据集,包含33,000多小时音频数据,其中10,000小时有高质量人工转录。数据来源包括有声书、播客和YouTube等,并提供多个规模的训练和评估子集。项目提供多种语音识别工具包的数据准备脚本,由志愿者维护并欢迎社区贡献,旨在促进语音技术的研究和应用。