#高质量音频
RAVE - 高效的实时神经音频合成工具
RAVE神经音频合成变分自编码器高质量音频实时音频处理Github开源项目
RAVE是一个高效的变分自动编码器,专为快速高质量的神经音频合成设计。支持Windows、Mac和Linux平台的RAVE VST版本,可应用于音乐表演和装置。提供详细教程和多种训练配置,包括数据增广选项。用户可以在Max/MSP或PureData中实时使用RAVE进行风格迁移和高层次操控。多个预训练模型可供下载,支持批量音频文件转换和实时嵌入式平台应用。
RealtimeTTS - 实时低延迟高质量文本转语音库
多引擎支持多语言支持Github开源项目RealtimeTTS低延迟高质量音频
RealtimeTTS是一款低延迟、高质量的实时文本转语音库。支持OpenAI、Elevenlabs、Azure、Coqui、gTTS和系统TTS引擎,兼容多语言,适用于专业和关键场景。新增灵活定制安装选项,用户可以选择所需功能模块。通过回退机制确保持续运行,完美兼容大语言模型,实现即时文本流转换和清晰自然的语音输出。
相关文章