TTS-Voice-Wizard

一款多功能语音互动工具

TTS-Voice-Wizard 语音识别文字转语音虚拟现实多语言翻译 Github 开源项目

TTS-Voice-Wizard是一款多功能语音互动工具，可用于VRChat和其他平台。它支持将语音转化为文本，文本再转化为语音，支持50多种语言的实时翻译和超过100种的语音选项。工具还能显示Spotify或浏览器的播放音乐和VR设备电池状况，同时支持以语音命令控制VRChat头像。

访问官网

Github

Huggingface

介绍相关项目

WhisperUI - 多语言支持的高效语音转文字工具

AI工具API密钥OpenAI Whisper多语言支持语音转文字转录

WhisperUI是一款基于先进语音识别技术的转文字工具。支持多种音频格式，可快速将语音转换为文本和SRT字幕。具备多语言转录功能，转录准确度高，抗干扰能力强。提供免费基础功能和付费高级特性。适用于多种场景的音频转文字需求，是一个便捷、经济的语音识别解决方案。

Speechki - 多语种AI语音生成和文本转语音平台

AI工具AI语音合成Speechki内容创作工具多语言支持文字转语音

Speechki是一个AI驱动的语音生成平台，支持1100多种声音和80多种语言。该工具可将文本转换为高质量音频，适合各类用户使用。具备实时校听、章节格式化、角色管理和精确停顿控制等功能，便于创建专业音频内容。支持多语言和多播放，有助于拓展全球受众。Speechki为用户提供了强大的文本转语音解决方案。

VoiceCraft - 实现零样本语音编辑和实时文本转语音的革命性技术

GithubVoiceCraft开源项目文本转语音神经编解码语言模型语音编辑零样本学习

VoiceCraft是一个开源的语音技术项目，专注于零样本语音编辑和实时文本转语音。该项目仅需几秒钟的参考音频即可克隆或编辑未知声音，在有声书、网络视频和播客等真实场景中表现出色。VoiceCraft提供多种运行方式，包括Google Colab、Docker和本地环境，方便研究人员和开发者使用。项目在语音编辑和零样本TTS领域达到了先进水平，为语音技术的发展开辟了新方向。

ttsMP3.com - 免费多语言文本转语音与MP3生成工具

AI工具AWS Polly多语言支持文字转语音英语语音合成

ttsMP3.com是一款支持多语言的免费文本转语音工具。它能将文字转换为自然语音，并支持MP3下载。适用于在线学习、演示、视频制作和网站无障碍化。用户可在线试听和下载MP3，每日限额3000字符。该工具还提供丰富的语音效果和定制选项，如插入停顿、强调词语、调整语速和音调等。

Real-Time-Voice-Cloning - 实时语音克隆与多声源文本到语音转换技术

GithubSV2TTS多说话者文本转语音合成实时语音克隆开源项目深度学习热门语音合成

Real-Time Voice Cloning是一个基于深度学习的实时语音克隆工具，能够通过简短语音样本快速创建个性化语音模型。项目实现了从说话人验证到多说话人文本到语音合成的框架（SV2TTS），并配备了实时工作的声码器。适用于需要个性化语音合成的开发者和研究人员，支持多种数据集，提供预训练模型以简化使用和实验过程。

Cognitive-Speech-TTS - 高效文本转语音解决方案，支持个性化声音定制

Azure AIAzure Cognitive ServicesGithubMicrosoftSpeech SDKText-to-Speech开源项目

Azure Cognitive Service的TTS技术支持高效的文本转语音转换，提供多语言、多情感和个性化声音定制。通过REST API和Speech SDK集成，提供跨平台解决方案，应用广泛，包括教育、媒体、娱乐和医疗等领域。最新更新及客户案例展示了Azure AI推动的创新及优质用户体验。

Text to Speech.im - 多语言文本转语音工具智能生成自然语音

AI工具AI语音合成在线工具多语言支持文字转语音语音下载

Text to Speech.im是一款先进的在线文本转语音工具，利用人工智能技术将文字转换为自然流畅的语音。支持多种语言和语音风格，用户可轻松生成高质量语音文件并下载。适用于视障人士、内容创作、教育等多种场景，跨设备使用，提供强大功能和简便操作。

Supertone Shift - 实时语音转换器

AI工具AI音频Supertone ShiftVTubers实时语音转换无需GPU热门语音自定义音频生成

Supertone Shift提供领先的实时变声技术，具备广泛的声音库和简易操作界面，支持即时切换声音，适合VTubers、内容创作者和游戏玩家。兼容多种平台如Discord、VRChat和Twitch，无需GPU，适用于多种设备。加入公开测试，体验通讯的未来发展。

OpenVoice - 全面掌握多语种声音克隆技术：OpenVoice提供高精度与灵活性

GithubOpenVoice商业使用多语言支持开源项目热门语音克隆音频质量

OpenVoice是一款革命性的语音克隆工具，提供准确的音色复制和灵活的声音风格控制，支持多种语言和口音。V2版本进一步强化了音质，并增设了多种母语级支持，包括英语、西班牙语、法语、中文、日语和韩语，并从2024年4月起免费提供商业使用。OpenVoice已广泛应用于即时语音克隆功能，并在全球范围内持续扩展用户群体。

JARVIS-ChatGPT - J.A.R.V.I.S声音技术激活的多功能智能对话助手

GithubIBM WatsonJARVIS-ChatGPTOpenAI开源项目语音助理项目动机

JARVIS-ChatGPT是一款集成了OpenAI Whisper、OpenAI ChatGPT和IBM Watson技术的智能对话助手，特设J.A.R.V.I.S语音。此助手能实时处理问题，与设备交互，管理文件及执行网上研究。特设研究模式及IoT功能，支持多语言操作，预计未来将继续进行优化更新。

相关项目

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

Project Cover

稿定AI

稿定设计是一个多功能的在线设计和创意平台，提供广泛的设计工具和资源，以满足不同用户的需求。从专业的图形设计师到普通用户，无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑，稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合，帮助用户轻松实现创意设计。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号