Crystal

跨平台多语言文字转语音合成引擎

Crystal TTS 多语言 SSML规范动态模块加载跨平台 Github 开源项目

Crystal TTS Engine通过C++开发，支持多语言合成，以SSML标准方便模块间交互。此外，该引擎支持动态模块加载及跨平台功能，适合开发需支援多语言环境的开发者。

coqui-ai-TTS - 先进的多语言文本转语音库支持1100多种语言

Coqui TTSGithub多语言支持开源项目文本转语音深度学习预训练模型

coqui-ai-TTS是一个先进的开源文本转语音库，支持超过1100种语言。该库提供多种深度学习模型，如Tacotron2、VITS和YourTTS，用于生成高质量语音。它还包含训练新模型、微调现有模型的工具，支持多说话人TTS，并提供数据集分析功能。

RealtimeSTT_LLM_TTS - 整合语音识别与AI对话的开源项目

GPU支持GithubRealtimeSTT唤醒词实时转录开源项目语音转文字

该项目集成语音识别、AI对话和语音合成,支持GPU加速以实现低延迟交互。具备语音检测、实时转录和唤醒词等功能,可用于开发语音助手和AI对话应用。Web界面支持个性化配置,适合快速构建语音交互系统。

MTrans - 轻量级多源在线翻译及TTS服务开源平台

GithubMTransTTS免费开源在线翻译多语种支持开源项目

MTrans 提供多源在线翻译及文本转语音服务，支持多种流行语种。通过 HTTP 请求实现与服务器的交互，简化翻译和语音合成流程。项目开源，支持二次开发和个性化定制，适用于多种应用场景。

TTSynth.com - 免费在线文本转语音工具支持多语言和自然音色

AI工具AI语音合成TTS多语言支持文字转语音语音下载

TTSynth.com提供免费的AI驱动在线文本转语音服务，支持多语言和自然音色。用户可快速将文本转换为高质量语音，选择语音并下载MP3文件。界面简洁易用，适用于制作有声书、演讲稿和辅助视障人士等多种场景。采用先进人工智能技术生成流畅自然的语音，为用户带来优质的多语言支持文本转语音体验。

open-tts-tracker - 全面追踪开放源代码语音合成模型的信息平台

AI语音GithubTTS模型多语言开源开源项目语音合成

Open TTS Tracker 是一个综合性的开源语音合成模型跟踪平台。该项目汇集了最新TTS模型的详细信息,包括名称、代码库、权重、许可证、微调能力、支持语言等多个方面。通过提供这些资源,Open TTS Tracker 旨在提升开源TTS模型的可见度,推动语音合成技术的进步。研究人员、开发者和爱好者可以在此找到丰富的模型信息和相关资源。

cheetah - 实时本地化语音转文字引擎

CheetahGithub实时转录开源项目本地处理语音转文字跨平台

Cheetah是一款本地化实时语音转文字引擎，具有隐私保护、高精度和跨平台特性。该引擎支持Linux、macOS、Windows、Android、iOS和主流浏览器等多种平台。Cheetah为开发者提供多种编程语言的SDK和演示应用，支持实时麦克风输入和音频文件处理，是一个灵活的语音识别解决方案。

ttsMP3.com - 免费多语言文本转语音与MP3生成工具

AI工具AWS Polly多语言支持文字转语音英语语音合成

ttsMP3.com是一款支持多语言的免费文本转语音工具。它能将文字转换为自然语音，并支持MP3下载。适用于在线学习、演示、视频制作和网站无障碍化。用户可在线试听和下载MP3，每日限额3000字符。该工具还提供丰富的语音效果和定制选项，如插入停顿、强调词语、调整语速和音调等。

YourTTS - 多语言零样本多发音人文本转语音及语音转换技术

Coqui TTSGithubYourTTS多语言开源项目语音转换零样本多说话者TTS

YourTTS项目开发了先进的多语言零样本多发音人文本转语音及语音转换技术，适用于少量语音样本。该技术支持多种语言，确保高语音相似度和优质输出。基于改良的VITS模型，此技术在多语训练中展现出色表现，获得业界肯定。

wetts - 端到端文本转语音开源工具包

GithubWeTTS多平台支持开源数据集开源项目端到端模型语音合成

WeTTS是一个开源的端到端文本转语音(TTS)工具包，专注于生产级和设备端应用。它支持多语言处理，提供预训练模型，并可在x86、Android和树莓派等多种平台上运行。WeTTS采用VITS等先进的端到端模型，结合WeTextProcessing进行文本规范化，并使用基于BERT的统一前端处理中文语音合成。该工具包支持多个开源数据集，为研究者和开发者提供高质量、易用的TTS解决方案。

tts - StreamElements API驱动的多语音文本转语音工具

APIGatsbyGithubStreamElementsTwitch开源项目文本转语音

Text to Speech是基于StreamElements API的在线文本转语音工具，提供10余种语音选项。该工具采用Gatsby构建前端，通过HTTPS提供服务。主要面向Twitch直播主播，用于转换观众互动信息为语音。工具使用需遵守相关规范，确保合理使用API。

相关项目

推荐项目

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

稿定AI

稿定设计是一个多功能的在线设计和创意平台，提供广泛的设计工具和资源，以满足不同用户的需求。从专业的图形设计师到普通用户，无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑，稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合，帮助用户轻松实现创意设计。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com