Project Icon

OpenVoiceOS

开源语音平台 实现跨设备语音控制

OpenVoiceOS是社区驱动的开源语音平台,致力于创建跨设备语音控制界面。平台支持自然语言处理,提供可定制界面,重视隐私安全。适用于多种设备,包括嵌入式设备和单板计算机,方便DIY智能音箱制作。OpenVoiceOS为开发者提供实验环境,可在Linux和开源语音助手项目中测试新功能。支持Docker和Python安装,并为Raspberry Pi和Mycroft设备提供预构建镜像。

TTS-Voice-Wizard - 一款多功能语音互动工具
GithubTTS-Voice-Wizard多语言翻译开源项目文字转语音虚拟现实语音识别
TTS-Voice-Wizard是一款多功能语音互动工具,可用于VRChat和其他平台。它支持将语音转化为文本,文本再转化为语音,支持50多种语言的实时翻译和超过100种的语音选项。工具还能显示Spotify或浏览器的播放音乐和VR设备电池状况,同时支持以语音命令控制VRChat头像。
EmotiVoice - 开源多声音、情感合成的文本转语音引擎
EmotiVoiceGithub多声音开源开源项目情感合成文本到语音热门
EmotiVoice是一款功能强大的开源文本转语音(TTS)引擎,支持中英文,并配备超过2000种声音选项。其最显著的特点是情感合成功能,用户可以创建表达各种情绪的语音,如快乐、激动、悲伤和愤怒等。EmotiVoice提供易于使用的Web界面和脚本接口,适用于批量生成结果,同时还支持语音速度调整,提供Mac应用程序和HTTP API,增设免费调用次数。
OpenDAN-Personal-AI-OS - 开源个人AI操作系统,整合多种AI模块
AI AgentAIOSGithubOpenDAN开源项目智能助手
OpenDAN是开源的个人AI操作系统,旨在整合多种AI模块,实现无缝互操作性。用户可以创建AI代理,如助理、私人教师和数字伴侣。这些代理能协同工作,解决复杂问题,连接服务并控制智能设备。通过Docker实现快速安装和部署,支持多种硬件环境。最新版本0.5.1引入多种内置AI代理和本地知识库,推动AI代理协作,打造智能化生活解决方案。
PI-Assistant - 树莓派智能家居语音助手 开源多功能可扩展
GithubHomeAssistantMQTT开源项目智能家居树莓派语音助手
PI-Assistant是一个基于树莓派的开源智能家居语音助手项目。它集成了语音唤醒、语音识别、文字转语音和连续对话等功能,并支持GPT和星火大模型。该项目还提供音乐播放、日程管理、WebUI调参和外设控制等特性,支持自动化智能家居场景。PI-Assistant具有高度可扩展性,适合智能家居爱好者和开发者使用。
TensorVox - 用 C++ 编写的神经语音合成桌面应用程序
Coqui-TTSGithubTensorFlowTTSTensorVoxVITS开源项目神经语音合成
TensorVox是为提高神经语音合成技术普及度而设计的桌面应用。支持多语言,不需庞大Python库,该工具通过TensorFlow C API和LibTorch实现轻量级操作。提供清晰易懂的模型训练和导出指南,是语音技术爱好者的顶级选择。
JARVIS-ChatGPT - J.A.R.V.I.S声音技术激活的多功能智能对话助手
GithubIBM WatsonJARVIS-ChatGPTOpenAI开源项目语音助理项目动机
JARVIS-ChatGPT是一款集成了OpenAI Whisper、OpenAI ChatGPT和IBM Watson技术的智能对话助手,特设J.A.R.V.I.S语音。此助手能实时处理问题,与设备交互,管理文件及执行网上研究。特设研究模式及IoT功能,支持多语言操作,预计未来将继续进行优化更新。
vosk-server - 多协议支持的高准确度离线语音识别服务器
GithubVosk-API开源项目服务器离线识别语音识别通信协议
vosk-server是一个基于Kaldi和Vosk-API的高准确度离线语音识别服务器。支持MQTT、GRPC、WebRTC和Websocket四种主要通信协议,适用于智能家居、PBX系统以及Web流式语音识别等场景。该服务器可本地部署,也可作为聊天机器人、网站和电话系统的后端。Vosk网站提供详细的文档和使用说明。
CosyVoice_For_Windows - 多语言语音合成工具 支持零样本和跨语言生成
AI语音CosyVoiceGithub开源项目深度学习自然语言处理语音合成
CosyVoice_For_Windows是一个开源的语音合成项目,支持多语言、零样本和跨语言语音生成。该工具提供SFT、零样本、跨语言和指令推理等多种模式。项目包含Web演示界面,便于快速了解功能。同时还支持高级训练和部署,适用于语音合成的研究和应用开发。
univoice - Unity开源语音聊天框架
GithubUniVoiceUnity插件开源项目网络通信语音聊天音频输入输出
UniVoice是一个为Unity开发的开源语音聊天框架。该项目支持多人群组语音聊天,提供即插即用功能,无需编写复杂的音频和网络代码。UniVoice具有高度可定制性,支持PUN2和WLAN等多种网络类型。开发者可自定义音频输入、输出和网络传输方式,以适应不同应用场景。该框架简化了Unity项目中实时语音通信的实现过程。
Omi - AI驱动的开源可穿戴设备 实现智能对话记录
AI可穿戴设备GithubOmi开源项目移动应用语音转录
Omi是一款创新的开源AI可穿戴设备,旨在优化对话记录和管理。通过与移动设备连接,Omi能够自动生成高质量的会议、聊天和语音备忘录转录。其低功耗蓝牙技术支持使用小型纽扣电池持续工作超过24小时。Omi的开源软件栈鼓励社区参与和协作。轻巧的人体工学设计使其成为理想的日常佩戴设备。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号