Project Icon

Interactive-LLM-Powered-NPCs

为热门游戏NPC提供逼真对话体验的项目

项目利用麦克风互动、面部识别和无限存储等技术,为热门游戏中的NPC提供逼真对话体验,无需修改源代码即可无缝整合。

PersonaTalk - 个性化唇形同步配音方案,突出个性与面部细节
AI工具PersonaTalk同步精度视觉配音跨注意力层面部细节
PersonaTalk 提供一种通过注意力机制实现的可视化配音框架,重视保留说话者的个性和面部细节。此框架分为音频几何构建和面部渲染两阶段,确保唇形同步的高保真效果。通过独特的双重注意力机制,能够精确渲染唇部和面部细节,达到优异的视觉质量和个性保留效果。
MimicTalk - 在几分钟内快速生成个性化的3D数字人
3D互动头像AI生成GithubMimicTalkReal3D-Portrait开源项目音驱动
MimicTalk提供了一种基于Pytorch的系统,通过短时间内训练生成具个性化和表现力的3D动态面孔。项目基于Real3D-Portrait的研究,利用NeRF框架实现高效头像动画。用户可通过演示页面观看视频示例,并通过项目提供的方法指南进行特定任务操作。该项目提供CLI和Gradio WebUI支持,能够进行针对特定用户的音频驱动动态头像生成,同时确保合法使用和版权保护。
AIUI - AI语音交互平台,兼容桌面和移动浏览器
AIUIGPT-3.5GPT-4Github开源项目文本到语音语音接口
AIUI平台提供与AI模型的无缝双向语音通信,现支持GPT-4和GPT-3.5,兼容桌面和移动浏览器,未来将支持开放模型。在浏览器中打开应用即可开始对话,AIUI会处理语音输入并提供语音回应,实现自然连续的交互。它提供本地运行指南、环境变量配置及一键部署选项,方便快速上手。
AniTalker - 面部动画生成技术通过解耦身份和运动编码实现多样化表现
AI绘图AniTalkerGithub人脸动画开源项目深度学习语音驱动
AniTalker是一个面部动画生成项目,通过解耦身份和面部运动编码实现多样化的说话面部动画。该技术根据音频和图像生成说话头像,支持控制头部姿态、位置和缩放。项目提供多个预训练模型,包括基于Hubert和MFCC的音频特征提取,适用于不同场景。AniTalker为创作和研究提供了生成说话面部动画的工具。
LL3DA - 3D环境下的多模态语言和视觉互动助手
3D环境3D语言模型GithubLL3DA开源项目点云视觉交互
LL3DA是一种大型语言3D助手,能够在复杂的3D环境中响应视觉和文本交互。现有的多模态模型在3D场景理解中的挑战使得LL3DA采用点云直接作为输入,从而减少计算负担并提升性能。实验结果表明,LL3DA在3D密集描述和3D问答任务上优于其他3D视觉语言模型。其开源代码和预训练模型权重允许用户训练定制模型,并进一步拓展到更大规模的3D视觉语言基准上。
Wiz.chat - 本地化AI角色对话平台
AI工具AI角色WizChat免费AI本地AI隐私保护
Wiz.chat提供本地化的AI角色对话体验,无需下载或注册。用户只需配备GPU的电脑和最新版Chrome浏览器即可使用。平台支持安全、轻松地与各种虚拟角色对话,激发创意。Wiz.chat不收费,也不会记录对话内容,为用户创造自由探索AI交互的空间。
gdansk-ai - 开源全栈AI语音对话系统 整合多项云服务
AI语音聊天机器人Auth0GithubOpenAIStripe全栈AI应用开源项目
Gdańsk AI是一个开源的全栈AI语音对话系统,集成了语音转文本、大型语言模型和文本转语音技术。该项目整合了Auth0身份验证、OpenAI和Google Cloud API的AI能力,以及Stripe支付功能。系统由Web应用、API和AI组件构成,为开发者提供完整的AI对话解决方案。用户可通过购买'bibs'代币与AI进行语音交互。本项目采用Node.js、TypeScript和Python等技术栈,结构清晰,便于二次开发。系统支持用户通过语音进行AI对话,并提供便捷的支付流程。开发者可根据需求自定义AI模型和对话流程,快速构建语音交互应用。
narrator - AI实时生活解说,模拟David Attenborough风格
AI应用开发API接口GithubReplicate开源项目机器学习模型语音合成
David Attenborough narrates your life 项目是一款基于AI技术的创新应用,能将日常生活场景实时转化为纪录片风格的解说。该项目整合了Replicate平台的机器学习模型、OpenAI的自然语言处理能力和ElevenLabs的语音合成技术,通过实时摄像头捕捉和AI语音生成,模仿著名纪录片解说员David Attenborough的风格,为普通生活场景添加独特的叙事视角。项目采用Python编写,支持简单的环境配置和API设置。开发者可以通过Replicate平台轻松部署和运行相关机器学习模型,结合OpenAI的语言生成能力和ElevenLabs的语音合成技术,实现实时视频捕捉和AI驱动的解说功能。这种创新应用为探索AI在日常生活中的创意应用提供了新的思路。
Infinite Adversaries - ChatGPT和DALL-E创造的无尽程序化游戏世界
AI工具Infinite Adversaries导航栏标题网站链接
Infinite Adversaries是一个创新的在线游戏平台,结合ChatGPT的叙事能力和DALL-E的图像生成技术,打造出无尽的程序化游戏内容。这种独特的组合为玩家带来前所未有的游戏体验,每次冒险都是独一无二的。游戏中充满了不可预测的挑战和故事情节,让玩家沉浸在一个永远变化的虚拟世界中。探索无限可能的RPG、策略和解谜游戏,体验AI驱动的个性化游戏乐趣。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号