Project Icon

Facemoji

表情追踪结合AI语音交互的Unity项目

Facemoji是一个专为Android开发的Unity项目,实现了面部表情追踪和AI语音聊天的结合。利用OpenCV和Dlib技术,检测并转换用户面部表情为Live2D模型,并支持动态GIF录制。该项目整合了图灵机器人和科大讯飞的语音技术,允许用户以中文进行语音或文本对话,提供沉浸式AI交互体验。

Emojinator - 基于机器学习的手势表情识别与分类
EmojinatorGithub开源项目手势识别机器学习电子信息表情符号
Emojinator项目通过机器学习技术提供不同手势表情的识别和分类解决方案。项目包含多个版本(如Emojinator 2.0和3.0),有详细的文件组织结构和创建手势及训练模型的代码。特别适合需处理电子消息和网页表情符号的应用场景,欢迎开发者们尝试使用。
Expressive-FastSpeech2 - 非自回归表情文本到语音合成技术
Expressive-FastSpeech2Github多语言支持对话TTS开源项目情感TTS非自回归TTS
Expressive-FastSpeech2是一个非自回归表情文本到语音(TTS)的研究项目,专注于emotional和conversational TTS。该项目使用AIHub多模态视频AI数据和IEMOCAP数据库进行韩语和英语的处理,并提供了不同语言适应和数据处理的指导。
speech-driven-animation - 语音驱动的端到端面部动画合成模型
GithubSpeech-Driven Animation人脸合成开源项目深度学习视频动画语音驱动
Speech-Driven Animation是一个开源项目,实现语音驱动的端到端面部合成模型。该项目根据输入图像和音频生成面部动画视频,支持GRID、TIMIT和CREMA等预训练模型。通过API可输入自定义音频和图像,输出同步动画视频。项目还提供音频和视频编码器,可用于特征提取和分类任务。
iSamur.ai - AI驱动的面部处理工具提升内容创作效率和质量
AI人脸增强AI工具iSamur.ai人脸交换图像处理视频编辑
iSamur.ai是一款专注于面部处理的AI内容创作工具,提供面部增强、修复和换脸等功能。该工具支持长视频处理和高分辨率输出,适合专业人士和内容创作者使用。iSamur.ai特点是处理速度快、价格实惠,为用户提供广阔的创意空间。未来还将推出语音文本转换、多媒体处理等功能,进一步拓展内容创作可能性。
MimicTalk - 在几分钟内快速生成个性化的3D数字人
3D互动头像AI生成GithubMimicTalkReal3D-Portrait开源项目音驱动
MimicTalk提供了一种基于Pytorch的系统,通过短时间内训练生成具个性化和表现力的3D动态面孔。项目基于Real3D-Portrait的研究,利用NeRF框架实现高效头像动画。用户可通过演示页面观看视频示例,并通过项目提供的方法指南进行特定任务操作。该项目提供CLI和Gradio WebUI支持,能够进行针对特定用户的音频驱动动态头像生成,同时确保合法使用和版权保护。
Meet Mine AI - 多语言智能虚拟角色创建与互动系统
AI工具Meetmine.ai人工智能客户支持智能头像虚拟角色
Meet Mine AI提供智能虚拟角色创建和互动服务。平台支持多语言和口音,具备100多个头像模板,可根据数据进行训练和定制。用户能创建表情丰富的智能角色或商业机器人,支持自然对话并持续学习。该系统拥有先进的多语言处理和丰富的表情系统,适用于客户支持、网站集成等多种场景,为用户带来创新的AI互动体验。
ComfyUI-PhotoMaker-ZHO - PhotoMaker 的非官方实现,支持 lora、多批次处理和通用提示词输入
AI绘图ComfyUIGithubPhotoMaker图像处理开源项目模型加载
ComfyUI-PhotoMaker 是 PhotoMaker 的非官方实现,支持 lora、多批次处理和通用提示词输入。用户可以下载或本地加载模型,并应用多种风格模板生成高质量图像。适合需要快速生成多样风格图像的设计师和开发者,版本 V2.5 新增了对 Disney-Character 和 DragNUWA 工作流的支持,提升了生成速度和操作便捷性。
SyncTalk - 同步技术驱动的高质量说话头像合成
CVPRGithubSyncTalk人工智能头像合成开源项目计算机视觉
SyncTalk项目通过三平面哈希表示法实现高度同步的说话头像视频合成。该技术生成同步的唇部运动、面部表情和稳定的头部姿势,同时还原发型细节,创造高分辨率视频。在保持人物身份的同时,项目显著提升了说话头像的自然度和真实感。
RisuAI - 跨平台AI聊天软件与多功能网络应用
AI聊天软件GithubRisuAI多API支持开源项目正则表达式跨平台
RisuAI是一个功能丰富的跨平台AI聊天软件,支持多API、实时群聊、可定制插件及多语言翻译,非常适合角色扮演和提升聊天体验。了解更多关于RisuAI的信息,发掘其带来的全新聊天互动体验。
arcore-depth-lab - ARCore Depth API在Unity中的高级AR交互示例
AR FoundationARCoreGithubUnity开源项目深度API深度图
ARCore Depth Lab项目包含多个利用深度API的AR交互示例,如3D准星、深度可视化、碰撞检测和角色运动等。基于AR Foundation开发,支持特定Android设备。项目展示了深度数据在AR中的实际应用,为开发者提供了探索深度感知AR技术的示例代码。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

稿定AI

稿定设计 是一个多功能的在线设计和创意平台,提供广泛的设计工具和资源,以满足不同用户的需求。从专业的图形设计师到普通用户,无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑,稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合,帮助用户轻松实现创意设计。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号