Project Icon

head-pose-estimation

实时人脸姿态估计,使用ONNX Runtime和OpenCV进行处理

本项目提供了一个实时的人脸姿态估计解决方案,依赖于ONNX Runtime和OpenCV框架。主要步骤包括人脸检测、68个面部标志点检测以及姿态估计。支持Ubuntu 22.04,提供简单的安装步骤和预训练模型下载链接,使用户可以快速启动并运行。本项目支持视频文件和摄像头输入,提供了详尽的训练指导和代码库,确保了高度的灵活性和扩展性,适合开发和测试用途。

heartbeat - 基于视频分析的非接触式心率测量开源项目
Github人脸检测信号处理开源项目心率测量无接触监测远程光电容积脉搏波描记法
Heartbeat是一个利用远程光体积描记法(rPPG)进行心率测量的开源项目。该项目采用OpenCV库实现人脸检测和跟踪,通过频率分析和滤波技术估算心率。它通过分析面部视频中的细微肤色变化来实现非接触式心率监测。Heartbeat支持实时视频流分析和离线视频文件处理,并提供多种算法选项和可调参数。这一创新工具不仅适用于研究人员和开发者,还为远程健康监测和情感状态评估等领域提供了新的可能性,展示了计算机视觉技术在健康监测领域的巨大潜力。
openvino - 提升深度学习模型部署与优化的开源工具包
AI应用GithubOpenVINO开源项目性能提升模型部署深度学习模型优化热门
OpenVINO™是一款开源软件工具包,用于优化和部署深度学习模型。它支持多种框架如TensorFlow、PyTorch等,能在从边缘到云的多种平台上高效部署。此工具包还包含大量社区资源和教程,助力提升计算机视觉、自然语言处理等领域的模型性能。
onnx-web - 简化ONNX模型运行的跨平台工具
AI绘图GithubStable Diffusiononnx-web图像生成开源项目硬件加速
onnx-web是一个简化ONNX模型运行过程的开源工具,支持AMD和Nvidia GPU加速以及CPU回退。它提供用户友好的Web界面,支持txt2img、img2img等多种diffusion管道。该工具允许添加自定义模型,融合LoRA等附加网络,并具有多阶段和区域提示功能。onnx-web还提供API接口,适用于各种创作需求。
controlnet-openpose-sdxl-1.0 - 基于SDXL的OpenPose人体姿态控制模型
GithubHuggingfaceOpenPoseSDXL-controlnetStable Diffusion人工智能绘画图像生成开源项目模型
这是一个基于Stable Diffusion XL的ControlNet模型,专门用于OpenPose人体姿态控制。通过人体骨骼图,用户可以精确控制生成图像中的人物姿势。该模型支持Diffusers和ComfyUI框架,可用于创建多种姿势的人物图像。模型在LAION数据集上训练,具有良好的性能。
FollowYourPose - 基于姿态和文本的自动视频生成技术
AAAI 2024AI生成Follow-Your-PoseGithub姿态控制开源项目文本生成视频
FollowYourPose项目提出了一种新方法,可以通过姿态和文本生成视频。该方法采用两阶段训练方案,利用易获取的数据集和预训练的文本到图像模型,生成可编辑且姿态可控的角色视频。第一阶段通过关键点图像对进行文本到图像的生成,第二阶段利用姿态自由视频数据集微调网络,成功生成连续的姿态可控角色视频,同时保留预训练模型的编辑和概念组合能力。
April-Tag-VR-FullBody-Tracker - 开源AprilTag技术实现低成本VR全身动作追踪
AprilTagGithubOpenCVVR全身追踪WxWidgets开源项目
April-Tag-VR-FullBody-Tracker项目利用AprilTag标记技术实现VR全身追踪。该开源方案仅需手机和纸板即可实现免费动作捕捉。系统采用精确的AprilTag技术,配备图形界面和简化校准流程,提高了易用性。用户通过制作三个追踪器,可在VRChat等应用中实现腿部和臀部的全身追踪。这为VR爱好者提供了一种成本效益高的全身追踪解决方案。
faceswap - 面部识别与交换工具,支持图片和视频处理
AI换脸FaceSwapGithub人脸识别开源项目深度学习视频处理
FaceSwap是一款深度学习驱动的面部识别和交换工具,适用于图片和视频。该项目支持Windows、Linux和MacOS操作系统,通过提取、训练和转换步骤实现面部交换,并支持GPU加速处理。FaceSwap提供详细的安装和使用指南,并拥有活跃的社区支持,包括Discord服务器和专门论坛。项目遵循严格的道德标准,倡导合理合法的使用,致力于推动AI技术的学习与应用。
torchlm - 面向人脸关键点检测的开源工具包
Githubtorchlm人脸关键点检测开源项目数据增强模型训练深度学习
torchlm是一个开源的人脸关键点检测工具包,提供训练、评估、导出和推理功能。它包含100多种数据增强方法,支持30多种原生关键点增强,可与torchvision和albumentations集成。torchlm实现了PIPNet等先进模型,在多个基准数据集上性能出色。该项目简化了人脸关键点检测的开发流程,适用于研究和实际应用。
opensphere - 统一的高维球面人脸识别训练评估框架
GithubOpenSpherePyTorch人脸识别开源项目深度学习超球面
OpenSphere是基于PyTorch的高维球面人脸识别库,提供统一的训练和评估框架。该项目将损失函数与其他组件解耦,支持公平比较不同损失函数。OpenSphere实现了多种先进的损失函数和网络架构,包括SphereFace系列,并集成了丰富的数据集。这一开源平台旨在为相关研究提供可复现的基准环境。
virtual-background - 浏览器内实时视频流虚拟背景替换,支持多个机器学习模型
BodyPixGithubML KitMediaPipeVirtual BackgroundWebAssembly开源项目
该项目展示了如何在浏览器实时视频流中,添加虚拟背景并切换三种预训练机器学习模型,包括BodyPix、MediaPipe Meet Segmentation和ML Kit Selfie Segmentation。用户可以对桌面和移动设备上的不同模型性能进行比较。此项目提供了详细的实现细节、性能分析及改进建议。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号