Project Icon

head-pose-estimation

实时人脸姿态估计,使用ONNX Runtime和OpenCV进行处理

本项目提供了一个实时的人脸姿态估计解决方案,依赖于ONNX Runtime和OpenCV框架。主要步骤包括人脸检测、68个面部标志点检测以及姿态估计。支持Ubuntu 22.04,提供简单的安装步骤和预训练模型下载链接,使用户可以快速启动并运行。本项目支持视频文件和摄像头输入,提供了详尽的训练指导和代码库,确保了高度的灵活性和扩展性,适合开发和测试用途。

mmpose - 先进的开源姿态估计工具箱
GithubMMPoseOpenMMLabPyTorch姿态估计开源项目计算机视觉
MMPose是基于PyTorch的开源姿态估计工具箱,支持2D多人人体姿态估计、手部姿态估计等多种主流任务。该工具箱实现了多个先进的深度学习模型,在训练速度和准确性方面表现出色。MMPose支持COCO、MPII等多个数据集,提供详细文档和API参考。其模块化设计便于用户构建自定义的姿态估计框架,适用于相关研究与应用开发。
InsightFace-REST - 便捷可扩展的面部检测与识别API解决方案
DockerFastAPIGithubInsightFace-RESTNVIDIA TensorRT人脸识别开源项目
InsightFace-REST提供使用FastAPI部署的面部检测和识别REST API,基于NVIDIA TensorRT进行优化。支持SCRFD检测器和ArcFace识别模型,自动下载模型,支持批处理和FP16推理,实现高性能。在启用NVIDIA GPU的系统上,通过Docker轻松部署和扩展,同时支持CPU上的ONNX推理,满足多样化需求。
retinaface - 深度学习人脸检测和标志识别工具
GithubPythonRetinaFace人脸检测人脸识别开源项目深度学习
RetinaFace是一个基于深度学习的高效人脸检测工具,能够在人群中准确检测人脸,并识别人脸标志。它是insightface项目的一部分,支持TensorFlow和MxNet。通过pip安装后,RetinaFace可以检测图像中的人脸并返回坐标和标志。结合ArcFace,形成了完整的人脸识别管线。其功能包括检测、对齐、标准化、表示和验证,显著提升了识别准确性。适用于需要高精度人脸识别的应用场景,并支持社区贡献和多种方式的支持。
Deep-Live-Cam - 开源实时人脸替换工具
AI换脸Deep-Live-CamGithub人工智能图像处理开源项目视频处理
Deep-Live-Cam是一个开源的实时人脸替换项目,支持视频和网络摄像头人脸替换。该工具采用深度学习算法,提供GPU加速,可快速完成高质量人脸替换。项目面向艺术家和内容创作者,注重伦理使用,内置不当内容检测。Deep-Live-Cam安装简便,界面直观,为AI生成媒体领域提供了实用解决方案。
control_v11p_sd15_openpose - 基于OpenPose的人体姿态控制AI图像生成模型
ControlNetGithubHuggingfaceStable Diffusion人工智能图像生成姿态检测开源项目模型
这是一个基于Stable Diffusion v1-5的图像生成控制模型,专注于人体姿态控制。相比1.0版本,该模型改进了OpenPose实现,增强了手部和面部细节控制,并优化了训练数据集。它能生成更自然准确的图像,为创作者提供精确的人物姿态控制功能。该模型可与Stable Diffusion v1-5无缝集成,适用于需要精细人体姿态控制的AI图像生成场景。
SPIGA - 结合CNN和GNN的人脸对齐与头部姿态估计算法
CNNGithubSPIGA人脸对齐图注意力网络头部姿态估计开源项目
SPIGA是一个结合CNN和GNN优势的人脸对齐和头部姿态估计算法。它能在复杂外观变化下生成合理的人脸形状,并在多个数据集上达到顶尖性能。该项目提供简单的推理框架,便于集成到其他应用中。此外,SPIGA还包含通用的数据加载器和基准测试工具,可用于相关任务的研究开发。
facenet-pytorch - Pytorch下基于预训练模型和快速MTCNN的人脸识别技术
Face RecognitionGithubInception Resnet V1MTCNNPytorchVGGFace2开源项目
facenet-pytorch是一个开源项目,利用Pytorch实现的Inception Resnet (V1)模型,已在VGGFace2和CASIA-Webface上预训练。项目还包括高效的MTCNN实现,用于人脸检测。其特点包括快速人脸检测、生成面部识别嵌入、视频流中的人脸跟踪以及从TensorFlow到Pytorch的参数转换。开发者可以通过简单的安装和使用指引快速集成和应用这些高精度、高性能的预训练模型和工具。
depthai - 深度学习与视频录制的多功能演示应用
DepthAIDockerGithubLuxonisPython依赖安装开源项目
这个项目提供了一个多功能的深度学习API演示程序,支持加载多种神经网络、创建管道和录制视频等功能。附有详细的安装指南和多种使用案例(包括QT GUI界面和命令行模式),用户能够轻松上手和测试DepthAI的功能。项目还支持多种AI模型,并可通过Docker运行,适用于开发者和机器学习爱好者。
yolov5-deepsort-tensorrt - 基于YOLOv5和DeepSORT的Jetson设备目标跟踪系统
DeepSortGithubJetsonTensorRTYolov5开源项目目标跟踪
这个项目是YOLOv5和DeepSORT算法在Jetson设备上的C++实现,针对Jetson Xavier NX和Jetson Nano进行了优化。系统能够高效跟踪多个人头目标,在Jetson Xavier NX上处理70多个目标时可达到10 FPS。项目包含环境配置、模型生成和运行指南,支持自定义模型,并提供了不同YOLOv5版本的兼容性说明。适合需要在边缘设备上进行高性能目标跟踪的应用场景。
YOLOv8-TensorRT-CPP - 用C++和TensorRT实现高效的YOLOv8模型推理
CPPGithubTensorRTYOLOv8开源项目深度学习目标检测
本文介绍了如何使用TensorRT的C++ API实现YOLOv8模型的推理,支持目标检测、语义分割和身体姿态估计,包括系统要求、安装步骤、模型转换和项目构建方法。内容中强调了在GPU上运行推理的注意事项和性能基准测试,提供了从PyTorch到ONNX模型转换的详细步骤,是开发计算机视觉应用的参考资料。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号