Logo

#人体姿态估计

Logo of deep-high-resolution-net.pytorch
deep-high-resolution-net.pytorch
deep-high-resolution-net.pytorch 项目提供了一个基于PyTorch的官方实现,专门用于人体姿态估计的深度学习模型。项目支持多个标准数据集,验证了其可靠性与准确性,也适应于多种视觉任务如图像分类及目标检测等。
Logo of PyMAF-X
PyMAF-X
PyMAF-X是一个开源的3D人体重建项目,利用金字塔网格对齐反馈循环技术,从单幅图像或视频中重建全身3D人体模型。该方法在COCO等数据集上表现优异,适用于计算机视觉和动作捕捉等领域。项目提供预训练模型,支持图像和视频输入,便于研究和应用。
Logo of SMPLer-X
SMPLer-X
SMPLer-X是一个基于ViT主干网络的人体姿态和形状估计框架,通过多数据集训练实现高精度和高效率。该框架提供多种规模的模型版本,适应不同计算资源。SMPLer-X在多个基准测试中表现优异,支持便捷的推理、训练和测试。项目还提供Docker部署,为研究和开发提供灵活的人体3D重建工具。
Logo of MonocularTotalCapture
MonocularTotalCapture
MonocularTotalCapture是一个开源项目,旨在实现野外环境下的单目3D人体姿态全方位捕捉。该系统同时捕捉人脸、身体和手部姿态,采用Adam可变形人体模型和OpenPose技术。基于CVPR19研究成果,项目提供完整的安装使用指南,为计算机视觉研究和3D重建提供了有力工具,仅限非商业研究使用。
Logo of HumanArt
HumanArt
Human-Art数据集包含50,000张来自20个场景的图像,涵盖自然和人工环境中的2D和3D人体表现。该数据集提供人体边界框、21个2D关键点、自接触关键点和描述文本等标注,旨在推进多场景人体检测、姿态估计和3D重建等任务。Human-Art的多样性有助于提高模型在实际应用中的特征提取和人体理解能力,同时支持跨域应用和可控人体图像生成。
Logo of MogaNet
MogaNet
MogaNet是一种创新的卷积神经网络架构,采用多阶门控聚合机制实现高效的上下文信息挖掘。这一设计在保持较低计算复杂度的同时,显著提升了模型性能。MogaNet在图像分类、目标检测、语义分割等多项计算机视觉任务中展现出优异的可扩展性和效率,达到了与当前最先进模型相当的水平。该项目开源了PyTorch实现代码和预训练模型,便于研究者进行进一步探索和应用。
Logo of litepose
litepose
LitePose是一种针对边缘设备的高效单分支架构,专用于实时多人姿态估计。通过融合解卷积头和大卷积核,该模型显著提升了性能。在移动平台上,LitePose将延迟降低5倍,同时保持估计精度。项目开源了预训练模型、训练脚本和评估工具,支持COCO和CrowdPose数据集。
Logo of AiOS
AiOS
AiOS是一个创新的人体姿态和形状估计框架,采用全新的全流程方法。该项目通过三阶段的渐进式处理,实现高精度的SMPL-X参数回归。AiOS支持多人场景分析,并能有效处理复杂遮挡情况。在AGORA和BEDLAM等多个基准数据集上,AiOS展现出卓越的性能表现。这一开源项目为计算机视觉和人机交互等领域提供了有力的研究工具。
Logo of HumanFallDetection
HumanFallDetection
HumanFallDetection项目是一个基于多摄像头和人工智能的跌倒检测系统。它整合了人体姿态估计、多目标跟踪和LSTM神经网络技术,实现实时多人跌倒检测。系统支持处理视频文件或实时摄像头数据,提供灵活的命令行配置。这一技术在老年人护理、医疗监控等领域具有重要应用价值,有助于提高安全监测效率。