TokenHMR

基于令牌化姿态表示的人体网格重建新方法

TokenHMR 人体网格恢复计算机视觉姿态表示深度学习 Github 开源项目

TokenHMR采用阈值自适应损失缩放和令牌预测技术,通过令牌化和TokenHMR两个阶段提高3D人体网格重建精度。该方法在图像对齐和3D姿态估计方面均有良好表现,可用于图像和视频处理,对人体姿态和形状估计研究具有重要意义。

MotionBERT - 多任务人体运动表征学习框架

GithubMotionBERT人体动作表示姿态估计开源项目深度学习计算机视觉

MotionBERT是一个多任务人体运动表征学习框架，整合了3D人体姿态估计、基于骨骼的动作识别和人体网格恢复等任务。该项目提供预训练模型和下游任务实现，支持自定义视频推理和生成以人为中心的视频表征。MotionBERT在多个基准测试中展现出优异性能，为人体运动分析研究提供了一个统一且高效的解决方案。

openpose - 实时检测人体、手部、面部和足部的多人人体关键点

CMU Panoptic StudioGithubOpenPose三维重建人体姿态识别实时多人人体关键点检测开源项目

OpenPose是首个实现实时多人人体、手部、面部和足部关键点检测的系统，能够在单张图像上检测135个关键点。其功能包括2D和3D姿态估计、支持Unity插件和多种输入输出方式，兼容多个操作系统和硬件配置，适用于研究和开发项目。

RSN - 高效聚合特征实现精确人体姿态估计

COCO数据集GithubRSN关键点检测姿态估计开源项目计算机视觉

RSN项目提出Residual Steps Network姿态估计方法,通过聚合同一空间尺度特征获得精细局部表示,实现精确关键点定位。项目引入Pose Refine Machine注意力机制进一步优化关键点位置。RSN在COCO和MPII基准测试中取得领先结果,并在2019年COCO关键点挑战赛中获得第一名和最佳论文奖。该方法在多人姿态估计任务中展现出优异性能。

PoseFix_RELEASE - 模块化设计的人体姿态优化工具

GithubPoseFixTensorFlow人类姿态估计图像处理开源项目模型无关

PoseFix是一个模块化设计的人体姿态优化工具，通过精炼现有的姿态估计结果来提升精度。此项目提供了完整的TensorFlow实现，兼容多个公开的2D多人物姿态数据集，如MPII、PoseTrack 2018和MS COCO 2017。用户只需使用简单的.json文件即可改进姿态估计结果。该工具具有灵活性和易于集成的特点，适用于各种姿态估计方法，应用前景广阔。

MVHumanNet - 多视角日常穿着人体捕捉大规模数据集

GithubMVHumanNet人体捕捉多视角开源项目数据集计算机视觉

MVHumanNet是一个大规模多视角人体捕捉数据集，包含4,500个人物身份、9,000套日常服装和60,000个动作序列。数据集提供645百万帧图像，附带丰富标注，如人体遮罩、相机参数、2D/3D关键点、SMPL/SMPLX参数及相应文本描述。这一资源为计算机视觉和人体建模研究提供了重要支持，适用于多种应用场景。

tram - 从非受控视频中重建3D人体全局轨迹和动作

3D人体捕捉GithubTRAM开源项目深度学习视频处理计算机视觉

TRAM是一个开源的4D人体捕捉系统，专门用于从非受控视频中估计3D人体的全局轨迹和动作。该系统集成了目标跟踪、SLAM和4D人体捕捉技术，能在世界坐标系中精确重建人体运动。TRAM的工作流程包括相机位姿估计、人体检测跟踪和4D人体重建，为复杂场景中的人体运动分析提供了有力工具。

TF-SimpleHumanPose - 2D多人体姿态估计和追踪的简易基线方法

GithubMS COCOTensorFlow姿态估计开源项目简单基线跟踪

该项目是利用TensorFlow实现的2D多人体姿态估计与追踪代码库，兼容多个数据集如MPII、PoseTrack 2018和MS COCO 2017。其代码简洁灵活，提供训练、测试和可视化功能，并生成与MS COCO和PoseTrack兼容的输出文件。在CUDA和cuDNN环境的Ubuntu系统上进行多GPU训练和测试。

PHALP - 基于3D外观、位置和姿态预测的人体跟踪技术

3D外观预测GithubPHALP人体跟踪位置预测姿态预测开源项目

PHALP是一个开源的3D人体跟踪项目，利用人体3D外观、位置和姿态预测实现精确跟踪。该项目提供完整代码实现，包含安装指南、演示代码、数据集准备和评估工具。PHALP可处理视频文件、YouTube视频和图像目录等多种输入源，并具备多样化的可视化功能。这一工具为人体动作分析和计算机视觉研究提供了有力支持。

hold - 视频中手物交互的无模板3D重建技术

3D重建GithubHOLD开源项目手部交互物体重建计算机视觉

HOLD是一种先进的计算机视觉技术，可从单目视频中重建手部和物体的3D几何形状，无需预先扫描物体模板。这项技术能够重建新颖物体和手部的3D结构，支持双手操作物体、无纹理物体以及多物体交互场景的重建。项目提供预处理数据、训练脚本和评估工具，为研究人员和开发者提供了全面的3D重建解决方案。

PARE - 三维人体姿态与形状估计的遮挡问题解决方案

3D人体姿态估计GithubICCV 2021PAREPyTorch人体形状估计开源项目

PARE是一种三维人体姿态和形状估计方法，具备遮挡鲁棒性。该项目基于PyTorch实现，提供演示和评估代码，支持在Ubuntu 18.04和Python 3.7以上环境下运行。用户可以通过Google Colab体验其功能，包括详细的训练和评估指引以及遮挡敏感性分析脚本，适用于非商业科学研究。

相关项目

推荐项目

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具，简化了选题、文献检索至论文撰写的整个过程。通过简单设定，平台可快速生成高质量论文大纲和全文，配合图表、参考文献等一应俱全，同时提供开题报告和答辩PPT等增值服务，保障数据安全，有效提升写作效率和论文质量。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com