MocapNET

基于RGB图像的3D人体姿态实时估计

MocapNET 3D姿态估计实时性能 RGB图像 Tensorflow Github 开源项目

MocapNET项目通过2D关节估计，将单目RGB图像转换为3D人体姿态，实现实时估计。它采用NSRM表示法、新的人体方位分类器和复合神经网络，能够在显著遮挡情况下精确恢复人体姿态。通过逆运动学解算器，MocapNET显著提升了人体姿态估计的准确性。最新的MocapNET v4版本用Python重写，支持3D凝视和BVH面部配置检索，并提供一键Google Collab部署和Blender 3D编辑器插件。项目不断更新，旨在提高其对社区的实用性和可访问性。

访问官网

Github

介绍相关项目

facenet-pytorch - Pytorch下基于预训练模型和快速MTCNN的人脸识别技术

Face RecognitionGithubInception Resnet V1MTCNNPytorchVGGFace2开源项目

facenet-pytorch是一个开源项目，利用Pytorch实现的Inception Resnet (V1)模型，已在VGGFace2和CASIA-Webface上预训练。项目还包括高效的MTCNN实现，用于人脸检测。其特点包括快速人脸检测、生成面部识别嵌入、视频流中的人脸跟踪以及从TensorFlow到Pytorch的参数转换。开发者可以通过简单的安装和使用指引快速集成和应用这些高精度、高性能的预训练模型和工具。

RobustVideoMatting - 实现实时且高分辨率的视频抠图技术

GithubPyTorchRVMRobust Video Matting实时性能开源项目热门视频抠图

RobustVideoMatting（RVM）是针对视频中人物进行抠图的专利技术，采用循环神经网络结构优化视频帧的时序处理，无需额外输入即可实现实时抠图。该项目支持4K 76FPS和HD 104FPS的实时处理速度，可广泛应用于各种视频编辑和增强场景。

acezero - 基于增量学习的图像集合场景重建与姿态估计方法

ACE0GithubPyTorch场景坐标重建开源项目深度估计相机注册

该项目提出了一种基于增量学习的场景坐标重建方法，结合了RANSAC和DSAC*算法，实现了高精度的图像姿态估计。ACE0提供了丰富的实验数据和可视化工具，支持部分重建和自监督重定位等高级用例。项目代码基于PyTorch实现，并已在Ubuntu 20.04和多种GPU环境下测试。

ICON - 利用法线预测实现穿衣人体的隐含表达，从RGB图像生成高细节的3D模型，包括衣服和人体网格

3D重建CVPR 2022GithubICON人体网格开源项目深度学习

ICON项目利用法线预测实现穿衣人体的隐含表达，从RGB图像生成高细节的3D模型，包括衣服和人体网格。项目支持多种基于PyTorch的模型，适合不同训练和评估需求。最新发布的ECON在此基础上进一步改进了功能。

RoHM - 基于扩散模型的稳健人体运动重建系统

AMASS数据集GithubRoHMSMPL-X人体动作重建开源项目扩散模型

RoHM是一个基于扩散模型的人体运动重建系统。它可以从含噪声和遮挡的输入数据中，在统一的全局坐标系下重建完整合理的人体运动。该系统将任务分为全局轨迹和局部运动两部分，并采用创新的条件模块捕捉二者关联。RoHM在多个标准数据集上表现优异，为人体运动重建研究提供了新的解决方案。

shape-of-motion - 从单个视频实现4D场景重建的前沿技术

4D重建GithubShape of Motion单视频重建开源项目深度学习计算机视觉

Shape of Motion项目展示了一种新型4D重建方法，可从单个视频重建动态3D场景。该项目结合深度学习和计算机视觉技术，实现运动物体的精确重建。项目包含完整工作流程，涵盖预处理、模型训练和性能评估。研究团队公开了源代码和数据集，为计算机视觉领域提供了有价值的研究资源。这一技术可能在计算机图形学、增强现实等方面带来应用突破。

first-order-model - First Order Motion Model：图像动画的高效解决方案

DockerFirst Order Motion ModelGithubPython图像动画开源项目数据集

First Order Motion Model项目提供了一种先进的图像动画运动模型，通过驾驶视频和源图像生成逼真的动画序列。支持包括VoxCeleb、Fashion和MGIF在内的多种数据集，提供详细的安装和使用指南。项目支持Python和Docker，确保了环境兼容性，还提供Colab和Kaggle的在线演示。此外，该项目还具备面部交换功能，适用于监督和非监督的视频编辑任务。

HumanBench - 推动人体感知基础模型研究进展

CVPRGithubHumanBench人体感知基础模型开源项目计算机视觉

HumanBench项目致力于开发通用人体感知基础模型，包含PATH和UniHCP两个子项目，均发表于CVPR 2023。该项目采用投影辅助预训练技术，旨在提升模型性能，为计算机视觉领域提供新的研究方向。项目代码已开源，上海人工智能实验室正在招募相关研究人员和工程师，共同推进人体感知基础模型的研究。

Motion-X - 丰富表现力的3D全身人体动作数据集

GithubMotion-XSMPL-X人体动作数据集多模态开源项目表情动作

Motion-X是一个大规模的3D全身人体动作数据集，包含15.6M个全身姿势和81.1K个动作片段的SMPL-X参数注释。数据集提供动作标签、文本标签及RGB视频、音频等多模态信息。Motion-X支持文本驱动的3D人体动作生成、全身网格恢复等多种任务。通过整合现有数据集并添加在线视频数据，Motion-X为人体动作研究提供了丰富的资源。

相关项目

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

Project Cover

稿定AI

稿定设计是一个多功能的在线设计和创意平台，提供广泛的设计工具和资源，以满足不同用户的需求。从专业的图形设计师到普通用户，无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑，稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合，帮助用户轻松实现创意设计。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号