RSN

高效聚合特征实现精确人体姿态估计

RSN 姿态估计 COCO数据集关键点检测计算机视觉 Github 开源项目

RSN项目提出Residual Steps Network姿态估计方法,通过聚合同一空间尺度特征获得精细局部表示,实现精确关键点定位。项目引入Pose Refine Machine注意力机制进一步优化关键点位置。RSN在COCO和MPII基准测试中取得领先结果,并在2019年COCO关键点挑战赛中获得第一名和最佳论文奖。该方法在多人姿态估计任务中展现出优异性能。

访问官网

Github

介绍相关项目

PSGAN - 姿势和表情鲁棒的空间感知妆容迁移技术

GithubPSGAN人脸识别妆容迁移开源项目深度学习计算机视觉

PSGAN是一种新型的妆容迁移技术，能够在不同姿势和表情下实现精确的妆容转移。该技术利用空间感知GAN架构，支持高度定制化的妆容效果，并能保留细节。PSGAN不仅适用于静态图像，还可应用于视频中的实时妆容迁移，为计算机视觉和美妆行业带来新的研究方向。项目还增加了使用拉普拉斯变换的高分辨率人脸支持功能，进一步提升了技术的应用范围和效果。PSGAN的开源代码支持GPU推理和训练，为研究者和开发者提供了便利的实验环境。

PHALP - 基于3D外观、位置和姿态预测的人体跟踪技术

3D外观预测GithubPHALP人体跟踪位置预测姿态预测开源项目

PHALP是一个开源的3D人体跟踪项目，利用人体3D外观、位置和姿态预测实现精确跟踪。该项目提供完整代码实现，包含安装指南、演示代码、数据集准备和评估工具。PHALP可处理视频文件、YouTube视频和图像目录等多种输入源，并具备多样化的可视化功能。这一工具为人体动作分析和计算机视觉研究提供了有力支持。

FCOS - 完全卷积单阶段对象检测技术

FCOSGithubResNet-50卷积神经网络开源项目性能提升目标检测

FCOS算法是一种完全卷积的单阶段对象检测方法，通过避免使用锚点框，提高了检测性能和速度。在COCO minival数据集上，FCOS实现了46FPS和40.3的AP评分，并在各种模型和硬件上表现出色，包括ResNe(x)t和MobileNet等。与Faster R-CNN相比，FCOS在ResNet-50平台上表现更佳（38.7对36.8的AP），且训练和推理时间更短。该项目已基于Detectron2实现，并引入了多项优化和改进。

GPS-Gaussian - 通用像素级3D高斯表示实现实时人体新视角合成

3D Gaussian SplattingGithub人体新视角合成实时渲染开源项目深度学习计算机视觉

GPS-Gaussian提出了一种通用像素级3D高斯表示方法，可实时合成未见过人物的新视角。无需微调或优化即可生成高质量图像，具有出色的泛化性能。项目包含安装指南、数据准备、训练和测试流程，支持合成和真实数据集评估。该方法在人体新视角合成任务中展现实时渲染能力。

3D-ResNets-PyTorch - 用于动作识别的 3D ResNets

3D ResNetsAction RecognitionGithubPyTorchSpatiotemporal 3D CNNs开源项目预训练模型

该项目提供基于PyTorch的3D ResNet代码，适用于动作识别，支持Kinetics和Moments in Time等数据集。项目包含训练、微调和测试脚本，并提供预训练模型，支持最新的PyTorch版本和分布式训练。用户可使用详细脚本进行数据准备和模型评估，适合研究与应用。

dressing-in-order - 递归生成人物图像的姿势迁移和虚拟试衣技术

GithubICCV人像生成姿势迁移开源项目服装编辑虚拟试衣

Dressing in Order 项目开发了一种创新的人物图像生成方法，实现姿势迁移、虚拟试衣和服装编辑功能。系统通过递归方式按顺序生成人物图像各部分，提高了图像操控的精细度和灵活性。项目提供开源代码、预训练模型和在线演示，便于研究者探索和应用这一技术。

GSM - 创新框架实现高效3D人体生成

3D人体生成3D渲染Github开源项目深度学习生成对抗网络高斯贝壳图

Gaussian Shell Maps (GSM)框架结合了先进的生成器网络和3D高斯渲染技术，用于高效生成3D数字人物。GSM采用多层壳结构，通过卷积神经网络生成3D纹理并映射到壳上。该方法可在单视图数据集上训练，生成多视图一致的高质量3D人体模型，并支持任意姿势变形。GSM为虚拟现实、社交媒体和电影制作等领域提供了创新的3D人体生成技术。

Parts2Whole - 多参考框架实现可控人像生成

GithubParts2Whole人像生成参考框架开源项目深度学习计算机视觉

Parts2Whole提出新型框架,利用多个参考图像生成定制人像。该框架包含语义感知外观编码器和多图像条件生成的共享自注意力机制,能精确选择人体部位实现高度可控生成。项目开源全套代码、模型和数据集,为人像生成研究提供完整解决方案。

GauHuman - 基于单目人体视频的高效3D重建与渲染技术

GauHumanGithub人体建模单目视频实时渲染开源项目高斯泼溅

GauHuman是一种新型3D人体重建技术，利用单目人体视频学习关节化高斯散射模型。该方法训练速度快(1-2分钟)，渲染实时(最高189 FPS)，适用于ZJU-Mocap和MonoCap等数据集。GauHuman提供高效的训练和评估流程，在3D人体重建和渲染领域表现出色，为相关研究开辟新途径。

d2-net - 深度学习驱动的联合特征检测与描述

CNND2-NetGithub开源项目深度学习特征提取计算机视觉

D2-Net是一个用于联合检测和描述局部图像特征的卷积神经网络模型。该项目提供模型实现、预训练权重、特征提取脚本和MegaDepth数据集训练流程。D2-Net在图像匹配和3D重建等计算机视觉任务中表现优异，提高了特征提取的准确性和效率。项目支持多尺度特征提取，并包含在不同数据集上训练的模型权重。

相关项目

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

Project Cover

稿定AI

稿定设计是一个多功能的在线设计和创意平台，提供广泛的设计工具和资源，以满足不同用户的需求。从专业的图形设计师到普通用户，无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑，稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合，帮助用户轻松实现创意设计。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号