Project Icon

RobustCap

单目图像和稀疏IMU信号融合的实时人体动作捕捉

RobustCap是一个开源项目,提出了融合单目图像和稀疏IMU信号的实时人体动作捕捉方法。该技术在遮挡、剧烈运动和弱光等复杂场景下仍能实现高精度动作重建,适用于虚拟现实、电影制作和运动分析等领域。项目提供了完整的系统实现、评估代码以及详细的安装和使用指南,便于研究人员复现和拓展。

ROMP - 单目实时多人体3D网格重建技术
3D人物重建BEVGithubROMPTRACE单摄像头开源项目
ROMP项目是一种用于实时单目多人体3D网格重建的工具,具备一阶段处理优势,并支持跨平台API(Linux、Windows、Mac)。用户可通过pip安装。最近的更新包括TRACE代码发布,增加了对动态摄像机背景中的5D时间回归,以及BEV的训练和评估代码发布,深入研究多人体深度关系,支持所有年龄段。ROMP还支持Python调用,BVH模型导出,并通过Blender插件实现角色驱动。详细信息请参考项目的论文、数据集及相关演示视频。
hmr-survey - 单目图像3D人体网格模型重建技术综述
3D人体网格重建Github人体建模单目图像开源项目深度学习计算机视觉
本文综述了单目图像3D人体网格模型重建技术的最新进展。文章详细介绍了基于优化和基于回归两种主要方法,分析其优缺点,并总结相关数据集、评估指标和基准结果。同时讨论了该领域的开放问题和未来方向,为研究人员提供全面的技术概览。
OmniControl - 先进的人体动作生成与精确控制技术
GithubOmniControl人体动作生成关节控制开源项目机器学习计算机视觉
OmniControl是一个基于扩散模型的人体动作生成项目,实现了对任意关节在任意时间的精确控制。通过空间引导和真实性引导,该项目能生成高质量、自然的动作序列。OmniControl提供预训练模型、训练代码和评估工具,支持HumanML3D等数据集,为动作生成研究和应用领域提供了灵活有力的解决方案。
tram - 从非受控视频中重建3D人体全局轨迹和动作
3D人体捕捉GithubTRAM开源项目深度学习视频处理计算机视觉
TRAM是一个开源的4D人体捕捉系统,专门用于从非受控视频中估计3D人体的全局轨迹和动作。该系统集成了目标跟踪、SLAM和4D人体捕捉技术,能在世界坐标系中精确重建人体运动。TRAM的工作流程包括相机位姿估计、人体检测跟踪和4D人体重建,为复杂场景中的人体运动分析提供了有力工具。
BlendArMocap - Blender的无标记动作捕捉与骨骼动画转换工具
BlendArMocapBlenderFreemocapGithubMediapipe动作捕捉开源项目
BlendArMocap是基于Google Mediapipe的Blender插件,用于无标记动作捕捉和骨骼动画转换。该工具支持从实时视频流或录像中检测人体、手部和面部特征,并能高效将捕捉数据转换到3D角色骨骼上。它还支持导入Freemocap会话数据,并与Rigify人形骨骼兼容。这个开源项目为3D动画制作提供了高效的动作捕捉和骨骼动画转换功能。虽然目前已停止活跃维护,BlendArMocap仍是动画制作者的实用动作捕捉解决方案。
HumanFallDetection - 多摄像头人工智能实时跌倒检测系统
GithubLSTM分类OpenPifPaf人体姿态估计多摄像头跟踪开源项目跌倒检测
HumanFallDetection项目是一个基于多摄像头和人工智能的跌倒检测系统。它整合了人体姿态估计、多目标跟踪和LSTM神经网络技术,实现实时多人跌倒检测。系统支持处理视频文件或实时摄像头数据,提供灵活的命令行配置。这一技术在老年人护理、医疗监控等领域具有重要应用价值,有助于提高安全监测效率。
dreamscene4d - 从单目视频生成动态多目标3D场景的突破性技术
3D场景生成DreamScene4DGithub多目标跟踪开源项目视频处理计算机视觉
DreamScene4D是一种从单目视频生成动态多目标3D场景的开源技术。它采用3D高斯和形变优化方法,能处理不同长度的视频和多个目标。项目提供自动化和分阶段优化脚本,支持处理有遮挡和无遮挡的视频。DreamScene4D在复杂场景和长视频序列处理方面表现优异,为计算机视觉和图形学研究提供了新思路。
MotionBERT - 多任务人体运动表征学习框架
GithubMotionBERT人体动作表示姿态估计开源项目深度学习计算机视觉
MotionBERT是一个多任务人体运动表征学习框架,整合了3D人体姿态估计、基于骨骼的动作识别和人体网格恢复等任务。该项目提供预训练模型和下游任务实现,支持自定义视频推理和生成以人为中心的视频表征。MotionBERT在多个基准测试中展现出优异性能,为人体运动分析研究提供了一个统一且高效的解决方案。
head-pose-estimation - 实时人脸姿态估计,使用ONNX Runtime和OpenCV进行处理
GithubONNX RuntimeOpenCV人脸检测头部姿态估计开源项目面部特征点检测
本项目提供了一个实时的人脸姿态估计解决方案,依赖于ONNX Runtime和OpenCV框架。主要步骤包括人脸检测、68个面部标志点检测以及姿态估计。支持Ubuntu 22.04,提供简单的安装步骤和预训练模型下载链接,使用户可以快速启动并运行。本项目支持视频文件和摄像头输入,提供了详尽的训练指导和代码库,确保了高度的灵活性和扩展性,适合开发和测试用途。
panoptic-toolbox - PanopticStudio多视角动作捕捉数据处理工具箱
3D关键点GithubPanopticStudio多视角系统开源项目数据集骨骼提取
PanopticStudio Toolbox是一款用于处理多视角人体动作捕捉数据的开源工具箱。它提供了下载、提取和可视化Panoptic Studio数据的功能,包括高清视频和3D关键点数据。该工具箱支持Python和Matlab,可实现3D关键点可视化和图像重投影。此外,它还包含KinopticStudio子系统工具和haggling数据集处理功能。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号