#人体动作
MotionGPT - 构建多任务的人体动作与语言统一模型
MotionGPT人机交互模型训练人体动作多模态数据Github开源项目
MotionGPT是一种整合人体动作和语言的统一模型,专注于两种模态间的语义耦合学习。在诸多人体动作任务中表现优异,包括文本驱动动作生成、动作标题生成及动作预测。该模型结合预训练与指令性微调,能高效处理多种动作相关任务,是动作语言模型的新代表。此外,其零拍技术使其能识别新词汇并生成相应动作,突显处理复杂场景的能力。
MimicMotion - 基于AI的高质量人体动作视频生成框架
MimicMotion视频生成人体动作AI深度学习Github开源项目
MimicMotion是一个创新的视频生成框架,可基于任意动作指导生成高质量的长视频。该项目采用置信度感知的姿态引导技术,提高了时间平滑性和模型鲁棒性。通过区域损失放大和渐进式潜在融合策略,MimicMotion有效解决了图像失真问题,并能以较低的资源消耗生成长视频。这一技术在视频质量、控制性和生成长度等方面显著优于现有方法,为人体运动视频生成领域开辟了新的可能性。
相关文章