ROMP

单目实时多人体3D网格重建技术

ROMP BEV TRACE 3D人物重建单摄像头 Github 开源项目

ROMP项目是一种用于实时单目多人体3D网格重建的工具，具备一阶段处理优势，并支持跨平台API（Linux、Windows、Mac）。用户可通过pip安装。最近的更新包括TRACE代码发布，增加了对动态摄像机背景中的5D时间回归，以及BEV的训练和评估代码发布，深入研究多人体深度关系，支持所有年龄段。ROMP还支持Python调用，BVH模型导出，并通过Blender插件实现角色驱动。详细信息请参考项目的论文、数据集及相关演示视频。

Github

介绍相关项目

LivePortrait - 高效的面部动画技术与重定向控制

GithubLivePortraitPyTorch实现人像动画实时渲染开源项目深度学习热门

LivePortrait是一种基于PyTorch实现的先进面部动画技术，支持高效的人像动画合成与重定向控制。项目提供了全面的预训练模型和易于使用的界面，支持Windows、macOS和Linux系统。用户可以快速开始，利用预训练权重生成高质量的动画肖像。支持静态图像与视频的动画生成，可广泛应用于虚拟现实、游戏开发和在线教育等领域。

vpuppr - Godot引擎驱动的开源虚拟主播软件

3D模型GithubGodotVTuber软件Vpuppr开源项目虚拟主播

Vpuppr是基于Godot引擎的开源虚拟主播软件，支持VRM模型加载和多种追踪数据处理。目前正在进行Godot 4版本重写，已实现MediaPipe、iFacialMocap等追踪方式。项目处于活跃开发阶段，计划添加GUI和数据保存功能。Vpuppr为开发者提供了便捷的构建和贡献机会，推动虚拟主播技术的进步。

Wonder3D - 使用跨域扩散技术从单一图像快速生成高质量3D模型

3D重建GithubWonder3D单视图重建多视图一致性开源项目扩散模型

Wonder3D是一个开源的3D重建项目，采用跨域扩散技术从单一图像生成高质量3D模型。该方法首先生成多视图法线贴图和彩色图像，然后通过法线融合实现快速重建。项目提供了推理和训练代码，支持自定义数据训练，并包含使用说明和演示。Wonder3D在重建速度和质量上均有优势，为3D内容创作提供了高效解决方案。

vid2avatar - 自监督场景分解实现野外视频3D人物重建

3D头像重建GithubVid2Avatar场景分解开源项目自监督学习视频处理

Vid2Avatar是一个开源项目，采用自监督场景分解方法从未处理的野外视频中重建3D人物模型。该方法无需额外监督，通过分离人物和背景实现精确建模。项目包含完整代码、预处理数据集和使用说明，适用于复杂场景的人物建模。

zero123 - 零样本单图像到3D对象转换技术

3D重建GithubObjaverseZero-1-to-3单视图开源项目稳定扩散

探索一种创新技术，通过一张图像实现高精度的3D对象重建。研究介绍了如何使用Zero123进行新视角合成和3D重建，解决了文字转图像模型中的视角歧义问题，并展示了其在多种应用中的卓越性能。项目还包括Zero123-XL和Objaverse-XL的最新权重发布，以及详细的使用和训练指南，支持研究者和开发者在现有硬件上进行开发和测试。

OMG - 优化多角色图像生成框架，支持个性化和样式控制

AI绘图ControlNetDiffusion模型GithubOMG多人物生成开源项目

OMG是一个多概念图像生成框架，支持Civitai.com的角色和样式LoRA模型。结合InstantID可实现单图多ID个性化。该框架提供高质量多角色图像生成，支持布局和样式控制。项目开源并附详细说明，为图像生成领域带来新突破。

rembg - 高效智能的开源图像背景去除工具

AI工具GithubRembg图像处理开源项目背景去除

Rembg是一个开源的图像背景去除工具,支持多种预训练模型处理人像、动物、汽车等场景。该工具提供命令行、Python库和HTTP API多种使用方式,可快速批量处理图片并输出透明背景PNG。Rembg适用于个人用户和开发者,能轻松实现自动化的图像背景去除。

CRM - 推荐用于快速生成3D纹理网格的前馈模型

3D模型CRMGithubHuggingface Demo卷积重建模型开源项目预训练模型

CRM是一种前馈模型，能够在短时间内生成高质量的3D纹理网格。它适用于Python 3.9版本，并依赖多个软件包和库的安装。用户可以通过可视化工具Gradio或命令行进行推理操作。项目目前提供预训练模型和推理代码，未来还计划优化推理代码以适应低内存GPU需求。相较于在线Demo的顶点颜色方法，官方实现使用了UV纹理，生成的纹理质量更高但也需要稍长的时间。

Consistent4D - 单目视频到360度动态物体的生成

4D重建Github动态物体生成单目视频开源项目时空一致性神经辐射场

Consistent4D是一种创新方法，能从未校准的单目视频生成动态物体的360度视图。该方法将360度动态物体重建转化为4D生成问题，利用物体级3D感知图像扩散模型监督动态神经辐射场的训练。Consistent4D引入级联DyNeRF和插值驱动的一致性损失，无需繁琐的多视图数据收集和相机校准。实验表明，该方法在4D动态物体生成和文本到3D生成任务中展现出优异性能。

GSM - 创新框架实现高效3D人体生成

3D人体生成3D渲染Github开源项目深度学习生成对抗网络高斯贝壳图

Gaussian Shell Maps (GSM)框架结合了先进的生成器网络和3D高斯渲染技术，用于高效生成3D数字人物。GSM采用多层壳结构，通过卷积神经网络生成3D纹理并映射到壳上。该方法可在单视图数据集上训练，生成多视图一致的高质量3D人体模型，并支持任意姿势变形。GSM为虚拟现实、社交媒体和电影制作等领域提供了创新的3D人体生成技术。

相关项目

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具，简化了选题、文献检索至论文撰写的整个过程。通过简单设定，平台可快速生成高质量论文大纲和全文，配合图表、参考文献等一应俱全，同时提供开题报告和答辩PPT等增值服务，保障数据安全，有效提升写作效率和论文质量。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号