mvsplat

从稀疏多视角图像高效重建3D场景

3D Gaussian Splatting 多视图图像 MVSplat 神经渲染计算机视觉 Github 开源项目

MVSplat是一种基于3D高斯分布渲染的多视角图像重建技术。该项目利用深度学习和计算机视觉方法，从稀疏的多视角图像高效重建3D场景并实现新视角渲染。MVSplat在RealEstate10K和ACID数据集上表现优异，并具有良好的跨数据集泛化能力。项目提供了安装指南、预训练模型和评估代码，便于研究人员进行复现和改进。

访问官网

Github

介绍相关项目

vggsfm - 深度学习驱动的结构运动恢复技术

GithubVGGSfM三维重建开源项目深度学习结构运动计算机视觉

VGGSfM是一种结合视觉几何原理和深度学习的结构运动恢复(SfM)技术。该开源项目提供Python包，支持3D重建、相机姿态估计和稠密深度图生成。VGGSfM在CVPR24 IMC挑战赛相机姿态估计中获得第一名。它支持多种特征点提取方法，并提供灵活的可视化选项，方便研究人员和开发者进行3D重建实验和应用开发。

MonoGS - 基于3D高斯分布的实时场景重建与定位系统

3D重建CVPR 2024Gaussian Splatting SLAMGithub单目SLAM实时视觉定位开源项目

MonoGS是一个基于3D高斯分布的SLAM系统，支持单目、双目和RGB-D输入。该系统实现了实时稠密三维重建和精确相机定位，在室内场景中表现优异。通过高斯分布表示三维场景，MonoGS采用创新优化方法实现高效场景更新和渲染。作为CVPR 2024亮点论文，MonoGS展示了在计算机视觉和机器人领域的应用前景。

2dimageto3dmodel - 创新损失函数实现单图2D到3D模型生成

3D模型生成GANGithub单图重建开源项目损失函数点云

该项目开发了一种新型损失函数，能够直接从单张2D图像生成3D模型，无需复杂的渲染过程。项目采用条件GAN架构实现纹理映射，并优化了点云到3D网格的转换技术。在CUB鸟类和Pascal 3D+数据集上的测试显示了显著效果。此外，项目还提供预训练模型、伪真值生成和网格生成器训练等功能，为3D重建研究领域贡献了实用工具和参考方法。

awesome-3D-gaussian-splatting - 3D Gaussian Splatting资源与应用综述

3D Gaussian SplattingGithub实时渲染开源项目渲染视图合成辐射场

本项目整理了3D Gaussian Splatting领域的前沿论文和开源资源,包括自动驾驶、头像生成、压缩优化等多个应用方向,以及实现代码、数据集和教程。这些资源为研究人员和开发者提供了全面的参考,有助于推动该技术的发展与落地应用。

3D-Gaussian-Splatting-Papers - 3D高斯溅射技术论文集锦：最新研究进展与应用

3D Gaussian SplattingGithub三维重建开源项目新视角合成深度学习计算机视觉

本项目汇集了3D高斯溅射(3D Gaussian Splatting)领域的前沿研究论文，涵盖基础理论与实际应用。收录内容包括多篇综述文章和顶级会议论文，按时间倒序排列。提供论文中英文摘要和代码链接，为3D场景重建和新视角合成研究提供全面参考。

Make-It-3D - 单图生成高逼真3D模型

3D重建GithubICCV 2023Make-It-3D单张图像开源项目高保真

Make-It-3D项目利用训练良好的2D扩散模型，从单个图像生成高质量3D内容。方法采用两阶段优化流程，先优化神经辐射场整合正视图和新视角的扩散先验，后将粗略模型转化为纹理点云并提升现实感。实验显示，该方法在视觉质量和重建准确性上大幅领先，并支持文本到3D创建和纹理编辑等应用。

splat - WebGL驱动的实时3D高斯泼溅渲染器

3D Gaussian SplattingGithubWebGL实时渲染开源项目点云透明度渲染

splat项目基于WebGL技术，实现了3D高斯泼溅的实时渲染。该渲染器可将一组图片转换为可交互的逼真3D场景，并在普通图形硬件上高效运行。支持键盘、鼠标和触摸等多种交互方式，用户可拖放.ply文件转换为.splat格式或通过URL参数加载自定义文件。项目采用渐进加载和异步排序等优化技术，提供流畅的3D场景浏览体验。作为轻量级WebGL实现，无需外部依赖即可运行。它采用CPU异步排序技术，优化了大规模点云数据的渲染效果。该项目还提供了多个预加载的3D模型示例，方便用户快速体验和测试。

PlatVR-kto - 模型用于生成和优化虚拟现实背景图像

EVIDENT框架GithubHuggingface图像生成开源项目文本生成模型用户偏好虚拟现实

模型为EVIDENT框架的一部分，旨在生成和优化虚拟现实背景图像。通过解析用户指令，该模型能生成和调整文本提示，提升图像生成的多样性和准确性。经过合成偏好数据的微调，增强用户满意度和创意性表现。支持英语输出，并可输入多种语言，适用于直接使用和图像背景的自定义设计。

PointLLM - 多模态大语言模型理解点云数据的突破性进展

3D点云GithubPointLLM多模态大语言模型开源项目计算机视觉

PointLLM是一个创新的多模态大语言模型，可理解物体的彩色点云数据。该模型能够感知物体类型、几何结构和外观，而不受深度模糊、遮挡或视角依赖等问题影响。项目团队收集了包含660K简单和70K复杂点云-文本指令对的数据集，并采用两阶段训练策略。为评估模型的感知和泛化能力，研究人员建立了生成式3D物体分类和3D物体描述两个基准，并使用三种评估方法进行测试。

hierarchical-3d-gaussians - 层次化3D高斯表示实现大规模场景实时渲染

3D高斯表示Github大规模数据集实时渲染层次结构开源项目点云

这个项目开发了一种层次化3D高斯表示方法，能够实时渲染大规模数据集。通过分层优化和合并策略，该方法高效地表示和渲染复杂场景。项目包含预处理、优化和实时查看器等步骤，可处理含数千图像的大型数据集。代码库提供完整实现和使用说明，涵盖环境配置、数据准备和训练流程。

相关项目

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

Project Cover

稿定AI

稿定设计是一个多功能的在线设计和创意平台，提供广泛的设计工具和资源，以满足不同用户的需求。从专业的图形设计师到普通用户，无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑，稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合，帮助用户轻松实现创意设计。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号