murf

多基线辐射场技术革新三维场景重建

MuRF 多基线辐射场计算机视觉 3D重建 CVPR 2024 Github 开源项目

MuRF是一种新型多基线辐射场技术，支持多种基线设置，在各类评估条件下表现卓越。该项目在三维场景重建领域取得突破，推动了计算机视觉和图形学的发展。MuRF在DTU、RealEstate10K和LLFF等数据集上展现出优异性能，为相关研究和应用提供了新思路。

gaussian-opacity-fields - 高效紧凑的无界场景表面重建技术

3D Gaussians3D重建Gaussian Opacity FieldsGithub开源项目无界场景表面重建

Gaussian Opacity Fields (GOF) 是一种新型表面重建方法，通过3D高斯分布识别几何信息。该方法使用正则化技术提高重建质量，并采用Marching Tetrahedra算法进行网格提取。GOF在无界场景中实现了高效、高质量的表面重建，为计算机视觉和图形学提供了创新解决方案。GOF方法特别适用于复杂的无界场景重建，如大规模室外环境或动态物体的表面重建。相比传统方法，GOF在处理速度和内存占用方面都有显著优势。

OpenLRM - 开源3D重建模型

GithubHugging FaceOpenLRM开源开源项目模型训练视觉重建

OpenLRM是一个开源项目，专注于将单张图像转换为三维模型，提供预训练模型、训练代码和工具。用户可访问Hugging Face平台上的模型和演示。最新版本v1.1.1支持Objaverse和MVImgNet数据集，并进行了代码重构以提升可用性和扩展性。项目还包含安装指南、推理脚本和训练配置文件，便于用户快速上手。

Make-It-3D - 单图生成高逼真3D模型

3D重建GithubICCV 2023Make-It-3D单张图像开源项目高保真

Make-It-3D项目利用训练良好的2D扩散模型，从单个图像生成高质量3D内容。方法采用两阶段优化流程，先优化神经辐射场整合正视图和新视角的扩散先验，后将粗略模型转化为纹理点云并提升现实感。实验显示，该方法在视觉质量和重建准确性上大幅领先，并支持文本到3D创建和纹理编辑等应用。

SIFU - 单图高精度3D人体重建技术适用于实际应用场景

3D人体重建GithubSIFU开源项目深度学习计算机视觉隐式函数

SIFU是一项创新的3D人体重建技术，能够从单一图像生成高质量的3D clothed human模型。该技术采用Side-view Conditioned Implicit Function提升特征提取和几何精度，并通过3D Consistent Texture Refinement改善纹理质量。SIFU在处理复杂姿势和宽松服装方面表现突出，适用于3D打印和场景创建等实际应用。作为CVPR 2024的亮点论文，SIFU为真实世界的人体重建任务提供了有效解决方案。

DG-Mesh - 从单目视频重建高保真度时序一致网格的框架

3D重建DG-MeshGithub动态场景单目视频开源项目网格生成

DG-Mesh是一个从单目视频重建高保真度时序一致网格的框架。它能够重建高质量的表面、外观和跨时间帧的网格顶点运动，支持灵活的拓扑变化，并能处理鸟翼等细结构。项目包含多个数据集的训练和评估代码，以及自定义数据集支持。

RayDiffusion - 射线扩散模型在相机姿态估计中的应用

GithubRayDiffusion开源项目扩散模型深度学习相机姿态估计计算机视觉

RayDiffusion项目提出了一种将相机表示为射线并应用扩散模型的姿态估计方法。该方法支持已知边界框和从掩码自动提取边界框两种模式，同时提供射线回归选项。项目包含代码实现、预训练模型和使用说明，适用于计算机视觉领域的研究和开发。

stable-fast-3d - 单图快速重建3D网格的开源模型

3D重建GithubSF3DUV展开单图重建开源项目照明解耦

Stable Fast 3D是一个开源的3D重建模型，可从单张图像快速生成3D网格。该模型基于TripoSR，改进了网格和纹理生成，并引入UV展开和光照分离技术。它不仅生成高质量3D资产，还保持快速推理速度。模型支持自定义纹理分辨率和重网格化，适用于游戏开发等领域。用户可通过命令行或Gradio应用使用这一工具。

MonoGS - 基于3D高斯分布的实时场景重建与定位系统

3D重建CVPR 2024Gaussian Splatting SLAMGithub单目SLAM实时视觉定位开源项目

MonoGS是一个基于3D高斯分布的SLAM系统，支持单目、双目和RGB-D输入。该系统实现了实时稠密三维重建和精确相机定位，在室内场景中表现优异。通过高斯分布表示三维场景，MonoGS采用创新优化方法实现高效场景更新和渲染。作为CVPR 2024亮点论文，MonoGS展示了在计算机视觉和机器人领域的应用前景。

UniTR - 多模态变换器网络推动3D感知进展

3D感知BEV分割GithubUniTR多模态转换器开源项目目标检测

UniTR是一种新型统一多模态变换器网络,用于3D感知任务。它通过共享权重处理相机和激光雷达等多传感器数据,实现高效多模态融合。在nuScenes数据集上,UniTR在3D目标检测和BEV地图分割任务中均达到最新水平,且降低推理延迟。该研究为提升自动驾驶系统的感知能力提供了新思路。

BAD-Gaussians - 基于高斯散射的3D场景去模糊重建与新视角合成技术

3D重建BAD-GaussiansGithub图像去模糊开源项目新视角合成高斯散射

BAD-Gaussians是一种创新的3D场景重建方法，结合束调整和高斯散射技术，有效处理运动模糊图像。该方法不仅能实现高质量的图像去模糊，还可合成新视角场景。基于nerfstudio框架实现，BAD-Gaussians支持多种数据集和训练模式，为计算机视觉和图形学研究提供了有力工具。

相关项目

推荐项目

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

稿定AI

稿定设计是一个多功能的在线设计和创意平台，提供广泛的设计工具和资源，以满足不同用户的需求。从专业的图形设计师到普通用户，无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑，稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合，帮助用户轻松实现创意设计。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com