Project Icon

Director3D

将文本转化为真实世界相机轨迹和3D场景的AI项目

Director3D是一个基于文本生成真实世界相机轨迹和3D场景的AI项目。它结合了轨迹扩散模型、3DGS驱动的多视角潜在扩散模型和SDS++优化技术,能在20秒内生成粗略3D高斯溅射,5分钟内完成精细化。项目开源了代码和预训练模型,并提供了在线演示,为3D内容创作和计算机视觉研究提供了新的可能性。

Unique3D - 单张图片实现高质量3D网格快速生成
3D网格生成GithubUnique3D单视图开源项目快速实现高保真
Unique3D可以从单张图片快速生成高质量的3D网格,支持多种平台的演示,包括Gradio和Huggingface。该项目正在不断更新,提供Windows和Docker安装支持,未来将推出更稳定的重建功能和训练代码。加入社区了解最新进展和合作机会。
Human-Video-Generation - 人工智能视频生成技术的演进与应用
3D建模Github人体视频生成人工智能开源项目深度学习计算机视觉
Human-Video-Generation项目收录了2018年以来人工智能视频生成领域的重要研究成果。该项目涵盖面部重演、动作迁移和语音驱动动画等多个方向,提供了前沿论文、代码实现和演示视频。从早期的PSGAN到最新的Real3D-Portrait,项目全面展示了AI视频生成技术的快速进展,为相关领域的研究者和开发者提供了丰富的参考资源。
Holodeck - 语言驱动的3D AI环境生成系统
3D环境生成AI2-THORGithubHolodeck实体AI开源项目自然语言指导
Holodeck是一个基于AI2-THOR平台的开源项目,旨在通过自然语言指令生成逼真的3D AI环境。该系统结合GPT-4语言模型和高效布局算法,能将文字描述转化为详细的3D场景。Holodeck为embodied AI研究提供了便捷工具,支持快速创建多样化的复杂环境用于测试和训练。项目提供完整代码和文档,为AI研究社区贡献了有价值的资源。
RayDF - 革新性射线基础3D形状表示与快速渲染技术
3D建模GithubRayDF多视图一致性开源项目深度图像渲染神经网络
RayDF是一种创新的基于射线的连续3D形状表示方法,在渲染800x800深度图像时比传统方法快1000倍。该项目包含完整的训练和评估流程,涵盖双射线可见性分类器和射线-表面距离网络训练,并在多个数据集上进行了实验。RayDF在3D重建和渲染方面表现出色,为计算机视觉和图形学领域开辟了新的研究方向。
DeepMotion - 3D动画创作与实时动作捕捉平台
3D动画AI动作捕捉AI工具DeepMotion人工智能数字人物
DeepMotion专注于开发人工智能驱动的3D动画生成和实时动作捕捉技术。其核心产品包括文本转3D动画工具SayMotion和视频转3D动画工具Animate 3D。通过简化动画创作流程,DeepMotion使各类用户都能轻松制作高质量数字人物动画。该技术广泛应用于游戏、影视和虚拟现实等领域,并获得了众多知名企业和机构的认可。
Text2Video - 文本生成视频模型
GithubText2Video开源项目深度学习生成对抗网络视频合成语音合成
Text2Video采用深度学习技术,通过建立音素姿势字典与训练生成对抗网络,从文本生成视频,该技术相较于传统音频驱动的视频生成方法,具有更少的数据需求、更高的灵活性和更低的时间成本。在标准数据集上的广泛测试证明了其显著的效果和优势。
Far3D - 突破远距离3D目标检测的新框架,提升环视感知能力
3D目标检测Far3DGithub开源项目深度学习自动驾驶计算机视觉
这是一个创新的稀疏查询框架,专注于解决远距离3D目标检测问题。该项目通过2D目标先验生成自适应3D查询,并利用透视感知聚合模块处理多视角和多尺度特征。还开发了范围调制的3D去噪技术,有效解决了查询错误传播和收敛问题。在Argoverse 2和nuScenes数据集上,展现出优异的性能,推动了环视3D目标检测技术的发展。
SpaTracker - 将2D像素的3D空间运动轨迹可视化
3D追踪CVPR 2024GithubSpatialTracker像素追踪开源项目计算机视觉
SpaTracker是一个计算机视觉项目,可在3D空间中追踪视频中任意2D像素的运动轨迹。该项目支持RGB和RGBD视频输入,采用单目深度估计技术实现像素级追踪。SpaTracker提供演示代码和预训练模型,可视化效果优秀。这一工具可应用于动作分析和视觉特效等领域。该项目在CVPR 2024被评为亮点论文,体现了其在3D视觉追踪领域的创新性。
Masterpiece X - 基于AI的快速3D模型生成工具
3D建模AI工具AI生成游戏开发虚拟现实角色动画
Masterpiece X是一个创新的AI驱动3D模型生成工具。通过简单的文字提示,用户可快速创建包含网格、纹理和动画的3D资产。该工具仅需浏览器即可使用,无需昂贵硬件或专业知识。它提供直观指导、多种模型选择,并兼容主流3D软件。Masterpiece X为创作者提供了一个高效、经济的3D建模方案,正在重塑3D内容创作流程。
Stable Diffusion 3 - 探索Stable Diffusion 3的高级文本到图像生成能力
AI工具AI绘图Stable Diffusion 3人工智能图像质量文本生成图像
Stable Diffusion 3是Stability AI开发的先进文本到图像模型,在图像质量、多主题处理和文本遵循方面有显著提升。本站提供免费在线体验,用户可通过文本提示生成高质量图像。网站详细介绍了Stable Diffusion 3的核心特性,并提供API接口和下载选项,满足开发者和研究人员的不同需求。探索AI驱动的图像生成新境界,体验Stable Diffusion 3的强大功能。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

稿定AI

稿定设计 是一个多功能的在线设计和创意平台,提供广泛的设计工具和资源,以满足不同用户的需求。从专业的图形设计师到普通用户,无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑,稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合,帮助用户轻松实现创意设计。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号