Project Icon

ER-NeRF

区域感知神经辐射场技术实现高保真说话人物肖像合成

ER-NeRF项目开发了一种区域感知神经辐射场技术,用于生成高保真的说话人物肖像。这种方法通过区域化处理提升了渲染效率和质量,可以渲染头部和躯干。项目开源了预训练模型和使用指南,涵盖数据预处理、模型训练和推理等环节。ER-NeRF在说话人物肖像合成领域展现出优异性能,为相关研究提供了新的思路。

DreamlikePhotoReal2 - 高细节增强的超现实图像生成模型
AI绘图Dreamlike PhotoRealGithubHuggingface开源项目模型稳定扩散视觉效果高细节
Dreamlike PhotoReal 2模型通过集成840K VAE进行优化,突出细节。该项目结合稳定扩散与文本转图像技术,使其有能力生成高细节和照片级逼真的图像,如乡间别墅的少女或东京街头的时尚女性。该模型专为需要更高精度图像生成的艺术与设计工作者设计,兼容diffusers库。
epiCPhotoGasm - Stable Diffusion驱动的超写实女性肖像生成模型
GithubHuggingfaceStable Diffusion人像生成开源项目文生图梦幻风格模型逼真
作为一个开源项目,epiCPhotoGasm在Stable Diffusion的基础上进行了优化,以生成高质量的女性肖像。它不仅能创造出照片级的写实效果,还能融入超现实主义元素,产生独特的视觉效果。这个模型为数字艺术家、广告设计师和内容创作者提供了一个强大的工具,可用于探索新的创作方向。
AbsoluteReality_v1.8.1 - 先进的逼真AI图像生成模型
AI绘画CivitAIGithubHuggingfaceStable Diffusion人工智能艺术开源项目文本生成图像模型
AbsoluteReality_v1.8.1是一个开源的AI图像生成模型,专注于创建高度逼真的视觉内容。该模型能够生成细节丰富的人物肖像、动物和场景图像,特别擅长呈现精细的盔甲、毛发纹理和机甲装备。AbsoluteReality_v1.8.1适用于多种创作场景,包括中世纪风格人物、自然动物照片和科幻主题插图。这一工具为数字艺术创作者提供了生成高质量、真实感强的视觉素材的能力。
FlashFace - 高保真人物图像个性化生成技术
AI绘图FlashFaceGithub人像定制图像生成开源项目身份保持
FlashFace是一项人物图像个性化生成技术,可在几秒内实现零样本人物图像定制,具有出色的身份保持能力。该技术能精确响应语言提示,并支持灵活调整身份图像和语言提示的控制强度。FlashFace可使用单张或多张参考人脸,对非名人也能有效保持身份特征,同时支持改变人物年龄或性别。
EchoMimic - 音频驱动的逼真人像动画系统 支持关键点编辑
AI模型EchoMimicGithub关键点条件开源项目肖像动画音频驱动
EchoMimic是一个音频驱动的人像动画系统,通过编辑关键点来控制动画效果。系统支持英语和中文音频输入,可生成自然的口型、表情和头部动作。项目开源了推理代码和预训练模型,可用于生成高质量的说话头视频,适用于虚拟主播等应用场景。
Imitator - 个性化语音驱动3D面部动画生成系统
3D面部动画GithubICCV 2023Imitator个性化开源项目语音驱动
Imitator是一个3D面部动画生成系统,能将个人语音转化为逼真的面部表情。该项目基于深度学习技术,实现了语音到面部动作的精确映射。Imitator提供通用模型和个性化训练方法,可适应不同说话者的特征。这项技术可应用于虚拟现实、电影制作和人机交互等领域。
Real-ESRGAN - 开源AI图像超分辨率增强项目
AI模型GithubReal-ESRGAN图像修复开源项目超分辨率
Real-ESRGAN是一个开源的AI图像超分辨率增强项目。该项目采用纯合成数据训练,可提升各类图像和视频质量。Real-ESRGAN提供多个预训练模型,适用于通用、动漫、人脸等场景,支持4倍及以上放大。项目包含Python脚本和便携式可执行文件,方便快速使用。此外,Real-ESRGAN开放训练代码,允许在自定义数据集上进行微调。
DreamWaltz - 基于文本生成3D可动画化虚拟形象和场景
3D动画头像DreamWaltzGithubNeRF人体姿态开源项目文本生成3D
DreamWaltz是一个文本驱动的3D可动画化虚拟形象创建框架,结合了预训练2D扩散模型和人体参数模型。通过优化可变形NeRF表示,该框架能从骨骼条件下的扩散监督中学习,实现3D一致性和对任意姿势的泛化。DreamWaltz不仅可以生成单个可动画化虚拟形象,还能构建复杂场景,实现虚拟形象与物体、环境及其他虚拟形象的交互。
DreamCraft3D - 层次化高保真3D内容生成技术
3D内容生成DreamCraft3DGithub几何雕刻分层结构开源项目纹理增强
DreamCraft3D是一种高保真层次化3D内容生成技术,利用2D参考图像指导几何雕刻和纹理增强,解决一致性问题。通过词汇蒸馏采样、视图依赖扩散模型和引入Bootstrapped Score Distillation,提升了几何一致性和纹理质量。该项目通过交替优化扩散先验和3D场景表示,生成逼真的3D对象,提升了3D内容生成技术水平。
ml-hugs - 从单个视频重建可动画化人体和场景的3D技术
3D重建GithubHUGS人体高斯分层动画生成开源项目神经辐射场
HUGS是一种利用神经辐射场的计算机视觉技术,能从单个视频重建背景场景和可动画化的人体3D表示。该开源项目提供完整实现,包括数据准备、模型训练和评估脚本。HUGS支持三种训练模式:联合人体和场景、仅人体以及仅场景,适用于多种应用场景。在PSNR、SSIM和LPIPS等指标上,HUGS展现了优异的性能,为人体动画和场景重建研究提供了新思路。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能,包括文生视频、动态画面和形象生成等,帮助用户快速上手,创造专业级内容。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台,用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品,帮助用户探索创意灵感。

Project Cover

讯飞文书

讯飞文书依托讯飞星火大模型,为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能,满足事务性工作的高频需求,帮助撰稿人节省精力,提高效率,优化工作与生活。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号