Collaborative-Diffusion

多模态控制的面部生成与编辑，协作扩散模型

Collaborative Diffusion 多模态脸部生成脸部编辑 CVPR 2023 MMLab@NTU Github 开源项目

Collaborative Diffusion项目展示了如何通过多模态控制生成和编辑面部图像，保证生成结果与输入条件一致。该项目使用动态扩散器在每一步选择性处理不同模态，确保身份信息的准确性。最新更新包括对FreeU的支持、单模态面部生成推理脚本，以及适用于不同分辨率的模型训练和推理代码，满足多样化应用需求。

访问官网

Github

介绍相关项目

modular-diffusion - 灵活可扩展的PyTorch扩散模型框架

GithubModular DiffusionPyTorch开源项目扩散模型机器学习模块化设计

Modular Diffusion是一个基于PyTorch的模块化扩散模型框架，为设计和训练自定义扩散模型提供了简洁的API。该框架支持多种噪声类型、调度类型、去噪网络和损失函数，并提供了预构建模块库。Modular Diffusion适用于图像生成和非自回归文本合成等多种应用场景，适合AI研究人员和爱好者使用。其模块化设计简化了新型扩散模型的创建和实验过程。

Sudachi_diffusers - 改进文本到图像生成的稳定扩散模型

GithubHuggingfaceStable Diffusiondiffusers图像生成开源项目文本生成图像模型

Sudachi_diffusers是一种强调稳定扩散的模型，适用于文本到图像的转换，为用户提供高质量的生成效果。

stable-diffusion-v1-5 - 先进的AI文本到图像生成模型

GithubHuggingfacediffusers人工智能开源项目机器学习模型模型卡环境影响

Stable Diffusion v1.5是一款基于扩散技术的文本到图像生成模型。该模型能够根据文本描述生成高质量、多样化的图像，适用于艺术创作、设计辅助等多个领域。通过简单的文本提示词，用户可以控制图像生成过程。Stable Diffusion v1.5在图像质量和多样性方面较前代有显著提升，为AI图像生成领域提供了有力支持。

fast-stable-diffusion - fast-stable-diffusion：Paperspace上的A1111、ComfyUI和DreamBooth集成

A1111ComfyUIDreamBoothGithubPaperspacefast-stable-diffusion开源项目

fast-stable-diffusion项目整合了AUTOMATIC1111 Webui、ComfyUI和DreamBooth，旨在提升稳定扩散技术的效率和效果。特别感谢Scenario和Paperspace的赞助支持。点击了解更多关于DreamBooth和实现细节。

BlendFace - 创新人脸交换技术，身份编码器重新设计

BlendFaceGithub人脸交换人脸识别开源项目深度学习身份编码器

BlendFace是一个开源的人脸交换项目，专注于改进身份编码器以提升交换效果。该项目通过创新方法解决了传统模型在人脸交换中的偏差问题，同时保持了对负样本的识别能力。BlendFace提供预训练模型和示例代码，便于研究人员进行复现和扩展研究。项目成果已在ICCV 2023会议上发表，为人脸交换技术带来新的突破。

DiffusionMat - 创新图像抠图的序列细化学习方法

DiffusionMatGithubalpha遮罩三元图图像抠图开源项目扩散模型

DiffusionMat是一种新型图像抠图框架,利用扩散模型实现从粗略到精细alpha遮罩的过渡。它将图像抠图视为序列细化学习过程,通过对trimaps添加噪声并迭代去噪来引导预测。框架的主要创新包括校正模块和Alpha可靠性传播技术,旨在提高抠图精度和一致性。DiffusionMat还采用了专门的损失函数来优化alpha遮罩的边缘精度和区域一致性。在多个图像抠图基准测试中,该方法展现出优于现有技术的性能。

FabricDiffusion - 基于2D图像的高质量纹理无缝转移至3D服装

3D服装生成AI工具FabricDiffusion生成模型纹理传输高保真

FabricDiffusion可从2D服装图像中提取高质量纹理，并将其无失真地应用于各种形状的3D服装。通过去除输入纹理中的扭曲，该模型生成平面纹理图，并在各种光照条件下实现真实服装效果。经过合成数据训练，这种方法在真实世界应用中展现出优于现有技术的显著性能。

sd-controlnet-depth - 结合深度估计的文本到图像扩散模型

ControlNetGithubHuggingface图像生成开源项目条件控制模型深度估计稳定扩散

ControlNet通过深度估计条件增强了Stable Diffusion等模型，允许在个人设备和高性能集群上进行快速训练，即使数据集较小。开发者Lvmin Zhang与Maneesh Agrawala提出的模型具有灵活性，加强了扩散模型的控制方式，推进应用实现。其多种检查点以不同条件训练，提供精细的生成控制。

sd-vae-ft-ema - 稳定扩散变分自编码器的增强版模型

GithubHuggingfaceStable Diffusion图像重建开源项目扩散模型机器学习模型自动编码器

sd-vae-ft-ema是一个基于LAION-Aesthetics和LAION-Humans数据集训练的稳定扩散变分自编码器。该模型在图像重建质量尤其是人脸细节方面优于原始VAE，具有更好的rFID、PSNR和SSIM指标表现，可作为扩散器工作流中的即插即用组件。

face-projection - 人脸投影技术带来新的视觉可能

GithubHuggingfaceLoRAf4c3_p40j3ct10n人脸图像生成开源项目投影模型

Face Projection项目通过Flux.1 D LoRA模型，让文字或概念在面部图像上投射，创造独特的视觉场景。借助触发词f4c3_p40j3ct10n，用户能将文本转化为投影图像。项目适配Diffusers库，同时提供Safetensors格式模型权重下载，是一个灵活的视觉生成工具。请参阅官方文档获取更多详情和实例，探索技术与创意的全新结合。

相关项目

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

Project Cover

稿定AI

稿定设计是一个多功能的在线设计和创意平台，提供广泛的设计工具和资源，以满足不同用户的需求。从专业的图形设计师到普通用户，无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑，稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合，帮助用户轻松实现创意设计。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号