TCD

新型少步采样蒸馏技术用于高质量图像生成

TCD 扩散模型生成AI 图像生成 LoRA Github 开源项目

TCD是一种创新的蒸馏技术，可将预训练扩散模型的知识提炼为高效的少步采样器。该技术具有灵活的NFE、优异的生成质量、可调节的细节程度和广泛的适用性。TCD无需对抗训练即可实现高质量的少步生成，有效避免了模式崩溃问题。项目开源了推理代码和基于SDXL Base 1.0蒸馏的TCD-SDXL模型，可与多种现有模型和技术无缝集成。

访问官网

Github

Huggingface

介绍相关项目

Lumina-T2X - Lumina-T2X项目：多模态文本转换的流式扩散模型

GithubLumina-T2X多模态生成大型扩散变换器开源项目文本转换高分辨率图像生成

Lumina-T2X利用基于流的扩散变换器，实现文本向多种模态、分辨率和持续时间的转换，包括图像、音频和视频。其功能还包括高分辨率生成、多轮对话、深度图和分割图估计等。项目提供多语言提示和表情符号支持，适用于多种智能生成需求。访问项目页面了解更多详情和使用案例。

sd-vae-ft-mse - 改进稳定扩散自编码器提升图像重建效果

GithubHuggingfaceStable Diffusion图像生成开源项目模型模型微调深度学习自动编码器

sd-vae-ft-mse是一款经过微调的稳定扩散自编码器，在LAION-Aesthetics和LAION-Humans数据集上训练。该模型旨在提高图像重建质量，尤其是人脸细节。相比原始模型，它在PSNR和SSIM等指标上有明显提升，能够生成更平滑的图像。该模型可作为VAE组件轻松集成到现有的diffusers工作流中，用于稳定扩散图像生成。

stable-diffusion - 基于Habana Gaudi处理器实现高性能AI图像生成方案

GPU加速GithubHabanaHuggingfaceStable Diffusion人工智能开源项目模型混合精度训练

Stable Diffusion模型在Habana Gaudi处理器上的优化配置方案。该方案集成了Hugging Face生态系统，支持高效的模型训练和部署，可在单处理器或多处理器环境下运行，适用于需要高性能图像生成的应用场景。

control_v11e_sd15_ip2p - 更好地控制扩散模型的图像处理能力

ControlNetGithubHuggingface图像生成开源项目扩散模型条件输入模型稳态扩散

本项目利用ControlNet v1.1提供了一种神经网络结构，能够通过附加条件控制预训练的大型扩散模型，与Stable Diffusion兼容。其支持指令化像素到像素的控制，通过边缘图、分割图和关键点等条件输入丰富图像生成方式。即便在小规模数据集下，ControlNet也能在个人设备上快速训练，相关源码及文档可在HuggingFace平台获取，适用于多种图像生成任务，提升图像处理灵活性。

sd-image-variations-diffusers - 基于Stable Diffusion的开源图像变体生成模型

CLIPGithubHuggingfaceStable Diffusion人工智能图像变体图像生成开源项目模型

sd-image-variations-diffusers是一个经过微调的Stable Diffusion模型，通过CLIP图像嵌入技术实现图像变体生成。该模型集成Diffusers库，可生成高质量的图像变体，主要应用于艺术创作、教育工具和AI研究等领域。模型目前已发布V2版本，相比V1版本具有更好的图像质量和相似度表现，但在生成人脸和文字方面仍存在局限性。

stable-diffusion-2-depth - 基于深度感知的Stable Diffusion AI图像生成模型

GithubHuggingfaceStable Diffusion人工智能图像生成开源项目机器学习模型深度学习

stable-diffusion-2-depth是基于Stable Diffusion 2的深度感知AI图像生成模型。它在原有基础上增加了处理MiDaS深度预测的输入通道，实现了额外的条件控制。该模型能够根据文本提示生成和修改高分辨率图像，主要应用于AI安全部署研究、模型局限性探索和艺术创作等领域。作为开源项目，stable-diffusion-2-depth为AI图像生成技术的进步提供了新的可能性。

custom-diffusion - 文本到图像扩散模型微调方法

Custom DiffusionGithubStable Diffusion图像生成多概念定制开源项目文本到图像扩散模型

该项目提供了一种高效的文本到图像扩散模型微调方法。只需调整部分模型参数，即可在短时间内完成训练，并减少存储需求。项目还支持多概念组合，附带新数据集和完整的训练步骤。适用于多种类别和应用场景。

Text-to-Image - 开源SDXL文本生成图像模型支持自定义训练及API调用

GithubHuggingfaceLoRASDXL图像生成开源项目文生图模型稳定扩散

该项目为基于stable-diffusion-xl-base-1.0的LoRA微调模型，通过madebyollin/sdxl-vae-fp16-fix进行VAE训练优化。项目提供Hugging Face API接口，开发者可使用Python实现文本到图像的转换功能。模型采用Safetensors格式发布，方便开发者进行集成部署和二次开发

SSD-1B - 轻量高效的Stable Diffusion文图生成模型

AI绘图GithubHuggingfaceSSD-1BStable Diffusion开源项目文本生成图像模型知识蒸馏

SSD-1B是Stable Diffusion XL的蒸馏版本,将模型参数减少50%,同时推理速度提升60%。通过知识蒸馏技术,SSD-1B融合多个专家模型的优势,保持了高质量的文图生成能力。该模型支持多种输出分辨率,适用于艺术创作、教育和研究等领域。在A100和RTX 4090 GPU上,SSD-1B比原版SDXL模型更快,为实时应用提供了高效选择。

stable-diffusion-xl-demo - 基于Stable Diffusion XL的开源AI图像生成WebUI

GithubStable Diffusion XL图像生成开源项目机器学习深度学习生成式AI

stable-diffusion-xl-demo是基于Stable Diffusion XL 1.0的Gradio演示WebUI。该项目集成了LCM LoRA和SSD-1B模型，提高了图像生成速度。它提供简便的安装和启动方法，支持多GPU并行处理，并可在Colab上运行。相比SD v2.1，SDXL无需额外调整即可生成更高质量图像。此外，项目还提供多种内存优化和性能提升选项。

相关项目

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具，简化了选题、文献检索至论文撰写的整个过程。通过简单设定，平台可快速生成高质量论文大纲和全文，配合图表、参考文献等一应俱全，同时提供开题报告和答辩PPT等增值服务，保障数据安全，有效提升写作效率和论文质量。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号