k-diffusion

扩散模型框架支持多种采样算法和模型架构

k-diffusion 生成模型 PyTorch transformer 注意力机制 Github 开源项目

k-diffusion是一个基于PyTorch的扩散模型实现框架。它支持分层Transformer模型、多种采样算法和Min-SNR损失加权。该框架提供模型包装器、CLIP引导采样功能，以及对数似然、FID和KID等评估指标的计算。k-diffusion为扩散模型研究和应用提供了实用工具。

fast-DiT - 改进PyTorch实现的可扩展扩散模型转换器

DiTGithubPyTorchTransformer图像生成开源项目扩散模型

fast-DiT 项目提供了扩散模型转换器（DiT）的改进 PyTorch 实现。该项目包含预训练的类条件 DiT 模型、Hugging Face Space 和 Colab 笔记本，以及优化的训练脚本。通过采用梯度检查点、混合精度训练和 VAE 特征预提取等技术，显著提升了训练速度和内存效率。这一实现为研究人员和开发者提供了探索和应用扩散模型的有力工具。

stable-diffusion-2 - 高分辨率文本到图像生成模型

AI绘图GithubHuggingfaceStable Diffusion开源项目文本生成图像机器学习模型深度学习

Stable Diffusion v2是一款基于潜在扩散模型的文本到图像生成工具，支持768x768高分辨率输出。该模型采用OpenCLIP-ViT/H文本编码器，在LAION-5B数据集上训练而成。它提供多个预训练检查点，包括基础模型、深度条件模型和放大模型，适用于艺术创作、设计和研究等领域。Stable Diffusion v2在图像生成质量和多样性方面有显著提升，为AI图像创作提供了新的可能。

normal-depth-diffusion - 通用法线深度扩散模型实现高细节3D生成

3D模型AI生成GithubNormal-Depth Diffusion Model图像生成开源项目深度学习

Normal-Depth Diffusion Model是一个创新的文本到3D生成模型，采用法线深度扩散技术生成细节丰富的3D模型。该项目支持单视图和多视图生成，提供预训练权重、推理和训练代码，以及Objaverse数据集的多视图渲染图像。这一模型为3D内容创作开辟新途径，可应用于艺术设计等多个领域。

ml-stable-diffusion - 在Apple设备上实现高效稳定的AI图像生成

AI绘图Core MLGithubStable Diffusion开源项目性能优化模型转换

ml-stable-diffusion是一个开源项目,旨在优化Stable Diffusion模型在Apple设备上的运行。它包含用于模型转换的Python工具和用于iOS/macOS应用集成的Swift包。通过权重压缩等技术,该项目显著提升了性能和内存效率,使开发者能够在Apple平台应用中实现高质量的AI图像生成。

imagedream-ipmv-diffusers - 多视角扩散模型用于3D图像生成

3D生成GithubHuggingfaceMVDream-diffusers使用限制图像扩散开源项目模型

该项目是ImageDream模型在diffusers中的移植版本，展示了基于图像提示的多视角扩散技术在3D生成中的能力。用户可前往GitHub获得使用指南。由Wang及其团队发布于2023年的arXiv。请注意，模型禁止用于生成或传播可能引发敌对环境的图像，或传播可能会打扰、困扰或冒犯公众，以及涉及历史或当代偏见的内容。

stable-diffusion-2-depth - 基于深度感知的Stable Diffusion AI图像生成模型

GithubHuggingfaceStable Diffusion人工智能图像生成开源项目机器学习模型深度学习

stable-diffusion-2-depth是基于Stable Diffusion 2的深度感知AI图像生成模型。它在原有基础上增加了处理MiDaS深度预测的输入通道，实现了额外的条件控制。该模型能够根据文本提示生成和修改高分辨率图像，主要应用于AI安全部署研究、模型局限性探索和艺术创作等领域。作为开源项目，stable-diffusion-2-depth为AI图像生成技术的进步提供了新的可能性。

Diffus - 高精度Stable Diffusion图像生成平台

AI工具AI绘图Stable Diffusion人工智能艺术图像生成深度学习

Diffus为创意工作者提供精确控制的Stable Diffusion图像生成平台。用户可通过独特的构图控制、灯光和颜色调整等功能,轻松创作高质量图像。丰富的模型库支持多样化创作需求,适用于专业项目和个人创作。Diffus致力于帮助用户将创意概念转化为视觉作品,提升图像生成效率。

stable-diffusion-v1-5 - 先进的文本到图像AI生成模型

GithubHuggingfaceStable Diffusion人工智能开源项目文本生成图像机器学习模型深度学习

Stable Diffusion v1-5是一种基于潜在扩散的文本到图像生成模型。它在LAION-5B数据集上经过595k步训练，可生成512x512分辨率的高质量图像。该模型适用于艺术创作、设计和研究，但存在人脸和文字渲染的局限性。模型通过Diffusers库提供，但不应用于生成有害内容。Stable Diffusion v1-5代表了AI图像生成技术的重要进展。

Diffusion-SVC - 高效实时语音转换系统

AI模型ContentVecDiffusion-SVCGithub开源项目扩散模型语音转换

Diffusion-SVC是一个基于扩散模型的语音转换项目，专注于实现高质量的实时语音转换。该系统以低显存占用、快速训练和推理为特点，并针对浅扩散和实时应用进行了优化。Diffusion-SVC支持多种预训练模型和编码器，适用于不同规模的GPU，可灵活搭配使用。通过与其他声学模型级联，系统能进一步提升音频质量并降低性能消耗，为语音转换技术带来新的可能性。

DiffusionGPT - LLM驱动的多功能文本转图像生成系统

DiffusionGPTGithub人工智能图像生成大语言模型开源项目文本生成图像

DiffusionGPT是一个利用大型语言模型(LLM)的文本到图像生成系统。该系统能适应多种类型的提示，并整合专业领域模型。DiffusionGPT通过LLM技术，提供了一个统一的生成平台，可处理多样化的输入并生成图像。项目提供开源代码、在线演示和使用指南，方便研究人员和开发者进行实验和应用。

相关项目

推荐项目

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

稿定AI

稿定设计是一个多功能的在线设计和创意平台，提供广泛的设计工具和资源，以满足不同用户的需求。从专业的图形设计师到普通用户，无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑，稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合，帮助用户轻松实现创意设计。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com