modular-diffusion

灵活可扩展的PyTorch扩散模型框架

Modular Diffusion 扩散模型 PyTorch 机器学习模块化设计 Github 开源项目

Modular Diffusion是一个基于PyTorch的模块化扩散模型框架，为设计和训练自定义扩散模型提供了简洁的API。该框架支持多种噪声类型、调度类型、去噪网络和损失函数，并提供了预构建模块库。Modular Diffusion适用于图像生成和非自回归文本合成等多种应用场景，适合AI研究人员和爱好者使用。其模块化设计简化了新型扩散模型的创建和实验过程。

Github

Huggingface

介绍相关项目

BentoDiffusion - 如何使用BentoML部署和运行Stable Diffusion模型的教程

BentoMLGithubSDXL TurboStable Diffusion图像生成开源项目模型部署

本项目示例展示如何使用BentoML部署和运行Stable Diffusion模型，适用于图像生成和操作系统应用开发。需具备Python 3.9+和BentoML基础知识，并可利用Nvidia GPU进行本地测试。内容涵盖依赖安装、服务运行和BentoCloud部署，提供多个模型选择如ControlNet、Latent Consistency Model和Stable Diffusion 2等。

web-stable-diffusion - 浏览器内完全独立运行的稳定扩散模型

GithubML模型部署TVM UnityWeb Stable DiffusionWebGPU开源项目机器学习编译

本项目实现了稳定扩散模型的全浏览器内运行，无需服务器支持。这项技术降低服务成本的同时增强了个性化和隐私保护。基于WebGPU和WebAssembly等技术，用户只需通过浏览器即可体验强大的AI功能。该项目利用开源生态系统，支持Python优先环境，便于开发和优化AI模型，能够广泛部署并提供可重复和可操作的工作流程。

tame-the-authenticity-machine-v10-sdxl - 稳定扩散XL模型实现逼真图像生成

GithubHuggingfacediffusersstable-diffusiontext-to-image图像生成开源项目模型真实感

该项目利用zyxt99565的模型，通过diffusers库进行文本到图像的转换，支持多标签如stable-diffusion-xl和photorealistic，专注于生成高质量逼真图像。

controlnet-sd21-depth-diffusers - 控制稳定扩散与艺术生成的革新选择

GithubHuggingfaceStable Diffusiondiffusers开源项目控制网模型艺术语言模型

controlnet-sd21-depth-diffusers 是稳定扩散2.1模型的初始版本，着重结合深度与艺术。这一模型在laion-art子集上训练，通过使用diffusers技术，提高了图像生成的控制能力。适合研究图像生成技术和艺术的用户，强调使用上的道德考量。感谢ControlNet和脚本转换贡献者的支持，确保功能实现的高质量与灵活性。

LLM-groundedDiffusion - 优化文本到图像合成的提示理解能力

GPT-4GithubHuggingFaceLLM-grounded DiffusionStable DiffusionTMLR开源项目

本项目通过将大型语言模型（LLM）与文本到图像扩散模型结合，提高了提示理解能力。LLM负责解析文本请求，生成中间表示如图像布局，最终通过稳定扩散模型生成高质量图像。项目支持多种生成方法和开源模型，用户可自行设置实现自托管，从而节约API调用成本。项目更新频繁，包括支持高分辨率生成和集成SDXL精炼器等功能。

Diffusion-Models-Papers-Survey-Taxonomy - 扩散模型的全面方法与应用概述

ACM Computing SurveysDiffusion ModelsGithub开源项目算法分类自然语言处理计算机视觉

本文系统梳理了扩散模型的最新进展，涵盖算法和应用分类，包括计算机视觉、自然语言处理及医疗图像重建等领域。项目持续更新，整合最新研究成果。读者将收获从无监督学习到高分辨率图像生成及多模态学习的丰富知识，掌握这一前沿技术。

InstanceDiffusion - 实现精确实例级图像生成控制的突破性方法

GithubInstanceDiffusion图像生成实例级控制开源项目文本到图像条件生成

InstanceDiffusion为文本到图像的扩散模型引入精确的实例级控制。该技术支持每个实例的自由语言条件，可灵活指定实例位置，包括单点、涂鸦、边界框和实例分割掩码。相比现有技术，InstanceDiffusion在框输入的AP50上提升2.0倍，掩码输入的IoU提高1.7倍，为图像生成和编辑领域带来新的可能性。

torchdistill - 模块化深度学习知识蒸馏框架

GithubPyYAMLtorchdistill开源项目模型训练深度学习知识蒸馏

torchdistill是一款模块化的深度学习知识蒸馏框架，通过编辑yaml文件即可设计实验，无需编写Python代码。支持提取模型中间表示，方便进行可重复的深度学习研究。通过ForwardHookManager，无需修改模型接口即可提取数据。支持从PyTorch Hub导入模块，并包含多种范例代码及预训练模型，适用于图像分类、目标检测、语义分割和文本分类等任务。

Awesome-Diffusion-Models-in-Medical-Imaging - 汇总医疗影像中扩散模型的前沿研究与应用

Anomaly DetectionDiffusion ModelsGithubMedical ImagingSegmentationSurvey Papers开源项目

本页面汇集了关于医疗影像扩散模型的精彩文章，包括综合调查、挑战报告以及多种应用领域的最新研究成果。这里汇集了关于异常检测、去噪、分割、图像生成和文本到图像转换等方面的详尽文献。这些内容展示了扩散模型在医学图像分析中的重要性，还覆盖了在皮肤病变分割、脑图像异常检测等具体应用中的最新进展。欢迎社区参与和贡献，共同推动这一领域的发展。

DNA-Diffusion - 扩散模型生成调控DNA序列的新方法

DNA DiffusionGithub人工智能基因组学开源项目生成模型调控序列

DNA-Diffusion项目利用扩散概率模型生成调控DNA序列。该项目开发基于文本提示的模型，生成特定细胞类型或上下文相关的DNA序列。这些序列具有特定调控特性，如细胞特异性染色质状态、基因表达水平调控或转录因子结合位点。该研究旨在深化对正常发育和疾病中DNA调控序列特性的理解。

相关项目

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

Project Cover

稿定AI

稿定设计是一个多功能的在线设计和创意平台，提供广泛的设计工具和资源，以满足不同用户的需求。从专业的图形设计师到普通用户，无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑，稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合，帮助用户轻松实现创意设计。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号