ddpm-ema-celebahq-256

无条件图像生成的高效去噪扩散模型

ProgressiveGAN 开源项目 CIFAR10 图像合成模型 DDPM Huggingface 噪声调度器 Github

项目通过去噪扩散概率模型实现高质量无条件图像生成，结合无平衡态热力学概念，在CIFAR10和256x256 LSUN数据集上取得了优异的Inception和FID评分。用户可以灵活选择噪声调度器以平衡生成质量与速度，该模型也支持渐进式无损压缩，作为自动回归解码的推广。详情请参照官方推理与训练示例。

epiCPhotoGasm - Stable Diffusion驱动的超写实女性肖像生成模型

GithubHuggingfaceStable Diffusion人像生成开源项目文生图梦幻风格模型逼真

作为一个开源项目，epiCPhotoGasm在Stable Diffusion的基础上进行了优化，以生成高质量的女性肖像。它不仅能创造出照片级的写实效果，还能融入超现实主义元素，产生独特的视觉效果。这个模型为数字艺术家、广告设计师和内容创作者提供了一个强大的工具，可用于探索新的创作方向。

LLM-groundedDiffusion - 优化文本到图像合成的提示理解能力

GPT-4GithubHuggingFaceLLM-grounded DiffusionStable DiffusionTMLR开源项目

本项目通过将大型语言模型（LLM）与文本到图像扩散模型结合，提高了提示理解能力。LLM负责解析文本请求，生成中间表示如图像布局，最终通过稳定扩散模型生成高质量图像。项目支持多种生成方法和开源模型，用户可自行设置实现自托管，从而节约API调用成本。项目更新频繁，包括支持高分辨率生成和集成SDXL精炼器等功能。

TCD-SDXL-LoRA - 创新扩散模型蒸馏技术助力高质量图像快速生成

GithubHuggingfaceLoRAStable DiffusionTCD开源项目快速采样文本生成图像模型

TCD是一款基于轨迹一致性蒸馏原理的开源项目，通过少步采样技术实现快速图像生成。该技术在保持高质量生成效果的同时，支持灵活调节采样步数和细节程度。作为SDXL的扩展模型，TCD可与社区模型、LoRA、ControlNet等技术无缝集成，并解决了传统对抗训练中的模式崩溃问题。

PASD - 像素感知稳定扩散模型用于图像超分辨率和风格化

GithubStable Diffusion个性化风格化人工智能图像超分辨率开源项目计算机视觉

PASD是一个基于像素感知稳定扩散模型的开源项目，专注于图像超分辨率和风格化处理。该技术能将低分辨率图像转换为高质量的高分辨率版本，同时支持老照片修复、图像上色和风格转换等多种任务。PASD的核心优势在于其像素级的感知能力，可以在各种复杂的图像处理过程中保持细节的完整性。

autoregressive-diffusion-pytorch - 自回归扩散模型：无向量量化的图像生成方法

GithubPyTorch图像生成开源项目深度学习神经网络自回归扩散

autoregressive-diffusion-pytorch是一个基于PyTorch的自回归扩散模型实现，源自'Autoregressive Image Generation without Vector Quantization'论文。模型支持序列和图像输入，无需向量量化即可生成高质量图像。项目提供简洁API接口，包含详细使用说明和示例代码，适合研究人员和开发者探索自回归扩散模型。

DemoFusion - 民主化高分辨率图像生成

DemoFusionGithub图像生成开源开源项目生成式人工智能高分辨率

DemoFusion项目致力于通过优化现有开源生成式人工智能（GenAI）模型，普及高分辨率图像生成技术，减少高额资本投资需求。该框架利用渐进式放大、跳过残差和膨胀采样机制，实现高质量图像生成。DemoFusion的渐进生成过程提供中间预览结果，便于用户快速调整和迭代。此项目旨在对抗大公司垄断，让公众无需支付高昂费用即可使用尖端的高分辨率图像生成技术。

StableSR - 通过扩散模型实现实际应用中的图像超分辨率

GithubHugging FaceStableSR图像超分辨率开源项目扩散模型模型训练

StableSR项目采用扩散模型，提高了真实世界场景中的图像超分辨率效果。最新更新包括对SD-Turbo的支持以及与ComfyUI和Hugging Face平台的集成。用户可以通过各种平台体验和测试该项目的功能。项目提供了详细的文档、代码示例和训练脚本，已被IJCV期刊接受，并在多个公开数据集中展示了其性能和效果。

blended-diffusion - 使用自然语言进行图像局部编辑的工具

Blended DiffusionCLIPDDPMGithub图像编辑开源项目自然语言描述

Blended Diffusion 是一种利用自然语言和ROI掩模进行图像局部编辑的工具。结合了CLIP预训练语言-图像模型和DDPM去噪扩散模型，实现了高效的自然图像编辑。它可以保持背景完整，并无缝融合编辑区域，减少对抗性结果。功能包括新增物体、移除/替换/改变现有物体、背景替换和图像外推。相关代码和模型已开放下载，供用户探索。

SpeeD - 通过时间步长优化实现扩散模型训练加速

AI生成GithubSpeeD开源项目扩散模型深度学习训练加速

SpeeD是一种创新的扩散模型训练加速技术,通过对时间步长的深入分析和优化,将训练过程分为加速、减速和收敛三个区域。该方法采用重采样和重加权策略,实现了训练速度的显著提升。SpeeD易于与现有模型集成,能有效提高扩散模型的训练效率,为图像生成等任务提供了新的解决方案。

推荐项目

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能，包括文生视频、动态画面和形象生成等，帮助用户快速上手，创造专业级内容。

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台，用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品，帮助用户探索创意灵感。

讯飞文书

讯飞文书依托讯飞星火大模型，为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能，满足事务性工作的高频需求，帮助撰稿人节省精力，提高效率，优化工作与生活。

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具，简化了选题、文献检索至论文撰写的整个过程。通过简单设定，平台可快速生成高质量论文大纲和全文，配合图表、参考文献等一应俱全，同时提供开题报告和答辩PPT等增值服务，保障数据安全，有效提升写作效率和论文质量。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com