Project Icon

ddpm-celebahq-256

高效的无条件图像生成与渐进解压的新型扩散模型

本项目使用去噪扩散概率模型,实现了高质量的图像合成,借鉴了不平衡热力学,创新性地结合了变分界限和去噪评分匹配,并通过Langevin动力学实现渐进的解压缩。模型在CIFAR10数据集上取得了9.46的Inception得分和3.17的最新FID得分,在256x256 LSUN上样本质量与ProgressiveGAN相近。推理中可使用离散噪声调度器如ddpm、ddim或pndm,ddim和pndm在速度和质量上表现出色。项目支持用户自主训练模型,并提供官方示例用于推理和训练。

stable-diffusion-3.5-medium - MMDiT-X高效能文本到图像生成技术
GithubHuggingfaceQK正则化Stable Diffusion图像质量提升多模态扩散变压器开源项目文本生成图像模型
Stable Diffusion 3.5 Medium是一款MMDiT-X模型,提升文本到图像生成的图像质量和资源效率。通过多模态扩散变压器结合QK标准化技术,该模型在多分辨率生成和文本理解方面表现出色,适合设计、创作与研究领域,年收入低于100万美元的用户可免费使用。
MultiDiffusion - 基于预训练模型的多功能可控的图像生成框架
GithubMultiDiffusion可控生成图像生成开源项目扩散模型文本到图像
MultiDiffusion 是一个统一框架,通过预训练的文字转图像扩散模型,实现多功能且可控的图像生成,无需进一步训练或微调。该框架支持用户使用各种控制信号,如纵横比和空间引导信号,生成高质量、多样化的图像。MultiDiffusion 优化了多重扩散生成过程,使用一组共享参数或约束,支持局部和全局编辑,适用于如烟雾、火焰和雪等半透明效果。
stable-diffusion-3.5-large-turbo-gguf - 直接量化的图像生成模型
AI社区GithubHuggingfaceStabilityAIstable-diffusion图像生成开源项目模型量化
stable-diffusion-3.5-large-turbo-gguf项目提供了对stabilityai的3.5稳定扩散模型的直接量化处理。模型文件可以在ComfyUI-GGUF自定义节点中运用,通过简单的文件部署即可实现。量化处理保持了原模型的许可证要求,提升了图像生成的运算效率,适用于文本到图像的生成任务。更多技术细节可以参考GitHub上的安装说明和量化类型概览。
DreamPhotoGASM - 高级写实AI图像生成工具
AI绘图DreamPhotoGithubHuggingfaceStable Diffusion开源项目模型模特真实感
DreamPhotoGASM是一款专注于生成高度写实人物图像的AI工具。该项目结合多种艺术模型,可创建从浪漫场景到时尚写真的多样化图片。它擅长捕捉人物细节,包括面部表情、服装质感和环境光线,为创作者提供了将文字描述转化为视觉艺术的平台。
pixart-900m-1024-ft-v0.6 - 使用稳定扩散技术的创新图像生成模型
AI绘图GithubHuggingfacecyberpunk风格stable-diffusion图像合成开源项目未来城市模型
此开源项目利用稳定扩散技术,专注于文本生成图像的应用,确保高质量的图像输出。以ptx0/pixart-900m-1024-ft-large为基础,通过simpletuner调试,适合描绘多种艺术场景,如外星市场、奇幻森林、赛博朋克城市等。用户可借助自定义文本提示,生成详尽且清晰的图像,支持去除模糊、裁剪及不美观的元素。适合创意者、设计师,激发艺术创意与设计灵感。
Paramount - 多模型融合的高质量AI图像生成项目
GithubHuggingfaceParamountStable Diffusion人工智能图像生成开源项目模型模型融合
Paramount是一个开源的AI图像生成项目,融合了Paragon 1.0、AnalogMadness和Analog Diffusion等多个模型。该项目结合了多个模型的特点,可生成高质量的写实照片、复古风格图像和创意场景。通过文本提示,Paramount能够创建各种风格的图像,如电影截图、漫画角色和科幻场景等。这个项目为图像创作提供了多样化的选择,适用于需要生成各类图像的场景。
dreamshaper-xl-1-0 - 基于Diffusers的AI图像生成模型 支持多样化创意表达
AI模型DiffusersGithubHuggingface开源项目数据集机器学习模型模型卡片
Dreamshaper-xl-1-0是基于Diffusers框架的AI图像生成模型。该模型能根据文本描述生成图像,支持多种艺术风格和场景。它可应用于创意设计、内容创作等领域。虽然功能强大,但使用时需注意潜在的偏见和局限性。目前该模型的具体训练数据、评估结果等信息尚未公开。
OnlyReal-Black-Mix - 利用文本到图像技术实现高效图像生成的创新解决方案
CivitaiGithubHugging FaceHuggingfacediffusersstable-diffusion图像生成开源项目模型
该项目结合稳定扩散模型与diffusers,支持文本转图像功能,适合多样化的创意应用场景。利用Hugging Face API生成的样本图像及原作者的演示,展示了其在艺术创作中的潜力与应用价值。
sd-vae-ft-ema - 稳定扩散变分自编码器的增强版模型
GithubHuggingfaceStable Diffusion图像重建开源项目扩散模型机器学习模型自动编码器
sd-vae-ft-ema是一个基于LAION-Aesthetics和LAION-Humans数据集训练的稳定扩散变分自编码器。该模型在图像重建质量尤其是人脸细节方面优于原始VAE,具有更好的rFID、PSNR和SSIM指标表现,可作为扩散器工作流中的即插即用组件。
DiG - 基于门控线性注意力的高效可扩展扩散模型
DiGDiffusion ModelsGated Linear AttentionGithub图像生成开源项目深度学习
DiG项目提出了一种基于门控线性注意力的扩散模型,用于解决现有模型在可扩展性和计算效率方面的挑战。该模型在高分辨率下展现出显著的训练速度提升和内存节省,性能优于DiT。DiG在不同计算复杂度下表现出色,随着模型深度/宽度增加或输入令牌增强,FID值持续下降。与其他次二次时间复杂度的扩散模型相比,DiG在多种分辨率下都展现出卓越的效率。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号