Project Icon

tree-ring-watermark

为扩散模型图像提供不可见鲁棒水印

Tree-Ring Watermarks是一种为扩散模型图像设计的水印技术。通过在初始噪声的傅里叶变换中嵌入特殊模式,生成的水印在图像中不可见,但可通过反向扩散检测。该技术有效验证和保护AI生成图像,能抵抗多种攻击并保持图像质量。项目提供完整实现代码,包含主要实验、CLIP评分计算和FID评估功能。

flash-diffusion - 用于加速条件扩散模型的高效蒸馏技术
Flash DiffusionGithubLoRA加速技术图像生成开源项目扩散模型
Flash Diffusion是一种用于加速预训练扩散模型图像生成的蒸馏方法。该技术高效、快速、通用且兼容LoRA,在COCO数据集上实现了少步骤图像生成的先进性能。Flash Diffusion只需几小时GPU训练时间和较少可训练参数,适用于文本生成图像、图像修复、换脸和超分辨率等多种任务。它支持UNet和DiT等不同骨干网络,能够显著减少采样步骤,同时保持高质量的图像生成效果。
Diffusion-Low-Light - 小波扩散模型提升低光照图像质量
GithubSiggraph Asia 2023低光照图像增强小波扩散模型开源项目深度学习计算机视觉
Diffusion-Low-Light是一个发表于Siggraph Asia 2023的开源项目,提出了基于小波扩散模型的低光照图像增强方法。该方法在LOLv1、LOLv2和LSRW等多个数据集上表现优异,与现有技术相比效果显著。项目提供预训练模型、代码和详细实施指南,在保持图像细节和自然度方面表现出色,为低光照图像处理领域带来了创新解决方案。
TCD-SDXL-LoRA - 创新扩散模型蒸馏技术助力高质量图像快速生成
GithubHuggingfaceLoRAStable DiffusionTCD开源项目快速采样文本生成图像模型
TCD是一款基于轨迹一致性蒸馏原理的开源项目,通过少步采样技术实现快速图像生成。该技术在保持高质量生成效果的同时,支持灵活调节采样步数和细节程度。作为SDXL的扩展模型,TCD可与社区模型、LoRA、ControlNet等技术无缝集成,并解决了传统对抗训练中的模式崩溃问题。
DeepRobust - PyTorch图像和图神经网络对抗性攻防开源库
DeepRobustGithubPyTorch图神经网络对抗攻击开源项目机器学习
DeepRobust是一个基于PyTorch的开源库,专注于图像和图神经网络的对抗性攻击与防御。它提供多种攻防算法,支持MNIST、CIFAR10等数据集,可与PyTorch Geometric集成。该库适用于对抗性机器学习研究,也为构建鲁棒深度学习模型提供工具。DeepRobust支持大规模图如OGB-ArXiv的攻击,并包含节点嵌入攻击和受害模型。它还提供图像预处理方法APE-GAN,支持ImageNet数据集,新增UGBA后门攻击和PRBCD可扩展攻击算法。库中包含MedianGCN、AirGNN等鲁棒模型,以及用于转换PyTorch Geometric和DeepRobust数据集的工具,成为全面的对抗性机器学习研究平台。
epiCRealism - Stable Diffusion模型实现真实感图像生成
AI绘图GithubHuggingFaceHuggingfaceStable Diffusion开源项目文本生成图像机器学习模型模型
epiCRealism是一个基于Stable Diffusion的开源模型,专注于生成高质量真实感图像。该模型支持多种场景创作,包括人像、风景和幻想题材,能够呈现细腻的细节和逼真效果。epiCRealism易于集成到各类图像生成项目中,为创作者和开发者提供了实现视觉创意的有力工具。
stable-diffusion-v1-4 - 先进的AI文本转图像模型
GithubHuggingfaceStable Diffusion人工智能开源项目扩散模型文本生成图像模型深度学习
Stable Diffusion v1-4是一个基于潜在扩散技术的AI模型,能将文本描述转化为高质量图像。它结合自动编码器和CLIP文本编码器,在大规模数据集上训练,可生成多样化的写实和艺术风格图像。该模型为研究人员和创意工作者提供了新的视觉创作工具,开启了AI辅助艺术创作的可能性。但值得注意的是,模型存在一些局限性,如无法生成可读文本,且在复杂组合任务上表现不佳。
stable-diffusion-v1-5 - 先进的文本到图像AI生成模型
GithubHuggingfaceStable Diffusion人工智能开源项目文本生成图像机器学习模型深度学习
Stable Diffusion v1-5是一种基于潜在扩散的文本到图像生成模型。它在LAION-5B数据集上经过595k步训练,可生成512x512分辨率的高质量图像。该模型适用于艺术创作、设计和研究,但存在人脸和文字渲染的局限性。模型通过Diffusers库提供,但不应用于生成有害内容。Stable Diffusion v1-5代表了AI图像生成技术的重要进展。
autoregressive-diffusion-pytorch - 自回归扩散模型:无向量量化的图像生成方法
GithubPyTorch图像生成开源项目深度学习神经网络自回归扩散
autoregressive-diffusion-pytorch是一个基于PyTorch的自回归扩散模型实现,源自'Autoregressive Image Generation without Vector Quantization'论文。模型支持序列和图像输入,无需向量量化即可生成高质量图像。项目提供简洁API接口,包含详细使用说明和示例代码,适合研究人员和开发者探索自回归扩散模型。
Imagen - 文字生成图片的AI技术
AI工具AI开发COCO FIDImagen扩散模型文本到图像模型训练热门语言模型
Imagen,一种先进的AI图片生成工具,利用深度语言理解和极致的图像真实性,实现从文字到图像的转换。此模型不仅在COCO数据集上刷新了技术记录,还通过高效的U-Net架构和强大的文本编码系统,优化了图文一致性和图像质量。鉴于潜在的社会影响和数据集偏差问题,当前未开放源代码或公共演示版本。
IF-I-XL-v1.0 - 先进的多级级联扩散模型实现高质量文本到图像生成
AI绘画DeepFloyd-IFGithubHuggingface开源项目扩散模型文本生成图像模型深度学习
IF-I-XL-v1.0是DeepFloyd和StabilityAI开发的三级级联扩散模型,具有4.3B参数规模。该模型采用冻结的T5转换器和改进的UNet架构,实现高质量文本到图像生成。在COCO数据集上,模型达到6.66的零样本FID-30K分数,展现出优秀的照片级真实感和语言理解能力。支持从64x64到1024x1024的多分辨率图像生成,可在14GB显存的GPU上高效运行。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

Project Cover

天工AI音乐

天工AI音乐平台支持音乐创作,特别是在国风音乐领域。该平台适合新手DJ和音乐爱好者使用,帮助他们启动音乐创作,增添生活乐趣,同时发现和分享新音乐。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号