Project Icon

Restormer

高效Restormer Transformer实现高分辨率图像修复

研究提出了一种名为Restormer的高效Transformer模型,通过多头注意力和前馈网络设计,实现了长距离像素交互,适用于大图像处理。该模型在图像去雨、单图像运动去模糊、散焦去模糊(单图像和双像素数据)和高斯及真实图像去噪等任务中表现优异。Restormer的训练代码和预训练模型已发布,并被选为CVPR 2022的口头报告。用户可通过Colab或命令行测试预训练模型。

Flux.1-dev-Controlnet-Upscaler - 基于ControlNet的Flux.1-dev兼容图像超分辨率模型
ControlNetGithubHuggingface人工智能图像增强图像处理图像超分辨率开源项目模型
Jasper研究团队开发的Flux.1-dev ControlNet超分辨率模型,专门处理低分辨率图像。采用合成复杂数据降质方案训练,可将图像分辨率提升4倍。基于diffusers库实现,支持高斯噪声、泊松噪声、图像模糊和JPEG压缩等多种图像降质处理。该模型与Flux.1-dev完全兼容,提供高质量的图像超分辨率功能。
stable-diffusion-x4-upscaler - 基于稳定扩散技术的AI图像4倍放大模型
GithubHuggingfaceStable Diffusion上采样人工智能图像生成开源项目机器学习模型
stable-diffusion-x4-upscaler是一个开源的AI图像放大模型,基于稳定扩散技术开发。它可以将图像分辨率提高4倍,同时保持图像质量。该模型支持文本引导,能根据描述优化放大效果。采用潜在扩散模型技术,在1000万张高分辨率图像上训练。适用于图像分辨率提升、艺术创作和图像编辑等领域。
NAFNet - 无需非线性激活函数的图像修复网络
GithubNAFNet图像修复图像去噪图像去模糊开源项目超分辨率
NAFNet是一种无需非线性激活函数的图像修复网络,通过简单的基线超过现有SOTA方法并显著降低计算成本。在GoPro数据集上,该网络的图像去模糊性能达到33.69 dB PSNR,在SIDD数据集上的图像去噪性能为40.30 dB PSNR,均显著超越前代SOTA性能。NAFNet适用于图像去噪、去模糊和立体图像超分辨率等任务。
KAIR - 多功能视频与图像增强开源工具箱,涵盖最新深度学习模型
BSRGANGithubSCUNetSwinIRUSRNetVRT开源项目
KAIR项目提供了视频超分辨率、去模糊、去噪等图像处理技术的训练和测试代码,支持如DnCNN、FFDNet、SRMD、MSRResNet、ESRGAN、SwinIR等最新模型。这些代码简洁易懂,并附有详细指南,即使是复杂的图像恢复任务也能取得高性能效果。项目定期更新,确保用户体验最新技术进展。
UpscaleImage AI - 全方位智能图像处理和生成平台
AI图像处理AI工具图像增强图像生成照片修复背景移除
UpscaleImage AI集成了多项先进的图像处理技术,包括模糊照片修复、分辨率提升、背景去除、旧照片修复等功能。该平台还提供AI驱动的逼真人物图像生成服务。无论是个人用户还是专业设计师,都能通过这一综合性工具提升图像质量,优化工作流程。UpscaleImage AI为图像处理和创作提供了高效、便捷的解决方案。
Remini - 智能照片和视频增强技术让视觉内容焕发新生
AI工具AI照片生成Remini图像增强照片修复视频增强
Remini运用先进的人工智能技术,将低质量图像和视频转换为高清作品。这款工具能够消除模糊、恢复旧照片、降噪、增强人脸细节、修复颜色,并支持2倍无损放大。Remini广泛应用于社交媒体、家族史保存、印刷服务和电子商务等领域,提供专业级的视觉内容增强服务。作为一款简单易用的应用,Remini已得到全球数百万用户的认可,成为照片和视频增强领域的创新产品。
MP-Former - 基于mask-piloted机制的先进图像分割模型
CVPR 2023GithubMP-FormerMask2FormerTransformer图像分割开源项目
MP-Former是一种新型图像分割transformer模型,采用mask-piloted机制改进分割效果。项目包含训练和评估代码,适用于实例分割和全景分割任务。基于Mask2Former架构开发,在COCO数据集上展现出良好性能。项目提供了复现论文实验的脚本,为计算机视觉研究提供参考实现。MP-Former在CVPR 2023上发表,提供了no noise和all-layer MP训练设置,12轮训练后在实例分割任务上达到40.15 AP。项目代码开源,安装过程与Mask2Former相同,便于研究者快速上手和进行进一步探索。
edsr-base - 轻量级单图像超分辨率深度残差网络
DIV2KEDSRGithubHuggingface图像超分辨率开源项目模型深度学习计算机视觉
EDSR-base是一种轻量级单图像超分辨率深度学习模型,基于增强型深度残差网络架构。该模型在DIV2K数据集上预训练,支持2倍、3倍和4倍图像放大。与原始EDSR相比,EDSR-base采用16个残差块和64个通道,模型大小约5MB。在多个基准数据集上,其PSNR和SSIM指标均优于双三次插值。研究者可通过super-image库使用该模型进行图像放大实验。
PASD - 像素感知稳定扩散模型用于图像超分辨率和风格化
GithubStable Diffusion个性化风格化人工智能图像超分辨率开源项目计算机视觉
PASD是一个基于像素感知稳定扩散模型的开源项目,专注于图像超分辨率和风格化处理。该技术能将低分辨率图像转换为高质量的高分辨率版本,同时支持老照片修复、图像上色和风格转换等多种任务。PASD的核心优势在于其像素级的感知能力,可以在各种复杂的图像处理过程中保持细节的完整性。
stable-diffusion-2-inpainting - 基于扩散模型的高分辨率图像生成和修复工具
GithubHuggingfaceStable Diffusion人工智能图像生成开源项目模型深度学习计算机视觉
stable-diffusion-2-inpainting是一个基于扩散模型的图像生成和修复工具。该模型能根据文本提示生成高质量图像,并支持高分辨率图像修复。它采用LAMA的掩码生成策略,结合掩码图像的VAE潜在表示作为额外条件。该模型在英语提示下效果最佳,适用于艺术创作、设计和研究等领域。然而,它也存在一些局限性,如无法生成可读文本,对复杂任务表现欠佳。使用时应注意避免生成有害或带有偏见的内容。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能,包括文生视频、动态画面和形象生成等,帮助用户快速上手,创造专业级内容。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台,用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品,帮助用户探索创意灵感。

Project Cover

讯飞文书

讯飞文书依托讯飞星火大模型,为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能,满足事务性工作的高频需求,帮助撰稿人节省精力,提高效率,优化工作与生活。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号