video2x

开源视频和图像超分辨率增强软件

Video2X是一个开源的视频、GIF和图像超分辨率处理软件。它集成了waifu2x、Real-ESRGAN等多种先进算法，能够有效提升媒体质量。Video2X提供图形界面、命令行和Docker容器三种使用方式，支持Windows和Linux平台。除了提高分辨率外，该工具还具备帧率插值功能，可以显著改善视频的流畅度和清晰度。

访问官网

Github

介绍相关项目

CogVideoX-2b - 轻量级开源视频生成模型支持低显存推理

CogVideoXGithubHuggingface人工智能开源项目扩散模型文本到视频模型视频生成

CogVideoX-2B是一个基于扩散模型的开源视频生成工具。该模型可将文本描述转化为6秒长、720x480分辨率、8帧/秒的视频。其最低仅需4GB显存即可运行，通过INT8量化还可进一步降低资源消耗。作为入门级选择，CogVideoX-2B在性能和资源使用间取得平衡，适合进行二次开发。模型目前支持英文输入，并提供多种优化方案以提升推理速度和降低显存占用。

SRGAN - 使用生成对抗网络提升单图像超分辨率效果

GithubSRGANTensorLayerXVGG19开源项目计算机视觉超分辨率

本项目展示了使用生成对抗网络（GAN）如何实现单图像的高分辨率超分辨率。使用预训练的VGG19模型和高分辨率图像进行训练，支持多种深度学习框架，如TensorFlow、PaddlePaddle、MindSpore，未来还将支持PyTorch。项目提供完整的训练和评估指南，并通过简单的代码修改可以切换不同的后端框架。适用于图像处理和计算机视觉领域的研究人员和开发人员，项目中展示了技术实现的详细结果，还提供了参考文献和讨论资源。

resdet - 精确识别放大图像原始分辨率的开源工具

FFTGithubresdet分辨率检测图像处理开源项目源代码

resdet是一个开源的图像分析工具，专注于检测经过放大处理的图像的原始分辨率。通过分析图像的频域特征，resdet能准确识别图像在放大前的分辨率。该工具支持多种图像格式和视频帧，并提供API接口方便集成。resdet适用于图像去重、质量评估等需要判断图像是否被放大的场景。其核心算法利用离散余弦变换，有效识别重采样过程中的频域特征。

Overmix - 专业动画截图拼接与图像重建工具

GithubOvermix动画截图图像拼接图像重建开源项目

Overmix是一个开源的图像拼接和重建工具，主要用于处理动画截图。它能将多个局部图像片段合成为完整的原始图像，克服MPEG压缩、色带和屏幕文字等问题。该工具具备16位高质量渲染、亚像素级偏移检测、多线程处理等功能。Overmix还支持去卷积锐化、字幕移除和循环动画检测，为图像重建提供全面解决方案。

Text2Video - 文本生成视频模型

GithubText2Video开源项目深度学习生成对抗网络视频合成语音合成

Text2Video采用深度学习技术，通过建立音素姿势字典与训练生成对抗网络，从文本生成视频，该技术相较于传统音频驱动的视频生成方法，具有更少的数据需求、更高的灵活性和更低的时间成本。在标准数据集上的广泛测试证明了其显著的效果和优势。

DemoFusion - 民主化高分辨率图像生成

DemoFusionGithub图像生成开源开源项目生成式人工智能高分辨率

DemoFusion项目致力于通过优化现有开源生成式人工智能（GenAI）模型，普及高分辨率图像生成技术，减少高额资本投资需求。该框架利用渐进式放大、跳过残差和膨胀采样机制，实现高质量图像生成。DemoFusion的渐进生成过程提供中间预览结果，便于用户快速调整和迭代。此项目旨在对抗大公司垄断，让公众无需支付高昂费用即可使用尖端的高分辨率图像生成技术。

image-super-resolution - Keras实现的高质量图像超分辨率，支持多种网络结构和训练脚本

GANGithubImage Super-ResolutionKerasPSNRResidual Dense Networks开源项目

本项目旨在通过实现多种残差密集网络（RDN）和残差在残差密集网络（RRDN）来提升低分辨率图像的质量，并支持Keras框架。项目提供了预训练模型、训练脚本以及用于云端训练的Docker脚本。适用于图像超分辨率处理，兼容Python 3.6，开源并欢迎贡献。

AI Image Extender - AI图像扩展与增强解决方案

AI图像扩展AI工具人工智能图像增强照片编辑背景扩展

AI Image Extender是一款基于人工智能的图像扩展工具，可将图像智能扩展至原始边界之外。它能够自动放大背景、调整图像比例、扩展照片边缘，同时保持视觉连贯性。这项技术适用于社交媒体图片优化、宽屏壁纸制作和去除图像中的不需要元素。AI Image Extender为各类用户提供了创新的图像处理解决方案。

aura-sr - 基于GAN的真实世界图像超分辨率增强工具

AuraSRGANGithub人工智能图像处理开源项目超分辨率

AuraSR是一款基于GAN技术的图像超分辨率工具，专为真实世界图像设计。作为GigaGAN论文的变体，它用于图像条件下的放大。该开源项目基于Torch实现，提供简洁的Python API，支持4倍图像放大，并能减少接缝伪影。AuraSR安装使用便捷，为开发者和研究者提供了强大的图像处理工具，适用于多种需要高质量图像增强的场景。

sd-webui-text2video - 基于Auto1111的多样化text2video模型实现

GithubLoRAModelScopeStableDiffusion WebUIText2videoVideoCrafter开源项目

基于Auto1111的webui依赖，该扩展实现了ModelScope和VideoCrafter等text2video模型，无需登录即可使用。要求至少6GB的VRAM，支持不同帧数和分辨率的视频生成。项目包含多次更新，新增功能如VAE设置、提示权重和WebAPI，并支持LoRA训练。提供详细的模型下载指南，并欢迎社区的贡献与支持。

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具，简化了选题、文献检索至论文撰写的整个过程。通过简单设定，平台可快速生成高质量论文大纲和全文，配合图表、参考文献等一应俱全，同时提供开题报告和答辩PPT等增值服务，保障数据安全，有效提升写作效率和论文质量。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号