cleanvision

图像数据集问题自动检测工具，提升计算机视觉项目质量

CleanVision 图像数据集数据问题检测计算机视觉数据质量 Github 开源项目

CleanVision是一个开源的图像数据集审核工具，能自动检测模糊、曝光不当和重复等常见问题。它为计算机视觉项目提供了数据预处理解决方案，支持多种图像格式，适用于分类、分割和对象检测等任务。开发者只需几行Python代码即可快速审核数据集，有助于提高机器学习模型的训练质量。

EasyCV - 基于PyTorch的全能计算机视觉工具箱，支持自监督学习和Transformer模型

EasyCVGithubPyTorch图像分类开源项目目标检测自监督学习

EasyCV是基于PyTorch的全能计算机视觉工具箱，专注于自监督学习、Transformer模型和主要视觉任务，包括图像分类、度量学习、目标检测和姿态估计。该工具箱提供了最先进的自监督算法如SimCLR、MoCO V2、Swav、DINO和基于掩码图像建模的MAE。它拥有简单综合的推理接口，并支持多种预训练模型。EasyCV支持多GPU和多工作者训练，利用DALI优化数据处理，使用TorchAccelerator和fp16加速训练，并通过PAI-Blade优化推理性能。

daclip-uir - 利用视觉语言模型控制实现通用图像修复

AI技术DA-CLIPGithub图像恢复开源项目视觉语言模型训练数据集

DA-CLIP模型通过视觉语言控制实现通用图像修复。用户可以通过多种方式使用预训练模型，如Gradio应用测试图像，或通过提供的代码示例和数据准备步骤进行训练和评估。该项目提供解决多种真实世界图像退化问题的方法，并提供多种预训练模型供下载。功能和性能的持续更新显著提升了其在图像修复中的适用性。

VisionVision - 优化图像合成质量，通过模型融合实现多元风格

AI绘图GithubHuggingfaceStable DiffusionVisionVision动漫开源项目模型真实感

该项目结合realistic-vision-v1.3和ZootVisionBeta模型，优化图像生成的质量与细节，尤其是在合成和眼部细节方面。VisionVision支持多种风格，包括写实与艺术表现，适用于动漫与真实感艺术创作。项目使用SuperMerger技术，提供丰富样例与提示，帮助用户生成优质图像。

clarity-upscaler - AI图像放大和增强的免费开源工具

AI应用Clarity AIGithub图像增强开源软件开源项目放大器

Clarity AI是免费的开源AI图像放大和增强工具，支持高达13k分辨率、多种格式输出及多步放大。项目不断更新，包括模式放大、图像锐化和自定义安全张量检查点支持。用户可以通过应用程序、ComfyUI节点或API轻松使用，也可以选择高级部署方式。

ScreenAI - 深度理解界面和信息图的视觉语言模型

GithubScreenAIUI理解信息图表理解多模态开源项目视觉语言模型

ScreenAI是一个开源的多模态视觉语言模型，专注于用户界面(UI)和信息图的理解。该模型集成了视觉变换器(ViT)、注意力机制和前馈网络，能够处理图像和文本输入。通过深度学习技术，ScreenAI实现了对复杂视觉信息的处理和文本整合分析，为UI设计、信息可视化和人机交互研究提供了新的工具和方法。

SupContrast - 监督对比学习框架增强视觉表征

GithubSupContrast图像分类对比学习开源项目损失函数监督学习

SupContrast是一个开源的监督对比学习框架，致力于提升视觉表征学习效果。该项目实现了监督对比学习和SimCLR算法，在CIFAR数据集上展现出色性能。它提供简洁的损失函数实现，支持自定义数据集，并附有详细运行指南和可视化结果。在ImageNet上，SupContrast实现了79%以上的Top-1准确率。这一工具为计算机视觉领域的研究和应用提供了重要支持。

visionscript - 抽象编程语言，用于快速执行计算机视觉任务

GithubPythonVisionScript图像分类对象检测开源项目计算机视觉

VisionScript是一个基于Python的编程语言，专门用于快速执行目标检测、分类和分割等常见计算机视觉任务。其简洁的语法允许用户通过少量代码完成复杂的视觉操作，并支持在交互式网络笔记本中运行。VisionScript兼容多个知名模型，包括CLIP、YOLOv8和BLIP，适合新手上手。无论是执行零样本分类，还是在照片中替换特定对象，VisionScript均能提供高效解决方案。

awesome-data-labeling - 全面数据标注工具集锦

CVATGithubawesome-data-labelingimage annotationlabelImg开源项目数据标注工具

汇集各类数据标注工具，包括图像、文本、音频、视频、时间序列、3D和Lidar等多种应用领域。这些开源高效的工具能有效加速机器学习和计算机视觉项目的数据准备。

realistic-vision-v12 - 基于文本生成逼真图像的新技术

AI绘图GithubHuggingfaceRealistic Visiondiffusersstable-diffusion图像生成开源项目模型

Realistic Vision 1.2结合稳定扩散技术和diffusers库，从文本生成高质量的逼真图像。采用CreativeML-OpenRAIL-M许可证，项目为数字创作提供了灵活性和创新性。通过简单的文本提示，用户可以生成多种符合视觉需求的图像，适用于多个创意领域。

overeasy - 无数据集需求的定制视觉模型构建

GithubOvereasy分割图像处理开源项目计算机视觉零样本视觉模型

Overeasy允许无大规模数据集，通过链式预训练零样本视觉模型实现高效图像处理。利用专用工具和工作流，用户可定制端到端管道，支持边框检测及分类。功能涵盖执行图和检测，安装简便，文档详尽，并提供Colab示例。

相关项目

推荐项目

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

稿定AI

稿定设计是一个多功能的在线设计和创意平台，提供广泛的设计工具和资源，以满足不同用户的需求。从专业的图形设计师到普通用户，无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑，稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合，帮助用户轻松实现创意设计。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com