labelImg

Python图像标注工具，兼容PASCAL VOC和YOLO格式

Label Studio LabelImg 数据标注工具图像注释 Python Github 开源项目

一款用Python编写的开源图像标注工具，适用于深度学习数据集的创建。支持PASCAL VOC、YOLO和CreateML等多种标注格式，可在Linux、macOS、Windows等平台上运行，并提供详细的安装和使用指南。用户可以通过直观的界面创建矩形框标注，支持预定义类、热键操作和Docker部署，是机器学习和计算机视觉项目的数据标注利器。

访问官网

Github

介绍相关项目

Image To Caption - 智能图像字幕生成工具

AI图像描述生成器AI工具CaptionMasterInstagram图片上传社交媒体

Image To Caption是一款基于人工智能的图像字幕生成工具。该工具能为图片创作吸引眼球的字幕，有助于增加社交媒体曝光率。支持多种图片格式，使用简便，上传图片后选择语言和平台即可生成字幕。此外，平台还提供丰富的字幕示例和相关资源，可作为社交媒体营销辅助工具。

DanTagGen-beta - AI图片标签生成器助力精准艺术创作

AI绘图DanTagGenGithubHuggingface开源项目数据集模型深度学习生成模型

DanTagGen-beta是一款基于LLaMA架构的AI标签生成器，专为Danbooru风格的AI艺术创作设计。通过5.3M数据集训练，该工具能够根据基础标签智能推荐相关标签，有效提升生成图像的质量和细节。DanTagGen-beta支持多种部署方式，包括llama.cpp和量化模型，为AI艺术创作者提供了高效的标签辅助工具。

LeYOLO - 可扩展高效的目标检测CNN架构

COCO数据集GithubLeYOLO开源项目目标检测神经网络计算效率

LeYOLO是一种新型目标检测模型系列，通过创新的CNN架构设计实现了计算效率与准确性的优化平衡。该模型引入高效主干网络缩放、快速金字塔架构网络和解耦网络中的网络检测头，大幅降低计算负载。在COCO验证集上，LeYOLO-Small仅使用4.5 GFLOP就达到38.2%的mAP，比YOLOv9-Tiny减少42%计算量。LeYOLO系列具有强大可扩展性，适用于从超低计算需求(<1 GFLOP)到高效高性能(>4 GFLOPs)的多种场景。

img-prompt - 图像提示词编辑工具简化AI绘图创作过程

AI绘图DALL·EGithubMidjourneyStable Diffusion开源项目提示词编辑器

IMGPrompt是一个面向Stable Diffusion、Midjourney和DALL·E等AI绘图工具的提示词编辑器。它具有简洁的界面，提供提示词标签化、互动编辑和分类展示功能，便于用户组合提示词。工具完全本地化运行，支持中文显示，无需依赖外部服务，有效提升了AI绘图创作的效率。

Imagen - 文字生成图片的AI技术

AI工具AI开发COCO FIDImagen扩散模型文本到图像模型训练热门语言模型

Imagen，一种先进的AI图片生成工具，利用深度语言理解和极致的图像真实性，实现从文字到图像的转换。此模型不仅在COCO数据集上刷新了技术记录，还通过高效的U-Net架构和强大的文本编码系统，优化了图文一致性和图像质量。鉴于潜在的社会影响和数据集偏差问题，当前未开放源代码或公共演示版本。

quickai - 简化复杂机器学习模型的实验过程

GithubPythonQuickAIYOLO卷积神经网络开源项目机器学习

QuickAI 是一个 Python 库，简化了前沿机器学习模型的实验流程。支持 EfficientNet、VGG、ResNet 等图像分类模型和 GPT-NEO、Distill BERT 等自然语言处理模型。只需1-2行代码即可完成模型训练和评估，兼容 TensorFlow 和 PyTorch，并提供 Docker 容器便于环境配置。适用于各水平用户，助力快速推进机器学习项目。

lvis-api - 大规模词汇实例分割API的便捷安装与功能

APIGithubLVIS图像标注大词汇实例分割开源项目数据集

LVIS API 提供读取和交互注释文件、可视化注释和评估结果的功能。该项目包含超过16.4万张图像和200万高质量实例分割掩码，并涵盖1200多个基础对象类别。支持在虚拟环境中通过pip安装。该API已在第2届联合COCO和LVIS工作坊的ECCV 2020大会上发布，适用于大规模词汇实例分割的研究和应用。

yolov10n - YOLOv10n：实时对象检测的创新技术

COCO数据集GithubHuggingfacePyTorch模型YOLOv10实时物体检测开源项目模型计算机视觉

YOLOv10n项目展示了对象检测的实时进展，结合计算机视觉与对象识别算法。其基于PyTorch的实现并支持COCO数据集用于训练与推理，保证了性能和应用的广泛性。简单的安装和模块调用，提供了快速的目标物体检测及识别功能，支持优化模型上传至相关平台，提升模型精度与效率。

raster-vision - 开源Python工具构建卫星和航空影像的计算机视觉模型

GithubPyTorchRaster Vision卫星图像开源项目深度学习计算机视觉

Raster Vision是一个开源的Python库和框架，用于构建卫星、航空和其他大型影像集的计算机视觉模型。它支持芯片分类、目标检测和语义分割，后端采用PyTorch。作为低代码框架，它允许用户无需深度学习专业知识即可配置和运行机器学习管道，并支持通过AWS Batch和AWS Sagemaker在云端进行部署。用户可以通过pip或Docker镜像进行安装和使用。更多详情参阅官方文档。

VoTT - 开源图像与视频标注工具，兼容多种数据存储方式

GithubVoTT图像标注开源标注工具开源项目机器学习视频标注

VoTT是一个基于React和Redux的开源图像和视频标注工具，支持从本地或云存储导入数据，并将标注数据导出到不同的存储提供商。作为机器学习工作流中的工具，VoTT提供图像和视频帧的标签功能，采用现代开发框架TypeScript编写，并进行代码检查和单元测试。支持Azure Blob Storage、Bing Image Search等多种数据源，用户可通过浏览器使用Web版本。

相关项目

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

Project Cover

稿定AI

稿定设计是一个多功能的在线设计和创意平台，提供广泛的设计工具和资源，以满足不同用户的需求。从专业的图形设计师到普通用户，无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑，稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合，帮助用户轻松实现创意设计。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号