mmyolo

YOLO算法与实时对象识别工具包

OpenMMLab MMYOLO YOLO系列算法实例分割目标检测 Github 开源项目

MMYOLO是一个基于PyTorch和MMDetection的开源工具包，专注于YOLO系列算法，适用于对象检测和旋转对象检测任务。该项目提供统一的基准测试、详细文档和模块化设计，便于用户构建和扩展模型。支持YOLOv5实例分割和YOLOX-Pose等功能，显著提升训练速度，并在RTMDet模型上实现了先进的性能。

Github

介绍相关项目

MMVP - 探索多模态大语言模型的视觉局限

GithubInterleaved-MoFMMVP基准测试多模态LLM开源项目视觉模式视觉能力

MMVP基准测试揭示了多模态大语言模型在视觉理解方面的局限。即使是顶尖模型也难以准确完成基本视觉定位任务。项目开发的Interleaved-MoF模型旨在改善这些问题。MMVP还提供了开放的评估工具和数据集，为多模态AI技术的发展做出了贡献。

labelImg - Python图像标注工具，兼容PASCAL VOC和YOLO格式

GithubLabel StudioLabelImgPython图像注释开源项目数据标注工具

一款用Python编写的开源图像标注工具，适用于深度学习数据集的创建。支持PASCAL VOC、YOLO和CreateML等多种标注格式，可在Linux、macOS、Windows等平台上运行，并提供详细的安装和使用指南。用户可以通过直观的界面创建矩形框标注，支持预定义类、热键操作和Docker部署，是机器学习和计算机视觉项目的数据标注利器。

OpenPCDet - 开源LiDAR 3D目标检测框架支持多种先进算法和数据集

3D目标检测GithubLiDAROpenPCDet开源项目深度学习点云

OpenPCDet是一个开源LiDAR 3D目标检测框架,支持PointRCNN、PV-RCNN等多种算法。具有简洁设计,兼容多种数据集和模型,在KITTI和Waymo等数据集上提供基准性能。支持分布式训练和多头检测,是功能丰富的3D检测工具箱。

pytracking - 基于PyTorch的开源视觉目标跟踪和视频对象分割框架

GithubPyTorch开源项目深度学习视觉目标跟踪视频目标分割计算机视觉

PyTracking是基于PyTorch的开源视觉目标跟踪和视频对象分割框架。它实现了多个先进的跟踪算法,如TaMOs、RTS和ToMP,并提供完整的训练代码和预训练模型。该框架包含用于实现和评估视觉跟踪器的库,涵盖常用数据集、性能分析脚本和通用构建模块。其LTR训练框架支持多种跟踪网络的训练,提供丰富的数据集和功能。

torchlm - 面向人脸关键点检测的开源工具包

Githubtorchlm人脸关键点检测开源项目数据增强模型训练深度学习

torchlm是一个开源的人脸关键点检测工具包,提供训练、评估、导出和推理功能。它包含100多种数据增强方法,支持30多种原生关键点增强,可与torchvision和albumentations集成。torchlm实现了PIPNet等先进模型,在多个基准数据集上性能出色。该项目简化了人脸关键点检测的开发流程,适用于研究和实际应用。

tensorrtx - TensorRT深度学习网络实现库

GPU加速GithubTensorRTYOLO系列开源项目模型转换深度学习网络

TensorRTx项目使用TensorRT API实现主流深度学习网络。它提供灵活构建、调试和学习TensorRT引擎的方法，支持YOLO、ResNet、MobileNet等多种模型。兼容TensorRT 7.x和8.x版本，并包含详细教程和常见问题解答，方便用户快速入门。

yolov9-face-detection - YOLOv9在WIDER Face数据集上的人脸检测实现

GithubWIDER Face数据集YOLOv9人脸检测开源项目深度学习计算机视觉

这个开源项目展示了如何利用YOLOv9模型在WIDER Face数据集上实现高精度人脸检测。项目提供了完整的工作流程，包括安装指南、预训练模型、数据准备、训练和推理方法。同时还包含数据集转换脚本和配置文件，方便研究者和开发者快速上手并应用于实际场景。

open-metric-learning - 开源的PyTorch度量学习框架支持多模态嵌入训练

GithubPyTorchopen-metric-learning嵌入向量度量学习开源项目检索系统

open-metric-learning是一个基于PyTorch的开源度量学习框架，用于训练和验证高质量嵌入模型。它提供端到端流水线、实用案例和预训练模型库，支持图像和文本等多种模态。该框架具有统一的检索结果处理和评估方法，适用于人脸识别、商品搜索等嵌入学习任务。已被多家知名公司和机构采用，是一个功能丰富、易于上手的度量学习工具。

yolov8m-building-segmentation - 卫星图像中YOLOv8建筑物分割的精准实现

GithubHuggingfaceYOLOv8ultralyticsplus卫星建筑分割图像分割开源项目模型

该模型专注于通过Yolov8m实现卫星图像中建筑物的精准分割，借助PyTorch以提高分析准确性，mAP@0.5的精度分别为0.62261和0.61275。使用ultralyticsplus库及Python示例可实现快速图像加载与预测，适合高精度建筑物分割的应用需求。

相关项目

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

Project Cover

稿定AI

稿定设计是一个多功能的在线设计和创意平台，提供广泛的设计工具和资源，以满足不同用户的需求。从专业的图形设计师到普通用户，无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑，稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合，帮助用户轻松实现创意设计。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号