Project Icon

yolor

改进的多任务统一网络实时对象检测模型

该项目实现了一个新型多任务统一网络,基于最新论文支持多任务并在COCO数据集中的实时对象检测上表现出色。优化后的YOLOR模型在测试和验证中均显示出较高的AP值和运行速度,适用于多种实时应用场景。项目提供了详细的安装、训练和测试指南,支持Docker和Colab环境,适合研究人员和开发者在复杂场景中进行高效的对象检测。

yolov10n - YOLOv10n:实时对象检测的创新技术
COCO数据集GithubHuggingfacePyTorch模型YOLOv10实时物体检测开源项目模型计算机视觉
YOLOv10n项目展示了对象检测的实时进展,结合计算机视觉与对象识别算法。其基于PyTorch的实现并支持COCO数据集用于训练与推理,保证了性能和应用的广泛性。简单的安装和模块调用,提供了快速的目标物体检测及识别功能,支持优化模型上传至相关平台,提升模型精度与效率。
yolov10 - 实现实时端到端目标检测新突破
GithubYOLOv10人工智能实时检测开源项目目标检测端到端
YOLOv10是新一代实时端到端目标检测模型,通过创新的无NMS训练策略和全面的效率-准确度优化设计,在推理速度和计算效率方面实现显著提升。COCO数据集实验结果表明,YOLOv10在不同模型规模下均达到了业界领先的性能和效率水平,为实时目标检测领域带来新的发展方向。
LeYOLO - 可扩展高效的目标检测CNN架构
COCO数据集GithubLeYOLO开源项目目标检测神经网络计算效率
LeYOLO是一种新型目标检测模型系列,通过创新的CNN架构设计实现了计算效率与准确性的优化平衡。该模型引入高效主干网络缩放、快速金字塔架构网络和解耦网络中的网络检测头,大幅降低计算负载。在COCO验证集上,LeYOLO-Small仅使用4.5 GFLOP就达到38.2%的mAP,比YOLOv9-Tiny减少42%计算量。LeYOLO系列具有强大可扩展性,适用于从超低计算需求(<1 GFLOP)到高效高性能(>4 GFLOPs)的多种场景。
yolov10x - 高效的实时端到端物体检测工具
GithubHuggingfacePyTorchYOLOv10对象检测开源项目模型深度学习计算机视觉
YOLOv10是一个高效的端到端物体检测开源项目,支持在COCO等数据集上进行准确的训练和验证。通过整合PyTorch模型资源,用户可简便地安装和应用。本项目支持从预训练模型进行迁移学习,适合多种计算机视觉应用需求,是追求速度与精度的理想选择。
DAMO-YOLO - 基于YOLO系列和嵌入包括神经网络架构搜索及轻量级算法在内的多项新技术的对象检测算法
DAMO-YOLOGithub开源项目性能优化检测模型目标检测算法更新
DAMO-YOLO, 阿里巴巴DAMO实验室的先进对象检测技术,基于YOLO系列和嵌入包括神经网络架构搜索及轻量级算法在内的多项新技术,以优化性能和效率。针对广泛行业场景,提供一站式解决方案,从训练到部署全面支持。
yolos-small - 基于Vision Transformer的高效物体检测模型
COCO数据集GithubHuggingfaceYOLOS图像识别开源项目模型目标检测视觉模型
YOLOS是一种基于Vision Transformer的物体检测模型,在COCO 2017数据集上进行了微调。该模型采用DETR损失函数训练,使用双向匹配损失和匈牙利算法优化参数。YOLOS-small版本在COCO验证集上达到36.1 AP的性能,而基础版本可达到与DETR相当的42 AP。YOLOS为计算机视觉领域提供了一种简单高效的物体检测方案,适用于多种目标检测场景。
yolov7 - 实时目标检测算法实现性能新突破
GithubYOLOv7开源项目性能优化深度学习目标检测计算机视觉
YOLOv7是一款高效的实时目标检测算法,在MS COCO数据集上实现了51.4% AP的性能。该项目提供多种模型变体,包括YOLOv7-X和YOLOv7-W6等,适用于不同应用场景。此外,YOLOv7还具备姿态估计和实例分割功能,支持多GPU训练、迁移学习和模型导出,是一个全面的目标检测解决方案。
mmyolo - YOLO算法与实时对象识别工具包
GithubMMYOLOOpenMMLabYOLO系列算法实例分割开源项目目标检测
MMYOLO是一个基于PyTorch和MMDetection的开源工具包,专注于YOLO系列算法,适用于对象检测和旋转对象检测任务。该项目提供统一的基准测试、详细文档和模块化设计,便于用户构建和扩展模型。支持YOLOv5实例分割和YOLOX-Pose等功能,显著提升训练速度,并在RTMDet模型上实现了先进的性能。
yolov9 - 高效准确的目标检测算法
GithubYOLOv9开源项目深度学习目标检测神经网络计算机视觉
YOLOv9是一种新型目标检测算法,采用可编程梯度信息技术提高学习能力。该开源项目提供YOLOv9的官方实现,包含预训练模型、训练评估脚本和使用文档。在COCO数据集上,YOLOv9展现出优异的检测性能,同时保持较低的模型复杂度。研究人员和开发者可利用这一工具进行高效准确的目标检测任务。
yolov5 - 视觉AI对象检测和图像分类技术
YOLOv5,一款由Ultralytics开源的视觉AI模型,支持对象检测、图像分割与分类。提供全面文档及社区支持,适合各级用户使用,并定期更新以集成最新技术。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

稿定AI

稿定设计 是一个多功能的在线设计和创意平台,提供广泛的设计工具和资源,以满足不同用户的需求。从专业的图形设计师到普通用户,无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑,稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合,帮助用户轻松实现创意设计。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号