Project Icon

fvcore

FAIR开发的轻量级计算机视觉库 提供核心共享功能

fvcore是FAIR开发的轻量级计算机视觉库,为多个框架提供核心共享功能。它包含常用PyTorch组件、FLOP计数工具、参数计数、BatchNorm统计重计算和超参数调度器等特性。该库支持Detectron2、PySlowFast和ClassyVision等项目,所有组件经过严格测试,兼容Python 3.6+和PyTorch环境。

big_vision - 基于Jax/Flax的大规模视觉模型训练框架
GithubJaxbig vision开源项目模型训练深度学习计算机视觉
Big Vision是一个用于训练大规模视觉模型的开源代码库。它基于Jax/Flax构建,支持在Cloud TPU VM和GPU上运行。该项目采用tf.data和TensorFlow Datasets实现高效的数据处理,可无缝扩展至2048个TPU核心的分布式环境。Big Vision涵盖了视觉Transformer、多模态学习、知识蒸馏等多个研究方向,为大规模视觉实验提供了可靠的基础。
insightface - 综合人脸分析开源工具库
GithubInsightFace人脸对齐人脸检测人脸识别开源项目深度学习
InsightFace是一个综合人脸分析开源工具库,基于PyTorch和MXNet实现。它涵盖人脸识别、检测和对齐等多个任务,提供高效算法、训练数据和网络设计。支持ArcFace、RetinaFace等方法,并包含多种网络骨干。该项目还提供评估流程和预训练模型,适用于人脸分析的研究与应用。
darkflow - 实时物体检测与分类工具,支持多种YOLO模型
GithubYOLOdarkflowobject detectiontensorflow开源项目训练模型
Darkflow是一个用于实时物体检测和分类的开源项目,兼容Python3、Tensorflow、Numpy和OpenCV。用户可以通过pip安装、构建Cython扩展或使用自定义标签进行训练和推理。项目还提供Android演示和支持保存加载protobuf文件,适合跨平台应用。
corenet - 用于训练多任务深度神经网络的工具库
CoreNetGithub开源项目模型训练深度学习神经网络计算机视觉
CoreNet是一款多功能深度神经网络工具库,支持训练各种规模的标准和创新模型。它适用于基础模型、计算机视觉和自然语言处理等多个领域。该项目提供可复现的训练方案、预训练模型权重和针对Apple Silicon优化的MLX示例,有助于推动AI研究和应用的发展。
Far3D - 突破远距离3D目标检测的新框架,提升环视感知能力
3D目标检测Far3DGithub开源项目深度学习自动驾驶计算机视觉
这是一个创新的稀疏查询框架,专注于解决远距离3D目标检测问题。该项目通过2D目标先验生成自适应3D查询,并利用透视感知聚合模块处理多视角和多尺度特征。还开发了范围调制的3D去噪技术,有效解决了查询错误传播和收敛问题。在Argoverse 2和nuScenes数据集上,展现出优异的性能,推动了环视3D目标检测技术的发展。
mindcv - 基于MindSpore的开源计算机视觉框架
GithubMindCV图像分类开源项目深度学习框架计算机视觉预训练模型
MindCV是一个开源计算机视觉框架,基于MindSpore构建。它集成了经典和最新的视觉模型,并提供预训练权重。通过模块化设计,支持定制化的数据处理、模型构建和训练流程。该框架适用于迁移学习和自定义CV任务开发,可在多种硬件平台上运行。MindCV注重效率与灵活性的平衡,同时提供了详细的教程和示例,方便开发者快速入门和应用。
dfdx - Rust中的深度学习库,提供GPU加速和编译时类型检查
GPU加速GithubRustdfdx开源项目深度学习神经网络
dfdx是一个注重人体工学和安全性的Rust深度学习库,支持GPU加速和最多6维的张量形状。它在编译时进行形状和类型检查,提供多种张量操作,例如矩阵乘法和卷积。该库还包含神经网络构建模块和标准的深度学习优化器,如Sgd和Adam。设计目标是性能最大化和最小化不安全代码。用户可以启用CUDA特性进行GPU加速,非常适合在Rust中进行深度学习开发的用户。
core - FFmpeg进程管理与媒体传输解决方案
APIFFmpegGithub媒体处理开源项目流媒体进程管理
Core是一个为FFmpeg设计的进程管理解决方案,支持HTTP、RTMP、SRT等多种媒体内容接口。该项目优化了在Docker等虚拟环境中的使用,适用范围从小型应用到大规模多实例框架。Core专注于发挥FFmpeg的能力,提供进程管理、媒体传输和资源限制等功能,并支持REST和GraphQL API。此外,Core还提供多种Docker镜像,便于快速搭建开发环境和集成云资源。Core具有错误检测和恢复功能,支持进程链接,并提供可配置的日志历史记录,这些特性使其在媒体处理领域具有独特优势。
models - 产业级开源模型库,支持多场景端到端开发
Github图像分类开源模型库开源项目目标检测语义理解飞桨
飞桨开源模型库提供经过实践验证的主流模型,支持语义理解、图像分类、目标检测等场景,助力企业低成本开发和快速集成。模型库根据国内企业研发流程定制,广泛应用于能源、金融、工业、农业等领域,包含超过600个官方模型和260个生态模型。
YOLOv6 - 高性能目标检测框架支持多场景应用
GithubYOLOv6开源项目模型训练深度学习目标检测计算机视觉
YOLOv6是一款高效的目标检测框架,提供从轻量级到大型的多种模型选择。它在速度和精度上取得平衡,支持量化和移动端部署,适用于各种实时检测场景。最新版本还引入了分割功能,扩展了应用范围。YOLOv6不仅适用于工业领域,还可广泛应用于安防、交通等多个领域。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能,包括文生视频、动态画面和形象生成等,帮助用户快速上手,创造专业级内容。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台,用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品,帮助用户探索创意灵感。

Project Cover

讯飞文书

讯飞文书依托讯飞星火大模型,为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能,满足事务性工作的高频需求,帮助撰稿人节省精力,提高效率,优化工作与生活。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号