efficientnet-b0

EfficientNet的复合系数法在资源有限设备上提升图像分类效果

EfficientNet 卷积神经网络模型缩放 ImageNet 模型 Github 开源项目图像分类 Huggingface

EfficientNet是一种训练于ImageNet-1k数据集、分辨率为224x224的卷积模型。该模型提出了复合系数方法，以均衡缩放模型的深度、宽度和分辨率。在移动设备上表现卓越，适用于图像分类。同时，用户可在Hugging Face平台上获取特定任务的微调版本。

文档

convnext_small.in12k_ft_in1k_384 - 高效的ConvNeXt图像分类与特征提取预训练模型介绍

ConvNeXtGithubHuggingfaceImageNettimm图像分类开源项目模型预训练

ConvNeXt图像分类模型，通过timm库在ImageNet-12k及ImageNet-1k上进行预训练与微调，提供图像特征提取与分类功能。支持TPU和8xGPU训练方式，适合大规模数据集处理。模型拥有50.2M参数和25.6 GMACs，支持384x384图像输入，并兼具特征图提取与图像嵌入功能，适用于高效图像处理需求。更多性能数据及结果可在timm库查阅。

tf_mobilenetv3_large_minimal_100.in1k - MobileNetV3轻量级图像分类模型

GithubHuggingfaceImageNetMobileNet-v3pytorchtimm图像分类开源项目模型

tf_mobilenetv3_large_minimal_100.in1k是基于MobileNet-v3架构的图像分类模型，在ImageNet-1k数据集上训练。该模型参数量为3.9M，计算复杂度为0.2 GMACs，适用于资源受限的移动设备。模型支持图像分类、特征图提取和图像嵌入等功能。最初由TensorFlow团队开发，后由Ross Wightman移植到PyTorch平台，为开发者提供了多平台使用选择。

resnet50.a1_in1k - 基于ResNet-B架构的多功能图像分类模型

GithubHuggingfaceresnet50人工智能图像分类开源项目模型深度学习特征提取

resnet50.a1_in1k是基于ResNet-B架构的图像分类模型，在ImageNet-1k数据集上训练。模型采用ReLU激活函数、7x7卷积层和1x1卷积shortcut，使用LAMB优化器和BCE损失函数。它拥有2560万参数，可用于图像分类、特征提取和图像嵌入等任务。模型支持灵活的输入尺寸，在ImageNet验证集上实现了82.03%的Top-1准确率。

resnet-152 - 深入解析ResNet-152在图像分类中的应用

GithubHuggingfaceResNet-152卷积神经网络图像分类图像识别开源项目模型深度学习

ResNet-152 v1.5模型在ImageNet-1k上预训练，采用224x224分辨率，改进后的下采样策略提升了模型的准确性。该模型可用于图像分类，亦可在模型中心找到特定任务的微调版本。

convnextv2_base.fcmae_ft_in22k_in1k - 多功能图像分类与特征提取模型

ConvNeXt-V2GithubHuggingfaceImageNettimm图像分类开源项目模型预训练模型

ConvNeXt-V2是一款先进的图像分类模型，通过全卷积掩码自编码器框架(FCMAE)预训练，并在ImageNet-22k和ImageNet-1k数据集上微调。除图像分类外，该模型还可用于特征图提取和图像嵌入。拥有8870万参数，ConvNeXt-V2在ImageNet-1k验证集上实现86.74%的Top-1准确率。凭借在多项基准测试中的卓越表现，ConvNeXt-V2成为各类计算机视觉任务的优秀选择。

regnety_120.sw_in12k_ft_in1k - 高级图像分类模型，优化大规模数据集的性能

GithubHuggingfaceRegNetY图像分类开源项目数据集模型特征提取预训练

RegNetY-12GF模型致力于图像分类，先在ImageNet-12k上预训练，再在ImageNet-1k上微调。其结构支持多项增强功能，如随机深度和梯度检查点，提高模型准确性和效率。基于timm库实现，广泛用于特征图提取和图像嵌入，适用于多种图像处理场景。

ml-cvnets - 灵活的计算机视觉模型训练库

CVNetsGithub图像分类对象检测开源项目模型训练计算机视觉

CVNets是一个计算机视觉库，支持研究人员和工程师训练和评估多种计算机视觉模型，包括对象分类、对象检测和语义分割等任务。最新版本引入了直接处理文件字节的Transformer和高效在线增强，支持如Mask R-CNN、EfficientNet、Swin Transformer和ViT等模型，并增强了蒸馏功能。

resnet34.a1_in1k - ResNet34 A1变体：轻量级高效图像分类模型

GithubHuggingfaceResNettimm图像分类开源项目模型模型训练深度学习

resnet34.a1_in1k是一种轻量级ResNet变体，在ImageNet-1k上训练。该模型采用ResNet-B架构，结合ReLU激活、7x7卷积和1x1短路下采样。训练过程使用LAMB优化器、BCE损失和余弦学习率。作为通用骨干网络，它适用于图像分类、特征提取和嵌入生成，在维持性能的同时显著降低了计算复杂度。

inceptionnext - 结合Inception和ConvNeXt优势的高效图像识别模型

ConvNeXtGithubInceptionNeXt卷积神经网络图像分类开源项目深度学习

InceptionNeXt是一种创新的图像识别模型，融合了Inception的设计理念和ConvNeXt的架构。通过分解大型深度卷积核，该模型在速度和准确率方面取得了平衡，达到了ResNet-50的速度和ConvNeXt-T的精度。在ImageNet数据集上，InceptionNeXt展现出卓越性能，推动了计算机视觉领域的发展。研究团队提供了多种规模的预训练模型，适用于不同的应用场景。

resnet18.a1_in1k - ResNet18图像分类模型适用于多种计算机视觉任务

GithubHuggingfaceResNettimm图像分类开源项目模型深度学习神经网络

resnet18.a1_in1k是基于ResNet-B架构的图像分类模型,在ImageNet-1k数据集上训练。它采用ReLU激活函数、单层7x7卷积等特性,支持图像分类、特征提取和嵌入等任务。该模型有1170万参数,在224x224分辨率下计算量为1.8 GMACs,可用于多种计算机视觉应用。

推荐项目

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

稿定AI

稿定设计是一个多功能的在线设计和创意平台，提供广泛的设计工具和资源，以满足不同用户的需求。从专业的图形设计师到普通用户，无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑，稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合，帮助用户轻松实现创意设计。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com