convnextv2_huge.fcmae_ft_in22k_in1k_512

ConvNeXt-V2高效的图像分类与特征提取模型

图像分类模型预训练 ConvNeXt-V2 Huggingface ImageNet Github 开源项目模型特征提取

ConvNeXt-V2模型在全卷积掩码自动编码器框架下进行预训练，并在ImageNet-22k和ImageNet-1k数据集上微调，提升了图像分类和特征提取的效率。模型拥有660.3M参数，处理512x512图像，适合复杂计算需求。支持图像分类、特征图提取和图像嵌入，确保高准确率和多样化应用，结合timm库简化操作，适用于研究和工业应用。

Github

Huggingface

介绍相关项目

tf_efficientnetv2_s.in21k - EfficientNetV2图像分类模型支持多种计算机视觉应用

EfficientNet-v2GithubHuggingfaceImageNet-21ktimm图像分类开源项目模型特征提取

tf_efficientnetv2_s.in21k是一个基于EfficientNet-v2架构的图像分类模型，在ImageNet-21k数据集上训练。该模型由TensorFlow原始训练，后移植至PyTorch，拥有4820万参数。模型支持图像分类、特征提取和图像嵌入等功能，适用于多种计算机视觉应用场景。通过timm库，开发者可以便捷地加载此预训练模型，实现图像分类、特征图提取或生成图像嵌入等任务。

vit_base_r50_s16_384.orig_in21k_ft_in1k - ResNet-Vision Transformer混合模型用于高精度图像分类

GithubHuggingfaceImageNetResNetVision Transformertimm图像分类开源项目模型

本模型结合ResNet与Vision Transformer优势，在大规模ImageNet-21k数据集上预训练，并在ImageNet-1k上微调，实现高效准确的图像分类。具备9900万参数，支持384x384像素输入，可用于分类任务和特征提取。研究人员可通过timm库轻松应用此模型，进行推理或深入研究。

edgenext_small.usi_in1k - 轻量级CNN-Transformer混合模型EdgeNeXt用于移动视觉应用

EdgeNeXtGithubHuggingfaceImageNet图像分类开源项目模型特征提取神经网络

edgenext_small.usi_in1k是一款轻量级CNN-Transformer混合模型，针对移动视觉应用优化。该模型在ImageNet-1k数据集上训练，参数量为5.6M，GMACs为1.3。它支持图像分类、特征图提取和图像嵌入等功能，结合CNN和Transformer优势，在保持性能的同时减少计算资源需求，适合在资源受限的移动设备上运行。

efficientnet_b5.sw_in12k_ft_in1k - EfficientNet-加强版：适用于图像分类与特征提取的高效模型

EfficientNetGithubHuggingfaceImageNettimm图像分类开源项目模型特征提取

EfficientNet模型结合了Swin Transformer的优化策略，经过ImageNet-12k预训练及ImageNet-1k微调，适用于图像识别、特征提取和嵌入生成。该模型使用AdamW优化器、梯度裁剪和余弦退火学习率等技术，提供高效的图像分类解决方案。

CLIP-convnext_base_w-laion2B-s13B-b82K-augreg - ConvNeXt-Base架构的CLIP模型用于高效图像分类

CLIPConvNeXtGithubHuggingfaceLAION-5B图像检索开源项目模型零样本图像分类

该项目提供了一系列基于ConvNeXt-Base架构的CLIP模型，在LAION-5B数据集子集上训练。这些模型作为ViT和ResNet的替代方案，在模型规模和图像分辨率方面展现出良好的可扩展性。经过13B样本训练，模型在ImageNet零样本分类任务中达到70.8%以上的top-1准确率，体现出较高的样本效率。这些模型可应用于零样本图像分类、图像文本检索等多种任务。

maxvit_base_tf_512.in21k_ft_in1k - MaxViT图像分类模型支持多尺寸特征提取和深度学习训练

GithubHuggingfaceImageNetMaxViT人工智能图像分类开源项目模型深度学习

MaxViT是谷歌研究团队开发的图像分类模型，通过ImageNet-21k预训练和ImageNet-1k微调实现。模型集成多轴注意力机制，总参数量119.9M，支持512x512分辨率输入。除图像分类外，还可输出多尺度特征图和嵌入向量，便于迁移至其他视觉任务。模型在ImageNet-1k测试中取得88.20%的分类准确率。

mobilenet_v2_1.0_224 - 轻量级移动设备图像分类神经网络MobileNet V2

GithubHuggingfaceImageNetMobileNet V2图像分类开源项目模型神经网络计算机视觉

MobileNet V2是一款针对移动设备优化的图像分类神经网络模型，在ImageNet-1k数据集上进行预训练。该模型以低延迟和低功耗著称，适用于资源受限的环境。MobileNet V2支持多种分辨率和深度配置，在模型大小、推理速度和准确性之间实现了良好平衡。除图像分类外，它还可应用于目标检测、特征嵌入和图像分割等计算机视觉任务，为移动端应用提供了versatile的解决方案。

vit_large_patch16_224.augreg_in21k_ft_in1k - 预训练ViT大模型实现高性能图像分类与特征提取

GithubHuggingfaceImageNettimm图像分类开源项目模型视觉转换器迁移学习

这是一个基于Vision Transformer (ViT)架构的大型图像处理模型，在ImageNet-21k数据集上预训练，并在ImageNet-1k上微调。模型采用了先进的数据增强和正则化技术，适用于图像分类和特征提取任务。它包含3.04亿参数，处理224x224尺寸的输入图像。通过TIMM库，用户可以方便地使用该模型进行图像分类和特征嵌入提取。由于在大规模数据集上训练，该模型展现出卓越的图像理解能力。

res2net50_14w_8s.in1k - Res2Net架构的多尺度骨干网络实现高效图像分类

GithubHuggingfaceImageNetRes2Nettimm图像分类开源项目模型深度学习模型

res2net50_14w_8s.in1k是基于Res2Net架构的图像分类模型，在ImageNet-1k数据集上训练。该模型采用多尺度ResNet结构，具有2510万参数，计算复杂度为4.2 GMACs。除图像分类外，还可作为特征提取器应用于其他计算机视觉任务。模型接受224x224像素的输入图像，并提供API支持图像分类、特征图提取和图像嵌入等功能。其高效的多尺度结构使其在保持准确性的同时降低了计算成本。

inception_next_tiny.sail_in1k - InceptionNeXt架构的轻量级图像分类模型

GithubHuggingfaceImageNet-1kInceptionNeXttimm图像分类开源项目模型特征提取

inception_next_tiny.sail_in1k是基于InceptionNeXt架构的图像分类模型，在ImageNet-1k数据集上训练。该模型结合Inception和ConvNeXt的特点，提供图像分类、特征图提取和图像嵌入功能。模型参数为28.1M，GMACs为4.2，适用于224x224大小的图像输入。它通过timm库提供简洁的API，支持预训练权重，可轻松应用于多种计算机视觉任务。

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具，简化了选题、文献检索至论文撰写的整个过程。通过简单设定，平台可快速生成高质量论文大纲和全文，配合图表、参考文献等一应俱全，同时提供开题报告和答辩PPT等增值服务，保障数据安全，有效提升写作效率和论文质量。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号