deit_small_patch16_224.fb_in1k

DeiT架构图像分类模型基于ImageNet-1k训练的高效Transformer

计算机视觉神经网络开源项目 DeiT 深度学习模型图像分类 Github Huggingface

DeiT小型模型是一种基于Transformer架构的图像分类模型，在ImageNet-1k数据集上训练。该模型采用注意力蒸馏技术，拥有2210万参数，适用于224x224像素图像输入。除图像分类外，它还可用于特征提取。模型通过timm库提供预训练权重，便于加载和推理。其数据效率和蒸馏技术使其在计算机视觉领域表现出色。

Github

Huggingface

介绍相关项目

dinov2-small-imagenet1k-1-layer - 视觉特征学习的Transformer模型

DINOv2GithubHuggingfaceVision Transformer图像分类开源项目模型特征提取自监督学习

DINOv2方法无监督预训练的Vision Transformer，适用于影像特征学习增强场景。此小尺寸模型能在ImageNet-1k数据集上执行分类任务，通过提取特征来辅助下游任务。尽管模型未包含微调头，但可附加线性层进行标准分类，适合高精度视觉特征需求的应用。

efficientnet_b1.ft_in1k - 基于ImageNet-1k微调的EfficientNet图像分类模型

EfficientNetGithubHuggingfaceImageNet-1kPyTorch图像分类开源项目模型特征图提取

EfficientNet图像分类模型已在ImageNet-1k上进行微调，适用于PyTorch。该模型参数为7.8M，支持特征图提取和图像嵌入，可用作高效的图像分类工具。

vit_small_patch14_dinov2.lvd142m - 基于Vision Transformer的自监督图像特征提取模型

DINOv2GithubHuggingfaceVision Transformertimm图像分类开源项目模型特征提取

这是一个基于Vision Transformer架构的图像特征提取模型。该模型采用DINOv2自监督学习方法，在LVD-142M数据集上预训练，拥有2210万参数，支持处理518x518尺寸的图像。模型可应用于图像分类和特征提取任务，并提供了相关的使用示例代码。作为一个无监督学习的视觉模型，它能够提取稳健的图像特征表示。

tf_efficientnetv2_s.in21k_ft_in1k - EfficientNet-v2图像分类模型基于双重ImageNet数据集训练

EfficientNet-v2GithubHuggingfaceImageNettimm图像分类开源项目模型特征提取

这是一个基于EfficientNet-v2架构的图像分类模型，采用ImageNet-21k预训练和ImageNet-1k微调策略。模型参数量为2150万，计算量为5.4 GMACs，支持图像分类、特征提取和图像嵌入等多种应用。训练采用300x300分辨率，测试时提升至384x384，在性能和效率之间实现良好平衡。该模型最初由论文作者在Tensorflow中实现，后由Ross Wightman移植至PyTorch框架。

swin_tiny_patch4_window7_224.ms_in1k - Swin Transformer: 基于移位窗口的层级视觉模型

GithubHuggingfaceImageNetSwin Transformertimm图像分类开源项目模型特征提取

swin_tiny_patch4_window7_224.ms_in1k是一个基于Swin Transformer架构的图像分类模型，在ImageNet-1k数据集上预训练。该模型包含2830万参数，支持224x224像素输入，可用于图像分类和特征提取。它采用分层视觉Transformer结构和移位窗口技术，提高了效率和性能。研究者可通过timm库便捷地使用此模型进行推理或进一步训练，适用于各种计算机视觉任务。

convit_base.fb_in1k - ConViT架构图像分类模型在ImageNet-1k上的应用

ConViTGithubHuggingfaceImageNet-1ktimm图像分类开源项目模型深度学习

convit_base.fb_in1k是一个在ImageNet-1k数据集上训练的ConViT架构图像分类模型。该模型融合卷积神经网络和视觉Transformer技术，拥有8650万参数，计算量为17.5 GMACs。它支持224x224尺寸的输入图像，可用于图像分类和特征提取。研究者可通过timm库加载此预训练模型，进行图像分类或提取图像嵌入向量等任务。

vit_large_patch14_reg4_dinov2.lvd142m - 带寄存器的视觉Transformer模型用于图像特征提取

DINOv2GithubHuggingfaceVision Transformertimm图像分类开源项目模型特征提取

vit_large_patch14_reg4_dinov2.lvd142m是一个带寄存器的视觉Transformer模型，在LVD-142M数据集上使用自监督DINOv2方法预训练。该模型具有3.044亿参数，可处理518x518大小的图像，适用于图像分类和特征提取任务。它结合了ViT和DINOv2技术，为计算机视觉应用提供了高效的解决方案。

vit_base_r50_s16_384.orig_in21k_ft_in1k - ResNet-Vision Transformer混合模型用于高精度图像分类

GithubHuggingfaceImageNetResNetVision Transformertimm图像分类开源项目模型

本模型结合ResNet与Vision Transformer优势，在大规模ImageNet-21k数据集上预训练，并在ImageNet-1k上微调，实现高效准确的图像分类。具备9900万参数，支持384x384像素输入，可用于分类任务和特征提取。研究人员可通过timm库轻松应用此模型，进行推理或深入研究。

swin-tiny-patch4-window7-224 - 层级结构的视觉Transformer模型

GithubHuggingfaceSwin Transformer图像分类开源项目机器学习模型神经网络计算机视觉

Swin Transformer模型通过层级特征图和局部注意力机制实现线性计算复杂度。在ImageNet-1k数据集上以224x224分辨率训练后，可作为图像分类和密集识别任务的骨干网络。采用shifted windows技术平衡效率与性能，适用于图像分类或特定任务微调。

vit_large_patch14_clip_224.openai_ft_in12k_in1k - 视觉变压器用于图像分类和特征嵌入的高级应用

CLIPGithubHuggingfaceVision TransformerWIT-400M图像分类开源项目模型模型比较

OpenAI开发的视觉变压器(ViT)模型在WIT-400M图像文本对上通过CLIP进行预训练，并在ImageNet-12k和ImageNet-1k上微调，适用于图像分类与特征嵌入生成。模型运行在timm库中，具有高参数量与计算效率，适用于高精度图像识别，支持实时与批量处理应用。

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具，简化了选题、文献检索至论文撰写的整个过程。通过简单设定，平台可快速生成高质量论文大纲和全文，配合图表、参考文献等一应俱全，同时提供开题报告和答辩PPT等增值服务，保障数据安全，有效提升写作效率和论文质量。

Project Cover

稿定AI

稿定设计是一个多功能的在线设计和创意平台，提供广泛的设计工具和资源，以满足不同用户的需求。从专业的图形设计师到普通用户，无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑，稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合，帮助用户轻松实现创意设计。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号