eva02_base_patch14_448.mim_in22k_ft_in22k_in1k

EVA02视觉Transformer的图像分类与特征提取模型

ImageNet Github 开源项目图像分类 EVA02 模型微调 Huggingface 视觉变换器模型

EVA02是一款基于视觉Transformer架构的图像分类和特征提取模型。它结合了平均池化、SwiGLU和旋转位置嵌入技术，在ImageNet-22k数据集上进行预训练并在ImageNet-1k上微调。兼容timm库，以确保在不同设备上的一致性和高效性，广泛适用于多种图像分类和特征提取任务。

vit_large_patch14_clip_336.openai_ft_in12k_in1k - ViT图像分类与特征提取模型

GithubHuggingfaceImageNet-1kVision TransformerWIT-400M图像分类开源项目模型预训练模型

OpenAI的ViT图像分类模型，利用CLIP在WIT-400M上预训练，并在ImageNet数据集上微调，适合多种视觉任务。其高性能参数为研究与开发提供强大支持，通过示例代码，可轻松实现图像分类与嵌入功能。

vit_base_r50_s16_384.orig_in21k_ft_in1k - ResNet-Vision Transformer混合模型用于高精度图像分类

GithubHuggingfaceImageNetResNetVision Transformertimm图像分类开源项目模型

本模型结合ResNet与Vision Transformer优势，在大规模ImageNet-21k数据集上预训练，并在ImageNet-1k上微调，实现高效准确的图像分类。具备9900万参数，支持384x384像素输入，可用于分类任务和特征提取。研究人员可通过timm库轻松应用此模型，进行推理或深入研究。

vit_large_patch14_dinov2.lvd142m - 基于DINOv2的大规模Vision Transformer视觉特征提取模型

DINOv2GithubHuggingfaceViTtimm图像分类开源项目模型特征提取

这是一个基于Vision Transformer架构的图像特征提取模型，采用DINOv2自监督学习方法在LVD-142M数据集上预训练。模型包含3.044亿参数，支持518x518像素输入，适用于图像分类和特征提取任务。该模型提供了完整的加载、预处理和推理示例代码，可应用于需要高质量视觉特征表示的各种计算机视觉场景。

swin-base-patch4-window7-224-in22k - 基于shifted windows的分层视觉Transformer图像处理模型

GithubHuggingfaceSwin Transformer图像分类图像识别开源项目模型深度学习计算机视觉

Swin Transformer是一个在ImageNet-21k数据集上预训练的视觉模型，通过shifted windows机制实现局部特征提取，降低计算复杂度。模型采用分层特征图构建和局部注意力计算方式，适用于图像分类和密集识别任务，计算复杂度与输入图像大小呈线性关系

swin_base_patch4_window7_224.ms_in22k_ft_in1k - Swin Transformer模型：用于图像分类和特征提取的层级视觉架构

GithubHuggingfaceImageNetSwin Transformertimm图像分类开源项目模型特征提取

swin_base_patch4_window7_224.ms_in22k_ft_in1k是一个基于Swin Transformer架构的图像分类模型，在ImageNet-22k上预训练并在ImageNet-1k上微调。该模型拥有8780万参数，支持224x224像素图像处理，可用于图像分类和特征提取。通过timm库，研究人员可以方便地加载预训练模型，进行图像分类、特征图提取或生成图像嵌入。这一模型在计算效率和性能之间实现了良好平衡，适用于各种计算机视觉任务。

vit-large-patch16-384 - Vision Transformer大模型，提升高分辨率图像分类表现

GithubHuggingfaceImageNetVision Transformertransformer图像分类开源项目模型深度学习

项目提供了预训练于ImageNet-21k并在ImageNet 2012上微调的Vision Transformer（ViT）大模型。ViT通过将图像分为固定大小的补丁并使用Transformer编码器进行解析，提升了分类精度和特征提取能力，支持高分辨率视觉识别任务并兼容PyTorch使用。

samvit_base_patch16.sa1b - 高效的图像特征提取与分类工具

GithubHuggingfaceVision Transformersamvit_base_patch16.sa1b图像分类图像特征提取开源项目模型预训练

Segment-Anything Vision Transformer（SAM ViT）模型专注于图像特征提取与分类，不含分割头。使用MAE权重进行初始化，并通过SA-1B数据集的预训练，展示出89.7M的参数量及486.4 GMACs的计算性能，适宜处理1024x1024图像。Python代码示例提供了图像分类与嵌入应用方式，用户可通过timm库使用预训练模型‘samvit_base_patch16.sa1b’以提升图像分析效率。

deit-tiny-patch16-224 - 高效小型视觉Transformer模型用于图像分类

DeiTGithubHuggingfaceImageNet图像分类图像处理开源项目模型深度学习

DeiT-tiny-patch16-224是一个在ImageNet-1k数据集上训练的高效视觉Transformer模型。该模型仅有5M参数，却在ImageNet top-1分类准确率上达到72.2%。它可处理224x224分辨率的图像输入，输出1000个ImageNet类别的预测结果，适用于各种图像分类任务。

wd-eva02-large-tagger-v3 - 开源图像标签分类模型支持评级角色和通用标签

GithubHuggingfaceONNXtimm图像标注开源项目数据集模型深度学习模型

WD EVA02-Large Tagger v3是一个开源的图像标签分类模型，支持评级、角色和通用标签分类。该模型基于Danbooru数据集训练，涵盖720万张图像。采用JAX-CV和timm库实现，支持ONNX推理，兼容性强。模型在验证集上达到0.4772的F1分数，支持批量推理，并提供了timm、ONNX和JAX等多种接口示例。最新版本更新了训练数据和标签至2024年2月，适用于图像分类、内容审核等多种应用场景，为开发者提供了实用的图像分析工具。

deit_base_patch16_224.fb_in1k - 基于Transformer架构的DeiT图像分类模型

DeiTGithubHuggingfaceImageNet-1k图像分类开源项目模型深度学习神经网络

deit_base_patch16_224.fb_in1k是一款基于Transformer架构的图像分类模型，在ImageNet-1k数据集上训练。该模型拥有8660万参数，支持224x224像素图像处理，可用于图像分类和嵌入向量生成。通过数据高效训练方法和注意力蒸馏技术，该模型在减少大规模数据依赖的同时保持了高性能。研究人员和开发者可以利用timm库轻松应用此模型进行推理或特征提取。

推荐项目

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具，简化了选题、文献检索至论文撰写的整个过程。通过简单设定，平台可快速生成高质量论文大纲和全文，配合图表、参考文献等一应俱全，同时提供开题报告和答辩PPT等增值服务，保障数据安全，有效提升写作效率和论文质量。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com