#ConvNeXt

inceptionnext - 结合Inception和ConvNeXt优势的高效图像识别模型

InceptionNeXtConvNeXt卷积神经网络图像分类深度学习Github开源项目

InceptionNeXt是一种创新的图像识别模型，融合了Inception的设计理念和ConvNeXt的架构。通过分解大型深度卷积核，该模型在速度和准确率方面取得了平衡，达到了ResNet-50的速度和ConvNeXt-T的精度。在ImageNet数据集上，InceptionNeXt展现出卓越性能，推动了计算机视觉领域的发展。研究团队提供了多种规模的预训练模型，适用于不同的应用场景。

convnext_small.fb_in22k - 支持多任务图像处理的预训练模型

ImageNetGithub开源项目特征提取图像分类ConvNeXttimmHuggingface模型

ConvNeXt是一个经过ImageNet-22k预训练的图像分类模型，具备66.3M参数和8.7 GMACs。本文介绍其关键特性及在图像特征提取中的应用，旨在帮助专业用户理解和有效利用该模型进行视觉任务。

convnext_xxlarge.clip_laion2b_soup_ft_in1k - 大规模预训练的高性能图像分类模型

Huggingface图像分类模型LAIONtimmGithubConvNeXt开源项目ImageNet-1k

ConvNeXt XXLarge是一款基于ConvNeXt架构的高性能图像分类模型。该模型在LAION-2B数据集上进行CLIP预训练，随后在ImageNet-1k上微调，拥有8.46亿参数。在256x256的图像输入下，Top-1准确率达到88.612%。除图像分类外，该模型还支持特征图提取和图像嵌入生成，可为多种计算机视觉任务提供强大支持。

CLIP-convnext_large_d_320.laion2B-s29B-b131K-ft-soup - ConvNeXt-Large CLIP模型提升零样本图像分类性能

模型零样本学习开源项目HuggingfaceCLIP机器学习图像分类ConvNeXtGithub

本模型基于LAION-2B数据集训练,采用320x320分辨率的ConvNeXt-Large架构和权重平均技术。在ImageNet-1k零样本分类任务上,准确率达到76.9%,超越了256x256分辨率版本。模型效率高于OpenAI的L/14-336,可应用于零样本图像分类、图文检索等任务。该项目为研究人员提供了强大的视觉-语言表征工具,助力探索大规模多模态模型。

CLIP-convnext_base_w-laion2B-s13B-b82K-augreg - ConvNeXt-Base架构的CLIP模型用于高效图像分类

CLIP模型图像检索零样本图像分类GithubConvNeXtHuggingface开源项目LAION-5B

该项目提供了一系列基于ConvNeXt-Base架构的CLIP模型，在LAION-5B数据集子集上训练。这些模型作为ViT和ResNet的替代方案，在模型规模和图像分辨率方面展现出良好的可扩展性。经过13B样本训练，模型在ImageNet零样本分类任务中达到70.8%以上的top-1准确率，体现出较高的样本效率。这些模型可应用于零样本图像分类、图像文本检索等多种任务。

upernet-convnext-small - 高效语义分割框架融合ConvNeXt技术

模型语义分割计算机视觉GithubConvNeXtUperNet图像分割Huggingface开源项目

UperNet是一种结合ConvNeXt骨干网络的语义分割框架，融合了特征金字塔网络(FPN)和金字塔池化模块(PPM)。它能为每个像素生成语义标签，适用于场景理解和图像分割等计算机视觉任务。该模型提供多种预训练版本，可根据具体需求应用于不同场景。UperNet的设计旨在提高语义分割的准确性和效率，为研究人员和开发者提供了强大的图像分析工具。

convnext_tiny.in12k - ConvNeXt架构图像分类模型适用于多种视觉任务

模型图像分类ImageNet-12k模型比较GithubtimmConvNeXtHuggingface开源项目

convnext_tiny.in12k是基于ConvNeXt架构的图像分类模型,在ImageNet-12k数据集上训练。该模型支持图像分类、特征图提取和图像嵌入等应用,参数量36.9M,GMACs 4.5,224x224分辨率下Top1精度84.186%。性能与效率均衡,适用于多种计算机视觉任务。

CLIP-convnext_base_w-laion2B-s13B-b82K - ConvNeXt CLIP模型在ImageNet零样本分类中达到70.8%以上准确率

模型开源项目HuggingfaceLAION-5BCLIP零样本图像分类OpenCLIPConvNeXtGithub

这是一系列基于LAION-5B数据集训练的CLIP ConvNeXt-Base模型。经过13B样本训练后，模型在ImageNet零样本分类中实现了70.8%以上的Top-1准确率，显示出比ViT-B/16更高的样本效率。模型使用timm的ConvNeXt-Base作为图像塔，并探索了增强图像增强和正则化的效果。作为首个在CLIP ViT-B/16和RN50x4规模下训练的ConvNeXt CLIP模型，它为零样本图像分类研究提供了新的选择。

convnext_base.fb_in22k_ft_in1k - ConvNeXt图像分类模型：ImageNet-22k预训练和ImageNet-1k微调

Huggingface图像分类模型ImageNettimmGithubConvNeXt预训练模型开源项目

convnext_base.fb_in22k_ft_in1k是Facebook研究团队开发的ConvNeXt图像分类模型。该模型在ImageNet-22k上预训练，ImageNet-1k上微调，拥有8860万参数。适用于图像分类、特征提取和图像嵌入，在ImageNet-1k验证集上达到85.8%的top-1准确率。模型采用ConvNeXt架构，为计算机视觉任务提供了有力支持。

CLIP-convnext_xxlarge-laion2B-s34B-b82K-augreg-soup - CLIP ConvNeXt-XXLarge模型在零样本图像分类上的卓越性能

CLIP模型零样本图像分类计算机视觉GithubConvNeXt深度学习Huggingface开源项目

CLIP ConvNeXt-XXLarge是基于LAION-2B数据集训练的大规模视觉-语言模型。它在ImageNet零样本分类任务中实现79.4%的准确率,成为首个非ViT架构突破79%的CLIP模型。该模型结合847M参数的ConvNeXt-XXLarge图像塔和ViT-H-14规模的文本塔,在计算效率和性能间达到平衡,为视觉-语言模型研究开辟新方向。

convnext_tiny.in12k_ft_in1k - ConvNeXt微型模型基于ImageNet-12k预训练和ImageNet-1k微调

模型预训练模型开源项目Huggingface图像分类ImageNetConvNeXtGithubtimm

ConvNeXt微型图像分类模型在ImageNet-12k数据集上预训练,并在ImageNet-1k上微调。模型采用最新ConvNeXt架构,参数量28.59M,GMACs 4.47,激活量13.44M。224x224输入时Top-1准确率84.186%,384x384输入时达85.118%。适用于图像分类、特征提取和图像嵌入等计算机视觉任务。

convnext_large_mlp.clip_laion2b_soup_ft_in12k_in1k_320 - ConvNeXt大型图像分类模型 LAION-2B预训练 ImageNet微调

模型开源项目Huggingface图像分类LAION-2BImageNetConvNeXtGithubtimm

ConvNeXt大型图像分类模型采用CLIP方法在LAION-2B数据集上预训练,并在ImageNet-12k和ImageNet-1k上微调。模型包含2亿参数,320x320输入下top-1准确率达87.968%。支持图像分类、特征提取和嵌入等任务,可应用于多种计算机视觉场景。

convnext_base.fb_in22k_ft_in1k_384 - 高效的ConvNeXt图像分类解决方案

图像分类Huggingface特征提取开源项目模型GithubImageNetConvNeXt模型对比

ConvNeXt图像分类模型经过ImageNet-22k的预训练和ImageNet-1k的微调，以384x384分辨率高效执行分类任务。拥有88.6M参数和45.2 GMACs，支持图像分类、特征提取和图像嵌入等功能。适用于多种机器学习任务，其高分辨率处理能力使其在深度学习领域具有良好表现。

convnext_small.fb_in22k_ft_in1k_384 - ConvNeXt模型提升图像分类精度的预训练与微调方案

特征提取ImageNet模型比较模型Github开源项目图像分类ConvNeXtHuggingface

ConvNeXt是一款用于图像分类的模型，于ImageNet-22k数据集预训练，并在ImageNet-1k上微调。该模型拥有50.2百万参数和25.6 GMACs，支持384x384尺寸的图像处理。除了图像分类外，它还支持特征图和图像嵌入提取。凭借其优异的性能和高效的图像处理能力，ConvNeXt被广泛应用于复杂的图像识别任务。通过timm库可实现模型便捷的加载与应用，适用于各种研究与工程需求。

convnext_small.in12k_ft_in1k_384 - 高效的ConvNeXt图像分类与特征提取预训练模型介绍

开源项目模型timmImageNetGithubHuggingfaceConvNeXt预训练图像分类

ConvNeXt图像分类模型，通过timm库在ImageNet-12k及ImageNet-1k上进行预训练与微调，提供图像特征提取与分类功能。支持TPU和8xGPU训练方式，适合大规模数据集处理。模型拥有50.2M参数和25.6 GMACs，支持384x384图像输入，并兼具特征图提取与图像嵌入功能，适用于高效图像处理需求。更多性能数据及结果可在timm库查阅。

convnext_atto.d2_in1k - 轻量级ConvNeXt模型，优化图像分类和特征提取

Ross Wightman特征提取开源项目模型GithubHuggingfaceConvNeXtImageNet-1k图像分类

ConvNeXt图像分类模型，经过Ross Wightman在timm库中使用ImageNet-1k数据集训练。其参数为3.7M，计算量为0.6 GMACs，适合高效图像嵌入与特征提取，计算复杂度低但准确度高，适合多种图像分析任务。

convnext_atto_ols.a2_in1k - 高效的ConvNeXt模型实现图像分类与特征提取

图像分类HuggingfaceImageNet-1k特征提取开源项目模型Github图像嵌入ConvNeXt

本项目提供一个基于ImageNet-1k数据集优化的ConvNeXt图像分类模型，其低参数量和高效计算性能使其成为图像处理任务（如特征图提取和图像嵌入生成）的理想选择。该模型在timm库中训练，支持快速且准确的分类任务，并适用于多种计算需求。

convnext_nano.in12k_ft_in1k - 基于ConvNeXt架构的轻量级图像分类模型

ConvNeXtGithub模型ImageNet开源项目图像分类timmHuggingface特征提取

convnext_nano.in12k_ft_in1k是基于ConvNeXt架构开发的轻量级图像分类模型，模型参数量1560万，在ImageNet-12k数据集预训练后在ImageNet-1k微调。支持图像分类、特征提取和嵌入向量生成等功能，适用于计算资源受限环境下的视觉任务。

InceptionNeXt: 当Inception遇上ConvNeXt的革命性突破

2024年09月05日

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com