#ViTamin

ViTamin: 革新性的可扩展视觉模型设计

3 个月前

ViTamin 视觉语言模型计算机视觉深度学习图像处理 Github 开源项目

3 个月前

相关项目

ViTamin

ViTamin是一系列可扩展的视觉语言模型,在图像分类、开放词汇检测和分割等任务上取得突破。以436M参数量在DataComp-1B数据集训练,实现82.9%的ImageNet零样本准确率。在7个开放词汇分割基准测试中创新纪录,并提升大型多模态模型能力。获timm和OpenCLIP官方支持,提供简单接口。ViTamin为计算机视觉领域带来新的可能性。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com