#DataComp-1B
CLIP-ViT-L-14-DataComp.XL-s13B-b90K - 基于DataComp-1B数据集训练的零样本图像分类器
OpenCLIPCLIP模型多模态模型零样本图像分类Github开源项目HuggingfaceDataComp-1B
CLIP ViT-L/14是一个基于DataComp-1B大规模数据集训练的多模态模型。在ImageNet-1k上达到79.2%的零样本分类准确率,可用于图像分类、检索等任务。该模型主要面向研究社区,旨在促进对零样本和任意图像分类的探索。由stability.ai提供计算资源支持,不建议直接用于部署或商业用途。
CLIP-ViT-B-32-256x256-DataComp-s34B-b86K - 基于DataComp训练的CLIP多模态视觉语言模型
开源项目模型GithubViT-B-32机器学习HuggingfaceCLIPDataComp-1B图像分类
CLIP ViT-B/32是一个在DataComp-1B数据集上训练的视觉语言模型,通过OpenCLIP框架实现。模型在ImageNet-1k分类任务中实现72.7%零样本准确率,支持图像分类、跨模态检索等研究任务。该开源项目为计算机视觉研究提供了重要的实验基础