Project Icon

CONCH

病理学视觉语言模型提升多任务性能

CONCH是为病理学量身打造的视觉语言模型,通过对比学习提高图像与文本检索能力。该模型在117万对图像描述数据集上预训练,可在多个任务中表现优异,包括图像分类、文本-图像检索、图像字幕生成和组织切割。CONCH的优势在于除H&E染色图像外,还在IHC及特殊染色图像上显示出色性能,为病理AI模型的开发与评估提供广泛应用选择。

CONCH项目介绍

什么是CONCH?

CONCH的全称为“CONtrastive learning from Captions for Histopathology”,是一个专为病理学设计的视觉语言基础模型。它使用目前最大的病理学特定视觉语言数据集进行预训练,包含117万对图像和标题对。与其他视觉语言基础模型相比,CONCH在计算病理学的14项任务中表现卓越,这些任务包括图像分类、文本到图像及图像到文本检索、图像标题生成以及组织分割。

为什么选择CONCH?

相较于其他仅在H&E图像上进行预训练的自监督编码器,CONCH能够在非H&E染色图像(如IHC和特殊染色)上生成更具表现力的表示。此外,CONCH不使用常见的公开组织学幻灯片集合,如TCGA、PAIP、GTEX等进行预训练,因此能够帮助研究社区建立和评估病理学AI模型,同时在公共基准或者私人病理学幻灯片集合上保持数据污染风险最低。

访问申请

如要使用CONCH模型,用户必须同意所有使用条款,并确保Hugging Face账号的主要邮箱地址与所属机构的邮箱地址一致。如果主要邮箱为个人邮箱(如@gmail、@hotmail、@qq),申请将被拒绝。用户需要提供详细的研究用途描述,并确保所有申请表单信息的准确性。

许可证和使用条款

CONCH模型及其相关代码采用CC-BY-NC-ND 4.0许可,仅限于非商业、学术研究用途,并需适当署名。任何商业用途、销售或其他变现行为均需事先获得批准。模型下载需要在Hugging Face平台上注册,并且同意其使用条款。

模型详细信息

  • 开发者: 哈佛大学/布列根妇女医院的Mahmood Lab AI病理实验室
  • 模型类型: 预训练的视觉-语言编码器(视觉编码器:ViT-B/16,90M参数;文本编码器:L12-E768-H12,110M参数)
  • 预训练数据集: 117万对病理图像-标题对
  • 项目代码库: GitHub链接
  • 许可: CC-BY-NC-ND-4.0

使用方法

要安装CONCH库,可以使用以下命令:

pip install git+https://github.com/Mahmoodlab/CONCH.git

请求访问模型权重后,可以使用如下代码加载模型:

from conch.open_clip_custom import create_model_from_pretrained
model, preprocess = create_model_from_pretrained('conch_ViT-B-16', "hf_hub:MahmoodLab/conch", hf_auth_token="<your_user_access_token>")

模型可以用于零样本ROI分类、图像与文本的检索等任务。

训练详情

  • 训练数据: 来自公共可用的Pubmed Central Open Access(PMC-OA)和内部策划来源的117万个人类病理学图像-标题对。
  • 硬件: 8台Nvidia A100
  • 培训时间: 大约21.5小时
  • 软件: PyTorch 2.0,CUDA 11.7

联系方式

如有任何问题或意见,请联系:

致谢

CONCH项目得益于出色的开源代码库,如openclip、timm以及huggingface transformers。感谢贡献者的付出。

引用格式

@article{lu2024avisionlanguage,
  title={A visual-language foundation model for computational pathology},
  author={Lu, Ming Y and Chen, Bowen and Williamson, Drew FK and Chen, Richard J and Liang, Ivy and Ding, Tong and Jaume, Guillaume and Odintsov, Igor and Le, Long Phi and Gerber, Georg and others},
  journal={Nature Medicine},
  pages={863–874},
  volume={30},
  year={2024},
  publisher={Nature Publishing Group}
}

CONCH项目为研究领域提供了一个多用途的工具,以其强大的图像和文本处理能力,助推病理学研究的发展。

项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能,包括文生视频、动态画面和形象生成等,帮助用户快速上手,创造专业级内容。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台,用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品,帮助用户探索创意灵感。

Project Cover

讯飞文书

讯飞文书依托讯飞星火大模型,为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能,满足事务性工作的高频需求,帮助撰稿人节省精力,提高效率,优化工作与生活。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号