#OLMo

OLMo - 开源语言模型加速科学研究
OLMo开源语言模型人工智能机器学习自然语言处理Github开源项目
OLMo是一个开源语言模型项目,提供多种规模的先进模型,如1B、7B和7B Twin 2T,全部基于Dolma数据集训练。该项目支持模型训练、微调和推理,提供详细配置和检查点以确保研究可重现。OLMo还包含数据检查和评估工具,为语言模型研究提供全面支持,旨在加速这一领域的科学进展。
OLMo-7B-0724-hf - OLMo开放式语言模型促进语言处理技术进步
AI2开源语言模型变形金刚Github开源项目OLMo自然语言处理Huggingface模型
OLMo是由AI2开发的开源语言模型系列,旨在推动语言模型科学研究。该模型基于Dolma数据集训练,采用先进的Transformer结构,实现性能提升和多阶段优化。OLMo-7B-0724-hf具备强大的文本生成能力,适用于文本推理和生成任务。支持在HuggingFace平台上进行加载、微调和评估,且提供多种数据检查点,方便研究与开发。该项目得到多家机构支持,并在多个主要AI任务中表现优异。
OLMo-7B - 专注于语言模型科学的开放模型
模型性能Huggingface开源项目OLMo模型训练数据集Github语言模型
OLMo系列模型由Allen Institute for AI开发,旨在推进语言模型科学。该系列模型使用Dolma数据集进行训练,提供诸如OLMo 7B等多种版本及详细的训练检查点和代码支持。这些模型可用于英文学术研究,并可在Hugging Face平台上获取。项目获得哈佛大学、Databricks、AMD等机构支持,并在MMLU测试中显示出明显的性能提升。
OLMo-1B-0724-hf - Dolma数据集驱动的英语语言模型在性能上的进步
机器学习Github模型开源项目语言模型OLMoHuggingface训练数据Dolma
OLMo 1B July 2024版本采用Dolma数据集,显著提高了HellaSwag等任务的评估表现。兼容HuggingFace Transformers v4.40及以上版本,由Allen Institute for AI开发,提供完整的代码、检查点及训练日志,支持实现文本生成与模型微调。在ARC挑战、BoolQ和HellaSwag等自然语言处理任务中表现出色,适用于研究人员和开发者在语言模型科学领域的进一步探索。
OLMo-7B-0724-Instruct-hf - 改进自然语言处理任务的问答精度与模型性能
语言模型Github开源项目OLMo自然语言处理Huggingface训练数据模型评估模型
OLMo 7B Instruct是由Allen Institute for AI与多家机构于2024年7月发布的更新版语言模型。此版本通过微调技术优化基础模型的问答能力,基于Dolma和Tulu 2 SFT混合数据集进行训练,提高了绩效和安全性。其自回归Transformer结构适用于精确的英文自然语言处理任务。
OLMo-1B-hf - 结合开放性与多功能性提升语言模型科学
开放语言模型开源项目模型GithubHuggingfaceTransformerDolma数据集OLMo语言模型
OLMo是一个由Allen Institute for AI开发的开源语言模型,支持Hugging Face Transformers格式和Dolma数据集,具有自回归Transformer架构,适合多种语言处理任务,涵盖完整训练代码和检查点。
投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号