phi-1_5 - 13亿参数的语言模型展现卓越性能

phi-1.5项目介绍

模型概述

phi-1.5是一个由微软开发的语言模型,它是一个拥有13亿参数的Transformer模型。该模型在phi-1的基础上进行了扩展,增加了新的NLP合成文本数据源进行训练。phi-1.5在测试常识、语言理解和逻辑推理的基准测试中表现出色,在参数量少于100亿的模型中几乎达到了最先进的水平。

值得注意的是,phi-1.5并没有经过指令跟随或人类反馈强化学习的微调。开发团队公开发布这个模型的目的是为研究社区提供一个不受限制的小型模型,以探索诸如减少有害内容、理解社会偏见、增强可控性等重要的安全挑战。

训练数据与安全性

为了增强模型的安全性,phi-1.5的训练数据排除了通用网络爬虫数据源(如common-crawl)。这种策略可以避免模型直接接触潜在的有害在线内容,从而在不使用人类反馈强化学习的情况下提高模型的安全性。然而,该模型仍然可能产生有害内容。研究团队希望通过发布这个模型,能够帮助研究社区进一步研究语言模型的安全性。