awesome-instruction-datasets
该项目提供多语言和多任务的高质量开源指令调优数据集,方便研究人员和开发者轻松访问和利用这些资源。收录数据集包括人类生成、自我指令生成和混合生成的数据,以加速NLP领域的发展,支持如ChatGPT的指令跟随型大语言模型的训练。