Project Icon

KULLM3

高性能韩语指令跟踪与对话模型

KULLM3是由NLP&AI Lab开发的语言模型,专注于韩语的指令跟随和流畅对话。基于upstage/SOLAR-10.7B-v1.0优化训练,适用于多种场景。利用66000多个训练样例,KULLM3在仿效GPT-3.5-turbo指令方面表现突出。在符合道德和法律标准的前提下提供自然互动,适合研究和商业用途。采用Apache 2.0许可,开放源码,详情可参阅KULLM的GitHub页面。

KULLM3项目介绍

KULLM3是一个由韩国大学NLP&AI实验室开发的全新的语言模型,具有先进的指令跟随能力和流畅的对话功能。它特别擅长跟随指令,其表现接近于GPT-3.5-turbo。值得注意的是,KULLM3是目前公开的韩语语言模型中表现最为出色之一。更多详情可以访问KULLM项目的Github页面

模型描述

KULLM3是一个基于🤗 transformers库发布在Hugging Face Hub上的语言模型,由韩国大学NLP&AI实验室开发,支持韩语和英语操作。其基础模型是upstage/SOLAR-10.7B-v1.0,并遵循Apache 2.0开源许可证进行发布。

示例代码

要使用KULLM3模型,首先需要安装相关依赖:

pip install torch transformers==4.38.2 accelerate

注意,在transformers版本4.39.0及以上的版本中,生成功能generate()可能无法正常工作(截至2024年4月4日)。

下面是一个简单的Python示例代码:

import torch
from transformers import AutoModelForCausalLM, AutoTokenizer, TextStreamer

MODEL_DIR = "nlpai-lab/KULLM3"
model = AutoModelForCausalLM.from_pretrained(MODEL_DIR, torch_dtype=torch.float16).to("cuda")
tokenizer = AutoTokenizer.from_pretrained(MODEL_DIR)
streamer = TextStreamer(tokenizer, skip_prompt=True, skip_special_tokens=True)

s = "고려대학교에 대해서 알고 있니?"
conversation = [{'role': 'user', 'content': s}]
inputs = tokenizer.apply_chat_template(
    conversation,
    tokenize=True,
    add_generation_prompt=True,
    return_tensors='pt').to("cuda")
_ = model.generate(inputs, streamer=streamer, max_new_tokens=1024)

这个代码展示了如何使用KULLM3来回答关于高丽大学的提问,其生成的韩语回答详细介绍了高丽大学的背景和特色。

训练细节

训练数据

KULLM3训练使用的数据包括来自vicgalle/alpaca-gpt4的数据和多种混合韩语指令数据(包括GPT生成和手工制作的数据等),总共包含约66000多例指令。

训练过程

训练过程中,模型使用了以下固定的系统提示:

당신은 고려대학교 NLP&AI 연구실에서 만든 AI 챗봇입니다.
당신의 이름은 'KULLM'으로, 한국어로는 '구름'을 뜻합니다.
당신은 비도덕적이거나, 성적이거나, 불법적이거나 또는 사회 통념적으로 허용되지 않는 발언은 하지 않습니다.
사용자와 즐겁게 대화하며, 사용자의 응답에 가능한 정확하고 친절하게 응답함으로써 최대한 도와주려고 노력합니다.
질문이 이상하다면, 어떤 부분이 이상한지 설명합니다. 거짓 정보를 발언하지 않도록 주의합니다.

训练的目标是确保KULLM3模型能够以道德、负责和友好的方式与用户进行交流,并能够识别和指出不合理的问题。

评估

KULLM3的评估详情,包括测试数据和指标,可以在GitHub中找到。在没有训练阶段使用的系统提示的情况下,KULLM的表现可能会低于预期。

结果

Instruction Evaluation Result

引用

研究人员和开发者可以引用KULLM项目以获取更多背景信息:

@misc{kullm,
  author = {NLP & AI Lab and Human-Inspired AI research},
  title = {KULLM: Korea University Large Language Model Project},
  year = {2023},
  publisher = {GitHub},
  journal = {GitHub repository},
  howpublished = {\url{https://github.com/nlpai-lab/kullm}},
}

通过KULLM3项目,韩国大学NLP&AI实验室展示了提升韩语自然语言处理技术的能力,并为多语言对话系统的开发提供了新的工具。

项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能,包括文生视频、动态画面和形象生成等,帮助用户快速上手,创造专业级内容。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台,用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品,帮助用户探索创意灵感。

Project Cover

讯飞文书

讯飞文书依托讯飞星火大模型,为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能,满足事务性工作的高频需求,帮助撰稿人节省精力,提高效率,优化工作与生活。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号