#Salesforce AI Research
CodeGen - 一系列用于程序合成的开源模型
CodeGenSalesforce AI ResearchProgram SynthesisCodeGen2.5CodeGen2.0Github开源项目
CodeGen是由Salesforce AI Research开发的开源项目,涵盖多个模型版本(350M、1B、3B、7B、16B),专注于程序合成。最新的CodeGen2.5模型在7B参数下超越了16B参数模型的性能。主要更新包括CodeGen2.0的强大补全能力和CodeGen1.0的发布,其性能媲美OpenAI Codex。所有模型均可在Hugging Face Hub上获取,适用于多轮程序合成任务。
xgen - 支持8K输入长度的7B长序列模型
XGenSalesforce AI Research7B LLM8K Input Sequence LengthHuggingFace HubGithub开源项目
Salesforce AI Research发布了XGen模型系列,支持最长8K输入序列。这些模型包括适用于4K和8K序列长度的基础模型以及经过指令微调的8K模型。模型使用OpenAI的Tiktoken进行分词,并可用于自回归采样。访问HuggingFace Hub获取更多模型详细信息和使用方法。
相关文章