360zhinao

支持超长上下文的开源大语言模型

360智脑大语言模型开源模型长上下文自然语言处理 Github 开源项目

360Zhinao是一系列开源大语言模型,包括基础模型和聊天模型。该项目利用3.4万亿高质量语料训练,在多项基准测试中表现优异。其聊天模型支持4K、32K和360K三种上下文长度,其中360K(约50万中文字符)为开源中文模型最长。此外,360Zhinao还发布了搜索和重排模型,在C-MTEB排行榜上表现出色。该项目持续更新,不断推进大语言模型技术发展。

访问官网

Github

Huggingface

介绍相关项目

glm-4-9b-chat-1m - 广泛语言支持与长文本处理能力的先进预训练模型

GLM-4-9BGithubHuggingface多语言支持开源项目机器学习模型长文本能力预训练模型

GLM-4-9B-Chat-1M 是智谱 AI 开发的先进预训练模型，具备网页浏览、代码执行和长文本推理等功能，支持 26 种语言，适用于需要大规模上下文处理的应用场景。最新更新提升了处理能力，支持长达 1M 上下文长度。

Qwen1.5-4B-Chat - 支持多语种与长上下文的高级语言模型

GithubHuggingfaceQwen1.5Transformer多语言支持开源项目性能提升模型语言模型

Qwen1.5是一种基于变压器架构的语言模型，提供八种型号，支持多语言处理和32K字符的上下文长度。这一版本在聊天模型的人类偏好方面表现显著提升，且不需要信任远程代码。改进涉及高级激活函数、注意力机制和多语言适应分词器。模型已在Hugging Face Transformers库上线，建议使用最新版本以避免可能错误。适用于多种文本生成任务，包含多种量化轻量化模型以满足不同需求。

openchat-3.5-1210 - 7B参数规模开源语言模型在多项测试中超越大规模商业模型

GithubHuggingfaceOpenChat人工智能大语言模型开源项目性能评估模型

OpenChat-3.5-1210在Mistral-7B基础上采用C-RLFT技术开发，通过多样化数据训练实现性能突破。模型在编程、对话和数学推理等多个领域展现出色表现，基准测试成绩优于部分大规模商业模型。此外，模型还配备评估反馈功能，支持多种应用场景。作为参数规模仅7B的开源模型，OpenChat-3.5-1210体现了小型模型的巨大潜力。

cogvlm2-llama3-chinese-chat-19B - 双语视觉语言模型，支持大规模文本和图像解析

CogVLM2GithubHuggingface中文支持开源模型开源项目文本生成模型视觉理解

CogVLM2-LLaMA3-Chinese 是一个开源模型，支持中文和英文，表现出显著性能提升，比如在 TextVQA 和 DocVQA 基准测试中。这一模型支持最大8K的文本长度和1344*1344的图像分辨率，特别适合文本和图像的理解与对话任务。构建于Meta-Llama-3-8B-Instruct基础之上，用户可在ZhipuAI开放平台进行实际体验，适用于需要强大图像解析和多语言支持的场景。

huozi - 支持32K上下文的双语稀疏混合专家模型

GithubHIT-SCIR中文MT-Bench开源项目活字3.0活字通用大模型自然语言处理

活字3.0是一个支持32K上下文的稀疏混合专家模型，具备中英文知识、数学推理和代码生成能力，并在指令遵循和安全性上有所提升。项目开源了中文MT-Bench数据集，支持多种推理框架如Transformers、vLLM和llama.cpp，为自然语言处理研究和应用提供更多选择。

longchat-13b-16k - 开源模型longchat-13b-16k优化长文本对话能力

GithubHuggingfacelongchat-13b-16k开源开源项目模型研究自然语言处理

Longchat-13b-16k使用凝缩旋转嵌入技术进行优化，能有效处理长文本对话，由Dacheng Li等人开发，适用于语言处理及机器学习研究领域。用户可通过FastChat与LongChat加载，凭18K对话训练数据，适合研究者探索其对长对话的扩展潜力。LongEval评估资源和GitHub资料提供更多技术支持和信息。

Telechat - 开源多语言对话模型，支持长文生成和高效部署

GithubTeleChat中文数据集大语言模型开源模型开源项目模型评测

TeleChat是一系列开源大语言模型,包含1B至12B规模,支持中英双语。采用优化结构和训练方法,在多领域表现优异。项目开源预训练数据集和评测结果,支持模型微调与高效部署。

LongMem - 为语言模型赋予长期记忆能力

GithubLongMem开源项目评估语言模型长期记忆预训练

LongMem项目通过创新的长期记忆机制提升了语言模型的性能。该项目实现了记忆库、检索机制和联合注意力等核心技术，使模型在内容学习任务中表现优异。项目开源了完整代码，包括环境配置、模型结构和评估方法，为研究者提供了便利的复现和探索工具。LongMem为自然语言处理领域开辟了新的研究方向。

Yi-1.5-34B-Chat-16K - 开源语言模型在多项基准测试中表现出色

GithubHuggingfaceYi-1.5人工智能开源项目模型深度学习语言模型

Yi-1.5是Yi系列的升级版本，经过5000亿高质量语料预训练和300万多样化样本微调。与前代相比，Yi-1.5在编码、数学、推理和指令遵循方面有显著提升，同时保持了优秀的语言理解、常识推理和阅读理解能力。Yi-1.5-34B-Chat模型在多项基准测试中媲美甚至超越了一些更大的模型，9B和6B版本在同等规模开源模型中也表现出色。项目提供多个预训练和对话模型版本可供下载使用。

Chinese-Tiny-LLM - 中文大语言模型训练流程与高质量语料库开源项目

Chinese-Tiny-LLMGithub中文语料库开源项目自然语言处理语言模型预训练

Chinese-Tiny-LLM项目提供完整的中文网络语料清洗流程和预训练代码，包含MAP-CC（8000亿中文token预训练数据集）、CHC-Bench（中文难例指令理解基准测试）和CT-LLM（2B参数中文中心语言模型）。该项目突破了传统依赖英语语料库的LLM训练方法，为构建更具包容性和适应性的语言模型奠定基础。

相关项目

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

Project Cover

稿定AI

稿定设计是一个多功能的在线设计和创意平台，提供广泛的设计工具和资源，以满足不同用户的需求。从专业的图形设计师到普通用户，无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑，稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合，帮助用户轻松实现创意设计。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号