BayLing

跨语言对齐与指令遵循的多语言大模型

BayLing是一个开源的多语言大规模语言模型，专注于跨语言对齐和指令遵循。该模型在英汉双语生成、指令执行和多轮交互方面表现优异，可在16GB显存的消费级GPU上运行。BayLing支持翻译、写作、创作和建议等多种任务，为用户提供多语言智能辅助。

访问官网

babilong - BABILong基准测试长文本处理能力评估大语言模型极限

BABILongGithub开源项目推理能力数据集语言模型评估长文本处理

BABILong是一个用于评估自然语言处理模型长文本处理能力的基准测试。它将bAbI数据集的任务句子隐藏在PG19背景文本中，生成长达数百万标记的测试样本。该基准包含20个推理任务，涉及事实链接、归纳、演绎和计数等多个方面。BABILong为评估和改进大语言模型的长文本处理能力提供了有效工具，同时也对现有长文本模型提出了挑战。

TowerBase-7B-v0.1 - 增强翻译及多语种任务的多语言模型性能

GithubHuggingfaceTowerBase-7BUnbabel多语言开源项目文本生成模型翻译模型

TowerBase-7B-v0.1是一个多语言模型，通过继续在Llama 2的基础上对20亿条多语种数据进行预训练，在10种主要语言中表现出色。非常适合用于翻译和相关应用任务，在AI2 Reasoning Challenge和HellaSwag等测试中展现出优异的归一化准确率。该模型支持快速无监督调优，为相应语言的研究提供支持。技术报告将提供详细信息。

AlignLLMHumanSurvey - 更好的理解和对齐大型语言模型与人类需求的方法综述

GithubLarge Language ModelsNLP培训方法开源项目数据收集模型评估

本综述探讨了大型语言模型（LLMs）与人类需求对齐的研究进展，包括数据收集、训练方法和模型评估。文章展示了如何改进LLMs在理解人类指令、避免偏见和减少虚假信息方面的表现，并为研究人员和从业者提供了有价值的参考，助力LLMs更好地满足人类任务和期望。

YAYI - 多任务中文预训练模型，增强对话和分析功能

Github人工智能多轮对话开源开源项目指令微调雅意大模型

雅意大模型通过深度微调媒体宣传、舆情分析、公共安全等领域数据，提升了中文对话和领域分析能力。开源项目促进了中文预训练大模型社区的发展，支持全参数和LoRA微调，提供多轮对话和插件功能。基于高质量数据集训练，适用于中文多领域任务，具备优异的自然语言处理性能，持续优化安全性和拒识能力。

ChatGLM2-6B - 基于GLM技术开发的中英双语对话模型

ChatGLM2-6BGithub开源项目性能提升推理速度显存占用模型开源

ChatGLM2-6B，基于GLM技术开发的中英双语对话模型，1.4T中英数据预训练后展现出改善的多语言处理效果，支持长达32K的上下文长度，新技术支持更快的推理速度和更好的对话体验。适用于学术研究和商业应用，如聊天机器人和客服AI，提供技术支持与灵活部署方案。

LLaMa2lang - 优化LLaMa3-8B模型性能，支持多语言微调和翻译

GPUGithubLLaMa3RAG开源项目翻译语言微调

LLaMa2lang提供便捷脚本，微调LLaMa3-8B模型以适应不同语言。结合RAG和翻译模型，将数据集OASST1翻译为目标语言，进行数据集成和细调，并支持推理。支持DPO和ORPO等优化方法，进一步提升模型回答质量，兼容多个基础模型与翻译架构。

Yi-6B - 开源双语大型语言模型的性能和应用

GithubHuggingfaceYi series人工智能大语言模型开源开源项目机器学习模型

Yi系列模型是01.AI从头自主训练的开源大型语言模型，支持双语，适用于语言理解、常识推理和阅读理解。Yi-34B-Chat在多项评估中表现出色，仅次于GPT-4 Turbo，而Yi-34B在开源模型中名列前茅。该系列模型采用Transformer架构，结合高质量训练数据集和高效管道，适合广泛的个人、学术和商业用途，支持在多个平台试用。

Chinese-LLaMA-Alpaca - 中文NLP开源模型，深化语义理解与执行技术

Github中文Alpaca中文LLaMA大模型开源开源项目指令精调

Chinese-LLaMA-Alpaca-3项目致力于提升中文NLP的处理效率和效果，通过扩展中文词表并使用中文数据进行二次预训练，大幅增强了中文文本的编解码能力。该项目提供了完善的模型下载、部署和训练指导，支持多种生态系统和快速本地部署，适合高质量文本生成和多轮对话任务。同时，通过开源和社区合作，推动开源大模型技术研究及应用。

aya-expanse-8b - Aya Expanse 8B开源多语言模型研究成果

Aya ExpanseGithubHuggingfaceTransformer架构多语言能力大规模语言模型开源项目模型非商业用途

Aya Expanse 8B是由Cohere For AI开发的多语言大语言模型，注重数据套利、多语言偏好训练、安全调优和模型合并等研究领域。它支持23种语言，具有8亿参数的先进架构。用户可以使用Cohere Playground或Hugging Face进行互动探索。该模型在CC-BY-NC许可证下发布，仅限非商业用途。了解更多信息，请访问相关博客和评估数据集。

InternVL2-2B - 多模态大语言模型支持多语言及多媒体理解

GithubHuggingfaceInternVL2人工智能多模态大语言模型开源项目模型自然语言处理计算机视觉

InternVL2-2B是一个开源的多模态大语言模型,参数量为2.2B。该模型在文档理解、图表分析和场景文本识别等任务中表现优异,性能接近商业闭源模型。InternVL2-2B支持8K上下文窗口,可处理长文本、多图像和视频输入,大幅提升了多模态理解能力。作为一款出色的开源模型,InternVL2-2B为多模态人工智能研究和应用提供了新的可能性。

相关项目

推荐项目

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具，简化了选题、文献检索至论文撰写的整个过程。通过简单设定，平台可快速生成高质量论文大纲和全文，配合图表、参考文献等一应俱全，同时提供开题报告和答辩PPT等增值服务，保障数据安全，有效提升写作效率和论文质量。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com