Project Icon

SeaLLM-7B-v2

东南亚多语言大模型的新选择

SeaLLM-7B-v2是一款经过多语言优化的开源大模型,专注于提升东南亚语言的推理能力。与前代 SeaLLM-13B 相比,该模型体积减小一半,但性能表现更出色,特别是在78.2分的GSM8K零样本推理任务中领先同类产品,并在多种语言的数学推理测试中超过GPT-3.5。凭借其稳健的多语言支持和开源特性,SeaLLM-7B-v2在数学推理、常识推理和多语言知识评估等多个领域中展示了强大的应用潜力,成为多语言文化与技术研究的有力工具。

Llama-3.1-Storm-8B - 多任务智能的高性能开源语言模型
GithubHuggingfaceLlama-3.1-Storm-8B人工智能大语言模型开源项目机器学习模型模型微调
Llama-3.1-Storm-8B是基于Llama-3.1-8B-Instruct改进的开源语言模型。通过自主数据筛选、定向微调和模型合并,它在10个基准测试中显著超越原始模型,包括指令遵循、知识问答、推理能力、真实性和函数调用。GPQA提升7.21%,TruthfulQA提升9%,函数调用准确率提升7.92%。支持Transformers、vLLM和Ollama等多种部署方式,为AI开发者提供高性能的通用型语言模型选择。
Llama-2-70b-hf - Meta开发的70亿参数开源大语言模型 支持多样化自然语言处理任务
GithubHuggingfaceLLAMA 2人工智能大语言模型开源开源项目模型自然语言处理
Llama-2-70b-hf是Meta开发的70亿参数大语言模型,基于优化的Transformer架构,支持4k上下文长度。模型在2万亿token公开数据上预训练,通过监督微调和人类反馈强化学习实现对话能力。在多项基准测试中表现优异,适用于对话、问答、推理等自然语言处理任务。作为开源发布的基础模型,为学术研究和商业应用提供了有力支持。
Chinese-Llama-2-7b - 开源且可商用的中文Llama2模型,兼容中英文SFT数据集与llama-2-chat格式
Chinese Llama 2 7BGithubHuggingFaceLlama2开源项目模型开源量化模型
项目提供开源且商用的中文Llama2模型及中英文SFT数据集,兼容llama-2-chat格式并支持优化。项目包含在线演示、多模态模型、Docker部署和API接口,支持多种硬件配置,用户可快速下载与测试。
Meta-Llama-3.1-8B - 开源支持128K上下文的多语言大规模语言模型
GithubHuggingfaceLlama 3.1人工智能模型多语言支持大语言模型开源项目机器学习模型
Meta Llama 3.1是新一代多语言大规模语言模型系列,提供8B、70B和405B三种参数规模。模型采用优化的Transformer架构,通过SFT和RLHF提升对话能力。支持8种语言,具有128K上下文窗口,基于15T+训练数据。采用GQA技术优化推理性能,适用于商业和研究领域的文本生成任务,知识截至2023年12月。
NeuralMonarch-7B - 基于Mistral架构的7B参数大语言模型在多项基准测试中展现卓越性能
GithubHuggingfaceNeuralMonarch-7B人工智能模型开源项目模型深度学习自然语言处理语言模型
NeuralMonarch-7B是基于Monarch-7B开发的开源语言模型,通过DPO技术微调并使用LazyMergekit整合多个基础模型。在Nous基准测试中获得62.73分的平均成绩,支持8k上下文窗口,专注于指令理解和逻辑推理能力。模型提供GGUF量化版本,可用于聊天及推理等多种应用场景。
llm-jp-1.3b-v1.0 - 大规模语言模型支持多语言和多种编程语言
GithubHuggingfaceLLM-jp大型语言模型开源项目模型深度学习自然语言处理训练数据
此大规模语言模型由日本研发,支持多语言(含日语和英语)及多编程语言。采用Transformer架构,经过预训练和指令调优,适用于多种自然语言处理任务。模型在多个硬件和软件环境中优化,包括使用Megatron-DeepSpeed和TRL,可用于生成自然语言文本,应用广泛,性能优异。
internlm2-20b - 提供深度适应性和超长文本理解能力的20B语言模型
GithubHuggingfaceInternLM对话模型开源项目性能评测模型模型开源评测工具
InternLM2-20B是一款支持20万字符上下文的语言模型,其在推理、数学和编程领域的表现突出。模型分为基础和对话优化版本,可以满足多样的语言处理需求。通过OpenCompass评测,其展示了卓越的综合性能,适合复杂的研究和商业应用。
open_llama_7b - 开源复现的大规模语言模型媲美原版LLaMA
GithubHuggingfaceOpenLLaMA人工智能大语言模型开源开源项目模型自然语言处理
OpenLLaMA是一个基于Apache 2.0许可的开源大型语言模型,旨在复现Meta AI的LLaMA。该项目提供了在1万亿个token上训练的7B和3B模型,以及在6000亿个token上训练的13B模型预览版。OpenLLaMA基于RedPajama数据集训练,在多项评估任务中表现与原版LLaMA相当或更优。项目开源了PyTorch和JAX格式的预训练权重,支持使用Hugging Face transformers和EasyLM框架加载模型。
WizardMath-7B-V1.1 - 新一代数学推理模型优化Mistral-7B架构实现卓越性能提升
AI训练GithubHuggingfaceWizardMath大语言模型开源项目数学推理机器学习模型
WizardMath-7B-V1.1基于Mistral-7B架构开发,通过强化进化指令训练方法提升数学推理能力。在GSM8k和MATH基准测试中分别达到83.2和33.0的评分,达到7B规模模型中的最佳水平。这一开源数学推理模型展现出与商业大模型相当的解题表现,为数学问题求解提供了新的解决方案。
Llama-3-Taiwan-8B-Instruct - 基于Llama-3架构的大规模双语语言模型 专注中英文处理
GithubHuggingfaceLlama-3-Taiwan中文对话人工智能大型语言模型开源项目模型深度学习
Llama-3-Taiwan-8B是基于Llama-3架构开发的大规模双语语言模型,采用繁体中文和英文高质量语料进行训练。模型在法律、制造、医疗和电子等专业领域进行优化,支持8K上下文长度。通过繁体中文NLP基准测试验证,可应用于对话、生成、推理等多个场景。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号