Project Icon

aya-23-8B

支持23种语言的开源多语言大模型

Aya-23-8B是由Cohere For AI开发的开源多语言大模型,基于Command系列模型架构,通过Aya Collection数据集进行指令微调。该模型包含80亿参数,支持阿拉伯语、中文、英语在内的23种语言,具有8192的上下文长度。模型采用优化的Transformer架构,主要面向学术研究和非商业应用场景。

SeaLLM-7B-v2 - 东南亚多语言大模型的新选择
GPT-3.5GithubHuggingfaceSeaLLM-7B-v2东南亚语言多语言开源项目数学推理模型
SeaLLM-7B-v2是一款经过多语言优化的开源大模型,专注于提升东南亚语言的推理能力。与前代 SeaLLM-13B 相比,该模型体积减小一半,但性能表现更出色,特别是在78.2分的GSM8K零样本推理任务中领先同类产品,并在多种语言的数学推理测试中超过GPT-3.5。凭借其稳健的多语言支持和开源特性,SeaLLM-7B-v2在数学推理、常识推理和多语言知识评估等多个领域中展示了强大的应用潜力,成为多语言文化与技术研究的有力工具。
internlm2-chat-1_8b - 优化指令遵循与对话功能的开源对话模型
GithubHuggingfaceInternLM开源模型开源项目模型模型性能部署工具长文本支持
InternLM2-Chat-1.8B是一款经过精确调整的1.8亿参数开源对话模型,通过监督微调和在线RLHF优化,支持超长文本处理,适用于多种应用场景。其在推理、数学和编码任务中表现出色,依照Apache-2.0协议开源,商用需申请许可。
internlm-xcomposer2d5-7b - 7B参数规模实现视觉语言理解和创作的开源多模态模型
GithubHuggingfaceInternLM-XComposer-2.5图像理解多模态开源项目模型网页生成长文本处理
InternLM-XComposer2.5采用7B参数规模构建,通过24K交错图文上下文训练,支持扩展至96K长文本理解。这个开源多模态模型在视频理解、多图对话、高清图像分析、网页生成和文章创作等场景中展现出强大的理解与创作能力。其优秀的长文本处理特性使其能够处理需要大量上下文的复杂任务。
Qwen2.5-32B-Instruct-GPTQ-Int8 - 开源多语言大模型Qwen2.5 32B量化版支持超长文本处理
GithubHuggingfaceQwen2.5多语言支持大语言模型开源项目文本生成模型量化
Qwen2.5-32B-Instruct-GPTQ-Int8是Qwen2.5系列的量化版本,通过GPTQ 8位量化技术实现高效部署。模型支持29种语言交互,具备128K超长上下文理解和8K文本生成能力。在编程、数学计算、文本理解等任务中表现优异,同时对结构化数据处理能力显著提升。该模型采用325亿参数规模,适合在资源受限环境中运行
awesome-huge-models - 大型AI模型最新动态与开源资源汇总
AI训练GithubLLMdeep learning模型大模型开源开源项目
详尽介绍大型AI语言模型最新进展及开源资源,包括训练代码、数据集和预训练权重。收录Baichuan、Falcon、OpenLLaMA等模型,并关注开源与分布式训练框架如PyTorch和XLA生态。提供全面资源链接,帮助研究人员和开发者了解当前AI模型的最前沿动态。
Pretrained-Language-Model - 先进预训练语言模型与优化技术集合
GithubMindSporePyTorchTensorFlow开源项目自然语言处理预训练语言模型
此开源项目汇集了多个先进的预训练语言模型和相关优化技术。包含200B参数中文语言模型PanGu-α、高性能中文NLP模型NEZHA、模型压缩技术TinyBERT和DynaBERT等子项目。这些模型在多项中文NLP任务中表现出色,支持MindSpore、TensorFlow和PyTorch等多种深度学习框架。
DeepSeek-LLM - 多语言大模型展现卓越编码与数学能力
DeepSeek LLMGithub人工智能开源开源项目自然语言处理语言模型
DeepSeek LLM是一个包含67亿参数的先进语言模型,经过2万亿英文和中文token的训练。该模型在推理、编码、数学和中文理解等方面表现优异,超越多个同类模型。其67B Chat版本在编码和数学方面尤为出色,在HumanEval和GSM8K等基准测试中名列前茅。项目开源了7B和67B的base与chat版本,可用于学术和商业研究。
Qwen2 - 阿里巴巴推出多语言大规模语言模型 支持128K上下文
GithubQwen2人工智能大语言模型开源项目模型训练自然语言处理
Qwen2是阿里巴巴发布的大规模语言模型系列,规模从0.5B到72B不等。支持27种语言,在编码和数学等领域表现优异。Qwen2-7B-Instruct和Qwen2-72B-Instruct模型的上下文长度达128K,显著增强长文本处理能力。项目提供多种部署选项,包括本地运行和规模化推理,并支持模型量化和微调。
llama3 - Llama 3开源大语言模型 推动AI创新与责任发展
GithubLlama 3Meta人工智能大语言模型开源开源项目
Meta推出Llama 3系列大语言模型,参数规模从8B到70B不等,包含预训练和指令微调版本。该系列面向广泛用户群体开放,旨在推动负责任的AI创新。Llama 3具备8192个token的序列处理能力,并提供便捷的加载和推理代码。模型权重和分词器可通过官方网站或Hugging Face平台获取。
Cohere - 企业级大语言模型与人工智能平台
AI工具AI开发Cohere CommandCohere EmbedCohere Rerank企业AI平台模型训练热门高级检索
Cohere专为企业提供尖端的大语言模型和检索增强生成技术,帮助企业高效解决实际问题并优化生成型AI、搜索与发现功能,从而推动全球企业在人工智能领域的持续竞争力。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能,包括文生视频、动态画面和形象生成等,帮助用户快速上手,创造专业级内容。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台,用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品,帮助用户探索创意灵感。

Project Cover

讯飞文书

讯飞文书依托讯飞星火大模型,为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能,满足事务性工作的高频需求,帮助撰稿人节省精力,提高效率,优化工作与生活。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号