OLMo-1B-0724-hf

Dolma数据集驱动的英语语言模型在性能上的进步

机器学习 Github 模型开源项目语言模型 OLMo Huggingface 训练数据 Dolma

OLMo 1B July 2024版本采用Dolma数据集，显著提高了HellaSwag等任务的评估表现。兼容HuggingFace Transformers v4.40及以上版本，由Allen Institute for AI开发，提供完整的代码、检查点及训练日志，支持实现文本生成与模型微调。在ARC挑战、BoolQ和HellaSwag等自然语言处理任务中表现出色，适用于研究人员和开发者在语言模型科学领域的进一步探索。

访问官网

Github

Huggingface

介绍相关项目

Llama-3.2-3B-GGUF - 高性能多语言型大语言模型支持8种语言

GithubHuggingfaceLlama 3.2人工智能多语言开源项目机器学习模型语言模型

Llama-3.2-3B是Meta开发的多语言大型语言模型,支持8种语言,适用于对话和代理任务。本项目使用llama.cpp对原模型进行量化,保留了128k上下文长度和分组查询注意力等特性。该模型在行业基准测试中表现优异,可用于聊天、知识检索、摘要等自然语言生成任务,适合商业和研究使用。

Llama-3.2-1B-Instruct-GGUF - 多语言模型优化，提升对话和信息处理效率

GithubHuggingfaceLlama 3.2优化多语言对话开源项目模型生成模型行业基准

这个项目提供了经过优化的多语言大语言模型，提升了对话应用的效果和效率。Llama 3.2系列在1B和3B规格中进行了预训练及指令优化，能够处理信息提取和文本总结等多种任务。该模型在常用的行业基准测试中表现优于许多其他开源和闭源模型。SanctumAI通过量化增加了模型的操作效率，并提供多种量化选项以适应不同的硬件需求。在多语言对话的使用案例中，这些优化后的模型确保了良好的性能表现。

Llama-3.1-405B - Meta开发的多语言大规模语言模型集合,支持商业和研究使用

GithubHuggingfaceLlama 3.1人工智能多语言大语言模型开源项目模型自然语言处理

Llama 3.1是Meta开发的多语言大型语言模型系列,提供8B、70B和405B三种规模。模型采用优化的Transformer架构,支持128k上下文长度,使用分组查询注意力机制提升推理效率。经指令微调后,可用于多语言对话等场景,在行业基准测试中表现出色。支持8种语言,适用于商业和研究用途,如助手式聊天和自然语言生成等任务。

Ollama - 接入与定制大型语言模型

AI工具AI开发Gemma 2Llama 3.1MistralPhi 3大型语言模型模型训练热门

Ollama 提供丰富的大型语言模型选择，包括 Llama 3.1、Phi 3、Mistral、Gemma 2 等，适用于 macOS、Linux 和 Windows 进行高效的语言处理任务。平台支持用户按需自定义模型，并提供便捷的下载服务。

Llama-3.2-3B - 利用优化技术实现提速和内存节省的开源语言模型项目

GithubHuggingfaceLlama 3.2多语言处理大语言模型开源项目模型模型微调算力优化

这是一个基于Unsloth技术的大型语言模型优化项目。支持8种官方语言，采用改进的transformer架构和GQA技术。训练速度提升2.4倍，内存使用减少58%。提供Google Colab环境，支持对话、文本补全等场景的模型微调，适合各级用户。该项目基于Meta的原始模型，遵循社区许可协议。

dolly-v2-3b - Databricks发布开源指令微调语言模型支持商业使用

DatabricksDollyGithubHuggingface开源开源项目指令微调模型语言模型

Dolly-v2-3b是Databricks开发的开源指令微调语言模型,基于Pythia-2.8b构建,拥有28亿参数。该模型使用约15,000条指令/回复数据进行训练,涵盖头脑风暴、分类、问答等多个领域。尽管不是最先进模型,但在指令遵循方面表现优异。Dolly-v2-3b采用MIT许可证,支持商业使用,可通过Transformers库轻松部署。

ollama - 提供大型语言模型快速部署和运行的平台，支持MacOS、Windows和Linux

GithubOllama大型语言模型安装指南开源项目模型下载模型定制

Ollama是一个提供大型语言模型快速部署和运行的平台，支持MacOS、Windows和Linux。用户可以通过容易理解的界面，下载并运行各种模型，如Llama 3.1和Gemma 2等，并可通过Docker镜像或自定义安装脚本进行部署。此外，Ollama允许用户自定义和优化模型，满足不同的应用需求，如设置模型参数、导入外部模型等功能。同时，Ollama支持多种开源库例如ollama-python和ollama-js，提供全面的桌面客户端支持，使开发者能够更便捷地整合和应用AI技术。

stablelm-3b-4e1t - StableLM开源语言模型在1万亿token数据上训练达到30亿参数规模

GithubHuggingfaceStableLM-3B-4E1T人工智能大语言模型开源模型开源项目文本生成模型

StableLM-3B-4E1T是一个开源语言模型，通过在Falcon RefinedWeb和RedPajama-Data等数据集上训练4轮获得，总计处理1万亿tokens数据。模型采用LayerNorm归一化和Rotary位置编码技术，支持Flash Attention 2优化。在HellaSwag和Winogrande任务评测中分别达到75.94%和71.19%的准确率，展现出良好的语言理解能力。

Llama-3.1-Storm-8B - 多任务智能的高性能开源语言模型

GithubHuggingfaceLlama-3.1-Storm-8B人工智能大语言模型开源项目机器学习模型模型微调

Llama-3.1-Storm-8B是基于Llama-3.1-8B-Instruct改进的开源语言模型。通过自主数据筛选、定向微调和模型合并，它在10个基准测试中显著超越原始模型，包括指令遵循、知识问答、推理能力、真实性和函数调用。GPQA提升7.21%，TruthfulQA提升9%，函数调用准确率提升7.92%。支持Transformers、vLLM和Ollama等多种部署方式，为AI开发者提供高性能的通用型语言模型选择。

dolly-v2-12b - Databricks开源商用语言模型

GithubHuggingfacedolly-v2-12b大语言模型开源项目性能限制指令调优数据集模型

dolly-v2-12b由Databricks开发，基于Pythia-12b构建，是一款为商业用途优化的大规模指令遵循语言模型。通过15000条指令/响应数据库微调，展示其在多领域应用中的潜力，如信息提取和问答系统。同时，提供更小的dolly-v2-7b和dolly-v2-3b版本以适应不同需求。

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能，包括文生视频、动态画面和形象生成等，帮助用户快速上手，创造专业级内容。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台，用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品，帮助用户探索创意灵感。

Project Cover

讯飞文书

讯飞文书依托讯飞星火大模型，为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能，满足事务性工作的高频需求，帮助撰稿人节省精力，提高效率，优化工作与生活。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具，简化了选题、文献检索至论文撰写的整个过程。通过简单设定，平台可快速生成高质量论文大纲和全文，配合图表、参考文献等一应俱全，同时提供开题报告和答辩PPT等增值服务，保障数据安全，有效提升写作效率和论文质量。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号