Project Icon

dolly

基于Pythia-12b开发的指令遵循大型语言模型

Dolly是由Databricks基于Pythia-12b开发的指令遵循大型语言模型,通过约1.5万条指令/响应微调数据集训练。尽管不是最先进的生成模型,但具备高质量的指令遵循能力。Dolly旨在让各类组织和个人都能利用人工智能的变革力量,并提供详细的使用和训练指南,适用于多种GPU配置。

ollama - 提供大型语言模型快速部署和运行的平台,支持MacOS、Windows和Linux
GithubOllama大型语言模型安装指南开源项目模型下载模型定制
Ollama是一个提供大型语言模型快速部署和运行的平台,支持MacOS、Windows和Linux。用户可以通过容易理解的界面,下载并运行各种模型,如Llama 3.1和Gemma 2等,并可通过Docker镜像或自定义安装脚本进行部署。此外,Ollama允许用户自定义和优化模型,满足不同的应用需求,如设置模型参数、导入外部模型等功能。同时,Ollama支持多种开源库例如ollama-python和ollama-js,提供全面的桌面客户端支持,使开发者能够更便捷地整合和应用AI技术。
pythia-1b - 开放8亿参数的自然语言模型研究工具
GithubHuggingfacePythia人工智能大语言模型开源项目机器学习模型深度学习
Pythia-1B是一个基于Transformer架构的开源语言模型,拥有8亿多非嵌入参数和154个训练检查点。模型在The Pile数据集上训练,主要用于语言模型的可解释性研究。通过Hugging Face库可实现快速部署,性能与同规模的OPT和GPT-Neo相当。该模型使用Apache 2.0许可证,适用于学术研究和实验。
DALLE2-pytorch - Pytorch实现的OpenAI DALL-E 2
DALL-E 2GithubPytorch开源项目文本到图像神经网络自监督学习
DALL-E 2的Pytorch实现由OpenAI开发,采用先进的神经网络技术将文本描述转化为高质量图像。本版本特别优化扩散先验网络,提供高性能的模型变体。开源项目鼓励开发者通过GitHub和Hugging Face参与贡献,并在Discord社区进行交流和支持。
pythia - 大语言模型训练过程知识演化分析开源项目
GithubPythia可解释性研究大语言模型学习动态开源项目模型训练
Pythia是一个开源项目,旨在分析大语言模型训练过程中的知识演化。该项目提供完整的模型、数据和代码,包含154个训练检查点,支持研究人员深入探索学习动态和因果关系。Pythia是业界首个支持全面复现和学习动态分析的模型套件,为大语言模型的可解释性研究提供了重要工具。
h2o-danube3-500m-base - 500M参数的大规模语言模型,支持离线文本生成
GPTGithubH2O.aiHuggingface大语言模型开源项目模型模型架构转化器
由H2O.ai推出的h2o-danube3-500m模型,是一个大规模语言模型,采用Llama 2架构调整及500M参数设计。模型支持原生离线运行,尤其适用于手机设备,并集成Mistral分词器,拥有32,000词汇量及8,192长度的上下文生成能力。在支持transformers库的环境中,模型可在GPU设备上有效运行,并且支持量化和多GPU分片处理。重要提醒用户在使用模型生成的内容时保持审慎态度并自行承担责任。
pythia-1.4b-deduped-v0 - 开源语言模型套件助力可解释性研究
EleutherAIGithubHuggingfacePythia开源项目机器学习模型自然语言处理语言模型
Pythia-1.4B-deduped是EleutherAI推出的开源语言模型,旨在推动AI可解释性研究。该模型在去重后的Pile数据集上训练,提供143个均匀分布的检查点,便于研究人员分析模型训练过程。虽然不以下游任务性能为主要目标,Pythia-1.4B-deduped在多项评估中仍表现出色,与同规模模型相当或更优。模型采用Apache 2.0许可,可用于进一步研究、微调和部署。
doremi - 创新算法提升语言模型训练效率
DoReMiGithub代理模型分布鲁棒优化开源项目数据混合优化语言模型
DoReMi是一种优化语言模型数据集混合的算法。它通过分布鲁棒优化调整数据混合,适应不同目标分布。算法训练小型代理模型动态调整各领域数据权重,并利用预训练参考模型避免对高熵领域过于悲观。DoReMi显著提高大型模型训练效率,如280M代理模型可使8B参数模型达到基线性能的速度提高2.6倍。项目提供PyTorch实现,包含快速可恢复的数据加载器和下游评估工具。
CodeLlama-34b-hf - 面向代码生成与理解的大型语言模型
Code LlamaGithubHuggingfaceMetaPython代码合成开源项目模型预训练模型
这是一个预训练和微调的语言模型,专注于代码生成和理解,参数规模可达34亿。适用于多样化的代码合成任务,特别针对Python进行了优化。基于Transformer架构,该模型为商业应用和研究提供了安全可靠的支持。
OLMo - 开源语言模型加速科学研究
GithubOLMo人工智能开源语言模型开源项目机器学习自然语言处理
OLMo是一个开源语言模型项目,提供多种规模的先进模型,如1B、7B和7B Twin 2T,全部基于Dolma数据集训练。该项目支持模型训练、微调和推理,提供详细配置和检查点以确保研究可重现。OLMo还包含数据检查和评估工具,为语言模型研究提供全面支持,旨在加速这一领域的科学进展。
OLMo-7B - 专注于语言模型科学的开放模型
GithubHuggingfaceOLMo开源项目模型模型性能训练数据集语言模型
OLMo系列模型由Allen Institute for AI开发,旨在推进语言模型科学。该系列模型使用Dolma数据集进行训练,提供诸如OLMo 7B等多种版本及详细的训练检查点和代码支持。这些模型可用于英文学术研究,并可在Hugging Face平台上获取。项目获得哈佛大学、Databricks、AMD等机构支持,并在MMLU测试中显示出明显的性能提升。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能,包括文生视频、动态画面和形象生成等,帮助用户快速上手,创造专业级内容。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台,用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品,帮助用户探索创意灵感。

Project Cover

讯飞文书

讯飞文书依托讯飞星火大模型,为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能,满足事务性工作的高频需求,帮助撰稿人节省精力,提高效率,优化工作与生活。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号