Project Icon

pythia-70m-deduped

促进语言模型可解释性的研究工具

Pythia-70m-deduped是Pythia模型套件中的一个7000万参数的语言模型,由EleutherAI开发。该模型在去重的Pile数据集上训练,提供154个训练检查点,便于研究模型在不同阶段的行为。尽管主要用于可解释性研究,Pythia-70m-deduped在下游任务上的表现也与同等规模模型相当。基于Transformer架构,这个模型为语言建模实验和分析提供了理想的研究平台。

t5-3b - 统一多语言自然语言处理任务的创新模型
GithubHuggingfaceT5-3B多任务学习开源项目文本到文本转换模型自然语言处理预训练模型
T5-3B是一个拥有30亿参数的多语言自然语言处理模型。它采用创新的文本到文本框架,统一处理机器翻译、文档摘要、问答和分类等多种NLP任务。该模型在C4语料库上预训练,并在24个任务中进行评估,展现出优秀的多语言和多任务处理能力。T5-3B为NLP领域的迁移学习研究提供了新的思路和可能性。
gpt-j-6b - 基于The Pile数据集训练的60亿参数大规模语言模型
EleutherAIGPT-J 6BGithubHuggingfacetransformer开源项目模型自然语言处理语言模型
GPT-J 6B是EleutherAI团队开发的60亿参数大规模语言模型,基于The Pile数据集训练。模型采用Mesh Transformer JAX架构,包含28层和4096维度结构。在多项自然语言处理任务中表现优异,但存在产生不当内容的风险。主要用途为文本生成,不适合直接部署于用户应用,需要人工审核和监督。
phi3-Chinese - 小体积高性能的phi3模型集合
GithubHugging FaceModelScopephi3phi3-mini开源项目训练变体
phi3-Chinese收录多种phi3训练变体,小体积高性能,适用于手机部署。提供Phi-3-mini-128k-instruct-Chinese中文版和其他英文原版模型的下载链接,并包含训练、推理和部署的详细教程。尽管目前版本存在词表过小和实际效果与预期不符的问题,但仍适用于轻量级垂直任务。
LLM-PowerHouse-A-Curated-Guide-for-Large-Language-Models-with-Custom-Training-and-Inferencing - 大型语言模型的定制训练和推理指南
GithubLLM PowerHousePython开源项目机器学习深度学习自然语言处理
LLM-PowerHouse项目为开发人员、研究人员和爱好者提供一站式指南,通过定制化训练和推理优化大型语言模型(LLMs)。包括基础知识、先进技术、模型压缩、优化策略和实例代码,适用于高效智能的自然语言理解应用。
stablelm-3b-4e1t - StableLM开源语言模型在1万亿token数据上训练达到30亿参数规模
GithubHuggingfaceStableLM-3B-4E1T人工智能大语言模型开源模型开源项目文本生成模型
StableLM-3B-4E1T是一个开源语言模型,通过在Falcon RefinedWeb和RedPajama-Data等数据集上训练4轮获得,总计处理1万亿tokens数据。模型采用LayerNorm归一化和Rotary位置编码技术,支持Flash Attention 2优化。在HellaSwag和Winogrande任务评测中分别达到75.94%和71.19%的准确率,展现出良好的语言理解能力。
dolly-v2-12b - Databricks开源商用语言模型
GithubHuggingfacedolly-v2-12b大语言模型开源项目性能限制指令调优数据集模型
dolly-v2-12b由Databricks开发,基于Pythia-12b构建,是一款为商业用途优化的大规模指令遵循语言模型。通过15000条指令/响应数据库微调,展示其在多领域应用中的潜力,如信息提取和问答系统。同时,提供更小的dolly-v2-7b和dolly-v2-3b版本以适应不同需求。
opt-6.7b - Meta AI推出开源预训练语言模型促进AI研究
GithubHuggingfaceOPT人工智能开源项目文本生成模型语言模型预训练
OPT-6.7B是Meta AI推出的开源预训练语言模型,采用因果语言建模方法训练。该模型具有67亿参数,在800GB多样化数据集上训练,性能接近GPT-3。OPT-6.7B可用于文本生成和下游任务微调,旨在促进大型语言模型的可重复研究,让更多研究者参与探讨语言模型的影响。
colab - 开源自然语言处理库
GithubHuggingfaceTransformers人工智能开源项目机器学习模型深度学习自然语言处理
Transformers是一个开源的自然语言处理库,提供预训练模型和工具。支持文本分类、问答等多种NLP任务,适用于研究和实际应用。库定期更新,集成新技术,为开发者和研究人员提供丰富资源。
GPT-2 - 开源语言模型训练与实现探索
GPT-2Github代码复现开源项目数据预处理模型架构训练循环
本项目是基于Andrej Karpathy代码的GPT-2开源实现。通过详细注释解释模型架构和训练过程,包含核心文件如模型结构、训练循环和数据预处理。计划添加KV-Cache、RoPE等功能。虽然Hellaswag测试性能略低,但为学习大型语言模型提供了重要资源。项目展示了模型训练过程中的各种考虑因素,如权重初始化、学习率调整等技术细节。
Nous-Hermes-llama-2-7b - 高效精调语言模型Nous-Hermes的特性与使用
GithubHuggingfaceNous-Hermes-Llama2-7bRedmond AI合成数据开源项目数据集模型模板格式
Nous-Hermes-Llama2-7b是由Nous Research精调的语言模型,基于GPT-4合成输出训练,具有处理长响应和减少幻觉的能力。该模型不受OpenAI审查机制影响,具备高精度的任务完成能力。数据集由Teknium及其他合作者提供,包括GPTeacher和CodeAlpaca。训练在高性能DGX机器上进行,确保模型的一致性和先进性,适用于文本生成及复杂指令理解等多种任务。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能,包括文生视频、动态画面和形象生成等,帮助用户快速上手,创造专业级内容。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台,用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品,帮助用户探索创意灵感。

Project Cover

讯飞文书

讯飞文书依托讯飞星火大模型,为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能,满足事务性工作的高频需求,帮助撰稿人节省精力,提高效率,优化工作与生活。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号