Project Icon

opt-2.7b

Meta AI开发的开放预训练Transformer语言模型

OPT是Meta AI开发的开放预训练Transformer语言模型系列,参数规模125M至175B。采用先进数据收集和训练方法,性能与GPT-3相当。旨在促进大规模语言模型的可重复研究,扩大研究群体。主要基于英语语料预训练,使用因果语言建模,适用于文本生成和下游任务微调。OPT开放了完整模型访问权限,有助于研究大语言模型的工作原理、影响及相关挑战。

gpt-neox-20b - EleutherAI开发的大规模开源语言模型
GPT-NeoX-20BGithubHuggingface人工智能大规模语言模型开源项目机器学习模型自然语言处理
GPT-NeoX-20B是EleutherAI开发的200亿参数大规模语言模型。模型基于The Pile数据集训练,采用与GPT-3相似的架构,包含44层Transformer结构。作为研究导向的开源模型,支持下游任务开发和模型微调,但仅限于英语语言处理,且未经过人类反馈优化,不适合直接用于产品部署。
GPT2 - PyTorch优化实现的自然语言生成模型
GPT-2GithubPyTorch开源项目文本生成深度学习自然语言处理
该项目是OpenAI GPT-2模型的PyTorch实现,提供模型训练、文本生成和指标可视化功能。代码设计兼顾可读性和性能优化,支持多GPU训练、自动混合精度和梯度检查点等特性。项目提供详细的命令行使用说明,并可在Google Colab中进行交互式文本生成和模型评估。
OpenGPT - 开发者友好的自然语言处理API集成
APIGithubOpenGPT人工智能模型开发者开源项目自然语言处理
OpenGPT 3.5/4 提供开发者友好的API,使自然语言处理功能易于集成。简单且不复杂的使用步骤,让开发者能快速应用GPT技术,增强其应用程序的功能。该项目让每个人都能免费获取人工智能模型,并为开发者提供便捷的接口和示例代码。欢迎贡献,推进AI技术的边界。
Sophia - 随机二阶优化器提升语言模型预训练效率
GithubSophia优化器开源项目机器学习语言模型预训练
Sophia是一种为大规模语言模型预训练设计的随机二阶优化器。它通过支持更大学习率,提高了训练速度和模型性能。该项目提供Sophia-G优化器的实现,包含超参数调优指南和GPT-2训练脚本,方便研究人员应用这一优化技术。Sophia适用于GPT-2等不同规模的模型,展现了良好的扩展性。
gpt-2-tensorflow2.0 - 在Tensorflow 2.0中实现的GPT-2模型预训练与文本生成
GPT-2GithubOpenAitensorflow开源项目文本生成模型预训练
该项目实现了OpenAi GPT-2模型在Tensorflow 2.0中的预训练和序列生成,并提供详细的设置和训练指南。用户可以使用示例数据进行预训练或下载OpenWebText数据进行训练。支持多GPU分布式训练,并提供命令行接口和TensorBoard集成,帮助高效地进行模型训练和优化。项目遵循MIT许可证,社区贡献和改进热烈欢迎。
other - 高性能开源自然语言处理框架
GithubHuggingfacetransformers人工智能开源项目机器学习模型深度学习自然语言处理
Transformers是一个开源的自然语言处理框架,提供多种预训练模型和工具。支持文本分类、问答和生成等任务,适用于研究和生产环境。该框架易用且灵活,可处理多语言文本,支持迁移学习。Transformers定期更新,紧跟NLP领域最新进展,为用户提供丰富的API和优化的性能。
OPT-6B-nerys-v2 - 基于多样数据集训练的文本生成模型
GithubHuggingfaceOPT 6B-Nerys偏见与局限开源项目文本生成模型训练数据许可证
OPT 6B-Nerys在Facebook的OPT模型基础上进行了微调,训练数据涵盖多类型电子书、CYOA数据集及数十部亚洲轻小说,标识为[Genre: <genre1>, <genre2>]格式。支持通过文本生成管道直接使用,适用于多种生成任务。需注意可能存在性别、职业、种族和宗教偏见,由OPT-175B许可协议保护。
OLMo - 开源语言模型加速科学研究
GithubOLMo人工智能开源语言模型开源项目机器学习自然语言处理
OLMo是一个开源语言模型项目,提供多种规模的先进模型,如1B、7B和7B Twin 2T,全部基于Dolma数据集训练。该项目支持模型训练、微调和推理,提供详细配置和检查点以确保研究可重现。OLMo还包含数据检查和评估工具,为语言模型研究提供全面支持,旨在加速这一领域的科学进展。
OLMo-1B-hf - 结合开放性与多功能性提升语言模型科学
Dolma数据集GithubHuggingfaceOLMoTransformer开放语言模型开源项目模型语言模型
OLMo是一个由Allen Institute for AI开发的开源语言模型,支持Hugging Face Transformers格式和Dolma数据集,具有自回归Transformer架构,适合多种语言处理任务,涵盖完整训练代码和检查点。
gpt2-xl - OpenAI开发的15亿参数GPT-2 XL语言模型
GPT-2GithubHuggingfaceOpenAI开源项目模型深度学习自然语言处理预训练模型
GPT-2 XL是OpenAI开发的大规模transformer语言模型,拥有15亿参数。该模型在大规模英语语料库上预训练,可用于文本生成、写作辅助和创意写作等多种任务。尽管具有强大的语言理解能力,但GPT-2 XL也存在潜在偏见和误用风险。研究人员可利用它探索大型语言模型的行为、能力和局限性。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号