Project Icon

bloom-1b1

BigScience开发的开源多语言预训练模型

BLOOM是BigScience开发的开源多语言预训练模型,支持45种自然语言和12种编程语言。模型基于Transformer架构,拥有1760亿参数,在3500亿词元上训练。主要用于文本生成和自然语言处理研究,具备多语言理解与生成能力。项目提供完整模型卡,详述技术规格、应用场景及使用限制。

Baichuan-13B - 包含130亿参数和出色Benchmark性能的大规模开源语言模型
Baichuan-13BGithub对齐模型开源模型开源项目百川智能量化版本
Baichuan-13B是一个包含130亿参数的开源模型,支持中英双语,并在多项Benchmark测试中表现优异。它具有更大的参数量和数据规模,更高效的推理能力,且完全免费商业使用。通过简单的代码即可部署,量化版本大大降低了部署门槛,广泛适用于学术研究和商业应用。
SOLAR-10.7B-v1.0 - 深度扩展技术驱动的大语言模型实现超30B参数级性能
GithubHuggingfaceSOLAR-10.7B人工智能大模型开源项目模型深度学习语言模型
SOLAR-10.7B采用深度扩展(DUS)技术开发,通过整合Mistral 7B权重和持续预训练,实现10.7B参数达到30B级模型性能。在H6评测中得分74.20,高于Mixtral-8x7B等大型模型。模型以Apache-2.0许可开源发布,提供完整预训练版本。
Orion-14B-Base - 卓越的多语言处理和长文本理解能力
GithubHuggingfaceOrion-14B多语言模型大语言模型开源项目模型模型下载模型评估
Orion-14B是OrionStarAI开发的开源多语言大语言模型系列。该系列在2.5T多语言语料上训练,包含基础模型、对话模型和长文本模型等多个版本。Orion-14B展现出卓越的多语言处理能力,尤其在中英日韩等语言上表现突出。此外,它还具备出色的长文本理解和高效的量化推理能力。在多项权威基准测试中,Orion-14B系列模型均展现出优异的综合性能。
SmolLM-360M - 3.6亿参数的高效语言模型 专注常识推理和知识理解
GithubHuggingfaceSmolLM人工智能开源项目模型模型训练神经网络语言模型
SmolLM-360M是一款拥有3.6亿参数的高效语言模型,基于Cosmo-Corpus数据集训练而成。该模型利用Cosmopedia v2合成教材、Python-Edu教育样本和FineWeb-Edu网络教育资源等高质量数据,在常识推理和世界知识等多项基准测试中表现出色。SmolLM-360M支持CPU/GPU部署,并提供8位和4位量化版本以优化内存使用。这款模型主要面向英语内容生成和理解,可作为AI辅助工具在多种场景中应用。
bigbird-roberta-base - 高性能长序列文本处理的稀疏注意力Transformer模型
BigBirdGithubHuggingfacetransformer模型开源项目模型深度学习自然语言处理长序列处理
BigBird-RoBERTa-base是一种基于块稀疏注意力机制的Transformer模型,可处理长达4096个token的序列。该模型在Books、CC-News、Stories和Wikipedia等大规模数据集上预训练,大幅降低了计算成本。在长文档摘要和长上下文问答等任务中,BigBird-RoBERTa-base展现出优秀性能。模型支持灵活配置注意力类型,可在默认的块稀疏模式和全注意力模式间切换,为超长序列文本处理提供了高效方案。
bart-large - 用于自然语言生成和理解的预训练序列到序列模型
BARTGithubHuggingfaceseq2seq开源项目文本生成模型自然语言处理预训练模型
BART是基于Transformer架构的预训练语言模型,结合了双向编码器和自回归解码器。通过去噪任务预训练,BART在文本生成(如摘要、翻译)和理解任务(如分类、问答)中均表现优异。该模型适用于多种自然语言处理任务,尤其在有监督数据集上进行微调后效果显著。BART为研究人员和开发者提供了强大的工具,推动了自然语言处理技术的发展。
BELLE - 推动中文大语言模型的开源发展与指令微调
BELLEGithub中文优化大语言模型开源社区开源项目指令微调
BELLE项目致力于推动中文对话大模型的开源发展,重点关注如何利用开源预训练大语言模型构建具有指令理解能力的个性化语言模型。该项目持续公开指令训练数据、模型、训练代码和应用场景,同时评估不同训练数据和算法对模型性能的影响。BELLE专门针对中文进行优化,仅采用ChatGPT生成的数据进行模型调优,不包含其他来源的数据。
Yi-34B-200K - 开源双语大模型 提升长文本理解能力
GithubHuggingfaceTransformerYi双语大语言模型开源开源项目模型
Yi-34B-200K是开源的双语大语言模型,专注于提升长文本理解。通过在长时间上下文数据上训练5亿个token,Yi-34B-200K的『寻针与草垛』测试表现从89.3%提高到99.8%。其独特的数据集和高效的训练管道,使Yi系列在语言理解、常识推理和阅读理解方面表现优异,超过其他开源模型。该模型适用于个人、学术和中小企业,性价比较高。
h2o-danube3-500m-base - 500M参数的大规模语言模型,支持离线文本生成
GPTGithubH2O.aiHuggingface大语言模型开源项目模型模型架构转化器
由H2O.ai推出的h2o-danube3-500m模型,是一个大规模语言模型,采用Llama 2架构调整及500M参数设计。模型支持原生离线运行,尤其适用于手机设备,并集成Mistral分词器,拥有32,000词汇量及8,192长度的上下文生成能力。在支持transformers库的环境中,模型可在GPU设备上有效运行,并且支持量化和多GPU分片处理。重要提醒用户在使用模型生成的内容时保持审慎态度并自行承担责任。
xmtf - 通过多任务微调提升跨语言泛化能力
BLOOMZGithubmT0xP3多任务微调开源项目跨语言泛化
XMTF项目探索了通过多语言多任务微调来增强模型的跨语言泛化能力。研究者基于BLOOM和mT5模型,使用xP3数据集进行微调,开发了BLOOMZ和mT0系列模型。这些模型在46种语言的13个任务上接受训练,展现出显著的跨语言和跨任务迁移学习能力。项目公开了完整的数据处理流程、模型训练方法和评估体系,为自然语言处理领域的跨语言研究提供了重要参考。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

稿定AI

稿定设计 是一个多功能的在线设计和创意平台,提供广泛的设计工具和资源,以满足不同用户的需求。从专业的图形设计师到普通用户,无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑,稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合,帮助用户轻松实现创意设计。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号