Project Icon

umberto-wikipedia-uncased-v1

UmBERTo模型专注意大利语NLP任务

UmBERTo Wikipedia Uncased是基于Roberta的意大利语语言模型,利用SentencePiece和Whole Word Masking技术进行训练。该模型展示出在命名实体识别和词性标注任务中的高表现,尤其是在F1和精确度指标上。模型训练于小规模的意大利语Wikipedia语料库,为意大利语应用提供支持。可以在huggingface平台上获取并进行应用测试。

bert-base-uncased - BERT基础版无大小写区分的预训练英语语言模型
BERTGithubHuggingface开源项目文本分类机器学习模型自然语言处理预训练模型
BERT-base-uncased是一个在大规模英语语料上预训练的基础语言模型。该模型不区分大小写,通过掩码语言建模和下一句预测两个目标进行训练,学习了英语的双向语义表示。它可以为序列分类、标记分类、问答等下游任务提供良好的基础,适合进一步微调以适应特定应用场景。
Minerva-350M-base-v1.0 - 意大利和英语数据驱动的开源LLM模型
GithubHuggingfaceMinerva偏见大型语言模型开源项目意大利语模型预训练
Minerva-350M-base-v1.0是一个基于350百万参数的开源语言模型,使用意大利语和英语数据进行训练。这一模型由Sapienza NLP、FAIR及CINECA共同开发,提升双语文本生成。使用时需注意可能存在的偏见与不当内容。
bert-base-portuguese-cased - 为巴西葡萄牙语优化的高性能预训练模型
BERTGithubHuggingface开源项目模型神经网络自然语言处理葡萄牙语预训练模型
BERTimbau是一个专为巴西葡萄牙语开发的预训练BERT模型,在多项自然语言处理任务中表现出色。该模型提供Base和Large两种版本,适用于掩码语言建模和文本嵌入等应用。作为neuralmind团队的开源项目,BERTimbau为葡萄牙语NLP研究和实践提供了有力支持。
robertuito-ner - 基于RoBERTuito的双语命名实体识别模型
GithubHuggingfaceLinCERoBERTuito命名实体识别开源项目机器学习模型模型自然语言处理
robertuito-ner是一个基于RoBERTuito的命名实体识别模型,用于处理西班牙语和英语混合文本。该模型在LinCE NER语料库训练,支持识别人名、地名等实体,在NER任务上达到68.5%的性能指标。通过pysentimiento库集成,可用于社交媒体文本分析和代码切换研究。
maestrale-chat-v0.4-beta - 优化意大利语语言处理的SFT与DPO对齐模型
GithubHuggingfaceMaestrale-chat开源项目微调意大利语模型模型描述语言模型
该模型专注于意大利语处理,基于Mistral-7b模型在大规模高质量语料库上的预训练,并结合了occiglot模型。对170万次对话和指令进行微调后,提升了数学、推理能力和拉丁文翻译能力。适用于多种应用场景,如生成Mermaid思维导图和SQL代码,采用ChatML提示格式。此外,作为Beta版设计,模型具有‘安全性’,能够拒绝有害问题的回答。
bert-large-uncased - 大规模无大小写区分BERT自然语言处理预训练模型
BERTGithubHuggingface开源项目掩码语言模型模型深度学习自然语言处理预训练模型
bert-large-uncased是基于大规模英文语料预训练的自然语言处理模型。通过掩码语言建模和下一句预测任务,模型学习了双向语言表示。它拥有24层结构、1024维隐藏层和16个注意力头,总计336M参数。该模型适用于序列分类、标记分类和问答等下游任务的微调,也可直接用于掩码填充或作为特征提取器。
ukr-roberta-base - 乌克兰文HuggingFace模型的语料库预训练
GithubHuggingFaceHuggingfaceUkrainian Wikipediaukr-roberta-base开源项目模型训练数据语言模型
该项目使用乌克兰语言的多种语料库,并结合HuggingFace的Roberta分词器进行了处理。所使用的语料包括乌克兰维基百科、OSCAR数据集及社交网络样本。通过V100硬件加速的方法,预训练出与roberta-base-cased架构类似的模型,拥有12层、768个隐藏单元和125M参数。有关详细的训练配置和技术细节,请参阅原始项目。
herbert-base-cased - 波兰语自然语言处理的新突破:HerBERT预训练模型
GithubHerBERTHuggingface开源项目模型波兰语模型深度学习自然语言处理预训练语言模型
HerBERT是一款专为波兰语设计的预训练语言模型,基于BERT架构并结合掩码语言建模和句子结构目标进行优化。该模型在六大波兰语语料库上训练,涵盖超过86亿个标记,采用50k词汇量的字符级字节对编码分词器。HerBERT为波兰语自然语言处理研究和应用提供了坚实基础,可广泛应用于文本分类、命名实体识别等多种任务。
bertin-roberta-base-spanish - 创新抽样技术实现高效西班牙语模型训练
BERTINGithubHuggingfaceRoBERTa开源项目机器学习模型自然语言处理西班牙语
BERTIN项目采用创新的抽样技术从mC4数据集中提取高质量西班牙语语料,实现了以更少的步骤和数据量训练RoBERTa模型。该方法不仅提高了训练效率,还使模型在某些任务上超越了现有的最先进水平,为小团队在有限资源下开发大型语言模型提供了新思路。
bert_uncased_L-2_H-512_A-8 - 小型BERT模型在资源受限环境中的表现及应用策略
BERTGLUEGithubHuggingface开源项目模型模型训练知识蒸馏计算资源
24款小型BERT模型在低计算资源环境中通过知识蒸馏实现有效性能,支持与BERT-Base和BERT-Large相同的微调模式。这些模型为中小型机构的研究提供了创新支持,尤其是在GLUE测试中通过优化批大小和学习率等微调参数。这些模型为探索非传统扩容的创新应用提供了可能性。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号