Project Icon

bert4ner-base-chinese

基于BERT的中文命名实体识别模型,具备高精度性能

bert4ner-base-chinese项目是一个基于BERT的中文命名实体识别模型,在人民日报数据集上取得了高精度表现。通过BertSoftmax网络结构,能够准确识别文本中的人名、时间等实体信息。可通过nerpy库调用该模型,也支持无外部依赖的直接调用方式,适用于各种自然语言处理应用。

UniNER-7B-all - 跨多数据集的命名实体识别开源模型
GithubHuggingfaceUniNER命名实体识别大模型开源项目模型研究自然语言处理
UniNER-7B-all模型结合ChatGPT生成的Pile-NER-type和Pile-NER-definition数据及Universal NER基准中40个数据集进行训练,适合多数据集的命名实体识别研究。模型在排除CrossNER和MIT数据集的情况下进行OOD评估。详细的使用指南和模型信息可以通过相关论文及GitHub仓库获得,模型适用于研究目的,遵循CC BY-NC 4.0许可协议。
chinese-bert-wwm-ext - 全词掩码中文BERT模型加速自然语言处理
BERTGithubHuggingface中文处理全词掩码开源项目模型自然语言处理预训练模型
chinese-bert-wwm-ext是一个开源的全词掩码中文BERT预训练模型,致力于提高中文自然语言处理效率。该模型由哈工大讯飞联合实验室开发,通过全词掩码技术增强了对中文语境的理解。项目开放了预训练模型和相关资源,可应用于文本分类、情感分析、问答系统等多种中文NLP任务。研究人员可基于此模型进行定制化微调,以满足特定领域的应用需求。
gliner_medium-v2.1 - 多功能通用型命名实体识别模型GLiNER
GLiNERGithubHuggingface人工智能命名实体识别开源项目机器学习模型自然语言处理
GLiNER是一种基于双向Transformer编码器的命名实体识别模型,可识别任意类型的实体。该模型为资源受限场景提供了实用的替代方案,克服了传统NER模型仅限预定义实体的局限性,同时避免了大型语言模型的高成本问题。GLiNER支持多语言,提供不同规模的版本,安装使用简便。在NER基准测试中表现优异,适用于多种应用场景。
chinese-macbert-base - 通过MLM误差校正任务优化中文BERT模型的性能
GithubHuggingfaceMacBERT句子排序预测开源项目掩码语言模型模型自然语言处理预训练模型
项目通过引入MLM误差校正预训练任务,减少预训练和微调过程中的差异,提升中文自然语言处理的模型表现。采用同义词工具进行相似词替换,改进传统BERT的[MASK]标记。此外,还结合全词掩码、N-gram掩码和句序预测技术,增强模型功能。MacBERT的架构与原始BERT兼容,为研究人员提供灵活的替换方案。
distilcamembert-base-ner - 法语命名实体识别模型,推理时间减半
CamemBERTDistilCamemBERT-NERGithubHuggingface实体识别开源项目模型模型优化法语
DistilCamemBERT-NER针对法语命名实体识别进行微调,与CamemBERT相比推理时间缩短一半但能耗保持不变。采用wikiner_fr数据集,综合F1得分达98.18%。在PER、LOC、ORG类别上,性能优于多语种与Flair法语模型,提供高效的文本处理解决方案。
bert4torch - 基于PyTorch开发的自然语言处理工具
Githubbert4torch功能开源项目快速上手模型预训练权重
bert4torch是一个基于PyTorch开发的自然语言处理工具。支持包括BERT、RoBERTa、GPT在内的多种预训练模型,适用于广泛NLP任务。提供丰富示例及详尽文档,助力快速实施项目。特包高级功能如大模型推理,极致满足专业需求,是NLP领域的首选工具库。
bert_uncased_L-4_H-512_A-8 - BERT小型模型为资源受限环境提供高效自然语言处理解决方案
BERTGLUEGithubHuggingface开源项目模型模型压缩知识蒸馏自然语言处理
BERT小型模型是为计算资源受限环境设计的自然语言处理工具。它保留了标准BERT架构和训练目标,但模型规模更小,适用于多种应用场景。这种模型在知识蒸馏中表现出色,可利用更大、更精确的模型生成微调标签。其目标是促进资源有限机构的研究工作,并鼓励学术界探索模型创新的新方向,而非仅仅增加模型容量。
xlm-roberta-large-ner-spanish - 基于XLM-Roberta-large的高性能西班牙语命名实体识别模型
CoNLL-2002GithubHuggingfaceXLM-RoBERTa命名实体识别开源项目模型自然语言处理西班牙语
xlm-roberta-large-ner-spanish是一个基于XLM-Roberta-large模型微调的西班牙语命名实体识别(NER)模型。该模型在CoNLL-2002数据集的西班牙语部分上训练,在测试集上实现了89.17的F1分数,展现出优秀的性能。此模型能够有效识别文本中的人名、地名、组织机构等命名实体,为西班牙语自然语言处理任务提供了有力工具。
Few-NERD - 大规模精细标注的命名实体识别数据集
BERTFew-NERDGithubfew-shot实体识别开源项目监督学习
Few-NERD是一个大规模精细标注的命名实体识别数据集,包含8种粗粒度类型、66种细粒度类型、188,200个句子、491,711个实体和4,601,223个标记。支持监督学习和少样本学习的三种基准任务。了解数据集的关键功能、最新更新,以及如何获取数据和运行模型的详细指南。
BertWithPretrained - 基于PyTorch实现的BERT模型及相关下游任务
BERTGithubPyTorchTransformer中文文本分类开源项目英文文本分类
该项目基于PyTorch实现了BERT模型及其相关下游任务,详细解释了BERT模型和每个任务的原理。项目支持分类、翻译、成对句子分类、多项选择、问答和命名实体识别等任务,涵盖中文和英语的自然语言处理。此外,项目还含有丰富的数据集和预训练模型配置文件。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号