small-e-czech-finetuned-ner-wikiann

捷克语命名实体识别模型精细化

数据集 Github 开源项目 small-e-czech-finetuned-ner-wikiann 训练精度 Huggingface 模型

这是一个基于Seznam/small-e-czech的微调模型，专用于wikiann数据集的捷克语命名实体识别。模型在精度、召回率和F1分数上分别达到0.8713、0.8970和0.8840，总体准确率为0.9557。项目采用Transformer、PyTorch等技术框架，使用线性学习率调度器，经过20个epoch的训练。适合需要捷克语文本命名实体识别的开发者和研究人员使用。

Huggingface

介绍相关项目

entity-recognition-datasets - 多领域实体识别和命名实体识别任务数据集

AnnotationsDatasetsEntity RecognitionGithubNERNamed Entity Recognition开源项目

此库包含多个领域的实体识别和命名实体识别（NER）任务数据集，包括新闻、社交媒体、医学等。项目提供数据目录和转换代码，部分数据因许可证限制无法直接共享。虽然自2020年起更新较少，但仍接受通过issue或pull request添加的数据集，并支持多种语言的NER数据，如德语、西班牙语和荷兰语等。

MiniCPM - 轻量级大语言模型实现高性能端侧部署

GithubMiniCPM多模态开源模型开源项目模型量化端侧大语言模型

MiniCPM是一系列高效的端侧大语言模型，仅有2.4B非词嵌入参数。经过优化后，在多项评测中表现优异，甚至超越了一些参数量更大的模型。该项目支持多模态功能，可在移动设备上流畅运行。MiniCPM开源了多个版本，涵盖文本、多模态、量化和长文本等应用场景，适用于学术研究和特定商业用途。这一开源项目由面壁智能与清华大学自然语言处理实验室联合开发。

llm-toys - 微调小型语言模型实现多任务处理

Githubllm-toys任务微调低资源模型对话摘要开源项目语气变化

llm-toys 项目提供适用于释义、语气转换、对话总结和主题生成等任务的小型量化3B和7B语言模型。这些经过微调的模型能在普通消费级硬件上高效运行，并通过简单的安装步骤提升文本处理和生成能力。

ESFT - 专家专门化微调提升稀疏大语言模型性能

ESFTGithub专家混合大语言模型开源项目效率提升模型微调

ESFT项目提出专家专门化微调方法，针对Mixture-of-Experts架构的大语言模型进行高效定制。通过仅调整任务相关部分，该方法提高了模型效率和性能，同时降低资源消耗。项目开源了训练代码和评估脚本，方便研究人员应用于自有模型和数据集。这一技术为大规模语言模型的个性化和优化提供了新思路。

DeepSeek-MoE - 创新MoE架构打造高效大规模语言模型

DeepSeekMoEGithubMoE架构大语言模型开源模型开源项目模型评估

DeepSeek-MoE项目开发了创新的混合专家架构语言模型，采用细粒度专家分割和共享专家隔离策略。该16.4B参数模型仅使用40%计算量就达到DeepSeek 7B和LLaMA2 7B的性能水平。模型可在单个40GB内存GPU上直接部署运行，无需量化，为学术和商业研究提供了高效便捷的工具。

TransnormerLLM - 使用线性注意力机制的大规模语言模型

GithubTransNormerLLM大语言模型开源项目模型权重线性注意力机制高质量语料库

TransNormerLLM是一种高效的大规模语言模型，使用线性注意力机制，优于传统的软注意力模型。该模型训练于高质量语料库，包含1.4万亿个词元，支持中文、英语和多语言基准测试，在多领域表现出色。提供385M、1B和7B参数版本，开放给学术研究，商用需申请许可。

EasyNLP - 综合性易用的NLP工具包，支持大规模预训练模型

EasyNLPGithubNLP工具包分布式训练多模态预训练模型开源项目知识蒸馏

EasyNLP是一个由阿里巴巴发布的自然语言处理工具包，基于PyTorch架构，支持分布式训练和多种NLP算法。它结合知识蒸馏和少样本学习技术，支持大规模预训练模型的部署，并支持CLIP和DALLE等多模态预训练模型，与阿里云PAI平台无缝集成，提供统一的模型训练和部署框架，广泛应用于多个业务场景。

fine-tune-mistral - Mistral大语言模型全量微调开源项目

GithubHugging FaceMistral开源项目微调模型训练深度学习

fine-tune-mistral是一个专注于Mistral 7B大语言模型全量微调的开源项目。项目提供完整训练代码和使用说明，支持多GPU训练。其中包含多项训练技巧，如学习率调整和数据量建议等。项目还强调通过评估任务来衡量模型性能改进。该工具为研究者提供了一个进行Mistral模型定制化的便捷平台。

DeepSeek-V2 - 兼顾效率与经济性的大规模混合专家语言模型

DeepSeek-V2Github大语言模型开源项目混合专家模型自然语言处理预训练模型

DeepSeek-V2是一款基于专家混合(MoE)架构的大规模语言模型,总参数量达2360亿,每个token激活210亿参数。相较于DeepSeek 67B,该模型在提升性能的同时,显著降低了训练成本和推理资源消耗。DeepSeek-V2在多项标准基准测试和开放式生成任务中表现优异,展现了其在多领域的应用潜力。

GLiNER - 通用轻量级命名实体识别模型

BERTGLiNERGithub命名实体识别开源项目机器学习自然语言处理

GLiNER是一个通用轻量级的命名实体识别模型,采用双向转换器编码器架构。它能识别任意类型的实体,填补了传统NER模型和大型语言模型之间的空白。GLiNER具有灵活性高、体积小、效率高的特点,适用于资源受限的场景。该模型支持自定义实体类型,可应用于信息提取、文本分类等多种自然语言处理任务。

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具，简化了选题、文献检索至论文撰写的整个过程。通过简单设定，平台可快速生成高质量论文大纲和全文，配合图表、参考文献等一应俱全，同时提供开题报告和答辩PPT等增值服务，保障数据安全，有效提升写作效率和论文质量。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号