granite-guardian-hap-38m

IBM开源轻量级文本毒性检测模型实现大语言模型安全防护

模型分类 RoBERTa 性能优化 Huggingface 开源项目模型文本检测 Github 内容审核

Granite-Guardian-HAP-38m是一个用于检测英文文本有害内容的轻量级二分类模型。通过4层神经网络架构设计，模型参数量仅为3800万，较RoBERTa模型显著缩减规模。该模型支持CPU部署运行，具备低延迟推理能力，适用于大语言模型的安全防护以及批量文本处理场景。实测显示，模型在维持分类准确率的同时达到了理想的性能指标。

Github

Huggingface

介绍相关项目

gte-large-en-v1.5 - 英语语义相似度模型用于文本分类和检索

GithubHuggingfacegte-large-en-v1.5分类开源项目情感分析检索模型聚类

gte-large-en-v1.5是一个英语语义相似度模型,在MTEB基准测试中表现优异。该模型在文本分类、检索和聚类等任务上成绩突出,尤其适用于亚马逊评论分类和问答检索等场景。基于Sentence-Transformers框架开发,gte-large-en-v1.5可应用于多种自然语言处理任务,为文本表示提供了有力支持。

twitter-spam-classifier - 基于特斯拉推文的AutoTrain Twitter内容过滤模型

AutoTrainGithubHuggingfaceTesla垃圾推文过滤开源项目文本分类模型模型评估指标

该项目是一个利用AutoTrain训练的文本分类模型，旨在过滤Twitter上与特斯拉相关的不当内容。模型能识别包含恶意攻击、不当语言和极端政治观点的推文。在验证测试中，模型表现优异，F1值为0.81，准确率达78.3%。这为社交媒体内容管理提供了一个有效的自动化解决方案。

roberta-large - 大型英语预训练模型，适合多种任务优化

GithubHuggingfaceRoBERTaTransformer模型开源项目模型语言模型遮蔽语言建模预训练模型

RoBERTa是一个自监督学习的变压器模型，通过掩码语言建模（MLM）目标优化英语语言的表示。主要用于细调下游任务，如序列和标记分类以及问答。此模型预训练于包括BookCorpus和Wikipedia在内的五个大型语料库，使用BPE分词法和动态掩码训练，实现双向句子表示，并在GLUE测试中表现优异，适合在PyTorch和TensorFlow中应用。

optimized-gpt2-1b - GPT-2架构优化模型提供高效可扩展的自然语言处理功能

GithubHuggingfacetransformers人工智能开源项目机器学习模型模型卡自然语言处理

optimized-gpt2-1b是一个基于GPT-2架构优化的大规模语言模型。该模型在保持GPT-2性能的基础上，通过架构和训练方法的优化提高了效率和可扩展性。它可应用于文本生成、摘要和问答等多种自然语言处理任务。模型支持直接使用或针对特定需求进行微调。项目提供了使用说明和评估结果，有助于研究人员和开发者更好地理解和应用这一语言模型。

VulBERTa-MLP-Devign - 基于深度学习的源代码安全漏洞检测模型

GithubHuggingfaceVulBERTa代码漏洞检测开源项目模型深度学习自然语言处理预训练模型

VulBERTa-MLP-Devign是一种先进的深度学习模型，专门用于检测源代码中的安全漏洞。该模型采用RoBERTa架构和自定义分词流程，通过预训练真实的C/C++项目代码来学习深层次的语法和语义知识表示。在多个数据集的评估中，VulBERTa-MLP-Devign在二进制和多类漏洞检测任务上展现出卓越性能。凭借其简洁的设计理念、较小的训练数据需求和精简的模型参数，该模型为代码安全分析领域提供了一个高效而强大的工具。

detoxify - 基于Pytorch Lightning和Transformers的多语言有害评论分类模型

DetoxifyGithubJigsawMultilingualPytorch LightningToxic Comment ClassificationTransformersUnintended Bias in Toxicity Classification开源项目

Detoxify项目利用Pytorch Lightning和Transformers构建模型，识别和分类包含威胁、辱骂和身份攻击的有害评论。这些模型支持多语言操作，致力于减少无意中的偏见。项目在多次Jigsaw挑战赛中表现出色，提供高效的有害内容检测方案，适合用于研究和内容审核工作，帮助更快速地标记有害内容和提高用户体验。

gemma-2b-it - Google开源轻量级语言模型适用于资源受限环境

GemmaGithubHuggingface人工智能大型语言模型开源项目机器学习模型自然语言处理

Gemma-2b-it是Google开源的轻量级指令调优语言模型,采用2B参数设计。该模型支持问答、摘要和推理等多种文本生成任务,适用于笔记本电脑等资源受限环境。Gemma-2b-it在英语环境下表现出色,开放权重为AI创新提供更多可能。该模型基于Gemini技术,是Google推动AI民主化的重要举措。

bge-small-en-v1.5 - 轻量级高性能英语句子嵌入模型

GithubHuggingfacesentence-transformers开源项目文本分类模型聚类自然语言处理语义相似度

BGE-small-en-v1.5是一款轻量级英语句子嵌入模型，在文本分类、检索、聚类和语义相似度等多项NLP任务中表现出色。该模型在MTEB基准测试中展现了优异性能，同时保持了较小的模型规模，适合需要高效句子向量化的应用场景。模型在MTEB评估中的多项任务上表现突出，包括亚马逊评论分类、ArguAna论点检索和BIOSSES生物医学语义相似度等，为各类NLP应用提供了高效的句子向量化解决方案。

MiniCPM3-4B - 轻量高效的开源模型支持长文本处理和函数调用

GithubHuggingfaceMiniCPM3人工智能大语言模型开源模型开源项目机器学习模型

MiniCPM3-4B是一款开源语言模型，仅用4B参数就达到了接近GPT-3.5-Turbo的性能。它具备32k上下文窗口、函数调用和代码解释器等功能，在中英双语、数学和编程等多个基准测试中表现出色。通过创新的训练策略，MiniCPM3-4B实现了与7B-9B模型相当的能力，为资源受限的AI应用场景提供了高效选择。

Content Guardian - AI内容检测平台集成多种工具实现一键式多重验证

AI内容检测AI工具WordPress集成内容分析内容原创性多引擎检测

Content Guardian整合8种主流AI内容检测工具，实现一键式多重验证。平台可识别各类AI生成内容，服务对象包括作家、数字出版商和教育机构。它提供WordPress插件、网页应用和详细分析功能，便于内容管理和优化。该平台致力于提升内容原创性和真实性，增强内容人工创作的可信度。

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

Project Cover

稿定AI

稿定设计是一个多功能的在线设计和创意平台，提供广泛的设计工具和资源，以满足不同用户的需求。从专业的图形设计师到普通用户，无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑，稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合，帮助用户轻松实现创意设计。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号