granite-guardian-hap-38m

IBM开源轻量级文本毒性检测模型实现大语言模型安全防护

模型分类 RoBERTa 性能优化 Huggingface 开源项目模型文本检测 Github 内容审核

Granite-Guardian-HAP-38m是一个用于检测英文文本有害内容的轻量级二分类模型。通过4层神经网络架构设计，模型参数量仅为3800万，较RoBERTa模型显著缩减规模。该模型支持CPU部署运行，具备低延迟推理能力，适用于大语言模型的安全防护以及批量文本处理场景。实测显示，模型在维持分类准确率的同时达到了理想的性能指标。

Github

Huggingface

介绍相关项目

twitter-roberta-base-offensive - 基于roBERTa的推特攻击性语言识别模型

GithubHuggingfaceroBERTa开源项目情感分析推特数据文本分类模型自然语言处理

这是一个基于roBERTa-base的模型，通过5800万条推文训练并使用TweetEval基准进行微调，专门用于识别攻击性语言。该模型能对文本进行预处理和分类，区分攻击性和非攻击性内容。它采用了自然语言处理技术，可作为社交媒体平台的内容审核工具。模型支持Python环境下的使用，能够输出文本的攻击性概率评分。

llm-guard - 大语言模型安全交互的全面防护工具

GithubLLM GuardProtect AI大语言模型安全开源项目数据泄漏

LLM Guard是由Protect AI设计的一款全面安全解决方案，专为保障大语言模型的安全互动而打造。它具备语言过滤、数据泄露预防和抗提示注入攻击等功能，确保互动安全和隐私。项目支持多种扫描器，能有效检测和防护潜在威胁。安装简便，易于集成到生产环境中，是提升LLM安全的理想工具。

granite-8b-code-instruct-GGUF - Granite 8B代码生成模型GGUF量化版发布提供多种精度选择

GithubGraniteHuggingface代码模型开源项目指令微调机器学习模型自然语言处理

Granite-8B-Code-Instruct是IBM Research开发的代码生成模型，现已推出GGUF量化版本。该模型在多个开源数据集上微调，具备出色的代码理解和生成能力。量化版本提供Q2至F16多种精度选项，文件大小范围3GB至16GB，适应不同硬件环境。模型采用Apache 2.0许可证，由SanctumAI完成量化处理。

roberta-base-openai-detector - RoBERTa实现的人工智能文本检测工具

GPT-2GithubHuggingfaceRoBERTa人工智能开源项目文本检测机器学习模型

这是OpenAI开发的一款基于RoBERTa架构的AI文本检测工具。通过微调RoBERTa基础模型，它可准确识别GPT-2生成的文本内容。该工具主要面向研究人员，用于探索和研究人工智能文本生成技术。需要注意的是，此工具并不适用于ChatGPT文本检测，建议与其他检测方法配合使用。

roberta-hate-speech-dynabench-r4-target - 动态数据集驱动的在线仇恨检测模型

GithubHuggingfaceLFTWR4 Target动态生成数据集在线仇恨检测开源项目模型深度学习

roberta-hate-speech-dynabench-r4-target是一个基于动态生成数据集的在线仇恨检测模型。该模型源自'Learning from the Worst'研究，旨在通过创新的数据生成方法提高AI系统识别网络仇恨言论的准确性。作为R4 Target系列的一部分，这个模型代表了在线内容审核技术的最新进展，为构建更安全的互联网环境提供了有力工具。

toxigen_roberta - 基于大规模数据集的隐含仇恨言论检测模型

GithubHuggingfaceToxiGen开源项目数据集文本分类机器学习模型隐式仇恨言论检测

ToxiGen是一个专门用于检测隐含和对抗性仇恨言论的机器学习模型。该模型基于大规模机器生成的数据集训练而成，源自一篇关于隐含仇恨言论检测的学术研究。ToxiGen提供了训练数据集和详细信息，为研究人员和开发者在改进在线内容审核方面提供了有力支持。这一工具有助于构建更安全的在线交流环境，对于社交媒体平台和内容管理系统具有重要应用价值。

RADAR-Vicuna-7B - 对抗学习训练的AI文本识别模型

AI文本检测GithubHuggingfaceRADARRoBERTa对抗学习开源项目模型语言模型

RADAR-Vicuna-7B是一款基于RoBERTa架构的AI文本检测模型，通过检测器与改写器的对抗学习方式训练而成。该模型利用OpenWebText数据集，能够有效识别大型语言模型生成的文本。RADAR采用创新的对抗训练方法提升检测能力，但仅限非商业用途。研究人员和开发者可通过Google Colab或Hugging Face API轻松使用该模型进行AI文本识别。

granite-code-models - 支持116种编程语言的开源代码生成模型家族

GithubGranite Code Models代码生成开源模型开源项目指令微调评估基准

Granite Code Models是一系列专注于代码生成任务的解码器模型，涵盖116种编程语言。这些模型在代码生成、解释、修复和翻译等多项任务中表现出色。模型使用合规数据训练，以Apache 2.0许可发布，可用于研究和商业目的。该系列包括基础模型和指令调优模型，参数规模从3B到34B不等，满足不同需求。

SecureBERT_Plus - 网络安全领域的增强版语言模型

GithubHuggingfaceSecureBERT+开源项目数据集机器学习模型网络安全语言模型

该模型在网络安全数据上进行训练，提升了9%的MLM性能，使用8xA100 GPU进行大规模训练，目前已上传至Huggingface平台，供用户访问和使用。

safeguards-shield - 增强人工智能应用的安全防护开发工具

GithubLLMsSafeguards Shield保护层安全风险工具包开源项目

Safeguards Shield是一个旨在安全、可靠使用大型语言模型(LLMs)的开发者工具包。本工具包提供保护层功能，能够防御恶意输入并过滤模型输出，使AI应用从原型快速转向生产阶段。此外，包含超过20种即用型检测器，为生成式AI(GenAI)应用提供全面的安全保障，并助力缓解LLM的可靠性与安全隐患。工具包还支持监控事件、成本及关于AI的责任指标，支持应用的长期发展。

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具，简化了选题、文献检索至论文撰写的整个过程。通过简单设定，平台可快速生成高质量论文大纲和全文，配合图表、参考文献等一应俱全，同时提供开题报告和答辩PPT等增值服务，保障数据安全，有效提升写作效率和论文质量。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号