当前位置: 网站首页 >手游评测 >手游评测 >正文

英伟达推出 NIM AI 护栏服务,防止模型遭用户“越狱”

来源:手抖软件园 时间:2025-02-16 12:27:44

本站 1 月 18 日消息,英伟达宣布推出一项名为“NIM”的 AI 护栏服务,该服务现已以英伟达 NeMo 护栏(NeMo Guardrails)套件的形式提供,可以让开发人员为大语言模型(LLM)添加一系列护栏规则,旨在解决用户通过提示词“越狱”大模型,防止 AI 生成不符合预期的内容。

英伟达表示,相应AI护栏服务套件基于英伟达的 Aegis 内容安全数据集进行训练而成,该数据集包含了 3.5 万个标注的数据样本,并已在 Hugging Face 上公开,本站附地址如下(点此访问)。

英伟达指出,相应AI护栏套件具有体积小、效率高的特点,在大部分场合中都能流畅运行,企业可以在开发 AI 模型时直接嵌入相应安全套件,可以改善医疗、汽车、制造业等领域部署的AI安全性。

此外,英伟达还提供了公布了一项名为 Garak 的漏洞扫描工具,用于检测模型的安全性,防止模型可能输出幻觉内容或泄露企业内部机密信息。

上一篇:API 14,华为 MatePad Pro 12.2 英寸平板获鸿蒙 HarmonyOS NEXT 5.0.0.103 Beta 版升级
相关资讯 更多+
最新录入 更多+
确定