帮你快速理解、总结文档立即下载

内容安全防护

最近更新时间:2026-07-17 17:30:05

我的收藏
TokenHub 联合腾讯云 Web 应用防火墙(简称 WAF)为大模型调用提供 大模型安全 防护能力。开启后,TokenHub 会将后付费模型自定义在线推理服务产生的用户输入(提示词)模型输出(生成内容)同步送至 WAF 检测,识别提示词注入、内容违规、敏感数据泄露等大模型应用场景下的常见风险,并按照您配置的策略进行放行、拦截或代答。
说明:
1. 该能力当前仅支持广州地域。
2. 大模型安全防护开启后,覆盖 TokenHub 后付费所有文本模型的调用与推理服务,不包括 Token Plan
3. 大模型安全防护依赖的 LLM-WAF 为腾讯云独立计费产品,与 TokenHub 模型调用计费分开结算,计费标准请参见 LLM-WAF 计费详情

功能概述

大模型安全防护提供以下四项可独立开启的检测能力:
能力
说明
提示词攻击防护
对大模型交互的输入进行安全检测,拦截多种类型的 Prompt 注入攻击。
内容合规检测
对大模型输入 / 输出内容进行合规安全检测,识别涉政、色情等违规内容。
敏感数据检测
对大模型交互进行数据分类与脱敏检测,保护企业敏感数据及 PII(个人身份信息)不被泄露。
自定义防护规则
支持您针对数据分类、涉敏信息、关键词、提示词注入、正则表达式及编码类型识别等场景自定义防护规则。
四项能力互相独立,可按需单独开启或关闭。大模型安全防护为账号级配置,开启后自动对账号下所有符合生效范围的调用生效,无需逐个模型或服务单独配置。

检测逻辑说明

大模型安全防护开启后,检测发生在两个环节:
1. 输入检测:客户请求到达 TokenHub 推理网关后,用户输入内容会先送至 WAF 检测。命中拦截规则时,请求不会继续调用模型;命中代答规则时,直接返回代答内容。
2. 输出检测:输入检测通过后,请求正常调用模型;模型返回的生成内容会再次送至 WAF 检测,命中拦截或代答规则时,实际返回给客户的内容会被相应处理。
检测过程中,您已开启的能力(提示词攻击防护、内容合规检测、敏感数据检测、自定义防护规则)会同时生效,任一能力命中风险即按对应策略处理。
说明:
大模型安全防护开启后,API 调用方式保持不变,无需在请求中新增任何安全相关字段,已有业务代码无需改动即可生效。

前提条件

已开通 TokenHub 并具备控制台操作权限。
首次开启大模型安全防护需要开通大模型 Web 应用防火墙(LLM-WAF),该产品为腾讯云独立计费产品,计费标准请参见 LLM-WAF 计费详情
开通过程中需要授权服务相关角色 TokenHub_QCSLinkedRoleInWebApplicationFirewall,用于 TokenHub 在已关联策略范围内访问 WAF 资源。

操作步骤

开启大模型安全防护

1. 登录 TokenHub 控制台
2. 在左侧导航栏选择平台配置 > 系统配置,进入安全防护区域。
3. 单击大模型安全开关。
4. 在弹出的开通大模型安全窗口中完成以下配置:
开通 LLM-WAF:确认计费提示,并同意授权 TokenHub_QCSLinkedRoleInWebApplicationFirewall 角色。
选择要开启的安全防护能力:根据业务需要,分别开启提示词攻击防护、内容合规检测、敏感数据检测、自定义防护规则中的一项或多项。
5. 单击同意开通 & 授权,完成开启。
开启成功后,安全防护卡片将展示:
展示项
说明
WAF 实例
系统自动为您创建后付费的专属 WAF 实例 ID 和基于 SDK 接入的 ServiceID,可单击跳转 LLM-WAF 控制台查看。
生效范围
TokenHub 后付费所有文本模型的调用与推理服务,不包括 Token Plan。
已开启能力
以标签形式展示当前已开启的防护能力。

调整已开启能力

大模型安全防护开启后,可随时调整已启用的防护能力:
1. 平台配置 > 系统配置 > 安全防护区域,找到已开启的大模型安全卡片。
2. 单击编辑
3. 在弹窗中按需开启或关闭对应能力,保存后立即生效。
若需要对具体检测规则(如自定义关键词、正则表达式、检测阈值等)做更细粒度的配置,请单击 产品文档计费说明 旁的入口,跳转至 LLM-WAF 控制台进行配置。

关闭大模型安全防护

平台配置 > 系统配置 > 安全防护区域,单击大模型安全开关即可关闭。关闭后,TokenHub 停止向 WAF 送检,模型调用不受影响;已创建的 WAF 实例及历史检测记录不会被删除。

常见问题

开启大模型安全防护后,模型调用会受到什么影响?

命中拦截规则的请求将不会返回模型生成内容,而是返回拦截提示;命中代答规则的请求会返回预设的代答内容。未配置拦截策略或未命中风险的请求不受影响。

大模型安全防护是否覆盖 Token Plan?

不覆盖。当前生效范围为 TokenHub 后付费所有文本模型的调用与推理服务,不包括 Token Plan。

检测规则可以在哪里配置?

大模型安全防护的四项能力开关在 TokenHub 控制台管理;具体检测规则(关键词、正则表达式、数据分类等细粒度配置)需跳转至 LLM-WAF 控制台设置。