功能概述
腾讯云大模型服务平台 TokenHub 已原生集成大模型 WAF(LLM-WAF),提供大模型调用一体化安全防护方案。TokenHub 接入本质上是一种 SDK/API 接入方式,由 TokenHub 平台后台统一调用大模型 WAF 的检测能力,用户无需自行集成 SDK 或改造业务代码,在 TokenHub 控制台一键开通,即可对平台下所有模型调用与推理服务提供安全防护,涵盖提示词攻击防护、内容合规检测、敏感数据检测等能力。
与其他接入方式相比,TokenHub 接入具有以下特点:
零代码改造:无需自行集成 SDK 或迁移域名,在 TokenHub 控制台开通即对平台下所有模型调用与推理服务全局生效。
一体化防护:开通后自动对平台下所有模型调用与推理服务提供安全防护,无需逐应用配置。
操作场景
本文介绍如何在 TokenHub 控制台开通大模型 WAF,并完成基础防护能力的启用。适用于以下场景:
已使用腾讯云大模型服务平台 TokenHub,希望为其上的模型调用与推理服务统一开启安全防护。
不希望改动业务代码或迁移域名,以较低成本快速获得大模型内容安全审核能力。
希望按实际 Token 用量弹性计费,无需预购安全套餐。
说明:
开通后防护立即对 TokenHub 平台下所有模型调用与推理服务生效。如需在 TokenHub 平台之外的环境(如自建 AI Agent、腾讯云外业务)使用大模型安全能力,需自行通过 SDK/API 接入 集成;如需通过域名对接流量,请参见 流量接入。
前提条件
已开通腾讯云大模型服务平台 TokenHub,并具备平台管理权限。
大模型安全为增值服务,需额外开通。可前往 TokenHub 控制台 查看详情及开通流程。
说明:
操作步骤
1. 登录 TokenHub 控制台,在左侧导航栏中选择平台配置 > 系统配置。
2. 在安全防护区域,单击大模型安全开关。

3. 在开通大模型安全页面,按需勾选所需开启的能力项。

4. 单击同意开通&授权,完成大模型 WAF 按量服务开通。

5. 开通完成后,可单击 WAF 实例跳转至 Web 应用防火墙控制台的大模型安全页面,查阅生效状态并进行 后续操作。

后续操作
配置防护策略:在 Web 应用防火墙控制台 的大模型安全 > 防护配置页面,按需启用或调整提示词攻击防护、内容合规检测、敏感数据检测等能力项,并配置对应的规则。
查看安全日志:在 Web 应用防火墙控制台 的大模型安全 >日志审计页面,查看大模型安全的检测和拦截记录。
注意事项
开通后系统将按实际使用量开始计费,建议根据业务需要合理配置检测能力项。
开通防护仅对开通后的流量生效,此前产生的调用记录不会被回溯检测。
防护检测在网关层实时完成,通常会引入一定时延,具体数值受请求特征、规则复杂度等因素影响。
如发现误拦截情况,可通过自定义白名单规则排除特定请求,或联系技术支持协助排查。