操作场景
AI 网关支持在日志记录和请求转发两个环节对敏感数据进行脱敏处理,帮助您满足数据安全和合规要求:
日志脱敏:在将 Prompt/Completion 内容写入 LLM Log 之前,对敏感信息进行掩码处理。适用于防止日志泄露场景,不影响 LLM 正常接收原始数据。
转发脱敏:在将请求转发给后端 LLM 供应商之前,将敏感数据替换为占位符。适用于数据主权合规要求严格的场景,阻止敏感数据进入第三方模型供应商。
对比项 | 日志脱敏 | 转发脱敏 |
处理时机 | 写入 LLM Log 之前 | 转发给 LLM 供应商之前 |
是否影响 LLM | 不影响,LLM 仍收到原始数据 | 影响,LLM 收到占位符 |
依赖包体采集 | 必须开启包体采集 | 不依赖 |
处理结果 | 掩码(如 138****8888) | 占位符(如 [手机号]) |
适用场景 | 大多数客户,既保合规又不影响模型效果 | 数据主权合规要求严格的客户 |
说明:
数据脱敏功能需配合 请求包体采集 开关使用。若未开启包体采集,日志脱敏不会生效;转发脱敏不依赖包体采集开关。
前置条件
1. 已创建模型 API 且处于运行中状态;
2. (日志脱敏)已在模型 API 详情页开启 请求包体采集(Prompt) 或 响应包体采集(Completion);
3. 已明确需要脱敏的敏感数据类型(如手机号、身份证号等)。
场景一:配置日志脱敏规则
日志脱敏在写入 LLM Log 前对敏感数据进行掩码处理,适用于需要记录日志内容同时保护敏感信息的场景。
步骤 1:进入模型 API 详情页
1. 登录 微服务平台控制台 ,在左侧导航栏单击云原生智能网关 > 实例列表。
2. 在实例列表页面,单击需要配置的网关实例的“ID”,进入该网关实例的基本信息页面。
3. 在左侧导航栏单击 模型管理,然后单击模型 API 页签。
4. 单击目标模型 API 名称,进入 API 详情页,切换至 基本信息 Tab。
步骤 2:开启包体采集
在 日志配置 区域,确认已开启包体采集
注意:
开启包体采集后,请求和响应的文本内容将写入日志存储。请确认内容不含用户个人隐私数据,且符合企业合规要求。
步骤 3:配置日志脱敏规则
在 日志脱敏规则(包体采集开启时生效) 区域,单击 配置规则,进入配置对话框。
配置参数说明:
参数 | 是否必填 | 说明 |
是否启用 | 是 | 日志脱敏的总开关,关闭时所有脱敏规则不生效 |
内置脱敏类型 | 否 | 勾选需要脱敏的内置数据类型 |
脱敏范围 | 否 | 选择脱敏作用范围:仅 Prompt、仅 Completion、或两者 |
自定义脱敏规则 | 否 | 添加业务特有的敏感数据识别规则 |
内置脱敏类型说明:
脱敏类型 | 识别规则 | 掩码示例 |
手机号 | 大陆 11 位手机号( 1[3-9]\\d{9}) | 138****8888 |
身份证号 | 18 位或 15 位身份证号 | 110101****1234 |
银行卡号 | 16-19 位数字(主流银行卡格式) | 6222****0001 |
邮箱 | 标准邮箱格式 | abc***@***.com |
IP 地址 | IPv4 格式 | 192.168.*.* |
姓名 | 2-4 位中文字符 | 张** |
步骤 4:配置自定义脱敏规则(可选)
如果内置脱敏类型无法满足业务需求,可添加自定义规则:
1. 单击 添加规则,填写规则参数:
参数 | 说明 | 示例 |
规则名称 | 规则标识名称,最长 60 个字符 | 员工工号 |
匹配正则 | 用于匹配敏感数据的正则表达式 | E\\d{6} |
掩码格式 | 脱敏后的掩码格式 | E*** |
启用 | 是否启用该规则 | 勾选启用 |
规则名称限制:
最长 60 个字符
支持中英文大小写、数字及分隔符(
-、_)不能以数字和分隔符开头
不能以分隔符结尾
2. 单击 确定 保存自定义规则
步骤 5:保存配置
在配置对话框中单击 确定,日志脱敏规则立即生效。
场景二:配置转发脱敏规则
转发脱敏在请求转发给 LLM 供应商之前,将敏感数据替换为占位符。适用于数据主权合规要求严格的场景。
注意:
开启转发脱敏后,LLM 收到的是占位符而非真实数据,模型对上下文的理解可能受影响。建议仅在有明确数据主权合规要求时启用。
步骤 1:进入模型 API 详情页
同场景一的步骤 1。
步骤 2:配置转发脱敏规则
在 数据安全配置(转发脱敏) 区域,单击 配置规则,进入配置对话框。
配置参数说明:
参数 | 是否必填 | 说明 |
是否启用 | 是 | 转发脱敏的总开关 |
内置脱敏类型 | 否 | 勾选需要在转发时脱敏的数据类型 |
占位符格式 | 是 | 替换后的占位符格式,默认自动( [{type}]),支持自定义,系统会自动将 {type} 替换为对应敏感类型的名称。 |
脱敏失败处理 | 是 | 脱敏规则处理异常时的行为 |
自定义脱敏规则 | 否 | 添加业务特有的敏感数据识别规则 |
脱敏失败处理策略:
策略 | 说明 | 适用场景 |
拒绝请求并返回 500(推荐) | 脱敏处理异常时直接拒绝请求,保证数据不泄露 | 强合规场景 |
跳过脱敏直接转发 | 脱敏失败时原样转发,不阻断请求 | 不推荐,存在数据泄露风险 |
步骤 3:保存配置
在配置对话框中单击 确定,转发脱敏规则立即生效。
注意事项
1. 包体采集依赖:日志脱敏仅在开启包体采集时生效。若未开启包体采集,日志中不记录 Prompt/Completion 内容,无需脱敏
2. 转发脱敏权衡:转发脱敏会改变 LLM 收到的实际内容,可能影响模型输出质量。建议仅在强合规场景下启用
3. 性能影响:脱敏处理会增加网关的 CPU 开销,高并发场景下建议进行性能测试
4. 自定义正则安全:自定义脱敏规则的正则表达式请谨慎编写,避免过于宽泛的规则导致正常内容被误脱敏
5. 脱敏范围选择:建议根据实际需求选择脱敏范围:
仅需审计请求输入 → 仅 Prompt
仅需审计模型输出 → 仅 Completion
需要完整审计 → Prompt + Completion
6. 姓名识别谨慎:姓名脱敏的误判率较高,普通中文词可能被误识别为姓名,建议评估后谨慎启用
7. 占位符对模型的影响:转发脱敏后的占位符(如
[手机号])会被 LLM 当作普通文本处理,模型无法理解其真实含义