添加检测策略
AI安全护栏支持添加针对豁免词、违规词、合规内容、提示词注入、敏感信息、算力消耗等内容的策略,构建针对MaaS系统的AI应用防御系统,有效识别并过滤文本或图片中的不良或违规内容。
步骤一:添加策略
- 登录Web应用防火墙控制台。
- 在控制台左上角,单击
图标,选择区域或项目。 - (可选) 如果您已开通企业项目,在左侧导航栏上方单击“按企业项目筛选”下拉框,选择您所在的企业项目。完成后,页面将为您展示该企业项目下的相关数据。
- 在左侧导航栏,选择。
- 在“策略管理”页签,单击“添加策略”。
- 在“添加策略”对话框,输入“策略名称”后,单击“确定”。
步骤二:添加检测规则
参考如下步骤,配置检测规则。
- 单击步骤一:添加策略创建的策略名。
- 单击左侧“语言检测”配置框,在“文本检测”页签,配置语言检测规则。
- 默认检测配置:语言检测规则默认开启,支持中文、英文检测,不支持关闭。
- 扩展配置:如需开启小语种检测或修改防护动作,可单击“操作”列的“编辑”,在“编辑语言检测”面板,完成以下配置。
- 开启小语种检测:打开扩展语言检测
开关。 - 修改防护动作:修改“防护动作”为“放行”或“拦截”。
- 开启小语种检测:打开扩展语言检测
- 单击步骤一:添加策略创建的策略名。
- 单击左侧“豁免词配置”配置框,在“文本检测”或“图片检测”页签,单击“添加规则”。
- 在“添加豁免词检测规则”面板,完成以下配置后,单击“确定”。
表1 添加豁免词检测规则参数说明 参数
参数说明
取值样例
规则名称
填写要添加的规则名称,要求只能由中文、字母、数字、下划线(_)、连字符(-)、冒号(:)和英文句号(.)组成,且不能超过256个字符长度。
waf_test
自定义豁免词
选择已添加的豁免词,支持多选。
如果未添加豁免词,可单击“添加词库”,在“自定义词库管理”页面,添加豁免词。具体操作,请参见管理自定义词库。
豁免词_01
添加完成后,检测规则默认为启用状态。如果输入输出文本包含豁免词时,WAF引擎会过滤文本中的豁免词后,再对剩余文本进行合规检测和提示词注入检测。
用户可根据业务需要,关闭启用状态,编辑或删除已添加的规则;也可选中多条,批量开启、删除、关闭规则,或导出规则。
- 单击步骤一:添加策略创建的策略名。
- 单击左侧“关键词词库检测”配置框,在“文本检测”或“图片检测”页签,配置检测规则。
- 配置内置关键词库检测规则 系统内置如表1所示的检测规则,且默认关闭。用户可根据业务需要,开启检测或修改防护动作。
- 开启检测规则:单击“启用状态”列的
开关。 - 修改防护动作:单击“操作”列的“编辑”,修改“防护动作”为“仅记录”或“拦截”。
内置检测规则不支持单个删除,也不支持批量删除、开启、关闭规则选中多条规则,可导出相关规则。
- 开启检测规则:单击“启用状态”列的
- 添加自定义关键词检测规则 如果内置关键词库检测规则不满足业务需求,可单击规则列表上方的“添加规则”,在“添加词库检测规则”面板,完成以下配置后,单击“确定”。
表2 添加关键词库检测规则参数说明 参数
参数说明
取值样例
规则名称
填写要添加的规则名称,要求只能由中文、字母、数字、下划线(_)、连字符(-)、冒号(:)和英文句号(.)组成,且不能超过256个字符长度。
waf_test
自定义违规词
选择已添加的违规词,支持多选。
如果未添加违规词,可单击“添加词库”,在“自定义词库管理”页面,添加违规词。具体操作,请参见管理自定义词库。
违规词_01
防护动作
选择命中违规词后,要执行的防护动作。
- 仅记录:表示命中违规词后,只记录不拦截。
- 拦截:表示命中违规词后,直接拦截。
仅记录
添加完成后,检测规则默认为启用状态。如果输入输出文本包含违规词时,WAF引擎会按照配置的防护动作进行处置。
用户可根据业务需要,关闭启用状态,编辑或删除已添加的自定义规则;也可选中多条,批量开启、删除、关闭规则,或导出规则。
- 配置内置关键词库检测规则
- 单击步骤一:添加策略创建的策略名。
- 单击左侧“算力消耗防护”配置框,在“文本检测”页签,单击“添加规则”。
- 在“添加算力消耗防护规则”面板,完成如下配置后,单击“确定”。
表3 添加算力消耗防护规则参数说明 参数
参数说明
取值样例
规则名称
填写要添加的规则名称,要求只能由中文、字母、数字、下划线(_)、连字符(-)、冒号(:)和英文句号(.)组成,且不能超过256个字符长度。
waf_test
规则描述
设置该规则的备注信息。
--
防护对象
选择要检测的防护对象。- 所有用户:对所有使用大模型应用的用户请求进行检测。
- 单个用户:对携带某类用户标识的用户请求进行检测。
选择该项后,需设置“用户标识”,用于标记要检测的用户。默认为end_user字段。详细信息,请参见API接入中的end_user参数。
所有用户
防护请求类型
选择要检测的请求类型。
- 输入检测:针对用户输入的文本进行检测。
- 输出检测:针对大模型应用输出文本进行检测。
- 输入输出检测:同时对用户输入和大模型应用输出进行检测。
输入检测
若触发防护阈值
设置检测阈值,即在指定检测周期内,调用次数或字符数超过阈值范围时,执行对应处置。- 检测周期:设置检测周期,取值范围为1~60秒、1~60分钟、1~24小时。
- 限流维度:选择要限制的流量类型,支持调用次数、字符数。
- 阈值范围:设置请求允许的最大范围。
- 调用次数:≤100万,取值范围为1~1,000,000个、1~100万。
- 字符数:≤1万亿,取值范围为1~1,000,000,000,000个、1~100,000,000万、1~100,000,000亿。
- 防护动作:选择触发防护阈值后的处置动作。
- 仅记录:表示命中违规词后,只记录不拦截。
- 拦截:表示命中违规词后,直接拦截。
- 检测周期:60秒
- 限流维度:调用次数
- 阈值范围:100万
- 防护动作:仅记录
添加完成后,检测规则默认为启用状态。如果输入输出文本超过防护阈值,则按照配置的防护动作进行处置。
用户可根据业务需要,修改防护动作,关闭启用状态,编辑或删除已添加的规则;也可选中多条,批量开启、删除、关闭规则,或导出规则。
后续操作
添加AI应用:为已添加的策略添加AI应用。
相关文档
管理自定义词库:参考该文档,可添加豁免词、违规词词库。


