# 配置大模型检测规则保障大模型应用安全合规
生成式人工智能技术的迅猛发展推动了大模型在AI推理领域的规模化应用，由此也暴露出新型安全隐患：推理过程中对用户输入的敏感信息缺乏有效过滤、攻击者通过精心设计的提示词注入诱导模型输出违规指令、大模型可能因训练数据偏差生成歧视性内容等。为有效缓解该类问题，WAF大模型检测支持针对文本内容的提示词验证、响应合规检测，针对图片的OCR检测、内容检测，识别并过滤不良或违规内容后，确保大模型输入和输出内容安全、稳定、可用、合规。
#### 介绍视频
<video controls="controls" preload="none" id="object920545341211" class="idp-external-video" src="https://res-video.hc-cdn.com/cloudbu-site/china/zh-cn/WAF-Operation/1762763616929978896.mp4" title="大模型防火墙介绍" poster="https://support.huaweicloud.com/usermanual-waf/zh-cn_image_0000002516817305.jpg" height="340.0000" width="600.0000"></video>
#### 方案简介
WAF大模型检测分为外部请求（大模型输入内容）检测、大模型响应数据（大模型输出内容）检测。
- WAF大模型检测通过对外部请求进行**文本类的提示词验证** 、**图片类的内容检测** ，确保大模型**输入内容**安全合规。
- WAF大模型检测通过对大模型响应数据进行**响应合规检测** ，确保大模型**输出内容**安全合规。
图1大模型检测   
![](https://support.huaweicloud.com/usermanual-waf/zh-cn_image_0000002541960147.png "点击放大")
**主要应用场景** 为：
- **自行搭建部署的本地大模型**
  企业自行搭建部署的本地大模型，对外部提供服务时，大模型检测模块帮助用户防范大模型应用时遇到文本合规威胁、防止大模型接口被滥用、以及Web框架的Web安全防护，确保业务的稳定。
  
- **调用第三方大模型云服务构建业务的应用**
  企业通过购买第三方大模型的API服务，构建自己的业务应用，避免恶意用户消耗企业的Token造成成本浪费、避免因恶意用户输入的恶意提示词导致账号被风控或封禁导致的业务影响。
  
 
#### 约束条件
| 功能       | 约束说明                                                                                                                                                                                                                                                                                                                                                                                                                                                                                            |
|:---|:---|
| 接入方式和版本限制 | - **云模式-CNAME接入** ：**标准版** 、**专业版** 、**企业版** 支持该功能。 如果购买的云模式版本为**标准版** 、**专业版** 、**企业版** ，则购买的大模型防火墙文本安全版本自动对应为**标准版** 、**专业版** 、**专业版**，且购买时长与云模式WAF时长一致。 如果不再继续使用大模型防火墙文本安全，可单独退订。退订后，不能继续使用该功能，且系统将根据资源使用详情，返还剩余金额到您的账户。   - **云模式-ELB接入**：不支持该功能。  - **独享模式接入**：不支持该功能。   |
| 地域限制   | 仅**华北-北京四** 、**华东-上海一** 、**华南-广州** 支持直接开通该功能。其他地域，请[提交工单](https://support.huaweicloud.com/usermanual-ticket/zh-cn_topic_0127038618.html)申请开通。                                                                                                                                                                                                                                                                                                                                                   |
| 文本检测     | 仅支持**UTF8格式**，否则防护可能会失效。                                                                                                                                                                                                                                                                                                                                                                                                                                                                        |
| 请求Body格式  | 需要为**Json格式** 。响应格式支持纯**Json格式** 与***data:*+Json格式** ，例如： ``` data: {"choices":[{"index":0,"delta":{"content":"具体内容","type":"text"}}],"created":1743564162} ``` 如果大模型源站原始响应是Json格式，则中止响应的返回也是Json格式；若原始响应是*data:* +Json格式，则中止响应的返回也是*data:*+Json格式。                                                                                                                                                                                                                                                 |
| 规则生效时间       | 添加或修改防护规则后，规则生效需要等待几分钟。规则生效后，您可以在"防护事件"页面，[查看防护效果](https://support.huaweicloud.com/usermanual-waf/waf_01_0156.html)。                                                                                                                                                                                                                                                                                                                                                                              |
   
#### 前提条件
- 已[通过云模式-CNAME接入将防护网站添加到WAF](https://support.huaweicloud.com/usermanual-waf/waf_01_0324.html)。
- 已购买**大模型防火墙文本安全** 。具体操作，请参见[购买云模式WAF](https://support.huaweicloud.com/usermanual-waf/waf_01_0109.html#waf_01_0109__zh-cn_topic_0000001871314330_section52661832195218)。
- 已[新增防护策略](https://support.huaweicloud.com/usermanual-waf/waf_01_0074.html)，且策略已绑定要生效的防护域名。
 
#### 步骤一：购买大模型防火墙文本安全
如果您在[购买云模式WAF](https://support.huaweicloud.com/usermanual-waf/waf_01_0109.html)时，已购买大模型防火墙文本安全，可跳过该步骤。关于大模型防火墙文本安全计费详情，请参见[计费项](https://support.huaweicloud.com/price-waf/waf_03_0006.html)。
1. [登录Web应用防火墙控制台](https://console.huaweicloud.com/waf/?locale=zh-cn)。
2. 在控制台左上角，单击![](https://support.huaweicloud.com/usermanual-waf/zh-cn_image_0000002304713360.png)图标，选择区域或项目。
3. (可选) 如果您已开通企业项目，在左侧导航栏上方单击"按企业项目筛选"下拉框，选择您所在的企业项目。完成后，页面将为您展示该企业项目下的相关数据。
4. 在左侧导航栏，单击"总览"。
5. 在"版本管理"区域，单击云模式处的"详情"。
6. 在"云模式详情"面板，单击"高阶功能 \> 大模型内容安全"处的"立即购买"。
7. 在"购买大模型安全"页面，确认购买详情，仔细阅读并勾选"Web应用防火墙免责声明"后，单击"去支付"，完成支付操作。 
   完成购买后，您可以添加文本检测规则，保障大模型应用文本安全合规。
   
   
 
#### 步骤二：配置大模型检测规则
1. [登录Web应用防火墙控制台](https://console.huaweicloud.com/waf/?locale=zh-cn)。
2. 在控制台左上角，单击![](https://support.huaweicloud.com/usermanual-waf/zh-cn_image_0000002304713360.png)图标，选择区域或项目。
3. (可选) 如果您已开通企业项目，在左侧导航栏上方单击"按企业项目筛选"下拉框，选择您所在的企业项目。完成后，页面将为您展示该企业项目下的相关数据。
4. 在左侧导航栏，选择"防护策略 \> WAF核心防护"。
5. 在防护策略列表，单击目标策略名称，进入目标策略的防护规则配置页面。 
   您也可以在"资产管理 \> 防护对象"页面，单击目标域名"防护策略"列的"已开启防护项"后的数字，进入网站绑定的防护策略的规则配置页面。
   
   
6. 单击"大模型检测"配置框，开启大模型检测防护规则。 
   ![](https://support.huaweicloud.com/usermanual-waf/zh-cn_image_0000002289492677.png)：开启状态。
   
   
7. 添加大模型检测规则。
 
- [添加文本检测规则]
  在"文本检测规则"页签，添加文本检测规则，针对大模型提示词、模型响应进行安全、合规的检测与防护。
  1. 在"文本检测规则"页签，单击"添加规则"。
  
  2. 在"添加文本检测规则"面板，完成以下参数配置后，单击"确定"。 
     表1大模型文本检测规则参数说明 
     | **参数名称**      | 参数说明                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                   | 取值样例                                                                                                                                                              |
     |:---|:---|:---|
     | **基本信息**                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                          |||
     | **规则名称**     | 添加要创建的大模型检测规则名称。该名称只能由中文、字母、数字、下划线（_）、连字符（-）、冒号（：）和英文句号（.）组成，且不能超过128个字符长度。                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                           | waf-text                                                                                                                                                           |
     | **预置协议模板**   | 大模型防火墙支持以下模板： - **OpenAI响应协议** 模板：大模型防火墙预置的一套模板，可满足大部分应用场景。同时，也支持在该模板的基础上，根据实际业务情况做对应调整。 该模板默认配置以下内容： - **模型问答路径**："/v1/chat/completions"。  - "提示词验证"： - 默认开启**注入检测**  - 默认开启**合规检测**  - **提示词索引**：$.messages\[-1\].content，表示提取messages数组最后一个元素的content参数值。  - **防护动作** ：**仅记录**    - "响应合规"： - 默认开启**响应合规检测**  - **响应内容索引**：$.choices\[-1\].delta.content，表示提取choices数组最后一个元素的content参数值。  - **防护动作** ：**脱敏**       - **自定义**模板：空白模板，不包含任务默认配置，需根据业务详情，自定义配置相关参数。                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                       | OpenAI响应协议                                                                                                                                                          |
     | **模型问答路径**  | 填写模型问答的URL地址。不能包含特殊字符（\<\>），首尾不能是空格，且不能超过4,096个字符长度。                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                   | /v1/chat/completions                                                                                                                                            |
     | **检测类别**     | 选择要识别的敏感词，支持内置类别、自定义的词库，支持多选。详细说明，请参见[管理自定义词库](https://support.huaweicloud.com/usermanual-waf/waf_01_00092.html)。                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                       | 1. 内置类别：色情、政治敏感、暴恐伤害  2. 自定义词库：水果   |
     | **描述(可选)**   | 填写该规则的备注信息。                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                           | -                                                                                                                                                                |
     | **提示词验证**                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                           |||
     | **注入检测**      | 注入检测是针对大模型特有攻击的检测，例如反面诱导、角色扮演等行为的检测。 开启该功能，并完成配置后，可有效防御攻击者通过精心设计的提示词注入诱导模型输出违规指令。                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                       | ![](https://support.huaweicloud.com/usermanual-waf/zh-cn_image_0000002531854833.png)                                                                              |
     | **合规检测**      | 合规检测是针对暴力、歧视、违法或违背社会公序良俗内容的检测。 开启该功能，并完成配置后，可有效过滤用户输入的违规信息。                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                             | ![](https://support.huaweicloud.com/usermanual-waf/zh-cn_image_0000002500134936.png)                                                                            |
     | **提示词索引**    | 索引是一种用于标识或定位提示词在特定数据结构中的位置或编号的方式。 配置提示词索引，可以方便地查找、访问和处理提示词相关的信息。该索引为请求Body体的JSONPath，并遵循JSONPath语法，支持[表5]中的所有示例。                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                        | $.messages\[-1\].content                                                                                                                                        |
     | **防护动作**     | 选择提示词命中检测要求后，进行的处置动作，支持： - **仅记录**：提示词命中检测要求后，仅记录攻击信息。  - **拦截** ：提示词命中检测要求后，拦截当前请求。 "防护动作"选择为"拦截"后，还需设置拦截页面的**HTTP返回码** 、**页面类型** 、**页面内容**。 关于**拦截** 防护动作的详细配置方法，请参见[示例一：提示词验证]。                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                          | **拦截**                                                                                                                                                           |
     | **响应合规**                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                            |||
     | **合规响应检测**    | 合规检测是针对模型响应数据的检测。 开启该功能，并完成配置后，可有效过滤大模型输出的违规信息。                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                          | ![](https://support.huaweicloud.com/usermanual-waf/zh-cn_image_0000002531814859.png)                                                                             |
     | **响应内容索引**    | 配置响应内容索引信息，可以方便地查找、访问和处理响应内容相关的信息。该为请求Body体的JSONPath，并遵循JSONPath语法，支持[表5]中的序号为1、2、3、5的示例。                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                             | $.choices\[-1\].delta.content                                                                                                                                    |
     | **防护动作**      | 选择响应内容命中检测要求后，要进行的处置动作，支持： - **仅记录**：响应内容命中检测要求后，仅记录攻击信息。  - **脱敏**：如果大模型输出的内容包含敏感词，检测组件结合上下文识别到存在该敏感词后，对该敏感词进行流式响应脱敏，即将敏感词标记为"-"。  - **中止响应**：如果大模型输出的内容包含敏感词，WAF将按照中止响应协议返回替换内容，并结束本次请求，忽略后续大模型源站的响应。                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                           | 脱敏                                                                                                                                                                 |
     | **中止响应协议** | "防护动作"选择为"中止响应"后，还需设置"中止响应协议"。"中止响应协议"用于定义执行**中止响应**防护动作后，返回的内容。 - 大模型防火墙默认预置终止响应协议如下： ``` [ { "$.choices": [ { "finish_reason": "content_filter", "index": 0, "delta": { "content": "你好，这个问题我暂时无法回答，让我们换个话题再聊聊吧。", "role": "assistant" } } ], "$.model": "$.model", "$.created": "$.created", "$.id": "$.id", "$.service_tier": "$.service_tier", "$.object": "$.object", "$.usage": "$.usage" }, { "$": "[DONE]" } ] ```   - 支持在默认终止响应协议模板上，自定义修改。中止响应协议语法遵循以下原则： - 需要按照Json列表格式填写，列表里每一项均为对象。  - 对象允许为空，即*{}*。为空时将复制拦截的响应数据，其键值语法与响应索引语法一致。若出现非法值，则该对象的配置内容将会跳过。  - 单条中止响应协议list最大支持5个对象，每个对象内支持配置10条索引，超出的数据将忽略。同个对象中的索引不允许重复，重复后可能会造成结果不准确。  - 如果每个响应内容不变，可以直接配置常量，例如[场景二："防护动作"设置为"中止响应"]示例里的*$.data.choices*。  - 如果每个响应的内容不一样，但可以从带有"卡"的响应中获取的场景，可参考[场景二："防护动作"设置为"中止响应"]示例*$.data.model*配置，对象值遵循响应索引语法。  - 索引内的操作若有顺序，后面的操作会将前面的覆盖。例如，先对*$.data.model* 赋值，后对整个*$.data* 赋值，则对*$.data.model*的赋值会不生效。  - 如果对象是数组类型，对其进行子对象赋值；如果对象是非数组类型，对其进行数组下标赋值，将会导致输出数据不正常。例如，原始请求数据如下： ``` {"data":{"arr":["1","2","3"],"item":{"sub_item":1}}} ``` 此时，*$.data.arr.new_index* 或者*$.data.item\[1\].new_index*是非法的。 如果必须这么修改，建议先清空*$.data.arr* 或*$.data.item*后赋值，如下： ``` [ { "$.data.arr": "{}", "$.data.arr.new_index": "new_data" } ] ```   - 如果对象是数组类型，不支持不存在的负数下标赋值。例如，原始请求数据如下： ``` {"data":{"arr":["1","2","3"],"item":{"sub_item":1}}} ``` 对*$.data.arr\[-4\]* 的赋值是非法的。如果需要在*$.data.arr* 的最前面插入"0"，你可以倒序对*$.data.arr*进行赋值（正序赋值会改变原有值，导致结果不符合预期）： ``` [ { "$.data.arr[3]": "$.data.arr[2]", "$.data.arr[2]": "$.data.arr[1]", "$.data.arr[1]": "$.data.arr[0]", "$.data.arr[0]": "0" } ] ```      关于中止响应协议的详细配置方法，请参见[示例二：响应合规检测]。 | 详细示例，请参见[示例二：响应合规检测]                                                                                                           |
        
     
     
   
完成以上配置后，您还可以执行以下操作：
- **查看规则状态**：在防护规则列表，查看已添加的规则。此时，"规则状态"默认为"已开启"。
- **关闭规则**：如果您暂时不想使该规则生效，可在目标规则"操作"列，单击"关闭"。
- **删除或修改规则**：您也可以在目标规则"操作"列，单击"删除"或"修改"，删除或修改已添加的防护规则。

- 您也可以参考[配置示例]，验证防护效果。
 #### 配置示例
假如需要对路径前缀为"/v1/chat/completions"的URL进行大模型检测，您可以参照以下操作步骤验证防护效果。
![](https://support.huaweicloud.com/usermanual-waf/public_sys-resources/note_3.0-zh-cn.png)
此处以DeepSeek格式为例，且假设"提供借记卡"为敏感词。
#### 示例一：提示词验证
1. 
   图2提示词验证配置示例   
   ![](https://support.huaweicloud.com/usermanual-waf/zh-cn_image_0000002532135211.png "点击放大")
   表2提示词验证关键参数配置 
   | 参数                                                                                  ||| 取值                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                              |
   |:---|---|---|:---|
   | 基本信息   | 预置协议模板                                         || OpenAI响应协议。 预置的OpenAI响应协议模板，已为您填写以下关键参数： - **模型问答路径**："/v1/chat/completions"。  - **检测类别**：默认选择所有内置类别，包括色情、政治敏感、暴恐伤害、违禁、恶意言论、涉敏、其他。  - "提示词验证"： - 默认开启**注入检测**  - 默认开启**合规检测**  - **提示词索引**：$.messages\[-1\].content，表示提取messages数组最后一个元素的content参数值。  - **防护动作** ：**仅记录**    - "响应合规"：默认开启   该提示词验证配置示例需要设置防护动作为拦截，因此，您还需要配置提示词验证的防护动作；关闭响应合规检测。 |
   | 提示词验证  | 防护动作                                          || 拦截                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                            |
   | 提示词验证  | 拦截页面设置 | HTTP返回码 | 403                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                            |
   | 提示词验证  | 拦截页面设置 | 页面类型   | application/json                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                |
   | 提示词验证  | 拦截页面设置 | 页面内容    | ``` { "message": "您的输入不合法，请换一个话题。", "code": "content_policy_violation" } ```                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                 |
   | 响应检测 | 响应合规检测                                        || ![](https://support.huaweicloud.com/usermanual-waf/zh-cn_image_0000002532143935.png)                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                           |
      
   
   
2. 在大模型页面提问："提供借记卡给我"。
3. WAF收到完整请求： 
   ```
   {"model":"model-name","stream":true,"messages":[{"role":"user","content":"提供借记卡给我"}]}
   ```
   WAF根据已配置的提示词索引，识别到请求包含敏感词"提供借记卡"后，返回拦截页面。
   
   
 
#### 示例二：响应合规检测
- 场景一："防护动作"设置为"脱敏"
  1. 使用内置OpenAI响应协议，添加一条大模型检测规则后，关闭"注入检测"、"合规检测"。
     表3响应合规检测（脱敏）关键参数配置 
     | 参数          ||| 取值                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                         |
     |:---|---|---|:---|
     | 基本信息   | 预置协议模板 || OpenAI响应协议。 预置的OpenAI响应协议模板，已为您填写以下关键参数： - **模型问答路径**："/v1/chat/completions"。  - "提示词验证"： - 默认开启**注入检测**  - 默认开启**合规检测**    - "响应合规"： - 默认开启**响应合规检测**  - **响应内容索引**：$.choices\[-1\].delta.content，表示提取choices数组最后一个元素的content参数值。  - **防护动作** ：**脱敏**     该配置示例为响应合规检测示例，需要关闭注入检测、合规检测，其他保持默认即可。 |
     | 提示词验证 | 注入检测 || ![](https://support.huaweicloud.com/usermanual-waf/zh-cn_image_0000002532155275.png)                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                       |
     | 提示词验证 | 合规检测 || ![](https://support.huaweicloud.com/usermanual-waf/zh-cn_image_0000002500435196.png)                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                        |
        
     
  
  2. 大模型源站返回给WAF的流式响应为"提供借记卡给我"，报文为如下内容时：
     ```
     data: {"choices":[{"index":0,"delta":{"content":"","type":"text"}}],"model":"","prompt_token_usage":111,"chunk_token_usage":0,"created":1743564162,"message_id":2,"parent_id":1} 
      data: {"choices":[{"index":0,"delta":{"content":"提供","type":"text"}}],"model":"","chunk_token_usage":1,"created":1743564162,"message_id":2,"parent_id":1} 
      data: {"choices":[{"index":0,"delta":{"content":"借记","type":"text"}}],"model":"","chunk_token_usage":1,"created":1743564162,"message_id":2,"parent_id":1} 
      data: {"choices":[{"index":0,"delta":{"content":"卡","type":"text"}}],"model":"","chunk_token_usage":1,"created":1743564162,"message_id":2,"parent_id":1}
      data: {"choices":[{"index":0,"delta":{"content":"给我","type":"text"}}],"model":"","chunk_token_usage":1,"created":1743564162,"message_id":2,"parent_id":1}
     ```
     WAF根据已配置的提示词索引，识别到敏感词"提供借记卡"后，将"卡"脱敏，替换为"---"。
     ```
     data: {"choices":[{"index":0,"delta":{"content":"","type":"text"}}],"model":"","prompt_token_usage":111,"chunk_token_usage":0,"created":1743564162,"message_id":2,"parent_id":1} 
     data: {"choices":[{"index":0,"delta":{"content":"提供","type":"text"}}],"model":"","chunk_token_usage":1,"created":1743564162,"message_id":2,"parent_id":1} 
     data: {"choices":[{"index":0,"delta":{"content":"借记","type":"text"}}],"model":"","chunk_token_usage":1,"created":1743564162,"message_id":2,"parent_id":1} 
     data: {"choices":[{"index":0,"delta":{"content":"---","type":"text"}}],"model":"","chunk_token_usage":1,"created":1743564162,"message_id":2,"parent_id":1}
     data: {"choices":[{"index":0,"delta":{"content":"给我","type":"text"}}],"model":"","chunk_token_usage":1,"created":1743564162,"message_id":2,"parent_id":1}
     ```
     
   

- 场景二："防护动作"设置为"中止响应"
  1. 使用内置OpenAI响应协议，添加一条大模型检测规则后，关闭"注入检测"、"合规检测"，修改"防护动作"为"中止响应"。
     表4响应合规检测（中止响应）关键参数配置 
     | 参数                                                                            ||| 取值                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                      |
     |:---|---|---|:---|
     | 基本信息    | 预置协议模板                                    || OpenAI响应协议。 预置的OpenAI响应协议模板，已为您填写以下关键参数： - **模型问答路径**："/v1/chat/completions"。  - "提示词验证"： - 默认开启**注入检测**  - 默认开启**合规检测**    - "响应合规"： - 默认开启**响应合规检测**  - **响应内容索引**：$.choices\[-1\].delta.content，表示提取choices数组最后一个元素的content参数值。  - **防护动作** ：**脱敏**     该响应合规检测配置示例需要设置防护动作为中止响应，因此，您还需要关闭注入检测、合规检测；修改示例的防护动作。 |
     | 提示词验证   | 注入检测                                      || ![](https://support.huaweicloud.com/usermanual-waf/zh-cn_image_0000002532160029.png)                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                     |
     | 提示词验证   | 合规检测                                      || ![](https://support.huaweicloud.com/usermanual-waf/zh-cn_image_0000002500320092.png)                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                     |
     | 响应合规检测 | 防护动作 | 中止响应 | 选择中止响应后，会自动填写一个中止响应协议模板，可根据实际情况调整。                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                       |
        
     
  
  2. 大模型源站返回给WAF的流式响应为"提供借记卡给我"，报文为如下内容时：
     ```
     data: {"choices":[{"index":0,"delta":{"content":"","type":"text"}}],"model":"","prompt_token_usage":111,"chunk_token_usage":0,"created":1743564162,"message_id":2,"parent_id":1} 
      data: {"choices":[{"index":0,"delta":{"content":"提供","type":"text"}}],"model":"","chunk_token_usage":1,"created":1743564162,"message_id":2,"parent_id":1} 
      data: {"choices":[{"index":0,"delta":{"content":"借记","type":"text"}}],"model":"","chunk_token_usage":1,"created":1743564162,"message_id":2,"parent_id":1} 
      data: {"choices":[{"index":0,"delta":{"content":"卡","type":"text"}}],"model":"","chunk_token_usage":1,"created":1743564162,"message_id":2,"parent_id":1}
      data: {"choices":[{"index":0,"delta":{"content":"给我","type":"text"}}],"model":"","chunk_token_usage":1,"created":1743564162,"message_id":2,"parent_id":1}
     ```
     WAF根据已配置的提示词索引，识别到敏感词"提供借记卡"后，触发合规检测中止响应。
     通过中止响应协议，带有"卡"的响应被替换成如下内容：
     ```
     data: 
     {"choices":[{"finish_reason":"content_filter","index":0,"delta":{"content":"你好，这个问题我暂时无法回答，让我们换个话题再聊聊吧。
     ","type":"text","role":"assistant"}}],"model":"","chunk_token_usage":0,"created":1743564162,"message_id":2,"parent_id":1} 
     data: [DONE]
     ```
     并且，结束本次请求，忽略后续大模型源站的响应。
     
   
 
#### 索引支持的语法
大模型索引是一种用于标识或定位提示词、响应内容在请求Body体的JSONPath中的位置或编号的方式，遵循JSONPath语法。开启**注入检测** 、**合规检测** 、**响应合规检测**后，需要配置索引，便于查找、访问和处理提示词/响应内容相关的信息。
大模型检测需要配置以下索引：
- 提示词索引：开启**注入检测** 、**合规检测**后，用于定位提示词在请求Body体的JSONPath中的位置，支持下表中所有语法。
- 响应内容索引：开启**响应合规检测**后，用于定位响应内容在响应Body体的JSONPath中的位置，支持下表中序号为1、2、3、5的语法，不支持列表通配符提取。
 
 表5索引示例 
| 序号 | 场景        | JSON结构                                                                                                                 | 路径（最大深度为10）           | 结果                                                                               | 说明                                     |
|:---|:---|:---|:---|:---|:---|
| 1 | 单对象         | {"prompt": {"role": "user","content": "..."}}                                                                           | $.prompt.content        | "..."                                                                             | 通过 . 逐层访问子节点，直接定位目标字段。必须写出子节点名，暂不支持省略 |
| 2 | 列表取第一个     | {"prompt": \[{"role": "user","content": "A"}, {"role":"assistant", "content": "B"}\]}                                  | $.prompt\[0\].content  | "A"                                                                              | 数组索引从0开始，\[0\]表示首元素                     |
| 3 | 列表取最后一个元素 | {"prompt": \[{"role": "user","content": "A"}, {"role":"assistant", "content": "B"}\]}                                 | $.prompt\[-1\].content | "B"                                                                              | 使用负索引-1表示倒数第一个元素                      |
| 4  | 列表通配符提取   | {"prompt": \[{"role": "user","content": "A"}, {"role":"assistant", "content": "B"},{"role": "user", "content": "C"}\]} | $.prompt\[\*\].content   | "ABC"                                                                            | \[\*\] 表示匹配数组所有元素，不支持递归获取              |
| 5  | 获取根节点    | {"prompt": \[{"role": "user","content": "A"}, {"role":"assistant", "content": "B"}\]}                                 | $                       | {"prompt":\[{"role": "user","content": "A"},{"role":"assistant","content":"B"}\]} | 获取根节点的JSON内容                             |
   
#### 相关操作
- **查看防护日志信息** ：[查询防护事件](https://support.huaweicloud.com/usermanual-waf/waf_01_0156.html)。
  WAF大模型检测在识别到攻击行为后，会将攻击日志上报到**安全云脑 SecMaster** ，您可以在安全云脑 SecMaster查看和分析攻击日志。更多信息请参见[大模型安全工作台](https://support.huaweicloud.com/usermanual-secmaster/secmaster_01_0437.html)。
  
- **退订大模型内容安全**
  1. 在左侧导航栏，单击"总览"。
  
  2. 在"产品信息"区域，单击"云模式"处的详情。
  
  3. 在"云模式详情"面板的"高阶功能"处，单击"退订"，退订该功能。
  
  
  退订后，不能继续使用大模型检测，且系统将根据资源使用详情，返还剩余金额到您的账户。
  
 
