敏感数据识别概述
- “规则匹配方式”基于数据识别引擎,对其储存结构化数据(RDS、DWS等)和非结构化数据(OBS)进行扫描、分类、分级。
- “大模型推理方式”是基于大模型语言能力对非结构化数据(OBS)和结构化数据(仅支持部分数据库)进行自动分级分类。
- 大模型推理方式处于公测阶段,目前仅部分区域支持,详细支持的区域可通过控制台查询详情。
敏感数据识别任务的使用约束
本章节介绍敏感数据识别任务支持的数据类型,包含规则匹配方式支持的数据源类型、大模型推理方式以及支持AI辅助算法二次校验的内置规则。
规则匹配方式支持的数据源类型
| 数据类型 | 数据源类型 |
|---|---|
| 数据库 | MySQL |
| TDSQL | |
| PostgreSQL | |
| GreenPlum | |
| SQLServer | |
| Oracle | |
| DWS | |
| OpenGauss | |
| KingBase | |
| DMDBMS | |
| MongoDB | |
| 大数据 | Hive |
| Hbase | |
| DLI | |
| MRS_HIVE | |
| Elasticsearch | |
| OBS | OBS |
支持AI辅助算法二次校验的内置规则
| 敏感数据分类 | 类型 |
|---|---|
| 个人敏感图片信息 |
|
| 密钥凭证敏感信息 |
|
| 位置敏感信息 | 地理位置信息 |
| 其他 | 金额信息 |
使用流程及说明
您可以直接使用华为云内置的按照各行业制定的识别模板直接进行敏感数据识别,也可以按照如下流程自定义识别规则、级别以及识别模板进行敏感数据识别。
步骤二:配置识别模板
拥有通用云数据安全分类分级模板,同时可以自定义新的分类分级模板,将多个零散的规则进行统一分级分类管理,是创建识别任务必须的配置项。详细操作请参见新建模板。
步骤三:配置识别任务
数据安全中心会根据创建的识别任务,在选定的OBS桶、数据库、大数据或者LTS的指定范围中,自动识别敏感数据并生成识别数据和结果。详细操作请参见新建规则匹配方式的分类分级任务和新建大模型推理方式分类分级任务。
步骤四:查看或下载识别结果
识别任务扫描完成后,可在识别任务列表查看识别结果,也可将识别结果下载到本地查看。详细操作请参见查看并下载敏感数据识别结果。