更新时间:2026-07-28 GMT+08:00
分享

敏感数据识别概述

敏感数据识别支持“规则匹配方式”“大模型推理方式”两种:
  • “规则匹配方式”基于数据识别引擎,对其储存结构化数据(RDS、DWS等)和非结构化数据(OBS)进行扫描、分类、分级。
  • “大模型推理方式”是基于大模型语言能力对非结构化数据(OBS)和结构化数据(仅支持部分数据库)进行自动分级分类。
  • 大模型推理方式处于公测阶段,目前仅部分区域支持,详细支持的区域可通过控制台查询详情。

敏感数据识别任务的使用约束

本章节介绍敏感数据识别任务支持的数据类型,包含规则匹配方式支持的数据源类型、大模型推理方式以及支持AI辅助算法二次校验的内置规则。

规则匹配方式支持的数据源类型

数据类型

数据源类型

数据库

MySQL

TDSQL

PostgreSQL

GreenPlum

SQLServer

Oracle

DWS

OpenGauss

KingBase

DMDBMS

MongoDB

大数据

Hive

Hbase

DLI

MRS_HIVE

Elasticsearch

OBS

OBS

大模型推理方式支持的数据源类型

数据类型

数据源类型

数据库

MySQL

PostgreSQL

Oracle

DWS

OBS

OBS

支持AI辅助算法二次校验的内置规则

敏感数据分类

类型

个人敏感图片信息

  • 姓名
  • 性别
  • 生日
  • 民族
  • 国籍
  • 婚姻状况
  • 电话号码(中国内地)
  • 手机号码(中国内地)
  • 出生地
  • 邮箱
  • 宗教信仰
  • 身份证(中国内地)
  • 军官证
  • 护照(中国内地)
  • 驾照(中国内地)
  • 港澳通行证
  • 车牌号(中国内地)
  • 车辆识别码
  • 教育程度
  • 工作单位
  • 银行卡号
  • 信用卡安全码
  • 吸烟史
  • 年龄
  • 籍贯
  • 住址
  • 政治面貌
  • 工作证
  • 社保号
  • 居住证
  • 台胞证
  • 微信号
  • QQ号
  • 微博账号
  • 个人职业
  • 工作地点
  • 工资
  • 银行账户
  • 证券账户

密钥凭证敏感信息

  • 密码
  • 动态口令/短信验证码
  • 认证Token
  • AK
  • SK

位置敏感信息

地理位置信息

其他

金额信息

使用流程及说明

您可以直接使用华为云内置的按照各行业制定的识别模板直接进行敏感数据识别,也可以按照如下流程自定义识别规则、级别以及识别模板进行敏感数据识别。

步骤一:配置识别规则或者级别

拥有DSC内置的规则和级别可供使用,同时可以自定义新的规则和级别,将零散的数据按照识别规则进行分类,是创建识别模板必须的配置项。详情请参见新建自定义规则新建分级

步骤二:配置识别模板

拥有通用云数据安全分类分级模板,同时可以自定义新的分类分级模板,将多个零散的规则进行统一分级分类管理,是创建识别任务必须的配置项。详细操作请参见新建模板

步骤三:配置识别任务

数据安全中心会根据创建的识别任务,在选定的OBS桶、数据库、大数据或者LTS的指定范围中,自动识别敏感数据并生成识别数据和结果。详细操作请参见新建规则匹配方式的分类分级任务新建大模型推理方式分类分级任务

步骤四:查看或下载识别结果

识别任务扫描完成后,可在识别任务列表查看识别结果,也可将识别结果下载到本地查看。详细操作请参见查看并下载敏感数据识别结果

相关文档