最新动态

更新时间:2026/07/13 GMT+08:00
分享

本文介绍了智能数据湖 AIDataLake各特性版本的功能发布和对应的文档动态,欢迎体验。

2026年06月

2026年06月30日

序号

功能名称

功能描述

阶段

相关文档

1

多模数据引擎Aura

AuraJobV2:

  • 支持创建ARM类型的通算工作组,支持复用智算CPU资源。
  • 支持新增、删除工作组,支持修改工作组资源规格、配额、镜像。
  • 支持查看已经提交、运行结束的会话、及会话详细信息,支持停止会话。
  • 支持查看已经提交、运行结束的作业,及作业详细信息,支持取消作业。
  • 支持查看作业历史监控信息,支持运行时算子监控。
  • 支持运行日志对接LTS在租户侧查看。

公测

修改/删除Aura引擎端点

查看Aura端点监控

查看作业监控

使用LTS管理AI DataLake作业日志

2

AI计算引擎Ray

  • 支持创建RayJob端点。

  • 支持查看RayJob端点的作业监控信息。

  • 支持通过API的方式提交RayJob作业。

公测

创建RayJob端点

查看Ray端点作业监控信息

基于RayJob Data的数据处理

3

批处理引擎Spark

  • 资源模式新增支持预留资源和混合模式。
  • 支持查看Spark UI。
  • 支持查看作业性能指标。
  • 支持查看Spark端点的资源及作业监控信息。
  • 支持本地UDF。
  • 支持Iceberg幂等性。
  • 支持Native加速。
  • 支持对接LakeFormation Catalog权限体系,实现行列级数据访问控制与精细化权限管理,同时支持外部表与内部表的统一管理。

公测

查看Spark UI

查看Spark端点的资源及作业监控信息

Spark Native算子优化

Spark对接LakeFormation数据权限管理

4

自定义镜像

  • 支持查看预置镜像。

  • 支持注册自定义镜像。

  • 支持查询和管理自定义镜像。

  • 支持镜像版本管理。

公测

管理AI DataLake镜像

5

资源监控

  • 支持查看计算资源池的实时运行状态,包括CPU、内存、NPU和GPU的使用率。

  • 支持查看存储资源的实时运行状态,包括客户端连接数、IOPS、带宽、容量和Inode使用情况。

公测

监控AI DataLake计算资源池

监控AI DataLake存储资源

2026年04月

2026年04月30日

序号

功能名称

功能描述

阶段

相关文档

1

首次发布

智能数据湖(AI DataLake)是华为云构建的企业级多模态智能数据分析与管理平台,为您提供构建AI时代数据基础设施的完整能力。提供多模数据引擎AuraAI计算引擎Ray批处理引擎Spark流处理引擎Flink四大核心计算引擎,聚焦多模数据处理、异构算力混合调度,开放湖仓处理,构建新一代多模湖仓架构,促进Data+AI协同创新。

公测期间未开放流处理引擎Flink

公测

什么是AI DataLake

AI DataLake产品优势

AI DataLake产品功能

相关文档