更新时间:2026-08-06 GMT+08:00
分享

Aura引擎端点概述

什么是端点

AI DataLake服务中,端点是用户与AI DataLake引擎和计算资源交互的入口,其本质是“计算引擎”与“计算资源”的绑定,使得提交的作业可以访问AI DataLake的引擎并使用AI DataLake的计算资源。

端点的优势:

  • 自动绑定引擎和计算资源池:创建端点时,AI DataLake自动将引擎和计算资源池绑定,在后续提交作业时无需再手动配置作业与引擎和资源的映射关系。
  • 灵活配置分配给端点的计算资源:您可以在创建端点时根据业务需求配置所需的资源池的计算规格,即资源池分配给当前端点的保障配额(Min)最大配额(Max)

图1介绍了AI DataLake端点的基本原理:

  • 作业层只需对接端点,无需关心底层引擎/资源细节。
  • 每个端点自动绑定对应的计算引擎(Aura、Ray、Spark、Flink)和计算资源(CPU、GPU、NPU)。
  • 端点可以灵活配置计算资源规格,作业无感知,无需重新配置/启动作业。
    图1 AI DataLake端点原理图

Aura引擎的端点类型

Aura引擎支持配置两种类型的端点,分别适用于不同的使用场景和业务需求。您可以根据场景选择合适的端点类型:

  • AuraJobV2

    细粒度Actor级算子编排调度,数据处理Pipeline执行,性能和效率极大提升。

  • AuraJob

    自定义镜像算子,智算、通算混合资源池统一调度,支持Job级弹性。

Aura引擎的资源使用模式

Aura引擎支持两种资源使用模式:预留模式和混合模式。用户可以根据业务负载特点选择合适的模式,优化成本、平衡资源性能。

表1 Aura引擎支持的资源使用模式

端点类型

资源使用模式

说明

详细说明

  • AuraJob
  • AuraJobV2

预留模式

独享性能,成本最优。预留资源,单价最低,确保业务基线稳定。适用于负载稳定业务场景。

资源使用模式:预留模式

混合模式

基线保障,自动扩容。优先消耗预留资源,高峰期自动触发弹性补位。适用于有规律波动的业务。

资源使用模式:混合模式

相关文档