# MaaS模型即服务 > 企业级大模型服务平台 ## 服务公告 - [MaaS模型发布公告](https://support.huaweicloud.com/bulletin-maas/bulletin-maas-0001.md): 本文介绍了MaaS服务的新模型发布记录与特性。表格中的√表示模型支持该功能,X表示模型不支持该功能。 - [MaaS模型下线公告](https://support.huaweicloud.com/bulletin-maas/bulletin-maas-0002.md): 为持续优化MaaS平台的模型性能、迭代服务能力,为您提供更高效、稳定的AI服务,MaaS会不定期对部分模型进行下线处理。为确保业务连续,请您及时进行模型替换。建议替换的新模型在性能和功能上都有显著提升,能为您带来更好的使用体验。不同模型/版本支持的能力、价格、API 参数以及实际应用表现存在差异,模型迁移前请务必仔细了解模型信息,结合实际 ## 产品介绍 - [什么是MaaS模型即服务](https://support.huaweicloud.com/productdesc-maas/productdesc_maas_0002.md): 在当前AI技术快速发展的背景下,企业和研究机构面临着构建和优化大模型的高成本和技术门槛。然而,对于许多企业来说,自建平台不仅成本高昂,而且技术难度大,如何降低大模型开发和应用的门槛成为了一个亟待解决的问题。MaaS模型即服务提供基于昇腾适配的主流大模型服务,作为企业与开发者的大模型敏捷应用枢纽,无需用户投入高昂成本进行模型训练、部署与运维 - [功能介绍](https://support.huaweicloud.com/productdesc-maas/productdesc_maas_0005.md): MaaS是一站式大模型开发托管服务,汇聚业界主流优质大模型,提供模型选择与在线推理调用能力,帮助企业降低AI落地门槛,以更低的成本、更快的速度将 AI 能力融入业务系统,加速千行百业的智能化转型。开箱即用的预置模型30+业界主流模型基于昇腾AI云服务进行适配,模型全、免配置、免调优、性能优。涵盖openPangu、GLM、DeepSeek - [MaaS基本概念](https://support.huaweicloud.com/productdesc-maas/productdesc_maas_0006.md): 指参数量级超过百亿甚至万亿的超大规模人工智能模型,基于深度学习技术(如Transformer架构),通过海量多模态数据训练,具备理解、推理、生成等类人能力。指按某种策略由已知判断推出新判断的思维过程。人工智能领域下,由机器模拟人类智能,使用构建的神经网络完成推理过程。在线推理是对每一个推理请求同步给出推理结果的在线服务(Web Servi - [责任共担](https://support.huaweicloud.com/productdesc-maas/productdesc_maas_0009.md): 华为云秉承“将公司对网络和业务安全性保障的责任置于公司的商业利益之上”。针对层出不穷的云安全挑战和无孔不入的云安全威胁与攻击,华为云在遵从法律法规业界标准的基础上,以安全生态圈为护城河,依托华为独有的软硬件优势,构建面向不同区域和行业的完善云服务安全保障体系。《华为云安全白皮书》 详细介绍华为云安全性的构建思路与措施,包括云安全战略、责任 - [资产识别与管理](https://support.huaweicloud.com/productdesc-maas/productdesc_maas_0011.md): 用户在MaaS中的资产包括用户发布的AI资产以及用户提供的一些个人信息。AI资产包括但不限于文本、图形、数据、文章、照片、图像、插图、代码、AI算法、AI模型等。用户的个人信息包括:用户注册时提供的昵称、头像、邮箱、手机号。用户注册时提供的企业信息。用户申请白名单时提供的华为云账号ID、邮箱、企业信息。对于用户发布在MaaS中的资产,Ma - [身份认证与访问控制](https://support.huaweicloud.com/productdesc-maas/productdesc_maas_0012.md): 用户访问MaaS的方式有多种,包括MaaS控制台、API,无论访问方式封装成何种形式,其本质都是通过MaaS提供的REST风格的API接口进行请求。MaaS的接口均需要进行认证鉴权以此来判断是否通过身份认证。通过控制台发出的请求需要通过Token认证鉴权,调用API接口认证鉴权支持Token认证。MaaS服务的访问授权是通过ModelAr - [数据保护技术](https://support.huaweicloud.com/productdesc-maas/productdesc_maas_0013.md): MaaS通过多种数据保护手段和特性,保障存储在MaaS中的数据安全可靠。 - [审计与日志](https://support.huaweicloud.com/productdesc-maas/productdesc_maas_0014.md): 云审计服务(Cloud Trace Service,CTS),是华为云安全解决方案中专业的日志审计服务,提供对各种云资源操作记录的收集、存储和查询功能,可用于支撑安全分析、合规审计、资源跟踪和问题定位等常见应用场景。用户开通云审计服务并创建和配置追踪任务后,CTS可记录MaaS的管理事件和数据事件用于审计。CTS的详细介绍和开通配置方法, - [服务韧性](https://support.huaweicloud.com/productdesc-maas/productdesc_maas_0015.md): 韧性特指安全韧性,即云服务受攻击后的韧性,不含可靠性、可用性。本章主要阐述MaaS服务受入侵的检测响应能力、防抖动的能力、域名合理使用、内容安全检测等能力。MaaS服务部署主机层、应用层、网络层和数据层的安全防护套件。及时检测主机层、应用层、网络层和数据层的安全入侵行为。MaaS服务涉及对互联网开放的Web应用,采用了统一推荐的Web安全 - [监控安全风险](https://support.huaweicloud.com/productdesc-maas/productdesc_maas_0016.md): MaaS支持监控在线服务和对应模型负载,执行自动实时监控、告警和通知操作。云监控可以帮助用户更好地了解服务和模型的各项性能指标。详细内容请参见在CES查看MaaS调用数据和监控指标。 - [故障恢复](https://support.huaweicloud.com/productdesc-maas/productdesc_maas_0017.md): MaaS全球基础设施围绕华为云区域和可用区构建。华为云区域提供多个在物理上独立且隔离的可用区,这些可用区通过延迟低、吞吐量高且冗余性高的网络连接在一起。利用可用区,您可以设计和操作在可用区之间无中断地自动实现故障转移的应用程序和数据库。与传统的单个或多个数据中心基础设施相比,可用区具有更高的可用性、容错性和可扩展性。MaaS通过对DB的数 - [认证证书](https://support.huaweicloud.com/productdesc-maas/productdesc_maas_0019.md): 华为云服务及平台通过了多项国内外权威机构(ISO/SOC/PCI等)的安全合规认证,用户可自行申请下载合规资质证书。合规证书下载华为云还提供以下资源来帮助用户满足合规性要求,具体请查看资源中心。资源中心华为云安全服务提供了网络安全专用产品安全检测证书、软件著作权等证书,供用户下载和参考。具体请查看合规资质证书。网络安全专用产品安全检测证书 - [安全边界](https://support.huaweicloud.com/productdesc-maas/productdesc_maas_0020.md): 云服务的责任共担模型是一种合作方式,其中云服务提供商和云服务客户共同承担云服务的安全和合规性责任。这种模型是为了确保云服务的安全性和可靠性而设计的。根据责任共担模型,云服务提供商和云服务客户各自有一些责任。云服务提供商负责管理云基础架构,提供安全的硬件和软件基础设施,并确保云基础架构的可用性。而云服务客户则需要负责保护自己的数据和应用程序 - [约束与限制](https://support.huaweicloud.com/productdesc-maas/productdesc_maas_0021.md): 本节介绍MaaS服务在使用过程中的约束和限制。 - [权限管理](https://support.huaweicloud.com/productdesc-maas/productdesc_maas_0022.md): 如果您需要对华为云上购买的MaaS资源,为企业中的员工设置不同的访问权限,以达到不同员工之间的权限隔离,您可以使用统一身份认证服务(Identity and Access Management,简称IAM)进行精细的权限管理。该服务提供用户身份认证、权限分配、访问控制等功能,可以帮助您安全的控制华为云资源的访问。通过IAM,您可以在华为云 - [与其他云服务的关系](https://support.huaweicloud.com/productdesc-maas/productdesc_maas_0024.md): MaaS使用统一身份认证服务(Identity and Access Management,简称IAM)实现认证功能。IAM的更多信息请参见统一身份认证服务产品文档。MaaS使用云监控服务(Cloud Eye Service, 简称CES)监控在线服务和对应模型负载,执行自动实时监控、告警和通知操作。CES的更多信息请参见云监控服务用户指 ## 计费说明 - [MaaS计费项概述](https://support.huaweicloud.com/price-maas/price-maas-0038.md): MaaS服务的在线体验以及模型调用场景下,是按需计费方式(在使用服务的文本生成、视频生成(平台模型)、图像理解、文本向量化、重排序功能时,MaaS是按token计费的;当使用图片生成功能时,MaaS是按张计费; 视频生成使用三方模型时,MaaS按生成的视频时长计费)。MaaS当前支持按需购买、Token Plan个人版套餐两种购买方式。 - [MaaS文本生成模型](https://support.huaweicloud.com/price-maas/price-maas-0002.md): 将文本对话的输入和输出转化为Token计费。调用文本生成模型时,内容生成成功会计费,内容生成失败不计费。支持以下两种计费方式。按Token付费Token Plan个人版套餐上下文缓存(以下简称缓存)旨在优化您调用模型服务的体验。通过缓存常用上下文信息,可以减少每次请求时的重复处理和加载开销,从而降低成本(命中缓存的输入享有折扣优惠)。这一 - [MaaS视频生成模型](https://support.huaweicloud.com/price-maas/price-maas-0003.md): 当前MaaS视频生成模型有两类:平台模型和三方模型。调用视频生成模型时,视频生成成功会计费,视频生成失败不计费。由MaaS平台提供的模型,支持的模型列表请参考视频生成模型表中的通义万相模型信息表。计费方式按Token计费,统计模型进行实时推理服务时消耗的Token数量,按Token数量付费。按Token计费,统计模型进行实时推理服务时消耗 - [MaaS图片生成模型](https://support.huaweicloud.com/price-maas/price-maas-0004.md): 图片生成模型是一种通过输入文本描述自动生成对应图像的人工智能模型,核心功能是 “将文字信息转化为视觉内容”。它属于生成式人工智能(AIGC) 的重要分支,通过深度学习技术学习文本与图像的关联规律,根据人类的文字指令生成全新的、符合描述的图像。调用图片生成模型时,内容生成成功会计费,内容生成失败不计费。按张计费:按照图片生成的张数计费。计费 - [MaaS图像理解模型](https://support.huaweicloud.com/price-maas/price-maas-0005.md): 图像理解模型是一种能够对图像内容进行分析、解读和理解的人工智能模型,其核心目标是让计算机像人类一样“看懂”图像。调用图像理解模型时,内容生成成功会计费,内容生成失败不计费。按Token计费:统计模型进行实时推理服务时消耗的Token数量,按Token数量付费。具体价格请以MaaS控制台为准。计费项说明用于模型推理的Token输入、输出。具 - [MaaS文本向量化](https://support.huaweicloud.com/price-maas/price-maas-0006.md): 文本向量化是一种将文本(如单词、句子、段落等)转化为计算机可理解的数值向量的技术模型,核心目的是让文本的语义信息以数学形式呈现,从而支持机器学习模型进行后续的分析、分类、检索等任务。调用文本向量化模型时,内容生成成功会计费,内容生成失败不计费。按Token计费:统计模型进行实时推理服务时消耗的Token数量,按Token数量付费。具体价格 - [MaaS重排序模型](https://support.huaweicloud.com/price-maas/price-maas-0007.md): 重排序模型是一种对初始候选结果列表进行二次调整排序的模型,核心目的是优化结果的相关性或者目标指标,将更符合需求的结果排在更靠前的位置。调用重排序模型时,内容生成成功会计费,内容生成失败不计费。按Token计费:统计模型进行实时推理服务时消耗的Token数量,按Token数量付费。具体价格请以MaaS控制台为准。计费项说明用于模型推理的To - [MaaS Token Plan计费项](https://support.huaweicloud.com/price-maas/price-maas-0035.md): MaaS Token Plan是专为开发者设计的订阅服务。在MaaS平台上购买Token Plan套餐后,您可以快速接入主流 AI 工具,加速开发流程。Token Plan个人版套餐适用于个人开发场景,可助力开发者完成个人项目、学习实践、工具搭建等编码任务。Token Plan仅支持按照套餐方式计费。您可以先在MaaS控制台的管理与统计 - [计费周期](https://support.huaweicloud.com/price-maas/price-maas-0012.md): 为提升费用结算的时效性与用户体验,将对部分模型服务(不含供给方式为“三方服务”的模型服务)功能的计费周期模式进行升级,将现有的按小时计费模式,升级为按5分钟周期计费模式。本次升级对平台模型服务(供给方式为“平台服务”)进行计费模式调整,三方模型服务(供给方式为“三方服务”)仍按小时计费模式。本次服务升级将于2026年4月17日开始分批引流 - [欠费说明](https://support.huaweicloud.com/price-maas/price-maas-0013.md): 用户在使用云服务时,账户的可用额度小于待结算的账单,即被判定为账户欠费。欠费后,可能会影响云服务资源的正常运行,请及时充值。已购买套餐包/资源包,但使用量超出套餐包额度,进而产生按需费用,同时账户中的余额不足以抵扣产生的按需费用。您需要重新购买套餐包或保证账户中的余额充足。未购买套餐包,在按需计费模式下账户的余额不足。当您的账号因按需资源 ## 配置MaaS访问授权 - [配置MaaS访问授权](https://support.huaweicloud.com/permission-maas/maas-modelarts-0016.md): 如果您是IAM用户,且首次使用MaaS服务,您需要联系您的管理员为您授予使用MaaS服务的相关权限。管理员需要在IAM控制台为MaaS用户组授予MaaS所依赖服务的IAM权限,然后通过权限管理功能授予MaaS服务拥有访问OBS,VPC等服务的相关权限。具体操作流程如下:为了使IAM子用户拥有委托授权的相关权限,管理员需要提前在IAM管理控 ## 首次调用大模型API - [首次调用大模型API](https://support.huaweicloud.com/qs-maas/qs-maas-0001.md): MaaS支持通过API调用大模型,涵盖Python、Curl、OpenAI接入方式。本文以文本对话预置模型openPangu-2.0-Pro为例,快速指导您完成大模型API调用。已注册华为账号并开通华为云,进行了实名认证,且在使用MaaS前检查账号状态,账号不能处于欠费或冻结状态。具体操作请参见注册华为账号并开通华为云和实名认证。请参考配 ## 模型调用 - [模型列表](https://support.huaweicloud.com/model-call-maas/usermanual_maas_0008.md): MaaS提供多种模型供您使用。您可以根据教程或者API说明,便捷地将模型服务整合到自身业务当中。下表列出了支持文本生成能力的模型,介绍了模型参数(模型 ID)、模型支持的能力、模型的长度限制(上下文长度、最大输入长度、最大输出长度和最大思维链长度)、模型限流信息;您可根据需要选择合适的模型。文本生成的教程请见文本生成,API说明请参见对话 - [文本生成概述](https://support.huaweicloud.com/model-call-maas/model-call-004.md): 在开发智能应用的过程中,开发者经常需要处理文本理解和生成的任务,但传统的文本处理方法往往效率低下且效果不佳。语言大模型具备文本理解和文字对话的能力,如当您传入文本信息时,大模型可以理解信息,并结合这些信息进行回复。然而,如何高效地利用这些大模型成为了一个挑战。本文主要介绍MaaS文本类型模型的使用场景,支持的模型,以及如何在模型API中设 - [多轮对话](https://support.huaweicloud.com/model-call-maas/model-call-100.md): chat.completions接口是无状态的,不会存储历史对话。为了实现多轮对话,模型需要在每次请求时,将历史信息都放在messages中,并通过role字段设置,让模型了解之前不同角色的不同对话内容(系统消息、用户消息、模型回复的消息),以便进行主题相关的延续性对话。模型调用的完整参数列表请见对话Chat/Post。已在模型推理 > - [流式输出](https://support.huaweicloud.com/model-call-maas/model-call-101.md): 流式输出(Streaming Output) 是指大模型在生成回复时,每产生一个片段就立即推送给调用方,而非等待全部内容生成完毕后一次性返回。降低了首字延迟,用户更快看到响应,提升交互体验。工作原理如下:请求发起:调用方发起请求,标识启用流式模式,"stream"字段取值为“True”。逐步生成:模型逐个 Token 生成内容。逐块推送: - [深度思考](https://support.huaweicloud.com/model-call-maas/model-call-005.md): 在处理复杂任务时,传统的模型往往难以提供全面和深入的回答。您可使用具备深度思考能力的模型来处理复杂任务。模型在回答问题前,会对问题进行分析和拆解,并基于对问题的拆解回答问题,回答会更加全面和深入。当您向模型提问时,MaaS返回模型回答问题前的问题思考逻辑(思维链内容),基于此可观察模型推导过程并使用这部分信息。通过启用具备深度思考能力的模 - [前缀续写](https://support.huaweicloud.com/model-call-maas/model-call-006.md): 在日常的文本处理任务中,如撰写文章、构建聊天机器人的回复等,可能会遇到需要根据已有的文本片段生成后续内容的需求。然而,手动完成这些任务不仅耗时,而且效率低下。如何确保生成的后续内容既符合语义又高效呢?MaaS支持模型前缀续写能力。用户给定一段文本的前缀(即开头部分),大模型即可按照用户要求生成语义连贯、合理的后续文本内容。前缀续写可以应用 - [Function Call](https://support.huaweicloud.com/model-call-maas/model-call-008.md): 工具调用(Tool Calling,Function Call,FC)是一种将大模型与外部工具和API相连的关键功能,作为自然语言与信息接口之间的“翻译官”,它能够将用户的自然语言请求智能地转化为对特定工具或API的调用,从而高效满足用户的特定需求。工作原理:开发者通过自然语言向模型描述工具的功能和定义,模型在对话过程中自主判断是否需要调 - [图像理解](https://support.huaweicloud.com/model-call-maas/model-call-011.md): 在多媒体内容处理领域,用户经常需要对图片或视频中的视觉信息进行分析和理解。然而,传统的处理方法往往需要复杂的图像处理技术和算法,这不仅增加了开发成本,也提高了技术门槛。部分大模型具备视觉理解能力,如当您传入图片或视频时,大模型可以理解图片或视频里的视觉信息,并结合这些信息完成如描述其中的物体等视觉相关任务。如何利用这些大模型简化多媒体内容 - [图片生成](https://support.huaweicloud.com/model-call-maas/model-call-012.md): MaaS支持通过图片生成模型(Qwen-Image-Edit)将用户输入的文本提示词及图片进行处理,输出符合预期的图片。还支持通过调用图片生成模型API,用户可输入文本、单图或多图,实现多图融合创作、图像编辑等多样化玩法。文生图(Text-to-Image) 是指用户输入自然语言描述(提示词),由大模型自动生成对应图像的技术。其核心流程为 - [视频生成概述](https://support.huaweicloud.com/model-call-maas/model-call-063.md): 在当今的数字内容创作领域,创作者们经常面临从零开始制作视频的挑战,这不仅耗时而且需要专业的编辑技能。视频生成模型具备出色的语义理解能力,可根据用户输入的文本、图片等内容,快速生成优质的视频片段,极大地简化了视频创作过程。然而,对于许多初学者来说,如何有效地利用这些高级工具仍然是一个难题。通过本文档您可以学习到如何通过调用视频生成模型API - [文生视频](https://support.huaweicloud.com/model-call-maas/model-call-064.md): 文生视频,简单来说就是“通过提示词生成视频”。你只需要输入一段描述性的文字,比如“一只猫在夕阳下的草地上奔跑”,文生视频功能就能自动理解你的意思,并生成一段对应的动态视频画面。MaaS支持模型以及相关参数,请参见支持模型。模型调用的完整参数列表请见通义万相创建视频生成任务、生数科技创建文生视频任务以及爱诗科技创建文生视频任务。任务数据(如 - [图生视频](https://support.huaweicloud.com/model-call-maas/model-call-065.md): 图生视频简单来说,就是让一张静止的图片“动起来”,变成一段视频。MaaS支持模型以及相关参数,请参见支持模型。已在模型推理 > 在线推理 > 预置服务页签开通预置服务。详情请见开通MaaS预置服务。(可选)如果需要控制服务调用流量,可提前创建自定义接入点(三方模型暂不支持创建自定义接入点),详情请参见MaaS创建自定义接入点。已获取API - [参考生视频](https://support.huaweicloud.com/model-call-maas/model-call-066.md): 基于参考图像和文本提示词生成视频。例如,以一张或者多张静态图片作为基础,通过模型根据这张图片的内容、风格或结构,生成一段动态视频。简单来说,就是让一张或者多张“静止的画”动起来,或者基于这张图的创意延伸出新的视频画面。MaaS支持模型以及相关参数,请参见支持模型。已在模型推理 > 在线推理 > 预置服务页签开通预置服务。详情请见开通Maa - [基于首尾帧生视频](https://support.huaweicloud.com/model-call-maas/model-call-067.md): 图生视频中的基于首尾帧技术,简单来说就是利用两张静态图片作为起点和终点,通过模型自动补全中间的过程,生成一段流畅的视频。MaaS支持模型以及相关参数,请参见支持模型。已在模型推理 > 在线推理 > 预置服务页签开通预置服务。详情请见开通MaaS预置服务。已获取API Key。详情请见在MaaS管理API Key。已获取模型服务的model - [文本向量化](https://support.huaweicloud.com/model-call-maas/model-call-014.md): 向量化模型是将人类语言和各类信息“翻译”成计算机能够直接进行数学处理和逻辑推理的“通用语言”,就像为各种信息(例如一段话、一张图片)创建一个专属的“数字指纹”。有了这个数字指纹,计算机就能理解信息的意思,并判断不同信息之间的相似性,而不仅是做表面的文字匹配。核心思想:从“关键词”到“语义”传统方法:例如搜索“苹果”,只能找到包含“苹果”这 - [重排序](https://support.huaweicloud.com/model-call-maas/model-call-015.md): 在电商搜索或信息检索场景中,用户期望获取与查询高度相关的结果,但文本检索系统在“召回”阶段为保证效率,返回的结果可能不够精准。通过文本排序模型可对召回的文档进行二次精准排序。创建重排序API提供灵活的数据项排序功能,确保最相关结果优先展示,从而提升用户体验和应用准确率。已在模型推理 > 在线推理 > 预置服务页签开通预置服务。详情请见开通 - [MaaS标准API V2](https://support.huaweicloud.com/model-call-maas/model-call-019.md): 该功能仅支持“西南-贵阳一”区域。您可以登录MaaS控制台,在模型广场页面的模型详情页面,查看模型的详细信息。请求示例如下:Linux环境下执行如下命令:响应示例:data: {"id":"346ebea908644dffac013c1a44e3ba8e","object":"chat.completion.chunk","created - [MaaS标准API V1](https://support.huaweicloud.com/model-call-maas/model-call-020.md): 本文介绍对话Chat相关API的调用规范。MaaS标准API V1接口不再演进,建议优先使用MaaS标准API V2接口。该功能仅支持“西南-贵阳一”区域。对于支持图片上传的模型,单个图片文件的大小不超过10MB。如果以Base64编码形式上传图片,需确保编码后的图片小于10MB。鉴权说明MaaS推理服务支持使用API Key鉴权,鉴权头 - [OpenAI兼容接口](https://support.huaweicloud.com/model-call-maas/model-call-021.md): 该功能仅支持“西南-贵阳一”区域。您可以登录MaaS控制台,在模型广场页面的模型详情页面,查看模型的详细信息。请求示例如下:Linux环境下执行如下命令:响应示例:data: {"id":"8697e7dad55f4ad5ae65f006ba18f2fc","object":"chat.completion.chunk","created - [Anthropic兼容接口](https://support.huaweicloud.com/model-call-maas/model-call-022.md): 该功能仅支持“西南-贵阳一”区域。您可以登录MaaS控制台,在模型广场页面的模型详情页面,查看模型的详细信息。请求示例如下:Linux环境下执行如下命令:响应示例:请求示例如下:Linux环境下执行如下命令:响应示例:{ "content": [ { "text": "北京今天的天气:**晴**,气温 **26°C - [图片生成](https://support.huaweicloud.com/model-call-maas/model-call-023.md): 图片生成API用于根据给定的文本提示词同步生成图像。其业务逻辑为接收包含模型名称、文本提示词以及图片生成参数(如图像尺寸、随机数种子等)的请求,调用相应模型进行图片生成,并返回生成结果的URL以及相关状态和使用信息。预置服务:已在模型推理 > 在线推理 > 预置服务页签开通Qwen_Image、Qwen-Image-Edit模型的预置服务 - [创建文生视频任务](https://support.huaweicloud.com/model-call-maas/model-call-070.md): 创建视频生成任务API用于根据用户的输入信息,如文本提示词等,结合指定的模型及视频处理参数,生成相应的视频片段。其业务逻辑是将用户输入的各种参数传递给后端模型进行处理,最终输出生成的视频链接。适用平台模型(通义万相系列)。POST https://api.modelarts-maas.com/v1/video/generations状态码 - [创建图生视频任务](https://support.huaweicloud.com/model-call-maas/model-call-083.md): 创建视频生成任务API用于根据用户的输入信息,如文本提示词、图片等,结合指定的模型及视频处理参数,生成相应的视频片段。其业务逻辑是将用户输入的各种参数传递给后端模型进行处理,最终输出生成的视频链接。适用平台模型(通义万相系列)。POST https://api.modelarts-maas.com/v1/video/generations - [根据视频任务ID查询视频](https://support.huaweicloud.com/model-call-maas/model-call-025.md): 根据创建视频生成任务任务ID查询视频生成任务的详细信息和状态。任务数据(如任务状态、视频URL等)仅保留24小时,超时后会被自动清除。请您务必及时保存生成的视频。GET https://api.modelarts-maas.com/v1/video/generations/{task_id}状态码:200状态码:200视频任务详情。请参见 - [创建文生视频任务](https://support.huaweicloud.com/model-call-maas/model-call-073.md): 根据用户输入提示词文本,生成视频。适用生数模型。POST https://api.modelarts-maas.com/v1/video/generations状态码:200文生视频(vidu/viduq3-turbo_text2video 为例)- Pythonimport requests import json if __name - [创建图生视频任务](https://support.huaweicloud.com/model-call-maas/model-call-074.md): 根据用户输入图像和提示词文本,生成视频。适用生数模型。POST https://api.modelarts-maas.com/v1/video/generations状态码:200图生视频(vidu/viduq3-turbo_img2video 为例)- Pythonimport requests import json if __na - [创建首尾帧视频生成任务](https://support.huaweicloud.com/model-call-maas/model-call-075.md): 根据用户传入的首尾帧图像和文本提示词,生成视频。适用生数模型。POST https://api.modelarts-maas.com/v1/video/generations状态码:200图生视频(基于首尾帧)(vidu/viduq3-turbo_start-end2video 为例)- Pythonimport requests imp - [创建参考生视频生成任务](https://support.huaweicloud.com/model-call-maas/model-call-076.md): 根据用户输入的参考图像和文本提示词,生成视频。适用生数模型。POST https://api.modelarts-maas.com/v1/video/generations状态码:200图生视频(基于参考图)(以vidu/viduq3-turbo_reference2video 为例)- Pythonimport requests imp - [根据视频任务ID查询视频](https://support.huaweicloud.com/model-call-maas/model-call-077.md): 根据创建视频生成任务接口生成任务ID查询视频生成任务的详细信息和状态。任务数据(如任务状态、视频URL等)仅保留24小时,超时后会被自动清除。请您务必及时保存生成的视频。GET https://api.modelarts-maas.com/v1/video/generations/{task_id}状态码:200状态码:200视频任务详情 - [创建文生视频任务](https://support.huaweicloud.com/model-call-maas/model-call-079.md): 根据用户输入提示词文本,生成视频。适用爱诗模型。POST https://api.modelarts-maas.com/v1/video/generations状态码:200文生视频(pixverse/pixverse-v6-t2v 为例)- Pythonimport requests import json if __name__ = - [创建图生视频任务](https://support.huaweicloud.com/model-call-maas/model-call-080.md): 根据用户输入图像和提示词文本,生成视频。适用爱诗模型。POST https://api.modelarts-maas.com/v1/video/generations状态码:200图生视频(pixverse/pixverse-v6-it2v 为例)- Pythonimport requests import json if __name - [创建首尾帧视频生成任务](https://support.huaweicloud.com/model-call-maas/model-call-081.md): 根据用户传入的首尾帧图像和文本提示词,生成视频。适用爱诗模型。POST https://api.modelarts-maas.com/v1/video/generations状态码:200图生视频(基于首尾帧)(pixverse/pixverse-v6-kf2v 为例)- Pythonimport requests import json - [创建参考生视频生成任务](https://support.huaweicloud.com/model-call-maas/model-call-082.md): 根据用户输入的参考图像和文本提示词,生成视频。适用爱诗模型。POST https://api.modelarts-maas.com/v1/video/generations状态码:200图生视频(基于参考图)(pixverse/pixverse-v6-r2v 为例)- Pythonimport requests import json - [根据视频任务ID查询视频](https://support.huaweicloud.com/model-call-maas/model-call-071.md): 根据创建视频生成任务任务ID查询视频生成任务的详细信息和状态。任务数据(如任务状态、视频URL等)仅保留24小时,超时后会被自动清除。请您务必及时保存生成的视频。GET https://api.modelarts-maas.com/v1/video/generations/{task_id}状态码:200状态码:200视频任务详情。请参见 - [创建文本向量化](https://support.huaweicloud.com/model-call-maas/model-call-027.md): 创建文本向量化API用于将文本数据转换为数值向量,以便于在机器学习和自然语言处理任务中使用。这些向量可以捕捉文本的语义信息,使得机器学习模型能够理解和处理文本数据。预置服务:已在模型推理 > 在线推理 > 预置服务页签开通BGE-M3模型的预置服务。具体操作,请参见MaaS开通预置服务。自定义接入点:已在模型推理 > 在线推理 > 自定义 - [创建重排序](https://support.huaweicloud.com/model-call-maas/model-call-028.md): 创建重排序API用于提供灵活的数据项排序功能,以提升用户体验和应用的可定制性。预置服务:已在模型推理 > 在线推理 > 预置服务页签开通BGE-Reranker-V2-M3模型的预置服务。具体操作,请参见MaaS开通预置服务。自定义接入点:已在模型推理 > 在线推理 > 自定义接入点页签为bge-reranker-v2-m3或Qwen3- - [获取模型列表Models/GET](https://support.huaweicloud.com/model-call-maas/model-call-029.md): 本文介绍如何通过Models接口查询模型列表的API调用规范。该功能仅支持“西南-贵阳一”区域。鉴权说明MaaS推理服务支持使用API Key鉴权,鉴权头采用如下格式:'Authorization': 'Bearer 该服务所在Region的ApiKey'MaaS推理服务支持使用API Key鉴权,鉴权头采用如下格式:响应参数说明响应参数 - [错误码](https://support.huaweicloud.com/model-call-maas/model-call-035.md): 在调用MaaS模型服务时,可能出现的错误码及相关信息如下。 - [华为云码道(CodeArts)代码智能体](https://support.huaweicloud.com/model-call-maas/model-call-227.md): 华为云码道代码智能体支持企业接入第三方大语言模型,可根据业务场景灵活定制,并满足企业私有化部署、数据安全与合规管控要求,实现模型能力与业务深度适配。华为云码道代码智能体专业版套餐支持通过控制台和客户端配置模型,基础版套餐和体验版套餐仅支持在客户端配置模型。控制台:仅华为云码道企业管理员可配置模型,并可管控华为云码道企业成员在客户端配置模型 - [果办OfficeAce](https://support.huaweicloud.com/model-call-maas/model-call-228.md): 果办OfficeAce是办公场景专属的桌面AI助手,致力于以AI重构桌面办公体验。不同于传统的对话AI,果办OfficeAce是能直接操控软件、处理文件、执行流程的数字办公专家。它通过自动化处理重复事务、智能整合信息及协作辅助,将用户从繁琐操作中解放出来,大幅提升办公效率,让智能办公触手可及。接入前请确保已开通预置模型服务,如未开通,请前 - [OpenClaw](https://support.huaweicloud.com/model-call-maas/maas-modelarts-0908.md): 在软件开发过程中,开发者经常面临代码编写效率低、调试困难等问题。OpenClaw是一款开源的个人AI助手平台,通过接入大模型可帮助开发者高效完成代码开发、调测。然而,如何将这些先进的AI能力快速集成到现有的开发环境中,成为了一个新的挑战。您可通过简单配置,把MaaS模型API接入OpenClaw,从而轻松实现AI能力的集成,提高开发效率。 - [OpenCode](https://support.huaweicloud.com/model-call-maas/maas-modelarts-0909.md): 在软件开发过程中,开发者经常面临代码编写效率低、调试困难等问题。OpenCode是一款AI编程工具,通过接入大模型可帮助开发者高效完成代码开发、调测。然而,如何将这些先进的AI能力快速集成到现有的开发环境中,成为了一个新的挑战。您可通过简单配置,把MaaS模型API接入OpenCode,从而轻松实现AI能力的集成,提高开发效率。本文档旨在 - [Claude Code](https://support.huaweicloud.com/model-call-maas/model-call-060.md): 在软件开发过程中,开发者经常面临代码编写效率低、调试困难等问题。Claude Code是一款AI编程工具,通过接入大模型可帮助开发者高效完成代码开发、调测。然而,如何将这些先进的AI能力快速集成到现有的开发环境中,成为了一个新的挑战。您可通过简单配置,把MaaS模型API接入Claude Code,从而轻松实现AI能力的集成,提高开发效率 - [Dify](https://support.huaweicloud.com/model-call-maas/model-call-037.md): 客服系统是企业与消费者沟通的重要桥梁,然而传统的人工客服存在着人工成本高昂、数据收集和分析困难、难以24小时提供服务等痛点。随着AI大模型的崛起,如何利用先进的大语言模型构建AI智能客服系统,提供更加自然、流畅的对话体验,提高用户使用效率,实现24*7的无间断服务,降低企业在客服场景下的投入成本,提升用户满意度成为企业和用户关注的热门领域 - [Cherry Studio](https://support.huaweicloud.com/model-call-maas/model-call-038.md): 在人工智能飞速发展的当下,大语言模型(LLMs)已成为推动自然语言处理应用革新的关键力量。DeepSeek作为一系列具有高效计算架构和强大推理能力的大规模语言模型,备受瞩目。与此同时,为了让用户更便捷地使用这些大语言模型,各种模型调用工具和平台应运而生。Cherry Studio便是其中一款功能强大的开源多模型桌面客户端,支持Window - [Cursor](https://support.huaweicloud.com/model-call-maas/model-call-040.md): Cursor是一款基于人工智能技术的现代化代码编辑器,专为开发者设计。它结合了传统编辑器(例如VS Code)的强大功能与AI驱动的智能编程能力,能够提供智能代码补全、自然语言编程、代码库理解等核心功能,极大地提升了开发效率。此外,Cursor支持多种主流AI模型(例如OpenAI的GPT-4、DeepSeek等),并提供灵活的自定义配置 - [Cline](https://support.huaweicloud.com/model-call-maas/model-call-041.md): Cline是一款基于大语言模型的VS Code插件,能够有效处理复杂的软件开发任务。借助VS Code开发平台,Cline为开发者带来了便捷高效的编程体验。Cline的优势如下:深度融合MaaS:Cline支持接入MaaS平台的DeepSeek系列模型服务。文件管理与代码纠错:支持便捷地创建和编辑文件,实时监控Linter和编译器的错误信 - [RAGFlow](https://support.huaweicloud.com/model-call-maas/model-call-042.md): RAGFlow是一款基于深度文档理解构建的开源RAG引擎,专为处理复杂数据结构与生成高质量问答而设计。该引擎结合了先进的检索技术和大型语言模型(LLM),支持多种数据格式(例如PDF、Word、Excel、图片等)的深度解析和知识提取。通过多路召回、融合重排序和可视化文本切片等功能,RAGFlow提供了精准、可解释且高效的信息处理能力,适 - [Deep Research](https://support.huaweicloud.com/model-call-maas/model-call-043.md): Deep Research是一款新型AI深度研究工具,它能够通过联网搜索和多步骤推理,快速生成专业级的研究报告,帮助用户在短时间内完成复杂的多步骤研究任务。该工具适用于金融、科学、政策、工程等领域,特别适用于需要深度分析和小众信息搜索的场景。MaaS服务将DeepSeek系列模型部署到平台,基于华为云昇腾云服务的全栈优化适配,可获得持平全 - [管理API Key](https://support.huaweicloud.com/model-call-maas/model-call-049.md): 在使用MaaS时,用户经常需要通过API接口调用模型服务进行数据请求和模型推理等操作。然而,如果API Key管理不当(如密钥丢失或泄露),可能导致未经授权的访问风险,从而影响服务的安全性和稳定性。如何确保API Key的安全管理,防止未授权访问?为了解决这个问题,MaaS平台提供了API Key管理功能,支持对API Key进行创建、编 - [在模型广场查看预置模型](https://support.huaweicloud.com/model-call-maas/model-call-050.md): MaaS平台提供了丰富的开源大模型,在“模型广场”页面可以查看。模型详情页可以查看模型的详细介绍,根据这些信息选择合适的模型进行训练、推理,接入到企业解决方案中。已注册华为账号并开通华为云,详情请见注册华为账号并开通华为云。目前三方服务仅支持个人用户开通。调用预置服务:不同类型的模型计费不同,计费详情请参见MaaS预置模型服务计费项。在模 - [使用预置服务](https://support.huaweicloud.com/model-call-maas/model-call-052.md): MaaS预置服务为企业用户提供高性能、高可用的推理API服务,支持按Token用量计费的模式。该服务适用于需要商用级稳定性、更高调用频次和专业支持的场景。企业智能客服:企业希望利用推理API优化客服系统,实现智能问答、意图识别,提升客服效率与客户满意度。内容创作辅助:媒体、广告公司借助推理API进行文案创作、创意生成,提高内容产出的效率与 - [使用自定义接入点](https://support.huaweicloud.com/model-call-maas/model-call-048.md): MaaS支持用户创建自定义接入点,通过自定义接入点名称进行模型调用(model参数设置),实现不同业务场景或模型版本的分流与精细化管理。在使用大语言模型进行推理服务时,推理接入点(Endpoint)是模型调用的关键入口。开发者只需通过指定的ID即可向大模型发起API推理请求,实现快速接入与灵活调用。然而在企业和开发者的AI应用开发与运营过 - [在MaaS体验文本对话](https://support.huaweicloud.com/model-call-maas/model-call-055.md): 在使用MaaS进行模型测试时,用户常需快速验证模型的文本对话效果,但传统方法往往因配置复杂和准备时间长而难以满足这一需求。如何在保证准确性的同时,快速体验模型的文本对话效果?MaaS支持使用“预置服务”、“自定义接入点”进行在线文本对话,还支持对比同一文本对话模型的不同版本或不同模型,帮助您快速体验模型的文本对话效果,提高测试效率。该功能 - [在MaaS体验图像理解](https://support.huaweicloud.com/model-call-maas/model-call-056.md): 在日常工作中,当您需要快速理解图像内容时(如分析产品设计图、解读活动现场照片等),通常会遇到人工处理耗时耗力、细节遗漏和专业门槛等问题。如何高效解决这些问题?MaaS提供图像理解功能,帮助您快速准确地分析图像内容,提高工作效率。该功能仅支持“西南-贵阳一”区域。单次对话一次只能发送一张图片,且必须携带文字。图片大小不能超过10MB,图片格 - [在MaaS体验图片生成](https://support.huaweicloud.com/model-call-maas/model-call-057.md): 在日常的创意设计和内容创作过程中,用户经常需要根据特定的文字描述快速生成对应的图片,以辅助创意构思或直接用于项目中。然而,传统的图片生成方式往往需要依赖专业的图片处理软件,不仅操作复杂,而且成本较高。MaaS提供图片生成在线体验功能,用户只需选择合适的模型,按需配置提示词、图片尺寸等信息,即可快速生成所需图片。图片生成后还可以直接下载使用 - [在移动端体验MaaS文本对话](https://support.huaweicloud.com/model-call-maas/model-call-059.md): MaaS提供了移动端的文本对话功能,帮助您快速在移动端华为云App体验GLM-5.1模型的文本对话效果。使用已开通的预置服务将消耗Token,费用请以实际发生为准。关于如何计费,请参见计费说明。已注册华为云账号,并进行实名认证。具体操作,请参见注册华为账号并开通华为云和实名认证。打开MaaS,跳转至模型服务体验页面。在模型服务体验页面,将 ## Token plan - [Token Plan个人版套餐概览](https://support.huaweicloud.com/Token-plan-maas/tokenplan-maas-0001.md): MaaS Token Plan是专为开发者设计的订阅服务。在MaaS平台上购买Token Plan套餐后,您可以快速接入主流AI工具,加速开发流程。Token Plan优势如下:多代码模型灵活切换:一次订阅即可按需自由切换GLM-5.1、Kimi-K2.6、DeepSeek-V4-Flash最新版本模型。兼容主流AI工具:支持华为云码道( - [华为云码道(CodeArts)代码智能体](https://support.huaweicloud.com/Token-plan-maas/tokenplan-maas-0014.md): 华为云码道代码智能体支持企业接入第三方大语言模型,可根据业务场景灵活定制,并满足企业私有化部署、数据安全与合规管控要求,实现模型能力与业务深度适配。已订阅MaaS Token Plan套餐,并获取模型ID、模型URL和API Key。具体操作请参见快速开始。已购买华为云码道CodeArts代码智能体专业版套餐。已获取华为云码道企业成员或企 - [果办OfficeAce](https://support.huaweicloud.com/Token-plan-maas/tokenplan-maas-0015.md): 果办OfficeAce是办公场景专属的桌面AI助手,致力于以AI重构桌面办公体验。不同于传统的对话AI,果办OfficeAce是能直接操控软件、处理文件、执行流程的数字办公专家。它通过自动化处理重复事务、智能整合信息及协作辅助,将用户从繁琐操作中解放出来,大幅提升办公效率,让智能办公触手可及。已订阅MaaS Token Plan套餐。具体 - [Claude Code](https://support.huaweicloud.com/Token-plan-maas/tokenplan-maas-0003.md): 在日常开发过程中,开发者经常面临代码编写效率低下、调试困难等问题,严重影响了项目的进度和质量。Claude Code作为一款终端内AI编程助手,旨在通过自然语言交互帮助开发者更快地编写、调试和管理代码。然而,如何高效利用Claude Code的功能,进一步提升开发效率和代码质量,成为了开发者面临的新挑战。您可以在MaaS平台上购买Toke - [OpenClaw](https://support.huaweicloud.com/Token-plan-maas/tokenplan-maas-0004.md): OpenClaw是一个开源的个人AI助手,能够连接到多种消息平台。通过Token Plan等渠道,用户可以配置并使用MaaS平台上的模型。已订阅MaaS Token Plan套餐。具体操作请参见快速开始。该功能仅支持“西南-贵阳一”区域。接入工具的核心参数如下:安装Node.js 22或更高版本。在安装过程中勾选 “Add to PATH - [OpenCode](https://support.huaweicloud.com/Token-plan-maas/tokenplan-maas-0008.md): 在软件开发过程中,开发者经常面临代码编写效率低、调试困难等问题。OpenCode是一款AI编程工具,通过接入大模型可帮助开发者高效完成代码开发、调测。然而,如何将这些先进的AI能力快速集成到现有的开发环境中,成为了一个新的挑战。您可通过简单配置,把MaaS模型API接入OpenCode,从而轻松实现AI能力的集成,提高开发效率。本文档旨在 - [Cherry Studio](https://support.huaweicloud.com/Token-plan-maas/tokenplan-maas-0009.md): Cherry Studio是一款功能强大的开源多模型桌面客户端,支持Windows、macOS和Linux系统。它支持接入多种主流大语言模型(例如OpenAI、DeepSeek、Gemini等),并支持本地模型运行。此外,它还具备丰富的功能,例如对话知识库、AI绘画、翻译、多模型切换等。MaaS模型即服务部署了多款模型服务,如GLM,Ki - [Dify](https://support.huaweicloud.com/Token-plan-maas/tokenplan-maas-0012.md): 客服系统是企业与消费者沟通的重要桥梁,然而传统的人工客服存在着人工成本高昂、数据收集和分析困难、难以24小时提供服务等痛点。随着AI大模型的崛起,如何利用先进的大语言模型构建AI智能客服系统,提供更加自然、流畅的对话体验,提高用户使用效率,实现24*7的无间断服务,降低企业在客服场景下的投入成本,提升用户满意度成为企业和用户关注的热门领域 - [Token Plan套餐相关问题](https://support.huaweicloud.com/Token-plan-maas/tokenplan-maas-0006.md): 目前MaaS Token Plan主要面向个人开发者,企业用户暂不支持购买Token Plan套餐。同一订阅套餐可在所有支持的工具中使用,额度共享。套餐额度仅在AI工具中生效,不可用于API调用。在非AI工具中使用MaaS Token Plan权益对应的专属Base URL和API Key可能会被识别为滥用或违规行为,导致订阅停用或账号封 - [接入AI工具相关问题](https://support.huaweicloud.com/Token-plan-maas/tokenplan-maas-0007.md): 不会。Token Plan默认不存储用户对话数据用于模型调优等用途,充分保证用户数据隐私。可以。您可以参考OpenClaw最佳实践汇总,对接通讯或办公平台。您可以参照以下操作,在控制台查看模型在编码工具中默认的thinking行为。真实使用时可由编码工具通过指定参数修改思考行为。登录MaaS控制台,在模型广场 > 模型详情页面的版本区域, - [错误码](https://support.huaweicloud.com/Token-plan-maas/tokenplan-maas-0013.md): 在调用Token Plan时,可能出现的错误码及相关信息如下。 ## 用量统计与性能监控 - [在MaaS查看在线推理的调用数据和监控指标](https://support.huaweicloud.com/call-statistics-maas/maas-modelarts-0074.md): MaaS提供调用统计功能,支持查看预置服务、自定义接入点在指定时间段内的调用数据和监控指标详情,包括总调用次数、总调用失败次数、总调用Tokens数、输入Tokens数、输出Tokens数、端到端时延等信息,并以分钟为最小时间粒度展示数据趋势,帮助您了解服务的使用情况和性能变化,从而更有效地进行模型评估、问题定位、故障排除和性能优化。资源 - [在CES查看MaaS调用数据和监控指标](https://support.huaweicloud.com/call-statistics-maas/maas-modelarts-0095.md): 云监控服务CES提供云服务监控功能,支持查看MaaS预置服务、自定义接入点在指定时间段内的调用数据和监控指标详情,包括RPM、TPM、请求失败率、输入Tokens数、输出Tokens数等信息,并以分钟为最小时间粒度展示数据趋势,帮助您了解服务的使用情况和性能变化,从而更有效地进行模型评估、问题定位、故障排除和性能优化。资源消耗监控:跟踪模 ## 最佳实践 - [MaaS最佳实践总览](https://support.huaweicloud.com/bestpractice-maas/bestpractice_maas_0000.md): 本文汇总了MaaS模型即服务的常见应用场景,并为每个场景提供详细的方案描述和操作指南,以帮助您快速了解并使用MaaS完成AI开发。 - [快速体验GLM-5.2模型](https://support.huaweicloud.com/bestpractice-maas/bestpractice_maas_0013_01.md): GLM-5.2是智谱AI于2026年6月17日正式上线并开源的新一代旗舰大模型。长程任务能力显著提升,减少复杂任务中的上下文漂移与目标遗忘;在复杂系统工程、深度调试中表现更稳。您可通过该模型进行对话,代码编程等操作。本文以预置模型GLM-5.2的文本对话为例,指导您完成文本对话以及模型API调用。模型能力详情请参考模型列表。已注册华为云账 - [快速体验openPangu-2.0-Pro模型](https://support.huaweicloud.com/bestpractice-maas/bestpractice_maas_0021_02.md): 开源盘古(openPangu )是华为开源AI模型品牌,致力于通过昇腾原生训练与推理技术,为业界用好昇腾提供最佳实践参考,助力打造Agent时代强大的智能底座,加快人工智能商业创新和生态繁荣。openPangu-2.0-Pro是基于昇腾NPU训练的大规模混合专家(MoE)语言模型,参数规模约505B,每token激活参数规模约18B,模型 - [快速体验openPangu-2.0-Flash模型](https://support.huaweicloud.com/bestpractice-maas/bestpractice_maas_0021_01.md): 开源盘古(openPangu )是华为开源AI模型品牌,致力于通过昇腾原生训练与推理技术,为业界用好昇腾提供最佳实践参考,助力打造Agent时代强大的智能底座,加快人工智能商业创新和生态繁荣。本文以预置模型openPangu-2.0-Flash的文本对话为例,指导您完成文本对话以及模型API调用。模型能力详情请参考模型列表。已注册华为云账 - [快速体验Kimi-K2.6模型](https://support.huaweicloud.com/bestpractice-maas/bestpractice_maas_0012_01.md): Kimi-K2.6是Kimi最新最智能的模型,Kimi-K2.6的通用Agent、代码等综合能力得到全面提升,您可通过该模型进行对话,代码编程等操作。本文以预置模型Kimi-K2.6的文本对话为例,指导您完成文本对话以及模型API调用。模型能力详情请参考模型列表。已注册华为云账号,并进行实名认证。具体操作,请参见注册华为账号并开通华为云和 - [快速体验DeepSeek-V4-Pro模型](https://support.huaweicloud.com/bestpractice-maas/bestpractice_maas_0014_01.md): DeepSeek-V4-Pro是DeepSeek-V4系列的旗舰版本,采用混合专家(MoE)架构,拥有万亿级总参数与1M(百万 Token)超长上下文窗口。该模型在Agent能力、世界知识与推理性能上均实现开源领域领先:在Agentic Coding评测中达到当前开源模型最佳水平。您可通过该模型进行对话,代码编程等操作。本文以预置模型De - [快速体验DeepSeek-V4-Flash模型](https://support.huaweicloud.com/bestpractice-maas/bestpractice_maas_0003.md): 本案例用于指导用户使用MaaS的DeepSeek-V4-Flash模型服务,快速实现对话问答。在调用预置模型推理服务的过程中,输入内容首先会被分词(tokenize),转换为模型可识别的Token。在调用MaaS预置服务时,将根据实际使用的Tokens数量进行计费。详细信息,请参见推理服务计费项。该功能仅支持“西南-贵阳一”区域。请参考配 - [Cherry Studio](https://support.huaweicloud.com/bestpractice-maas/bestpractice_maas_0002.md): 在人工智能飞速发展的当下,大语言模型(LLMs)已成为推动自然语言处理应用革新的关键力量。DeepSeek作为一系列具有高效计算架构和强大推理能力的大规模语言模型,备受瞩目。与此同时,为了让用户更便捷地使用这些大语言模型,各种模型调用工具和平台应运而生。Cherry Studio便是其中一款功能强大的开源多模型桌面客户端,支持Window - [RAGFlow](https://support.huaweicloud.com/bestpractice-maas/bestpractice_maas_0006.md): RAGFlow是一款基于深度文档理解构建的开源RAG引擎,专为处理复杂数据结构与生成高质量问答而设计。该引擎结合了先进的检索技术和大型语言模型(LLM),支持多种数据格式(例如PDF、Word、Excel、图片等)的深度解析和知识提取。通过多路召回、融合重排序和可视化文本切片等功能,RAGFlow提供了精准、可解释且高效的信息处理能力,适 - [提示词工程概述](https://support.huaweicloud.com/bestpractice-maas/bestpractice_maas_0017.md): 提示词工程(Prompt Engineering)是指系统化设计、优化和管理输入提示,以引导生成式人工智能模型产出高质量、符合预期结果的技术方法。它不涉及模型参数修改,却能显著影响模型的输出精度、风格与可控性,是人与大模型高效交互的“编程语言”。华为云MaaS模型即服务支持提示词工程的能力,帮助企业将大模型潜能转化为稳定、可靠的生产力。客 - [文生文Prompt指南](https://support.huaweicloud.com/bestpractice-maas/bestpractice_maas_0018.md): 一个优秀的Prompt通常具备以下5个核心特征:目标明确。清楚地告诉AI“做什么”,通常以动词开头。示例如下:正例:请找出这段Python代码中的Bug,并给出修改建议。反例:帮我看下这段Python代码。正例:请找出这段Python代码中的Bug,并给出修改建议。反例:帮我看下这段Python代码。上下文充足。提供尽可能多的“已知条件” - [文生图Prompt指南](https://support.huaweicloud.com/bestpractice-maas/bestpractice_maas_0019.md): 一个好的图片生成提示词(Prompt)是清晰、具体、结构化的描述,它就像给AI画师的详细“拍摄脚本”,能极大提升生成图像的准确性、质量和可控性。本文将介绍如何撰写高质量的图片生成提示词,助您快速上手图像制作,将创意转化为图片。图片生成模型的关键能力,请参考能力说明。图片模型的API调用可参考图片生成。对于初次尝试AI创作的新用户,及将AI - [视频生成Prompt指南](https://support.huaweicloud.com/bestpractice-maas/bestpractice_maas_0020.md): 一个好的视频生成Prompt需要清晰、具体、结构化的描述,并提供丰富的视觉与动态描述。其核心是将文字想象力转化为算法可理解的视觉脚本。本文将介绍如何撰写高质量的文生视频提示词,助您快速上手视频制作,将您的创意转化为视频。MaaS提供多种视频生成大模型,支持文生视频(T2V)、图生视频(I2V/IT2V)、参考生视频(R2V)和首尾帧生视频 - [突发流量应对与服务保障指南](https://support.huaweicloud.com/bestpractice-maas/bestpractice_maas_0022.md): 本文面向MaaS平台企业客户,说明业务流量出现突发波动时的自助处置方法、平台保障能力与服务边界,帮助客户合理规划业务稳定性保障方案。MaaS平台对单位时间内的请求数(RPM/QPS)、Token 消耗量(TPM)、并发在途请求数,以及消耗增长速率设置上限。当业务请求超出上述任一维度上限时,超出的请求将被拒绝,通常以429状态码返回。各维度 ## API参考 - [使用前必读](https://support.huaweicloud.com/api-maas/api-maas-0001.md): 在调用MaaS API之前,请确保已经充分了解MaaS相关概念,详细信息请参见产品介绍。MaaS提供了REST(Representational State Transfer)风格API,支持您通过HTTPS请求调用,调用方法请参见如何调用API。终端节点(Endpoint)即调用API的请求地址,不同服务不同区域的终端节点不同,您可以从 - [API概览](https://support.huaweicloud.com/api-maas/api-maas-0002.md): 本文介绍MaaS支持的API,分别为模型API(文本生成、图片生成、视频生成等)和管控面API(自定义接入点、MaaS调用统计等)。 - [构造请求](https://support.huaweicloud.com/api-maas/api-maas-0004.md): 本节介绍REST API请求的组成,并以调用IAM服务的获取用户Token接口说明如何调用API,Token可以用于调用其他API时的鉴权。请求URI由如下部分组成:{URI-scheme} :// {Endpoint} / {resource-path} ? {query-string}例如您需要获取西南-贵阳一区域的Token,则需使 - [认证鉴权](https://support.huaweicloud.com/api-maas/api-maas-0005.md): 通用接口(自定义接入点、调用统计、以及查询AI开发平台相关接口)调用接口支持Token认证方式,即通过Token认证通用请求。模型API接口(文本生成、图片生成、视频生成)支持API Key认证方式。具体接口的认证方式请参考接口描述。Token的有效期为24小时,需要使用同一个Token鉴权时,可以缓存起来,避免频繁调用。Token在计算 - [返回结果](https://support.huaweicloud.com/api-maas/api-maas-0006.md): 请求发送以后,您会收到响应,包含:状态码、响应消息头和响应消息体。状态码是一组从1xx到5xx的数字代码,状态码表示了请求响应的状态,完整的状态码列表请参见状态码。对于获取用户Token接口,如果调用后返回状态码为201,则表示请求成功。对应请求消息头,响应同样也有消息头,如Content-type。对于获取用户Token接口,返回如图1 - [创建自定义接入点](https://support.huaweicloud.com/api-maas/api-maas-0013.md): 在企业和开发者的AI应用开发与运营过程中,面临着推理服务调用管理无序、流量控制困难、成本核算模糊等问题。多个业务线共用同一推理服务,导致资源争抢、服务性能不稳定,同时缺乏有效的调用限制手段,难以追溯各业务模块的资源消耗情况。MaaS支持自定义接入点功能,通过创建独立的调用入口,允许用户设置限流规则,并基于自定义接入点名称实现费用的精准统计 - [编辑自定义接入点](https://support.huaweicloud.com/api-maas/api-maas-0014.md): 该API用于编辑指定接入点的流控、内容安全护栏开关、接入点名称、接入点描述。该功能仅支持“西南-贵阳一”区域。自定义接入点创建后,不支持修改模型服务。PUT /v1/{project_id}/maas/services/custom-endpoint/endpoint/{custom_endpoint_id}MaaS非多模态模型:此处以修 - [查询自定义接入点](https://support.huaweicloud.com/api-maas/api-maas-0015.md): 该API用于查询用户接入点列表。该功能仅支持“西南-贵阳一”区域。GET /v1/{project_id}/maas/services/custom-endpoint/endpoint此处以查询接入点列表为例。成功响应,状态码:200。{ "total": 1, "count": 1, "quantity_limi - [删除自定义接入点](https://support.huaweicloud.com/api-maas/api-maas-0016.md): 该API用于根据传入的custom_endpoint_id,删除指定的接入点。该功能仅支持“西南-贵阳一”区域。同一账户下不允许存在同名的自定义接入点,已删除的接入点名称不允许新建时使用。DELETE /v1/{project_id}/maas/services/custom-endpoint/endpoint/{custom_endpo - [启用/停用自定义接入点](https://support.huaweicloud.com/api-maas/api-maas-0017.md): 该API用于根据传入的project_id和custom_endpoint_id,启用或停用接入点。该功能仅支持“西南-贵阳一”区域。PUT /v1/{project_id}/maas/services/custom-endpoint/control/{custom_endpoint_id}成功响应:状态码:204,启停成功不返回消息。状 - [获取区域信息](https://support.huaweicloud.com/api-maas/api-maas-0019.md): 该API用于获取AI开发平台ModelArts-在线服务的区域信息。当创建自定义接入点的source参数选择custom_from_modelarts_v2时,获取请求中的region参数。该功能仅支持“西南-贵阳一”区域。GET /v1/{project_id}/maas/services/custom-endpoint/region - [获取工作空间信息](https://support.huaweicloud.com/api-maas/api-maas-0020.md): 该API用于获取AI开发平台ModelArts-在线服务的工作空间信息。当创建自定义接入点的source参数选择custom_from_modelarts_v2时,查询infer_service_id。该功能仅支持“西南-贵阳一”区域。GET /v1/{project_id}/maas/services/workspace/{regio - [获取推理服务信息](https://support.huaweicloud.com/api-maas/api-maas-0021.md): 该API用于获取AI开发平台ModelArts-在线服务的推理服务信息。当创建自定义接入点的source参数选择custom_from_modelarts_v2时,获取推理服务信息。该功能仅支持“西南-贵阳一”区域。成功响应,状态码:200{ "data": [ { "id": "add6b - [获取最新内容安全护栏免责声明](https://support.huaweicloud.com/api-maas/api-maas-0022.md): 该API用于获取MaaS-在线推理的内容安全护栏免责声明。当创建自定义接入点的“moderation”参数选择false时,必须签订最新版本的免责声明。该功能仅支持“西南-贵阳一”区域。成功响应,状态码:200{ "agreement_id": "4dd6b9f8-7e97-4f1c-8816-************", "agre - [获取汇总统计](https://support.huaweicloud.com/api-maas/ShowStatistics.md): 获取汇总统计接口用于查询在线推理服务调用的汇总数据,包括:总调用次数、总调用失败次数、总调用Tokens数、输入Tokens数、输出总Tokens数等。仅保存30天内的统计数据。区域限制:仅支持西南-贵阳一区域。API流量限制:所有用户对该API的总请求次数上限,1分钟内不超过1000次。用户流量限制:单个用户对该API的请求次数上限,1 - [获取服务统计信息列表](https://support.huaweicloud.com/api-maas/ListServiceStatistics.md): 获取服务统计信息列表接口用于获取用户已开通的预置服务或已创建的自定义接入点两种类型服务,并展示每个服务的调用次数、调用失败率、调用总Tokens数、输入Tokens数、输出Tokens数、端到端时延等指标信息。仅保存30天内的统计数据。区域限制:仅支持西南-贵阳一区域。API流量限制:所有用户对该API的总请求次数上限,1分钟内不超过10 - [获取服务指标时间分布统计信息](https://support.huaweicloud.com/api-maas/ShowDetailChart.md): 获取服务指标时间分布统计信息接口用于获取服务的指标明细数据。查看该服务的调用次数、调用失败率、调用tokens量、输入Tokens大小、输出Tokens大小、端到端时延、TPM、RPM、QPS、平均生成时长等指标时间变化趋势。仅保存30天内的统计数据。区域限制:仅支持西南-贵阳一区域。API流量限制:所有用户对该API的总请求次数上限,2 - [获取服务错误明细列表](https://support.huaweicloud.com/api-maas/ListErrors.md): 获取服务错误明细列表接口用于获取服务的错误明细数据,查看调用失败的相关信息,如错误码、发生次数、错误信息等。仅保存30天内的统计数据。区域限制:仅支持西南-贵阳一区域。API流量限制:所有用户对该API的总请求次数上限,1分钟内不超过1000次。用户流量限制:单个用户对该API的请求次数上限,1分钟内不超过200次。限流响应:超出限流阈值 - [获取服务列表](https://support.huaweicloud.com/api-maas/ListServices.md): 获取服务列表接口用于获取服务ID对应的服务名称。区域限制:仅支持西南-贵阳一区域。API流量限制:所有用户对该API的总请求次数上限,1分钟内不超过1000次。用户流量限制:单个用户对该API的请求次数上限,1分钟内不超过200次。限流响应:超出限流阈值时,API将返回HTTP 429状态码(Too Many Requests)。重试建议 - [查询IP列表](https://support.huaweicloud.com/api-maas/ListSourceIps.md): 查询IP列表接口用于获取IP地址。区域限制:仅支持西南-贵阳一区域。API流量限制:所有用户对该API的总请求次数上限,1分钟内不超过1000次。用户流量限制:单个用户对该API的请求次数上限,1分钟内不超过200次。限流响应:超出限流阈值时,API将返回HTTP 429状态码(Too Many Requests)。重试建议:遇到限流时, - [查询资源监控指标详情](https://support.huaweicloud.com/api-maas/GetServiceDetailMetricData.md): 查询资源监控指标详情接口用于查询MaaS在线推理模块我的服务类型资源监控指标信息。仅保存30天内的统计数据。区域限制:仅支持西南-贵阳一区域。API流量限制:所有用户对该API的总请求次数上限,1分钟内不超过1000次。用户流量限制:单个用户对该API的请求次数上限,1分钟内不超过200次。限流响应:超出限流阈值时,API将返回HTTP - [查询服务版本调用数据](https://support.huaweicloud.com/api-maas/ListVersionStatistics.md): 查询服务版本调用数据接口用于查询服务的所有版本及其相应的监控指标数据。仅保存30天内的统计数据。区域限制:仅支持西南-贵阳一区域。API流量限制:所有用户对该API的总请求次数上限,1分钟内不超过1000次。用户流量限制:单个用户对该API的请求次数上限,1分钟内不超过200次。限流响应:超出限流阈值时,API将返回HTTP 429状态码 - [获取不同模型类型支持的指标列表](https://support.huaweicloud.com/api-maas/GetGenerationSupportedMetrics.md): 获取不同模型类型支持的指标列表接口用于获取服务模型类型对应支持的指标列表。区域限制:仅支持西南-贵阳一区域。API流量限制:所有用户对该API的总请求次数上限,1分钟内不超过1000次。用户流量限制:单个用户对该API的请求次数上限,1分钟内不超过200次。限流响应:超出限流阈值时,API将返回HTTP 429状态码(Too Many R - [获取服务错误码时间分布统计信息](https://support.huaweicloud.com/api-maas/ShowErrorCodeChart.md): 获取服务错误码时间分布统计信息接口用于展现服务的错误码统计时间分布信息。仅保存30天内的统计数据。区域限制:仅支持西南-贵阳一区域。API流量限制:所有用户对该API的总请求次数上限,20秒内不超过80次。用户流量限制:单个用户对该API的请求次数上限,20秒内不超过1次。限流响应:超出限流阈值时,API将返回HTTP 429状态码(To - [状态码](https://support.huaweicloud.com/api-maas/api-maas-0027.md): 状态码如下表所示。 - [错误码](https://support.huaweicloud.com/api-maas/ErrorCode.md): 当您调用MaaS 通用API(自定义接入点、调用统计、以及查询AI开发平台相关接口)或模型API时,可能会出现接口错误;为了帮助您快速定位问题,通用API请参考表1。 - [获取项目ID和名称](https://support.huaweicloud.com/api-maas/api-maas-0028.md): 在调用接口的时候,部分请求中需要填入项目ID或项目名称。获取方式如下:从控制台获取项目ID和名称调用API获取项目ID从控制台获取项目ID(project_id)的步骤如下:登录管理控制台。鼠标悬浮至右上角的用户名处,在下拉列表中单击我的凭证。我的凭证在API凭证页面的项目列表,项目ID列的值为项目ID,项目列的值为项目名称。查看项目ID - [获取账号名和账号ID](https://support.huaweicloud.com/api-maas/api-maas-0029.md): 在调用接口的时候,部分请求中需要填入账号名(domain name)和账号ID(domain_id)。获取步骤如下:登录管理控制台。鼠标悬浮至右上角的用户名处,在下拉列表中单击我的凭证。我的凭证在API凭证页面,查看账号名和账号ID。获取账号名和ID - [获取用户名和用户ID](https://support.huaweicloud.com/api-maas/api-maas-0030.md): 在调用接口的时候,部分请求中需要填入用户名(user name)和用户ID(user_id)。获取步骤如下:登录管理控制台。鼠标悬浮至右上角的用户名处,在下拉列表中单击我的凭证。我的凭证在API凭证页面,获取IAM用户名和IAM用户ID。获取用户名和ID ## 常见问题 - [什么是Token?](https://support.huaweicloud.com/maas_faq/maas_faq_0001.md): 在自然语言处理中,Token通常指将文本分割成的最小单位,例如词语、子词或字符等。在调用模型推理服务时,输入内容会被分词(tokenize),转化为模型可识别的Token 。模型处理后会输出Token,并将其转换为用户所需文本或其他内容载体。模型处理(包括输入、输出)的Token数量会被作为模型推理服务用量的一个重要计量单位。关于Toke - [创建API Key后需要等待多久才能生效?](https://support.huaweicloud.com/maas_faq/maas_faq_0002.md): MaaS API Key在创建后不会立即生效,通常需要等待几分钟才能生效。 - [API Key是否支持跨区域使用?](https://support.huaweicloud.com/maas_faq/maas_faq_0003.md): API Key是区域级别的,不支持跨区域使用。例如,西南-贵阳一区域的API Key必须通过西南-贵阳一控制台创建,且仅能在该区域内调用服务。其他区域的API Key同理。 - [配置模型服务接口地址时需要注意什么格式问题?](https://support.huaweicloud.com/maas_faq/maas_faq_0005.md): 在大部分应用平台内配置模型服务接口地址时,需要去除URL尾部的/chat/completions路径。正确示例:假设原始地址为https://example.com/v1/chat/completions,应简化为https://example.com/v1。获取模型服务接口地址的操作步骤如下:在MaaS控制台左侧导航栏,选择模型推理 > - [如何正确获取模型名称?](https://support.huaweicloud.com/maas_faq/maas_faq_0006.md): 请使用MaaS控制台调用说明页面显示的模型名称,而非服务名称。两者可能不同,直接复制服务名称会导致调用失败。请在配置时仔细核对相关信息。获取模型名称的操作步骤如下:在MaaS控制台左侧导航栏,选择模型推理 > 在线推理。在线推理页面的预置服务页签,在已开通预置服务右侧的操作列,单击调用说明。或者在在线推理页面的自定义接入点页签,在状态为使 - [如果模型服务的RPM数值为300,可以1秒直接发送300个请求吗?](https://support.huaweicloud.com/maas_faq/maas_faq_0008.md): 不可以。建议您均匀地发送API请求,避免在短时间内发送大量请求。限流策略可能按照秒级QPS(RPM/60)限制,即使调用总量未达到每分钟上限,短时间内发送大量请求也可能触发限流,导致请求失败并返回错误码ModelArts.81101(Too Many Requests)。 - [使用预置服务,付费状态显示冻结,如何处理?](https://support.huaweicloud.com/maas_faq/maas_faq_0010.md): 您可以将鼠标悬浮于冻结,查看冻结的详细信息。如果提示“资源因账户欠费被冻结,您可充值后继续使用”,此时欠费冻结的资源不可使用,未开通的模型不支持再开通。您可以通过充值进行解冻,被冻结的资源实例将恢复使用,未开通的模型将支持开通。详细操作请参见账户充值。如果提示“资源被冻结,如需解冻,请提交工单”,单击提交工单,跳转至新建工单页面。问题描述 - [Tokens计费服务是否支持子账号单独计费?](https://support.huaweicloud.com/maas_faq/maas_faq_0011.md): Tokens计费服务不支持IAM子账号单独计费。IAM子账号产生的费用会计入主账号的账单。如果主账号授予IAM子账号费用中心的查看权限,IAM子账号则可以查看主账户产生的费用。关于如何为主账号下的IAM子账号授予费用中心权限,请参见费用中心。关于如何查看消费明细,请参见流水和明细账单。 - [预置服务能否关闭内容审核?](https://support.huaweicloud.com/maas_faq/maas_faq_0012.md): 模型本身具有原生安全能力,MaaS额外提供内容审核(内容安全护栏)功能。仅客户等级为V2及以上,支持关闭内容审核(内容安全护栏)。在模型推理链路中,开启内容安全护栏,提供额外拦截输入输出有害内容的能力,可能导致时延增加;不开启则使用模型原生安全能力。关于客户等级介绍,请参见客户等级体系;关于如何查看客户等级,请参见如何查看客户等级。关闭内 - [客户应用上架:算法备案资质申请流程](https://support.huaweicloud.com/maas_faq/maas_faq_0013.md): 为通过规范技术应用、强化安全治理,推动行业健康有序发展,当客户的应用或小程序使用了大模型服务,想要将接入大模型的应用/小程序上架到应用市场/小程序平台中,若满足舆论属性或社会动员能力,上架平台需要开发者提供相关资料:技术主体的算法备案证明(算法类型为"生成合成类(深度合成)"或"生成合成类")。应用主体与技术主体的合作协议(协议需包含算法 - [配置用户缺失的MaaS相关服务权限](https://support.huaweicloud.com/maas_faq/maas-modelarts-0059.md): 在使用MaaS服务的过程中,用户可能会遇到权限配置的问题,如未正确配置权限或缺失权限,MaaS控制台将显示权限缺失的提示。这种情况下,部分功能将无法正常运行,严重影响用户的使用体验。面对权限问题,用户可能会感到困惑,不知道如何高效地解决权限报错提示。为确保MaaS服务的正常运行,建议用户参照本文档提供的指导,及时配置缺失的权限,避免因权限 - [模型开发相关能力下线之后,功能如何切换?](https://support.huaweicloud.com/maas_faq/maas_faq_0015.md): 因业务策略调整,平台将聚焦Serverless化模型服务能力提升,将于 2026/08/18 24:00(北京时间) 正式下线基于算力资源规格计费的模型开发能力。相关下线进展将会通过短信、站内信、邮件等方式发布通知,请及时关注。西南-贵阳一、华北-乌兰察布一、华东二。1、按算力资源规格计费的模型部署:部署功能下线后,无法新增部署实例;现有 - [应用开发相关能力下线之后,功能如何切换?](https://support.huaweicloud.com/maas_faq/maas_faq_0016.md): 因业务策略调整,华为云MaaS 模型即服务平台主要聚焦Serverless化模型服务能力提升,将于 2026/08/18 24:00(北京时间) 正式下线应用开发相关功能,建议用户前往智果(AgentArts)智能体平台进行体验应用开发。相关下线进展将会通过短信、站内信、邮件等方式发布通知,请及时关注。西南-贵阳一。已开通的或已创建的MC