# 模型列表
MaaS提供多种模型供您使用。您可以根据教程或者API说明，便捷地将模型服务整合到自身业务当中。
#### 推荐模型
| DeepSeek-V4.1-Flash                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                               | GLM-5.3                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                         | Kimi-K2.6                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                                    |
|:---|:---|:---|
| DeepSeek-V4.1-Flash是DeepSeek 于2026 年9月10日正式发布的新一代大语言模型。 - 该模型采用 552B参数的 MoE（混合专家）架构，配合全新的Causal-Encoder-Decoder非对称结构，在Prefill阶段每Token仅激活约8B参数，Decode阶段激活约16B参数。  - 在 KV Cache压缩方面，V4.1 Flash将HBM显存需求降至上一代的1/4，SSD存储需求降至 1/8，显著降低了Agent类长上下文任务的使用成本。  - 支持1M序列长度、最大输入1M、最大输出384K、最大思维链96K。  - 支持思维链、Function Call功能。   | GLM-5.3 是智谱最新旗舰模型，复杂软件工程与 Agent 任务能力全面进阶。它使用与 GLM-5.2 相同的基础模型------所有提升均来自后训练。与 GLM-5.2 相比，它在复杂编程和长程任务方面表现更加出色： - 更强的编程能力:GLM-5.3 的编程能力大幅提升，在智谱内部 Z.ai Code Bench 上较 GLM-5.2 提升了 50%，在包括 Terminal Bench 3.0、Agents' Last Exam (CLI) 在内的公开基准测试中达到开源模型 SOTA 水平。  - 涌现的网络安全能力：随着后训练规模持续扩大，模型的网络安全能力以超出预期的速度提升。GLM-5.3 在漏洞发现基准 CyberGym 上取得当前最佳成绩；越深入漏洞利用链，其相较 GLM-5.2 的提升越显著，在漏洞利用类基准测试中的得分达到 GLM-5.2 的两倍以上。  - 支持1M序列长度、最大输入1M、最大输出128K、最大思维链128K。  - 支持思维链、Function Call功能。   | Kimi K2.6是Kimi最新最智能的模型，Kimi K2.6的通用Agent、代码等综合能力得到全面提升，其中在博士级难度的完整版人类最后的考试（Humanity's Last Exam）、在考察模型真实软件工程能力的SWE-Bench Pro、评估Agent深度检索能力的DeepSearchQA等基准测试中均取得行业领先的成绩，同时支持思考与非思考模式，对话与Agent任务。 - 支持256K序列长度、最大输入256K、最大输出96K、最大思维链96K。  - 支持思维链、Function Call、前缀续写功能。   |
   
#### 文本生成
下表列出了支持文本生成能力的模型，介绍了模型参数（模型 ID）、模型支持的能力、模型的长度限制（上下文长度、最大输入长度、最大输出长度和最大思维链长度）、模型限流信息；您可根据需要选择合适的模型。
文本生成的教程请见[文本生成](https://support.huaweicloud.com/model-call-maas/model-call-004.html)，API说明请参见[对话Chat/Post](https://support.huaweicloud.com/model-call-maas/model-call-018.html)。
- [精选模型]
  表1精选模型 
  | model参数（模型 ID）       | 支持能力                                                                                                                                                                        | 长度限制                                                                                                                                                                                        | 默认限流                                                                                                                                                                                                                              |
  |:---|:---|:---|:---|
  | openpangu-2.0-pro    | 深度思考（可开关） Function Call 前缀续写 前缀缓存 | 上下文长度：512K 最大输入长度：500K 最大输出长度：128K 最大思维链长度：64K     | - TPM: 1,000,000  - RPM: 100           |
  | openpangu-2.0-flash | 深度思考（可开关） Function Call 前缀续写 前缀缓存 | 上下文长度：512K 最大输入长度：500K 最大输出长度：128K 最大思维链长度：64K  | - TPM: 1,000,000  - RPM: 100   |
  | glm-5.3                | 深度思考（不可关闭） Function Call 前缀缓存                                                      | 上下文长度：1M 最大输入长度：1M 最大输出长度：128K 最大思维链长度：128K                 | - TPM: 1,000,000  - RPM: 100                      |
  | glm-5.2              | 深度思考（可开关） Function Call                                                                                                     | 上下文长度：1M 最大输入长度：1M 最大输出长度：128K 最大思维链长度：64K         | - TPM: 1,000,000  - RPM: 100             |
  | glm-5.1               | 深度思考（可开关） Function Call                                                                                                     | 上下文长度：198K 最大输入长度：192K 最大输出长度：128K 最大思维链长度：96K     | - TPM: 1,000,000  - RPM: 100       |
  | kimi-k2.6             | 深度思考（可开关） Function Call 前缀续写                                                  | 上下文长度：256K 最大输入长度：256K 最大输出长度：96K 最大思维链长度：96K | - TPM: 100,000  - RPM: 10           |
  | deepseek-v4.1-flash   | 深度思考（可开关） Function Call 前缀缓存                                                    | 上下文长度：1M 最大输入长度：1M 最大输出长度：384K 最大思维链长度：96K              | - TPM: 1,000,000  - RPM:100                  |
  | deepseek-v4-pro       | 深度思考（可开关） Function Call 前缀续写                                                     | 上下文长度：1M 最大输入长度：1M 最大输出长度：128K 最大思维链长度：96K        | - TPM: 60,000  - RPM: 15           |
  | deepseek-v4-flash  | 深度思考（可开关） Function Call 前缀续写                                                   | 上下文长度：1M 最大输入长度：1M 最大输出长度：384K 最大思维链长度：96K            | - TPM: 60,000  - RPM: 15           |
     
- [其它模型]
  表2其它模型 
  | model参数（模型 ID） | 支持能力       | 长度限制                                                                                                                                                                                        | 默认限流                                                                                                                                                                                                                           |
  |:---|:---|:---|:---|
  | qwen3-32b       | 深度思考（可开关） | 上下文长度：128K 最大输入长度：128K 最大输出长度：128K 最大思维链长度：128K | - TPM: 100,000  - RPM: 300   |
  | qwen3-30b-a3b  | 深度思考（可开关） | 上下文长度：128K 最大输入长度：128K 最大输出长度：128K 最大思维链长度：128K | - TPM: 100,000  - RPM: 300      |
     
#### 深度思考
下表列出了支持深度思考能力的模型，介绍了模型参数（模型 ID）、模型支持的能力、模型的长度限制（上下文长度、最大输入长度、最大输出长度和最大思维链长度）、模型限流信息；您可根据需要选择合适的模型。
深度思考的教程请见[深度思考](https://support.huaweicloud.com/model-call-maas/model-call-005.html)，API说明请参见[对话Chat/Post](https://support.huaweicloud.com/model-call-maas/model-call-018.html)。
- [精选模型]
  表3精选模型 
  | model参数（模型 ID）       | 支持能力                                                                                                                                                                           | 长度限制                                                                                                                                                                                        | 默认限流                                                                                                                                                                                                                             |
  |:---|:---|:---|:---|
  | openpangu-2.0-pro    | 深度思考（可开关） Function Call 前缀续写 前缀缓存 | 上下文长度：512K 最大输入长度：500K 最大输出长度：128K 最大思维链长度：64K | - TPM: 1,000,000  - RPM: 100      |
  | openpangu-2.0-flash | 深度思考（可开关） Function Call 前缀续写 前缀缓存 | 上下文长度：512K 最大输入长度：500K 最大输出长度：128K 最大思维链长度：64K       | - TPM: 1,000,000  - RPM: 100      |
  | glm-5.3               | 深度思考（不可关闭） Function Call 前缀缓存                                                  | 上下文长度：1M 最大输入长度：1M 最大输出长度：128K 最大思维链长度：128K         | - TPM: 1,000,000  - RPM: 100   |
  | glm-5.2               | 深度思考（可开关） Function Call                                                                                                          | 上下文长度：1M 最大输入长度：1M 最大输出长度：128K 最大思维链长度：64K      | - TPM: 1,000,000  - RPM: 100     |
  | glm-5.1               | 深度思考（可开关） Function Call                                                                                                         | 上下文长度：198K 最大输入长度：192K 最大输出长度：128K 最大思维链长度：96K | - TPM: 1,000,000  - RPM: 100   |
  | kimi-k2.6             | 深度思考（可开关） Function Call 前缀续写                                                      | 上下文长度：256K 最大输入长度：256K 最大输出长度：96K 最大思维链长度：96K | - TPM: 100,000  - RPM: 10          |
  | deepseek-v4.1-flash   | 深度思考（可开关） Function Call 前缀缓存                                                          | 上下文长度：1M 最大输入长度：1M 最大输出长度：384K 最大思维链长度：96K           | - TPM: 1,000,000  - RPM:100      |
  | deepseek-v4-pro      | 深度思考（可开关） Function Call 前缀续写                                                       | 上下文长度：1M 最大输入长度：1M 最大输出长度：128K 最大思维链长度：96K        | - TPM: 60,000  - RPM: 15            |
  | deepseek-v4-flash       | 深度思考（可开关） Function Call 前缀续写                                                         | 上下文长度：1M 最大输入长度：1M 最大输出长度：384K 最大思维链长度：96K       | - TPM: 60,000  - RPM: 15                |
     
- [其它模型]
  表4其它模型 
  | model参数（模型 ID） | 支持能力     | 长度限制                                                                                                                                                                                         | 默认限流                                                                                                                                                                                                                        |
  |:---|:---|:---|:---|
  | qwen3-32b       | 深度思考（可开关） | 上下文长度：128K 最大输入长度：128K 最大输出长度：128K 最大思维链长度：128K | - TPM: 100,000  - RPM: 300    |
  | qwen3-30b-a3b  | 深度思考（可开关）  | 上下文长度：128K 最大输入长度：128K 最大输出长度：128K                                                             | - TPM: 100,000  - RPM: 300   |
     
#### 文本向量化
下表列出了支持文本向量化能力的模型，介绍了模型参数（模型 ID）、模型支持的能力、模型的输入输出限制（单个列表元素最大输入限制、支持输入类型、支持输出类型和最高向量维度）、模型限流信息；您可根据需要选择合适的模型。
文本向量化的教程请见[文本向量化](https://support.huaweicloud.com/model-call-maas/model-call-014.html)，API说明请参见[创建文本向量化](https://support.huaweicloud.com/model-call-maas/model-call-027.html)。
- [精选模型]
  表5精选模型 
  | model参数（模型 ID） | 支持能力   | 输入输出限制                                                                                                                                                                                                                                                      | 默认限流                                                                                                                                                                                                                                   |
  |:---|:---|:---|:---|
  | bge-m3       | 文本向量化 | 单个列表元素最大输入限制：8192 Token 支持输入类型：文本 支持输出类型：向量 最大输入长度：8K 最高向量维度：1024 | - TPM: 1,200,000  - RPM: 100   |
     
#### 重排序
下表列出了支持重排序能力的模型，介绍了模型参数（模型 ID）、模型支持的能力、模型的输入输出限制（单个列表元素最大输入限制、支持输入输出类型和最大输入长度）、模型限流信息；您可根据需要选择合适的模型。
重排序的教程请见[重排序](https://support.huaweicloud.com/model-call-maas/model-call-015.html)，API说明请参见[创建重排序](https://support.huaweicloud.com/model-call-maas/model-call-028.html)。
- [精选模型]
  表6精选模型 
  | model参数（模型 ID）     | 支持能力 | 输入输出限制                                                                                                                                                                                        | 默认限流                                                                                                                                                                                                                        |
  |:---|:---|:---|:---|
  | bge-reranker-v2-m3 | 重排序   | 单个列表元素最大输入限制：8192 Token 支持输入类型：文本 支持输出类型：文本 最大输入长度：8K | - TPM: 20,000  - RPM: 120   |
     
#### 图像理解
下表列出了支持图像理解能力的模型，介绍了模型参数（模型 ID）、模型支持的能力、模型的输入输出限制（上下文长度、最大输入长度和最大输出长度）、模型限流信息；您可根据需要选择合适的模型。
图像理解的教程请见[图像理解](https://support.huaweicloud.com/model-call-maas/model-call-011.html)，API说明请参见[MaaS标准API V1](https://support.huaweicloud.com/model-call-maas/model-call-020.html)。
- [精选模型]
  表7精选模型 
  | model参数（模型 ID）       | 支持能力   | 输入输出限制                                                                                                                                                                                                                                                                                                             | 默认限流                                                                                                                                                                                                                          |
  |:---|:---|:---|:---|
  | deepseek-v4.1-flash | 图像理解   | 上下文长度：1M 最大输入长度：1M 最大输出长度：384K 最大思维链长度：96K 图片限制：图片最大数量600张，单张图片大小不超过32MB，图片分辨率不限制（推荐小于4096\*2160），支持JPEG、PNG、GIF和WebP格式。 | - TPM: 1,000,000  - RPM:100   |
  | qwen2.5-vl-72b     | 图像理解 | 上下文长度：48K 最大输入长度：文本48K；图片10MB（Base64编码格式）或者公网可访问的图片地址。 最大输出长度：16K                                                                                                                                                   | - TPM: 100,000  - RPM: 60   |
     
#### 图片生成
下表列出了支持图片生成能力的模型，介绍了模型参数（模型 ID）、模型支持的能力、模型的输入限制（输入类型和输入图片格式）、模型限流信息；您可根据需要选择合适的模型。
图片生成的教程请见[图片生成](https://support.huaweicloud.com/model-call-maas/model-call-012.html)，API说明请参见[图片生成](https://support.huaweicloud.com/model-call-maas/model-call-012.html)。
- [精选模型]
  表8精选模型 
  | model参数（模型 ID）       | 支持能力   | 输入限制                                                                                       | 默认限流    |
  |:---|:---|:---|:---|
  | qwen-image             | 文本生成图片 | 输入类型：文本 输入图片格式：不涉及                           | RPM: 144 |
  | qwen-image-edit-2509 | 文生图、图像编辑  | 输入类型：文本、图片 输入图片格式：png、jpeg、jpg、webp、bmp、tiff | RPM: 144 |
     
- [其它模型]
  表9其它模型 
  | model参数（模型 ID）  | 支持能力    | 输入限制                                                                                    | 默认限流       |
  |:---|:---|:---|:---|
  | qwen_image_edit | 文生图、图像编辑 | 输入类型：文本、图片 输入图片格式：png、jpeg、jpg、webp、bmp、tiff | RPM: 144 |
     
#### 视频生成
下表列出了支持视频生成能力的模型，介绍了模型参数（模型 ID）、模型支持的能力、模型的输入输出限制（最大输入限制、输出视频格式、输出视频帧率、输出视频最高分辨率和输出视频时长）、模型限流信息；您可根据需要选择合适的模型。
视频生成的教程请见[视频生成](https://support.huaweicloud.com/model-call-maas/model-call-013.html)，API说明请参见[视频生成](https://support.huaweicloud.com/model-call-maas/model-call-024.html)。
- [精选模型]
  表10精选模型 
  | model参数（模型 ID）                 | 支持能力   | 输入输出限制                                                                                                                                                                                                                                                                                                                                                   | 默认限流      |
  |:---|:---|:---|:---|
  | vidu/viduq3-turbo_text2video | 文生视频   | 输入类型：文本 最大输入限制：文本 5000 字符 输出视频格式：MP4 输出视频帧率（fps）：24 输出视频最高分辨率：1080p 输出视频时长：1s～16s，可选。                            | RPM: 30  |
  | vidu/viduq3-turbo_img2video    | 图生视频     | 输入类型：文本+图片 最大输入限制：文本 5000 字符；图片 50 MB（Base64编码）。 输出视频格式：MP4 输出视频帧率（fps）：24 输出视频最高分辨率：1080p 输出视频时长：1s～16s，可选。 | RPM: 30    |
  | pixverse/pixverse-v6-t2v     | 文生视频 | 输入类型：文本 最大输入限制：文本 5000 字符 输出视频格式：MP4 输出视频最高分辨率：1080p 输出视频时长：1s～15s，可选。                                                                                        | RPM: 30   |
  | pixverse/pixverse-v6-it2v    | 图生视频    | 输入类型：文本+图片 最大输入限制：文本 5000 字符；图片 20MB，10000px（Base64编码）。 输出视频格式：MP4 输出视频最高分辨率：1080p 输出视频时长：1s～15s，可选。                                                      | RPM: 30 |
     
- [其它模型]
  表11其它模型 
  | model参数（模型 ID）                    | 支持能力   | 输入输出限制                                                                                                                                                                                                                                                                                                                                                                                                                                  | 默认限流     |
  |:---|:---|:---|:---|
  | vidu/viduq3-pro_text2video      | 文生视频    | 输入类型：文本 最大输入限制：文本 5000 字符 输出视频格式：MP4 输出视频帧率（fps）：24 输出视频最高分辨率：1080p 输出视频时长：1s～16s，可选。                                                                                                      | RPM: 30 |
  | vidu/viduq3-pro_img2video           | 图生视频    | 输入类型：文本+图片 最大输入限制：文本 5000 字符；图片 50 MB（Base64编码）。 输出视频格式：MP4 输出视频帧率（fps）：24 输出视频最高分辨率：1080p 输出视频时长：1s～16s，可选。                                                                                 | RPM: 30   |
  | vidu/viduq3-pro_start-end2video   | 首尾帧生成视频    | 输入类型：文本+图片 最大输入限制：文本 5000 字符；图片 50 MB（Base64编码）。 输出视频格式：MP4 输出视频帧率（fps）：24 输出视频最高分辨率：1080p 输出视频时长：1s～16s，可选。                                                                                | RPM: 30   |
  | vidu/viduq3-turbo_start-end2video | 首尾帧生成视频   | 输入类型：文本+图片 最大输入限制：文本 5000 字符；图片 50 MB（Base64编码）。 输出视频格式：MP4 输出视频帧率（fps）：24 输出视频最高分辨率：1080p 输出视频时长：1s～16s，可选。                                                                                | RPM: 30   |
  | vidu/viduq3-turbo_reference2video  | 参考生成视频  | 输入类型：文本+图片 最大输入限制：文本 5000 字符；图片 50 MB（Base64编码）。 输出视频格式：MP4 输出视频帧率（fps）：24 输出视频最高分辨率：1080p 输出视频时长：1s～16s，可选。                                                                                     | RPM: 30    |
  | vidu/viduq3-mix_reference2video   | 参考生成视频  | 输入类型：文本+图片 最大输入限制：文本 5000 字符；图片 50 MB（Base64编码）。 输出视频格式：MP4 输出视频帧率（fps）：24 输出视频最高分辨率：1080p 输出视频时长：1s～15s，可选。                                                                                    | RPM: 30  |
  | vidu/viduq3-ad_reference2video    | 参考生成视频 | 输入类型：文本+图片 最大输入限制：文本 5000 字符；图片 50 MB（Base64编码）。 输出视频格式：MP4 输出视频帧率（fps）：24 输出视频最高分辨率：1080p 输出视频时长：1s～15s，可选。                                                                                 | RPM: 30  |
  | pixverse/pixverse-v6-kf2v           | 首尾帧生成视频   | 输入类型：文本+图片 最大输入限制：文本 5000 字符；图片 20MB，10000px（Base64编码）。 输出视频格式：MP4 输出视频帧率（fps）：24 输出视频最高分辨率：1080p 输出视频时长：1s～15s，可选。                                                                               | RPM: 30   |
  | pixverse/pixverse-v6-r2v             | 参考生成视频   | 输入类型：文本+图片 最大输入限制：文本 5000 字符；图片 50 MB（Base64编码）。 输出视频格式：MP4 输出视频帧率（fps）：24 输出视频时长：1s～15s，可选。                                                                                                                                                   | RPM: 30  |
  | Wan2.2-T2V-A14B                  | 文生视频    | 输入类型：文本 最大输入限制：文本 1000 字符。 输出视频帧率（fps）：16、24、30，默认值为16。 输出视频格式：MP4 输出视频分辨率：480P、720P 输出视频时长：3s、5s，默认值为5s。                                                                               | RPM: 60   |
  | Wan2.2-I2V-A14B                    | 图生视频     | 输入类型：文本+图片 最大输入限制：文本 1000 字符；图片 8 MB（Base64编码）。 输入图片格式：jpg、png、webp、jpeg、bmp 输出视频格式：MP4 输出视频帧率（fps）：24 输出视频分辨率：480P、720P 输出视频时长：3s、5s，默认值为5s。 | RPM: 60   |
     
