更新时间:2026-08-05 GMT+08:00
分享

模型列表

MaaS提供多种模型供您使用。您可以根据教程或者API说明,便捷地将模型服务整合到自身业务当中。

推荐模型

openPangu-2.0-Pro

GLM-5.2

Kimi-K2.6

openPangu-2.0-Pro 是基于昇腾 NPU 训练的大规模混合专家(MoE)语言模型,参数规模约 505B,每 token 激活参数规模约 18B,模型支持 512k 上下文长度,训练数据总量约34T tokens。后训练阶段完成快慢合一微调(SFT)、多专项强化学习(RL),并通过在线蒸馏(OPD)完成能力合一。

openPangu-2.0-Pro 在模型架构上实现了全面的升级:

Attention架构:沿用高效 MLA,并采用 DSA+SWA 独立分层混合架构,层配比为 1:2;SWA 层负责局部窗口建模,DSA 层负责稀疏全局聚合,在保持精度的同时显著降低长序列推理的计算、显存与访存开销。

拓扑架构:将传统残差连接升级为 4 支流 mHC 架构,提升表征多样性与泛化能力。

自投机模块:采用 3 头 MTP 架构,一次额外预测 3 个 token,显著提升模型的推理速度。

Muon优化器:训练中采用Muon优化器,获得更快的收敛速度。

GLM-5.2是智谱AI于2026年6月17日正式上线并开源的新一代旗舰大模型,核心特色包括:

长程任务能力显著提升,减少复杂任务中的上下文漂移与目标遗忘。

Coding与长程任务评测达到开源SOTA,在复杂系统工程、深度调试中表现更稳。

真实开发体验显著提升,项目级上下文承载、工程规范遵循与多端开发更可靠。

支持198K序列长度、最大输入192K、最大输出128K、最大思维链64K。

支持思维链、Function Call功能。

Kimi K2.6是Kimi最新最智能的模型,Kimi K2.6的通用Agent、代码等综合能力得到全面提升,其中在博士级难度的完整版人类最后的考试(Humanity’s Last Exam)、在考察模型真实软件工程能力的SWE-Bench Pro、评估Agent深度检索能力的DeepSearchQA等基准测试中均取得行业领先的成绩,同时支持思考与非思考模式,对话与Agent任务。

支持256K序列长度、最大输入256K、最大输出96K、最大思维链96K。

支持思维链、Function Call、前缀续写功能。

文本生成

下表列出了支持文本生成能力的模型,介绍了模型参数(模型 ID)、模型支持的能力、模型的长度限制(上下文长度、最大输入长度、最大输出长度和最大思维链长度)、模型限流信息;您可根据需要选择合适的模型。

文本生成的教程请见文本生成,API说明请参见对话Chat/Post

表1 精选模型

model参数(模型 ID)

支持能力

长度限制

默认限流

openpangu-2.0-pro

深度思考(可开关)

Function Call

前缀续写

上下文长度:512K

最大输入长度:500K

最大输出长度:128K

最大思维链长度:64K

  • TPM: 1,000,000
  • RPM: 100

openpangu-2.0-flash

深度思考(可开关)

Function Call

前缀续写

上下文长度:512K

最大输入长度:500K

最大输出长度:128K

最大思维链长度:64K

  • TPM: 1,000,000
  • RPM: 100

glm-5.2

深度思考(可开关)

Function Call

上下文长度:198K

最大输入长度:192K

最大输出长度:128K

最大思维链长度:64K

  • TPM: 1,000,000
  • RPM: 100

glm-5.1

深度思考(可开关)

Function Call

上下文长度:198K

最大输入长度:192K

最大输出长度:128K

最大思维链长度:96K

  • TPM: 1,000,000
  • RPM: 100

kimi-k2.6

深度思考(可开关)

Function Call

前缀续写

上下文长度:256K

最大输入长度:256K

最大输出长度:96K

最大思维链长度:96K

  • TPM: 100,000
  • RPM: 10

deepseek-v4-pro

深度思考(可开关)

Function Call

前缀续写

上下文长度:1M

最大输入长度:1M

最大输出长度:128K

最大思维链长度:96K

  • TPM: 30,000
  • RPM: 3

deepseek-v4-flash

深度思考(可开关)

Function Call

前缀续写

上下文长度:1M

最大输入长度:1M

最大输出长度:128K

最大思维链长度:96K

  • TPM: 30,000
  • RPM: 3
表2 其它模型

model参数(模型 ID)

支持能力

长度限制

默认限流

glm-5

深度思考(可开关)

Function Call

上下文长度:198K

最大输入长度:192K

最大输出长度:64K

最大思维链长度:64K

  • TPM: 1,000,000
  • RPM: 100

deepseek-v3.2

深度思考(可开关)

Function Call

前缀续写

上下文长度:160K

最大输入长度:128K

最大输出长度:32K

最大思维链长度:32K

  • TPM: 500,000
  • RPM: 700

DeepSeek-V3

Function Call

上下文长度:128K

最大输入长度:128K

最大输出长度:32K

  • TPM: 500,000
  • RPM: 1,500

deepseek-r1-250528

深度思考

Function Call

前缀续写

上下文长度:128K

最大输入长度:96K

最大输出长度:32K

最大思维链长度:32K

  • TPM: 500,000
  • RPM: 1,500

qwen3-32b

深度思考(可开关)

上下文长度:128K

最大输入长度:128K

最大输出长度:128K

最大思维链长度:128K

  • TPM: 500,000
  • RPM: 1,500

qwen3-30b-a3b

深度思考(可开关)

上下文长度:128K

最大输入长度:128K

最大输出长度:128K

最大思维链长度:128K

  • TPM: 500,000
  • RPM: 1,500

深度思考

下表列出了支持深度思考能力的模型,介绍了模型参数(模型 ID)、模型支持的能力、模型的长度限制(上下文长度、最大输入长度、最大输出长度和最大思维链长度)、模型限流信息;您可根据需要选择合适的模型。

深度思考的教程请见深度思考,API说明请参见对话Chat/Post

表3 精选模型

model参数(模型 ID)

支持能力

长度限制

默认限流

openpangu-2.0-pro

深度思考(可开关)

Function Call

前缀续写

上下文长度:512K

最大输入长度:500K

最大输出长度:128K

最大思维链长度:64K

  • TPM: 1,000,000
  • RPM: 100

openpangu-2.0-flash

深度思考(可开关)

Function Call

前缀续写

上下文长度:512K

最大输入长度:500K

最大输出长度:128K

最大思维链长度:64K

  • TPM: 1,000,000
  • RPM: 100

glm-5.2

深度思考(可开关)

Function Call

上下文长度:198K

最大输入长度:192K

最大输出长度:128K

最大思维链长度:64K

  • TPM: 1,000,000
  • RPM: 100

glm-5.1

深度思考(可开关)

Function Call

上下文长度:198K

最大输入长度:192K

最大输出长度:128K

最大思维链长度:96K

  • TPM: 1,000,000
  • RPM: 100

glm-5

深度思考(可开关)

Function Call

上下文长度:198K

最大输入长度:192K

最大输出长度:64K

最大思维链长度:64K

  • TPM: 1,000,000
  • RPM: 100

kimi-k2.6

深度思考(可开关)

Function Call

前缀续写

上下文长度:256K

最大输入长度:256K

最大输出长度:96K

最大思维链长度:96K

  • TPM: 100,000
  • RPM: 10

deepseek-v4-pro

深度思考(可开关)

Function Call

前缀续写

上下文长度:1M

最大输入长度:1M

最大输出长度:128K

最大思维链长度:96K

  • TPM:30,000
  • RPM:3

deepseek-v4-flash

深度思考(可开关)

Function Call

前缀续写

上下文长度:1M

最大输入长度:1M

最大输出长度:128K

最大思维链长度:96K

  • TPM: 30,000
  • RPM: 3
表4 其它模型

model参数(模型 ID)

支持能力

长度限制

默认限流

deepseek-v3.2

深度思考(可开关)

Function Call

前缀续写

上下文长度:160K

最大输入长度:128K

最大输出长度:32K

最大思维链长度:32K

  • TPM: 500,000
  • RPM: 700

deepseek-r1-250528

深度思考

Function Call

前缀续写

上下文长度:128K

最大输入长度:96K

最大输出长度:32K

最大思维链长度:32K

  • TPM: 500,000
  • RPM: 1,500

qwen3-32b

深度思考(可开关)

上下文长度:128K

最大输入长度:128K

最大输出长度:128K

最大思维链长度:128K

  • TPM: 500,000
  • RPM: 1,500

qwen3-30b-a3b

深度思考(可开关)

上下文长度:128K

最大输入长度:128K

最大输出长度:128K

  • TPM: 500,000
  • RPM: 1,500

文本向量化

下表列出了支持文本向量化能力的模型,介绍了模型参数(模型 ID)、模型支持的能力、模型的输入限制(单个列表元素最大输入限制、支持输入类型、支持输出类型和最高向量维度)、模型限流信息;您可根据需要选择合适的模型。

文本向量化的教程请见文本向量化,API说明请参见创建文本向量化

表5 精选模型

model参数(模型 ID)

支持能力

输入限制

默认限流

bge-m3

文本向量化

单个列表元素最大输入限制:8192 Token

支持输入类型:文本

支持输出类型:向量

最大输入长度:8K

最高向量维度:1024

  • TPM: 1,200,000
  • RPM: 1,200

重排序

下表列出了支持重排序能力的模型,介绍了模型参数(模型 ID)、模型支持的能力、模型的输入输出限制(单个列表元素最大输入限制、支持输入输出类型和最大输入长度)、模型限流信息;您可根据需要选择合适的模型。

重排序的教程请见重排序,API说明请参见创建重排序

表6 精选模型

model参数(模型 ID)

支持能力

输入输出限制

默认限流

bge-reranker-v2-m3

重排序

单个列表元素最大输入限制:8192 Token

支持输入类型:文本

支持输出类型:文本

最大输入长度:8K

  • TPM: 20,000
  • RPM: 120

图像理解

下表列出了支持图像理解能力的模型,介绍了模型参数(模型 ID)、模型支持的能力、模型的长度限制(上下文长度、最大输入长度和最大输出长度)、模型限流信息;您可根据需要选择合适的模型。

图像理解的教程请见图像理解,API说明请参见MaaS标准API V1

表7 精选模型

model参数(模型 ID)

支持能力

长度限制

默认限流

qwen2.5-vl-72b

图像理解

上下文长度:48K

最大输入长度:文本48K;图片10MB(Base64编码格式)。

最大输出长度:16K

  • TPM: 100,000
  • RPM: 60

图片生成

下表列出了支持图片生成能力的模型,介绍了模型参数(模型 ID)、模型支持的能力、模型的输入限制(输入类型和输入图片格式)、模型限流信息;您可根据需要选择合适的模型。

图片生成的教程请见图片生成,API说明请参见图片生成

表8 精选模型

model参数(模型 ID)

支持能力

输入限制

默认限流

qwen-image

文本生成图片

输入类型:文本

输入图片格式:不涉及

RPM: 144

qwen-image-edit-2509

文生图、图像编辑

输入类型:文本、图片

输入图片格式:png、jpeg、jpg、webp、bmp、tiff

RPM: 144

表9 其它模型

model参数(模型 ID)

支持能力

输入限制

默认限流

qwen_image_edit

文生图、图像编辑

输入类型:文本、图片

输入图片格式:png、jpeg、jpg、webp、bmp、tiff

RPM: 144

视频生成

下表列出了支持视频生成能力的模型,介绍了模型参数(模型 ID)、模型支持的能力、模型的输入输出限制(最大输入限制、输出视频格式、输出视频帧率、输出视频最高分辨率和输出视频时长)、模型限流信息;您可根据需要选择合适的模型。

视频生成的教程请见视频生成,API说明请参见视频生成

表10 精选模型

model参数(模型 ID)

支持能力

输入输出限制

默认限流

vidu/viduq3-turbo_text2video

文生视频

输入类型:文本

最大输入限制:文本 5000 字符

输出视频格式:MP4

输出视频帧率(fps):24

输出视频最高分辨率:1080p

输出视频时长:1s~16s,可选。

RPM: 30

vidu/viduq3-turbo_img2video

图生视频

输入类型:文本+图片

最大输入限制:文本 5000 字符;图片 50 MB(Base64编码)。

输出视频格式:MP4

输出视频帧率(fps):24

输出视频最高分辨率:1080p

输出视频时长:1s~16s,可选。

RPM: 30

pixverse/pixverse-v6-t2v

文生视频

输入类型:文本

最大输入限制:文本 5000 字符

输出视频格式:MP4

输出视频最高分辨率:1080p

输出视频时长:1s~15s,可选。

RPM: 30

pixverse/pixverse-v6-it2v

图生视频

输入类型:文本+图片

最大输入限制:文本 5000 字符;图片 20MB,10000px(Base64编码)。

输出视频格式:MP4

输出视频最高分辨率:1080p

输出视频时长:1s~15s,可选。

RPM: 30

表11 其它模型

model参数(模型 ID)

支持能力

输入输出限制

默认限流

vidu/viduq3-pro_text2video

文生视频

输入类型:文本

最大输入限制:文本 5000 字符

输出视频格式:MP4

输出视频帧率(fps):24

输出视频最高分辨率:1080p

输出视频时长:1s~16s,可选。

RPM: 30

vidu/viduq3-pro_img2video

图生视频

输入类型:文本+图片

最大输入限制:文本 5000 字符;图片 50 MB(Base64编码)。

输出视频格式:MP4

输出视频帧率(fps):24

输出视频最高分辨率:1080p

输出视频时长:1s~16s,可选。

RPM: 30

vidu/viduq3-pro_start-end2video

首尾帧生成视频

输入类型:文本+图片

最大输入限制:文本 5000 字符;图片 50 MB(Base64编码)。

输出视频格式:MP4

输出视频帧率(fps):24

输出视频最高分辨率:1080p

输出视频时长:1s~16s,可选。

RPM: 30

vidu/viduq3-turbo_start-end2video

首尾帧生视频

输入类型:文本+图片

最大输入限制:文本 5000 字符;图片 50 MB(Base64编码)。

输出视频格式:MP4

输出视频帧率(fps):24

输出视频最高分辨率:1080p

输出视频时长:1s~16s,可选。

RPM: 30

vidu/viduq3-turbo_reference2video

参考生成视频

输入类型:文本+图片

最大输入限制:文本 5000 字符;图片 50 MB(Base64编码)。

输出视频格式:MP4

输出视频帧率(fps):24

输出视频最高分辨率:1080p

输出视频时长:1s~16s,可选。

RPM: 30

pixverse/pixverse-v6-kf2v

首尾帧生视频

输入类型:文本+图片

最大输入限制:文本 5000 字符;图片 20MB,10000px(Base64编码)。

输出视频格式:MP4

输出视频帧率(fps):24

输出视频最高分辨率:1080p

输出视频时长:1s~15s,可选。

RPM: 30

pixverse/pixverse-v6-r2v

参考生成视频

输入类型:文本+图片

最大输入限制:文本 5000 字符;图片 50 MB(Base64编码)。

输出视频格式:MP4

输出视频帧率(fps):24

输出视频时长:1s~15s,可选。

RPM: 30

Wan2.2-T2V-A14B

文生视频

输入类型:文本

最大输入限制:文本 1000 字符。

输出视频帧率(fps):16、24、30,默认值为16。

输出视频格式:MP4

输出视频分辨率:480P、720P

输出视频时长:3s、5s,默认值为5s。

RPM: 60

Wan2.2-I2V-A14B

图生视频

输入类型:文本+图片

最大输入限制:文本 1000 字符;图片 8 MB(Base64编码)。

输入图片格式:jpg、png、webp、jpeg、bmp

输出视频格式:MP4

输出视频帧率(fps):24

输出视频分辨率:480P、720P

输出视频时长:3s、5s,默认值为5s。

RPM: 60

相关文档