更新时间:2026-09-14 GMT+08:00
分享

模型列表

MaaS提供多种模型供您使用。您可以根据教程或者API说明,便捷地将模型服务整合到自身业务当中。

推荐模型

DeepSeek-V4.1-Flash

GLM-5.3

Kimi-K2.6

DeepSeek-V4.1-Flash是DeepSeek 于2026 年9月10日正式发布的新一代大语言模型。

  • 该模型采用 552B参数的 MoE(混合专家)架构,配合全新的Causal-Encoder-Decoder非对称结构,在Prefill阶段每Token仅激活约8B参数,Decode阶段激活约16B参数。
  • 在 KV Cache压缩方面,V4.1 Flash将HBM显存需求降至上一代的1/4,SSD存储需求降至 1/8,显著降低了Agent类长上下文任务的使用成本。
  • 支持1M序列长度、最大输入1M、最大输出384K、最大思维链96K。
  • 支持思维链、Function Call功能。

GLM-5.3 是智谱最新旗舰模型,复杂软件工程与 Agent 任务能力全面进阶。它使用与 GLM-5.2 相同的基础模型——所有提升均来自后训练。与 GLM-5.2 相比,它在复杂编程和长程任务方面表现更加出色:

  • 更强的编程能力:GLM-5.3 的编程能力大幅提升,在智谱内部 Z.ai Code Bench 上较 GLM-5.2 提升了 50%,在包括 Terminal Bench 3.0、Agents’ Last Exam (CLI) 在内的公开基准测试中达到开源模型 SOTA 水平。
  • 涌现的网络安全能力:随着后训练规模持续扩大,模型的网络安全能力以超出预期的速度提升。GLM-5.3 在漏洞发现基准 CyberGym 上取得当前最佳成绩;越深入漏洞利用链,其相较 GLM-5.2 的提升越显著,在漏洞利用类基准测试中的得分达到 GLM-5.2 的两倍以上。
  • 支持1M序列长度、最大输入1M、最大输出128K、最大思维链128K。
  • 支持思维链、Function Call功能。

Kimi K2.6是Kimi最新最智能的模型,Kimi K2.6的通用Agent、代码等综合能力得到全面提升,其中在博士级难度的完整版人类最后的考试(Humanity’s Last Exam)、在考察模型真实软件工程能力的SWE-Bench Pro、评估Agent深度检索能力的DeepSearchQA等基准测试中均取得行业领先的成绩,同时支持思考与非思考模式,对话与Agent任务。

  • 支持256K序列长度、最大输入256K、最大输出96K、最大思维链96K。
  • 支持思维链、Function Call、前缀续写功能。

文本生成

下表列出了支持文本生成能力的模型,介绍了模型参数(模型 ID)、模型支持的能力、模型的长度限制(上下文长度、最大输入长度、最大输出长度和最大思维链长度)、模型限流信息;您可根据需要选择合适的模型。

文本生成的教程请见文本生成,API说明请参见对话Chat/Post

表1 精选模型

model参数(模型 ID)

支持能力

长度限制

默认限流

openpangu-2.0-pro

深度思考(可开关)

Function Call

前缀续写

前缀缓存

上下文长度:512K

最大输入长度:500K

最大输出长度:128K

最大思维链长度:64K

  • TPM: 1,000,000
  • RPM: 100

openpangu-2.0-flash

深度思考(可开关)

Function Call

前缀续写

前缀缓存

上下文长度:512K

最大输入长度:500K

最大输出长度:128K

最大思维链长度:64K

  • TPM: 1,000,000
  • RPM: 100

glm-5.3

深度思考(不可关闭)

Function Call

前缀缓存

上下文长度:1M

最大输入长度:1M

最大输出长度:128K

最大思维链长度:128K

  • TPM: 1,000,000
  • RPM: 100

glm-5.2

深度思考(可开关)

Function Call

上下文长度:1M

最大输入长度:1M

最大输出长度:128K

最大思维链长度:64K

  • TPM: 1,000,000
  • RPM: 100

glm-5.1

深度思考(可开关)

Function Call

上下文长度:198K

最大输入长度:192K

最大输出长度:128K

最大思维链长度:96K

  • TPM: 1,000,000
  • RPM: 100

kimi-k2.6

深度思考(可开关)

Function Call

前缀续写

上下文长度:256K

最大输入长度:256K

最大输出长度:96K

最大思维链长度:96K

  • TPM: 100,000
  • RPM: 10

deepseek-v4.1-flash

深度思考(可开关)

Function Call

前缀缓存

上下文长度:1M

最大输入长度:1M

最大输出长度:384K

最大思维链长度:96K

  • TPM: 1,000,000
  • RPM:100

deepseek-v4-pro

深度思考(可开关)

Function Call

前缀续写

上下文长度:1M

最大输入长度:1M

最大输出长度:128K

最大思维链长度:96K

  • TPM: 60,000
  • RPM: 15

deepseek-v4-flash

深度思考(可开关)

Function Call

前缀续写

上下文长度:1M

最大输入长度:1M

最大输出长度:384K

最大思维链长度:96K

  • TPM: 60,000
  • RPM: 15
表2 其它模型

model参数(模型 ID)

支持能力

长度限制

默认限流

qwen3-32b

深度思考(可开关)

上下文长度:128K

最大输入长度:128K

最大输出长度:128K

最大思维链长度:128K

  • TPM: 100,000
  • RPM: 300

qwen3-30b-a3b

深度思考(可开关)

上下文长度:128K

最大输入长度:128K

最大输出长度:128K

最大思维链长度:128K

  • TPM: 100,000
  • RPM: 300

深度思考

下表列出了支持深度思考能力的模型,介绍了模型参数(模型 ID)、模型支持的能力、模型的长度限制(上下文长度、最大输入长度、最大输出长度和最大思维链长度)、模型限流信息;您可根据需要选择合适的模型。

深度思考的教程请见深度思考,API说明请参见对话Chat/Post

表3 精选模型

model参数(模型 ID)

支持能力

长度限制

默认限流

openpangu-2.0-pro

深度思考(可开关)

Function Call

前缀续写

前缀缓存

上下文长度:512K

最大输入长度:500K

最大输出长度:128K

最大思维链长度:64K

  • TPM: 1,000,000
  • RPM: 100

openpangu-2.0-flash

深度思考(可开关)

Function Call

前缀续写

前缀缓存

上下文长度:512K

最大输入长度:500K

最大输出长度:128K

最大思维链长度:64K

  • TPM: 1,000,000
  • RPM: 100

glm-5.3

深度思考(不可关闭)

Function Call

前缀缓存

上下文长度:1M

最大输入长度:1M

最大输出长度:128K

最大思维链长度:128K

  • TPM: 1,000,000
  • RPM: 100

glm-5.2

深度思考(可开关)

Function Call

上下文长度:1M

最大输入长度:1M

最大输出长度:128K

最大思维链长度:64K

  • TPM: 1,000,000
  • RPM: 100

glm-5.1

深度思考(可开关)

Function Call

上下文长度:198K

最大输入长度:192K

最大输出长度:128K

最大思维链长度:96K

  • TPM: 1,000,000
  • RPM: 100

kimi-k2.6

深度思考(可开关)

Function Call

前缀续写

上下文长度:256K

最大输入长度:256K

最大输出长度:96K

最大思维链长度:96K

  • TPM: 100,000
  • RPM: 10

deepseek-v4.1-flash

深度思考(可开关)

Function Call

前缀缓存

上下文长度:1M

最大输入长度:1M

最大输出长度:384K

最大思维链长度:96K

  • TPM: 1,000,000
  • RPM:100

deepseek-v4-pro

深度思考(可开关)

Function Call

前缀续写

上下文长度:1M

最大输入长度:1M

最大输出长度:128K

最大思维链长度:96K

  • TPM: 60,000
  • RPM: 15

deepseek-v4-flash

深度思考(可开关)

Function Call

前缀续写

上下文长度:1M

最大输入长度:1M

最大输出长度:384K

最大思维链长度:96K

  • TPM: 60,000
  • RPM: 15
表4 其它模型

model参数(模型 ID)

支持能力

长度限制

默认限流

qwen3-32b

深度思考(可开关)

上下文长度:128K

最大输入长度:128K

最大输出长度:128K

最大思维链长度:128K

  • TPM: 100,000
  • RPM: 300

qwen3-30b-a3b

深度思考(可开关)

上下文长度:128K

最大输入长度:128K

最大输出长度:128K

  • TPM: 100,000
  • RPM: 300

文本向量化

下表列出了支持文本向量化能力的模型,介绍了模型参数(模型 ID)、模型支持的能力、模型的输入输出限制(单个列表元素最大输入限制、支持输入类型、支持输出类型和最高向量维度)、模型限流信息;您可根据需要选择合适的模型。

文本向量化的教程请见文本向量化,API说明请参见创建文本向量化

表5 精选模型

model参数(模型 ID)

支持能力

输入输出限制

默认限流

bge-m3

文本向量化

单个列表元素最大输入限制:8192 Token

支持输入类型:文本

支持输出类型:向量

最大输入长度:8K

最高向量维度:1024

  • TPM: 1,200,000
  • RPM: 100

重排序

下表列出了支持重排序能力的模型,介绍了模型参数(模型 ID)、模型支持的能力、模型的输入输出限制(单个列表元素最大输入限制、支持输入输出类型和最大输入长度)、模型限流信息;您可根据需要选择合适的模型。

重排序的教程请见重排序,API说明请参见创建重排序

表6 精选模型

model参数(模型 ID)

支持能力

输入输出限制

默认限流

bge-reranker-v2-m3

重排序

单个列表元素最大输入限制:8192 Token

支持输入类型:文本

支持输出类型:文本

最大输入长度:8K

  • TPM: 20,000
  • RPM: 120

图像理解

下表列出了支持图像理解能力的模型,介绍了模型参数(模型 ID)、模型支持的能力、模型的输入输出限制(上下文长度、最大输入长度和最大输出长度)、模型限流信息;您可根据需要选择合适的模型。

图像理解的教程请见图像理解,API说明请参见MaaS标准API V1

表7 精选模型

model参数(模型 ID)

支持能力

输入输出限制

默认限流

deepseek-v4.1-flash

图像理解

上下文长度:1M

最大输入长度:1M

最大输出长度:384K

最大思维链长度:96K

图片限制:图片最大数量600张,单张图片大小不超过32MB,图片分辨率不限制(推荐小于4096*2160),支持JPEG、PNG、GIF和WebP格式。

  • TPM: 1,000,000
  • RPM:100

qwen2.5-vl-72b

图像理解

上下文长度:48K

最大输入长度:文本48K;图片10MB(Base64编码格式)或者公网可访问的图片地址。

最大输出长度:16K

  • TPM: 100,000
  • RPM: 60

图片生成

下表列出了支持图片生成能力的模型,介绍了模型参数(模型 ID)、模型支持的能力、模型的输入限制(输入类型和输入图片格式)、模型限流信息;您可根据需要选择合适的模型。

图片生成的教程请见图片生成,API说明请参见图片生成

表8 精选模型

model参数(模型 ID)

支持能力

输入限制

默认限流

qwen-image

文本生成图片

输入类型:文本

输入图片格式:不涉及

RPM: 144

qwen-image-edit-2509

文生图、图像编辑

输入类型:文本、图片

输入图片格式:png、jpeg、jpg、webp、bmp、tiff

RPM: 144

表9 其它模型

model参数(模型 ID)

支持能力

输入限制

默认限流

qwen_image_edit

文生图、图像编辑

输入类型:文本、图片

输入图片格式:png、jpeg、jpg、webp、bmp、tiff

RPM: 144

视频生成

下表列出了支持视频生成能力的模型,介绍了模型参数(模型 ID)、模型支持的能力、模型的输入输出限制(最大输入限制、输出视频格式、输出视频帧率、输出视频最高分辨率和输出视频时长)、模型限流信息;您可根据需要选择合适的模型。

视频生成的教程请见视频生成,API说明请参见视频生成

表10 精选模型

model参数(模型 ID)

支持能力

输入输出限制

默认限流

vidu/viduq3-turbo_text2video

文生视频

输入类型:文本

最大输入限制:文本 5000 字符

输出视频格式:MP4

输出视频帧率(fps):24

输出视频最高分辨率:1080p

输出视频时长:1s~16s,可选。

RPM: 30

vidu/viduq3-turbo_img2video

图生视频

输入类型:文本+图片

最大输入限制:文本 5000 字符;图片 50 MB(Base64编码)。

输出视频格式:MP4

输出视频帧率(fps):24

输出视频最高分辨率:1080p

输出视频时长:1s~16s,可选。

RPM: 30

pixverse/pixverse-v6-t2v

文生视频

输入类型:文本

最大输入限制:文本 5000 字符

输出视频格式:MP4

输出视频最高分辨率:1080p

输出视频时长:1s~15s,可选。

RPM: 30

pixverse/pixverse-v6-it2v

图生视频

输入类型:文本+图片

最大输入限制:文本 5000 字符;图片 20MB,10000px(Base64编码)。

输出视频格式:MP4

输出视频最高分辨率:1080p

输出视频时长:1s~15s,可选。

RPM: 30

表11 其它模型

model参数(模型 ID)

支持能力

输入输出限制

默认限流

vidu/viduq3-pro_text2video

文生视频

输入类型:文本

最大输入限制:文本 5000 字符

输出视频格式:MP4

输出视频帧率(fps):24

输出视频最高分辨率:1080p

输出视频时长:1s~16s,可选。

RPM: 30

vidu/viduq3-pro_img2video

图生视频

输入类型:文本+图片

最大输入限制:文本 5000 字符;图片 50 MB(Base64编码)。

输出视频格式:MP4

输出视频帧率(fps):24

输出视频最高分辨率:1080p

输出视频时长:1s~16s,可选。

RPM: 30

vidu/viduq3-pro_start-end2video

首尾帧生成视频

输入类型:文本+图片

最大输入限制:文本 5000 字符;图片 50 MB(Base64编码)。

输出视频格式:MP4

输出视频帧率(fps):24

输出视频最高分辨率:1080p

输出视频时长:1s~16s,可选。

RPM: 30

vidu/viduq3-turbo_start-end2video

首尾帧生成视频

输入类型:文本+图片

最大输入限制:文本 5000 字符;图片 50 MB(Base64编码)。

输出视频格式:MP4

输出视频帧率(fps):24

输出视频最高分辨率:1080p

输出视频时长:1s~16s,可选。

RPM: 30

vidu/viduq3-turbo_reference2video

参考生成视频

输入类型:文本+图片

最大输入限制:文本 5000 字符;图片 50 MB(Base64编码)。

输出视频格式:MP4

输出视频帧率(fps):24

输出视频最高分辨率:1080p

输出视频时长:1s~16s,可选。

RPM: 30

vidu/viduq3-mix_reference2video

参考生成视频

输入类型:文本+图片

最大输入限制:文本 5000 字符;图片 50 MB(Base64编码)。

输出视频格式:MP4

输出视频帧率(fps):24

输出视频最高分辨率:1080p

输出视频时长:1s~15s,可选。

RPM: 30

vidu/viduq3-ad_reference2video

参考生成视频

输入类型:文本+图片

最大输入限制:文本 5000 字符;图片 50 MB(Base64编码)。

输出视频格式:MP4

输出视频帧率(fps):24

输出视频最高分辨率:1080p

输出视频时长:1s~15s,可选。

RPM: 30

pixverse/pixverse-v6-kf2v

首尾帧生成视频

输入类型:文本+图片

最大输入限制:文本 5000 字符;图片 20MB,10000px(Base64编码)。

输出视频格式:MP4

输出视频帧率(fps):24

输出视频最高分辨率:1080p

输出视频时长:1s~15s,可选。

RPM: 30

pixverse/pixverse-v6-r2v

参考生成视频

输入类型:文本+图片

最大输入限制:文本 5000 字符;图片 50 MB(Base64编码)。

输出视频格式:MP4

输出视频帧率(fps):24

输出视频时长:1s~15s,可选。

RPM: 30

Wan2.2-T2V-A14B

文生视频

输入类型:文本

最大输入限制:文本 1000 字符。

输出视频帧率(fps):16、24、30,默认值为16。

输出视频格式:MP4

输出视频分辨率:480P、720P

输出视频时长:3s、5s,默认值为5s。

RPM: 60

Wan2.2-I2V-A14B

图生视频

输入类型:文本+图片

最大输入限制:文本 1000 字符;图片 8 MB(Base64编码)。

输入图片格式:jpg、png、webp、jpeg、bmp

输出视频格式:MP4

输出视频帧率(fps):24

输出视频分辨率:480P、720P

输出视频时长:3s、5s,默认值为5s。

RPM: 60

相关文档