更新时间:2026-09-10 GMT+08:00

模型列表

MaaS提供多种模型供您使用。您可以根据教程或者API说明,便捷地将模型服务整合到自身业务当中。

模型推荐

GLM-5.2

GLM-5.1

GLM-5.2是智谱AI于2026年6月17日正式上线并开源的新一代旗舰大模型,核心特色包括:

长程任务能力显著提升,减少复杂任务中的上下文漂移与目标遗忘。

Coding与长程任务评测达到开源SOTA,在复杂系统工程、深度调试中表现更稳。

真实开发体验显著提升,项目级上下文承载、工程规范遵循与多端开发更可靠。

支持1M序列长度、最大输入1M、最大输出128K、最大思维链64K。

支持思维链、Function Call功能。

GLM-5.1 是智谱最新旗舰模型,代码能力大大增强,长程任务显著提升,能够在单次任务中持续、自主地工作长达 8 小时,完成从规划、执行到迭代优化的完整闭环,交付工程级成果。

在综合能力与 Coding 能力上,GLM-5.1 整体表现对齐 Claude Opus 4.6,并在长程自主执行、复杂工程优化与真实开发场景中展现出更强的持续工作能力,是构建 Autonomous Agent 与长程 Coding Agent 的理想基座。

支持198K序列长度、最大输入192K、最大输出128K、最大思维链96K。

支持思维链、Function Call功能。

文本生成

教程:文本生成;API:对话Chat/Post;价格:文本生成模型计费项

表1 模型列表

model参数(模型 ID)

支持能力

长度限制

默认限流

glm-5.2

深度思考(可开关)

Function Call

上下文长度:1M

最大输入长度:1M

最大输出长度:128K

最大思维链长度:64K

  • TPM: 1,000,000
  • RPM: 100

glm-5.1

深度思考(可开关)

Function Call

上下文长度:198K

最大输入长度:192K

最大输出长度:128K

最大思维链长度:96K

  • TPM: 1,000,000
  • RPM: 100

deepseek-v4-flash

深度思考(可开关)

Function Call

前缀续写

上下文长度:1M

最大输入长度:1M

最大输出长度:384K

最大思维链长度:96K

  • TPM: 60,000
  • RPM: 15

deepseek-v4-pro

深度思考(可开关)

Function Call

前缀续写

上下文长度:1M

最大输入长度:1M

最大输出长度:128K

最大思维链长度:96K

  • TPM: 30,000
  • RPM: 3

深度思考

教程:[xref]The T深度思考;API:对话Chat/Post;价格:文本生成模型计费项

表2 模型列表

model参数(模型 ID)

支持能力

长度限制

默认限流

glm-5.2

深度思考(可开关)

Function Call

上下文长度:1M

最大输入长度:1M

最大输出长度:128K

最大思维链长度:64K

  • TPM: 1,000,000
  • RPM: 100

glm-5.1

深度思考(可开关)

Function Call

上下文长度:198K

最大输入长度:192K

最大输出长度:128K

最大思维链长度:96K

  • TPM: 1,000,000
  • RPM: 100

deepseek-v4-flash

深度思考(可开关)

Function Call

前缀续写

上下文长度:1M

最大输入长度:1M

最大输出长度:384K

最大思维链长度:96K

  • TPM: 60,000
  • RPM: 15

deepseek-v4-pro

深度思考(可开关)

Function Call

前缀续写

上下文长度:1M

最大输入长度:1M

最大输出长度:128K

最大思维链长度:96K

  • TPM: 30,000
  • RPM: 3