模型列表
MaaS提供多种模型供您使用。您可以根据教程或者API说明,便捷地将模型服务整合到自身业务当中。
推荐模型
| openPangu-2.0-Pro | GLM-5.2 | Kimi-K2.6 |
|---|---|---|
| openPangu-2.0-Pro 是基于昇腾 NPU 训练的大规模混合专家(MoE)语言模型,参数规模约 505B,每 token 激活参数规模约 18B,模型支持 512k 上下文长度,训练数据总量约34T tokens。后训练阶段完成快慢合一微调(SFT)、多专项强化学习(RL),并通过在线蒸馏(OPD)完成能力合一。 openPangu-2.0-Pro 在模型架构上实现了全面的升级: Attention架构:沿用高效 MLA,并采用 DSA+SWA 独立分层混合架构,层配比为 1:2;SWA 层负责局部窗口建模,DSA 层负责稀疏全局聚合,在保持精度的同时显著降低长序列推理的计算、显存与访存开销。 拓扑架构:将传统残差连接升级为 4 支流 mHC 架构,提升表征多样性与泛化能力。 自投机模块:采用 3 头 MTP 架构,一次额外预测 3 个 token,显著提升模型的推理速度。 Muon优化器:训练中采用Muon优化器,获得更快的收敛速度。 | GLM-5.2是智谱AI于2026年6月17日正式上线并开源的新一代旗舰大模型,核心特色包括: 长程任务能力显著提升,减少复杂任务中的上下文漂移与目标遗忘。 Coding与长程任务评测达到开源SOTA,在复杂系统工程、深度调试中表现更稳。 真实开发体验显著提升,项目级上下文承载、工程规范遵循与多端开发更可靠。 支持198K序列长度、最大输入192K、最大输出128K、最大思维链64K。 支持思维链、Function Call功能。 | Kimi K2.6是Kimi最新最智能的模型,Kimi K2.6的通用Agent、代码等综合能力得到全面提升,其中在博士级难度的完整版人类最后的考试(Humanity’s Last Exam)、在考察模型真实软件工程能力的SWE-Bench Pro、评估Agent深度检索能力的DeepSearchQA等基准测试中均取得行业领先的成绩,同时支持思考与非思考模式,对话与Agent任务。 支持256K序列长度、最大输入256K、最大输出96K、最大思维链96K。 支持思维链、Function Call、前缀续写功能。 |
文本生成
下表列出了支持文本生成能力的模型,介绍了模型参数(模型 ID)、模型支持的能力、模型的长度限制(上下文长度、最大输入长度、最大输出长度和最大思维链长度)、模型限流信息;您可根据需要选择合适的模型。
文本生成的教程请见文本生成,API说明请参见对话Chat/Post。
| model参数(模型 ID) | 支持能力 | 长度限制 | 默认限流 |
|---|---|---|---|
| openpangu-2.0-pro | 深度思考(可开关) Function Call 前缀续写 | 上下文长度:512K 最大输入长度:500K 最大输出长度:128K 最大思维链长度:64K |
|
| openpangu-2.0-flash | 深度思考(可开关) Function Call 前缀续写 | 上下文长度:512K 最大输入长度:500K 最大输出长度:128K 最大思维链长度:64K |
|
| glm-5.2 | 深度思考(可开关) Function Call | 上下文长度:198K 最大输入长度:192K 最大输出长度:128K 最大思维链长度:64K |
|
| glm-5.1 | 深度思考(可开关) Function Call | 上下文长度:198K 最大输入长度:192K 最大输出长度:128K 最大思维链长度:96K |
|
| kimi-k2.6 | 深度思考(可开关) Function Call 前缀续写 | 上下文长度:256K 最大输入长度:256K 最大输出长度:96K 最大思维链长度:96K |
|
| deepseek-v4-pro | 深度思考(可开关) Function Call 前缀续写 | 上下文长度:1M 最大输入长度:1M 最大输出长度:128K 最大思维链长度:96K |
|
| deepseek-v4-flash | 深度思考(可开关) Function Call 前缀续写 | 上下文长度:1M 最大输入长度:1M 最大输出长度:128K 最大思维链长度:96K |
|
| model参数(模型 ID) | 支持能力 | 长度限制 | 默认限流 |
|---|---|---|---|
| glm-5 | 深度思考(可开关) Function Call | 上下文长度:198K 最大输入长度:192K 最大输出长度:64K 最大思维链长度:64K |
|
| deepseek-v3.2 | 深度思考(可开关) Function Call 前缀续写 | 上下文长度:160K 最大输入长度:128K 最大输出长度:32K 最大思维链长度:32K |
|
| DeepSeek-V3 | Function Call | 上下文长度:128K 最大输入长度:128K 最大输出长度:32K |
|
| deepseek-r1-250528 | 深度思考 Function Call 前缀续写 | 上下文长度:128K 最大输入长度:96K 最大输出长度:32K 最大思维链长度:32K |
|
| qwen3-32b | 深度思考(可开关) | 上下文长度:128K 最大输入长度:128K 最大输出长度:128K 最大思维链长度:128K |
|
| qwen3-30b-a3b | 深度思考(可开关) | 上下文长度:128K 最大输入长度:128K 最大输出长度:128K 最大思维链长度:128K |
|
深度思考
下表列出了支持深度思考能力的模型,介绍了模型参数(模型 ID)、模型支持的能力、模型的长度限制(上下文长度、最大输入长度、最大输出长度和最大思维链长度)、模型限流信息;您可根据需要选择合适的模型。
深度思考的教程请见深度思考,API说明请参见对话Chat/Post。
| model参数(模型 ID) | 支持能力 | 长度限制 | 默认限流 |
|---|---|---|---|
| openpangu-2.0-pro | 深度思考(可开关) Function Call 前缀续写 | 上下文长度:512K 最大输入长度:500K 最大输出长度:128K 最大思维链长度:64K |
|
| openpangu-2.0-flash | 深度思考(可开关) Function Call 前缀续写 | 上下文长度:512K 最大输入长度:500K 最大输出长度:128K 最大思维链长度:64K |
|
| glm-5.2 | 深度思考(可开关) Function Call | 上下文长度:198K 最大输入长度:192K 最大输出长度:128K 最大思维链长度:64K |
|
| glm-5.1 | 深度思考(可开关) Function Call | 上下文长度:198K 最大输入长度:192K 最大输出长度:128K 最大思维链长度:96K |
|
| glm-5 | 深度思考(可开关) Function Call | 上下文长度:198K 最大输入长度:192K 最大输出长度:64K 最大思维链长度:64K |
|
| kimi-k2.6 | 深度思考(可开关) Function Call 前缀续写 | 上下文长度:256K 最大输入长度:256K 最大输出长度:96K 最大思维链长度:96K |
|
| deepseek-v4-pro | 深度思考(可开关) Function Call 前缀续写 | 上下文长度:1M 最大输入长度:1M 最大输出长度:128K 最大思维链长度:96K |
|
| deepseek-v4-flash | 深度思考(可开关) Function Call 前缀续写 | 上下文长度:1M 最大输入长度:1M 最大输出长度:128K 最大思维链长度:96K |
|
| model参数(模型 ID) | 支持能力 | 长度限制 | 默认限流 |
|---|---|---|---|
| deepseek-v3.2 | 深度思考(可开关) Function Call 前缀续写 | 上下文长度:160K 最大输入长度:128K 最大输出长度:32K 最大思维链长度:32K |
|
| deepseek-r1-250528 | 深度思考 Function Call 前缀续写 | 上下文长度:128K 最大输入长度:96K 最大输出长度:32K 最大思维链长度:32K |
|
| qwen3-32b | 深度思考(可开关) | 上下文长度:128K 最大输入长度:128K 最大输出长度:128K 最大思维链长度:128K |
|
| qwen3-30b-a3b | 深度思考(可开关) | 上下文长度:128K 最大输入长度:128K 最大输出长度:128K |
|
文本向量化
下表列出了支持文本向量化能力的模型,介绍了模型参数(模型 ID)、模型支持的能力、模型的输入限制(单个列表元素最大输入限制、支持输入类型、支持输出类型和最高向量维度)、模型限流信息;您可根据需要选择合适的模型。
| model参数(模型 ID) | 支持能力 | 输入限制 | 默认限流 |
|---|---|---|---|
| bge-m3 | 文本向量化 | 单个列表元素最大输入限制:8192 Token 支持输入类型:文本 支持输出类型:向量 最大输入长度:8K 最高向量维度:1024 |
|
重排序
下表列出了支持重排序能力的模型,介绍了模型参数(模型 ID)、模型支持的能力、模型的输入输出限制(单个列表元素最大输入限制、支持输入输出类型和最大输入长度)、模型限流信息;您可根据需要选择合适的模型。
| model参数(模型 ID) | 支持能力 | 输入输出限制 | 默认限流 |
|---|---|---|---|
| bge-reranker-v2-m3 | 重排序 | 单个列表元素最大输入限制:8192 Token 支持输入类型:文本 支持输出类型:文本 最大输入长度:8K |
|
图像理解
下表列出了支持图像理解能力的模型,介绍了模型参数(模型 ID)、模型支持的能力、模型的长度限制(上下文长度、最大输入长度和最大输出长度)、模型限流信息;您可根据需要选择合适的模型。
图像理解的教程请见图像理解,API说明请参见MaaS标准API V1。
| model参数(模型 ID) | 支持能力 | 长度限制 | 默认限流 |
|---|---|---|---|
| qwen2.5-vl-72b | 图像理解 | 上下文长度:48K 最大输入长度:文本48K;图片10MB(Base64编码格式)。 最大输出长度:16K |
|
| model参数(模型 ID) | 支持能力 | 输入限制 | 默认限流 |
|---|---|---|---|
| qwen-image | 文本生成图片 | 输入类型:文本 输入图片格式:不涉及 | RPM: 144 |
| qwen-image-edit-2509 | 文生图、图像编辑 | 输入类型:文本、图片 输入图片格式:png、jpeg、jpg、webp、bmp、tiff | RPM: 144 |
| model参数(模型 ID) | 支持能力 | 输入限制 | 默认限流 |
|---|---|---|---|
| qwen_image_edit | 文生图、图像编辑 | 输入类型:文本、图片 输入图片格式:png、jpeg、jpg、webp、bmp、tiff | RPM: 144 |
视频生成
下表列出了支持视频生成能力的模型,介绍了模型参数(模型 ID)、模型支持的能力、模型的输入输出限制(最大输入限制、输出视频格式、输出视频帧率、输出视频最高分辨率和输出视频时长)、模型限流信息;您可根据需要选择合适的模型。
| model参数(模型 ID) | 支持能力 | 输入输出限制 | 默认限流 |
|---|---|---|---|
| vidu/viduq3-turbo_text2video | 文生视频 | 输入类型:文本 最大输入限制:文本 5000 字符 输出视频格式:MP4 输出视频帧率(fps):24 输出视频最高分辨率:1080p 输出视频时长:1s~16s,可选。 | RPM: 30 |
| vidu/viduq3-turbo_img2video | 图生视频 | 输入类型:文本+图片 最大输入限制:文本 5000 字符;图片 50 MB(Base64编码)。 输出视频格式:MP4 输出视频帧率(fps):24 输出视频最高分辨率:1080p 输出视频时长:1s~16s,可选。 | RPM: 30 |
| pixverse/pixverse-v6-t2v | 文生视频 | 输入类型:文本 最大输入限制:文本 5000 字符 输出视频格式:MP4 输出视频最高分辨率:1080p 输出视频时长:1s~15s,可选。 | RPM: 30 |
| pixverse/pixverse-v6-it2v | 图生视频 | 输入类型:文本+图片 最大输入限制:文本 5000 字符;图片 20MB,10000px(Base64编码)。 输出视频格式:MP4 输出视频最高分辨率:1080p 输出视频时长:1s~15s,可选。 | RPM: 30 |
| model参数(模型 ID) | 支持能力 | 输入输出限制 | 默认限流 |
|---|---|---|---|
| vidu/viduq3-pro_text2video | 文生视频 | 输入类型:文本 最大输入限制:文本 5000 字符 输出视频格式:MP4 输出视频帧率(fps):24 输出视频最高分辨率:1080p 输出视频时长:1s~16s,可选。 | RPM: 30 |
| vidu/viduq3-pro_img2video | 图生视频 | 输入类型:文本+图片 最大输入限制:文本 5000 字符;图片 50 MB(Base64编码)。 输出视频格式:MP4 输出视频帧率(fps):24 输出视频最高分辨率:1080p 输出视频时长:1s~16s,可选。 | RPM: 30 |
| vidu/viduq3-pro_start-end2video | 首尾帧生成视频 | 输入类型:文本+图片 最大输入限制:文本 5000 字符;图片 50 MB(Base64编码)。 输出视频格式:MP4 输出视频帧率(fps):24 输出视频最高分辨率:1080p 输出视频时长:1s~16s,可选。 | RPM: 30 |
| vidu/viduq3-turbo_start-end2video | 首尾帧生视频 | 输入类型:文本+图片 最大输入限制:文本 5000 字符;图片 50 MB(Base64编码)。 输出视频格式:MP4 输出视频帧率(fps):24 输出视频最高分辨率:1080p 输出视频时长:1s~16s,可选。 | RPM: 30 |
| vidu/viduq3-turbo_reference2video | 参考生成视频 | 输入类型:文本+图片 最大输入限制:文本 5000 字符;图片 50 MB(Base64编码)。 输出视频格式:MP4 输出视频帧率(fps):24 输出视频最高分辨率:1080p 输出视频时长:1s~16s,可选。 | RPM: 30 |
| pixverse/pixverse-v6-kf2v | 首尾帧生视频 | 输入类型:文本+图片 最大输入限制:文本 5000 字符;图片 20MB,10000px(Base64编码)。 输出视频格式:MP4 输出视频帧率(fps):24 输出视频最高分辨率:1080p 输出视频时长:1s~15s,可选。 | RPM: 30 |
| pixverse/pixverse-v6-r2v | 参考生成视频 | 输入类型:文本+图片 最大输入限制:文本 5000 字符;图片 50 MB(Base64编码)。 输出视频格式:MP4 输出视频帧率(fps):24 输出视频时长:1s~15s,可选。 | RPM: 30 |
| Wan2.2-T2V-A14B | 文生视频 | 输入类型:文本 最大输入限制:文本 1000 字符。 输出视频帧率(fps):16、24、30,默认值为16。 输出视频格式:MP4 输出视频分辨率:480P、720P 输出视频时长:3s、5s,默认值为5s。 | RPM: 60 |
| Wan2.2-I2V-A14B | 图生视频 | 输入类型:文本+图片 最大输入限制:文本 1000 字符;图片 8 MB(Base64编码)。 输入图片格式:jpg、png、webp、jpeg、bmp 输出视频格式:MP4 输出视频帧率(fps):24 输出视频分辨率:480P、720P 输出视频时长:3s、5s,默认值为5s。 | RPM: 60 |