资源规划
该解决方案主要部署如下资源,不同产品的花费仅供参考,实际以收费账单为准,具体请参考华为云官网价格。“请注意,此处列出的资源成本规划仅涵盖‘快速部署’阶段产生的资源及相关费用。后续在‘AI开发平台ModelArts’上实际使用服务时,将产生额外的计费项目。”
| 华为云服务 | 配置示例 | 数量 | 一次完整流程预估(1小时)花费 |
|---|---|---|---|
| Flexus云服务器X实例 |
| 1台 | $0.14 USD |
| 弹性公网IP EIP |
| 1个 | $0.16 USD/GB |
| 对象存储服务OBS |
| 1个 | 费用包括存储空间、请求费用、流量费用两部分,详细请参考每月账单。 |
| 合计 | - | $0.14 USD+ 弹性公网IP EIP费用+OBS实际使用费用 |
| 序号 | 模型名称 | 是否支持fp16/bf16推理 | 是否支持W8A8量化 | 是否支持W4A8量化 | v0/v1 后端 | 最小卡数(64G显存) | 最大序列(K) max-model-len | 开源权重获取地址 |
|---|---|---|---|---|---|---|---|---|
| 1 | Qwen3.6-35B-A3B | √ | x | x | v1 | 2 | 128 | |
| 2 | DeepSeek-V4-Flash-0731-w8a8 | x | √ | x | x | 8 | 128 | / |
| 3 | Qwen3.8-27B-W8A8 | x | √ | √ | v1 | 1 | 256 | https://modelscope.cn/models/Eco-Tech/Qwen3.8-27B-w8a8/files |
| 4 | Qwen3-ASR-1.7B | √ | x | x | v1 | 1 | 32 | |
| 5 | Qwen3-TTS-12Hz-1.7B-CustomVoice | √ | x | x | v1 | 1 | 32 | https://modelscope.cn/models/Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice/files |
| 6 | Qwen3-TTS-12Hz-1.7B-VoiceDesign | √ | x | x | v1 | 1 | 32 | https://modelscope.cn/models/Qwen/Qwen3-TTS-12Hz-1.7B-VoiceDesign/files |
| 7 | MinerU | √ | x | x | v1 | 1 | / | https://modelscope.cn/models/OpenDataLab/MinerU2.5-Pro-2605-1.2B/files |