外观
约 886 字大约 3 分钟
2026-04-15
智算多多采用按量计费模式,价格透明,根据实际 Token 使用量收费。以下为各模型的详细价格。
计费说明
- 计费单位:元/百万 Token
- 输入 Token:用户发送的文本内容
- 输出 Token:模型返回的文本内容
- 缓存 Token:复用缓存的输入内容(价格更低)
- --:表示该模型暂不支持缓存
计费优势
智算多多支持输入缓存功能,相同内容多次调用时可大幅降低成本。缓存价格仅为输入价格的 5%~10%。
价格总览
| 模型名称 | 输入价格 (元/百万Token) | 输出价格 (元/百万Token) | 缓存价格 (元/百万Token) |
|---|---|---|---|
qwen3.5-flash | 0.2 | 2 | 0.02 |
qwen-plus | 0.8 | 2 | 0.08 |
qwen3.5-plus | 0.8 | 4.8 | 0.08 |
qwen3.5-35b-a3b | 0.4 | 3.2 | -- |
qwen-flash | 1 | 4 | 0.1 |
qwen3-coder-flash | 1 | 4 | 0.1 |
qwen3.6-plus | 2 | 12 | 0.2 |
deepseek-v3.2 | 2 | 3 | 0.4 |
qwen-max | 2.4 | 9.6 | 0.48 |
qwen3-max | 2.5 | 10 | 0.25 |
MiniMax-M2.5 | 2.1 | 8.4 | 0.42 |
MiniMax/MiniMax-M2.7 | 2.1 | 8.4 | 0.42 |
qwen3-coder-30b-a3b-instruct | 3.75 | 15 | -- |
kimi-k2.5 | 4 | 21 | 0.8 |
qwen3-coder-plus | 4 | 16 | 0.4 |
glm-5.1 | 8 | 28 | 1.6 |
qwen3-coder-480b-a35b-instruct | 15 | 60 | -- |
farui-plus | 20 | 20 | -- |
注意
价格可能根据市场情况调整,请以控制台实时显示为准。大额使用可联系客服获取折扣优惠。
分系列价格
Qwen 系列
| 模型名称 | 输入价格 | 输出价格 | 缓存价格 | 推荐场景 |
|---|---|---|---|---|
qwen3.5-flash | ¥0.2 | ¥2 | ¥0.02 | 高并发、轻量对话 |
qwen-plus | ¥0.8 | ¥2 | ¥0.08 | 通用对话、文本生成 |
qwen3.5-plus | ¥0.8 | ¥4.8 | ¥0.08 | 通用对话、代码辅助 |
qwen3.5-35b-a3b | ¥0.4 | ¥3.2 | -- | 中等复杂度任务 |
qwen-flash | ¥1 | ¥4 | ¥0.1 | 快速响应场景 |
qwen-max | ¥2.4 | ¥9.6 | ¥0.48 | 复杂推理、深度分析 |
qwen3.6-plus | ¥2 | ¥12 | ¥0.2 | 高质量文本生成 |
qwen3-max | ¥2.5 | ¥10 | ¥0.25 | 最新版本、全面能力 |
Qwen Coder 系列
| 模型名称 | 输入价格 | 输出价格 | 缓存价格 | 推荐场景 |
|---|---|---|---|---|
qwen3-coder-flash | ¥1 | ¥4 | ¥0.1 | 代码补全、快速响应 |
qwen3-coder-30b-a3b-instruct | ¥3.75 | ¥15 | -- | 代码生成、审查 |
qwen3-coder-plus | ¥4 | ¥16 | ¥0.4 | 专业代码开发 |
qwen3-coder-480b-a35b-instruct | ¥15 | ¥60 | -- | 复杂架构、大型项目 |
DeepSeek 系列
| 模型名称 | 输入价格 | 输出价格 | 缓存价格 | 推荐场景 |
|---|---|---|---|---|
deepseek-v3.2 | ¥2 | ¥3 | ¥0.4 | 代码生成、推理分析 |
其他模型
| 模型名称 | 输入价格 | 输出价格 | 缓存价格 | 推荐场景 |
|---|---|---|---|---|
glm-5.1 | ¥8 | ¥28 | ¥1.6 | 中文理解、长文本 |
kimi-k2.5 | ¥4 | ¥21 | ¥0.8 | 超长文本处理 |
MiniMax-M2.5 | ¥2.1 | ¥8.4 | ¥0.42 | 多模态、创意写作 |
MiniMax/MiniMax-M2.7 | ¥2.1 | ¥8.4 | ¥0.42 | 最新版本 |
farui-plus | ¥20 | ¥20 | -- | 法律咨询、合规分析 |
成本计算示例
以处理 10 万 Token(约 15 万汉字)为例:
qwen-plus
输入:5万Token × ¥0.8/百万 = ¥0.04
输出:5万Token × ¥2/百万 = ¥0.10
总计:¥0.14qwen3.5-flash(低成本)
输入:5万Token × ¥0.2/百万 = ¥0.01
输出:5万Token × ¥2/百万 = ¥0.10
总计:¥0.11使用缓存(更省钱)
首次调用:
输入:5万Token × ¥0.8/百万 = ¥0.04
输出:5万Token × ¥2/百万 = ¥0.10
后续调用(缓存命中):
输入:5万Token × ¥0.08/百万 = ¥0.004
输出:5万Token × ¥2/百万 = ¥0.10
节省:90% 输入成本计费周期与结算
- 计费周期:实时计费,按请求结算
- 结算方式:预付费余额扣款
- 账单查询:控制台 → 账单管理 → 使用明细
- 余额充值:支持支付宝、微信、银行卡
提示
建议开启用量预警,当余额低于设定阈值时自动提醒,避免服务中断。
