---
url: /guide/pricing/index.md
---
智算多多采用按量计费模式，价格透明，根据实际 Token 使用量收费。以下为各模型的详细价格。

## 计费说明

* **计费单位**：元/百万 Token
* **输入 Token**：用户发送的文本内容
* **输出 Token**：模型返回的文本内容
* **缓存 Token**：复用缓存的输入内容（价格更低）
* **--**：表示该模型暂不支持缓存

::: tip 计费优势
智算多多支持输入缓存功能，相同内容多次调用时可大幅降低成本。缓存价格仅为输入价格的 5%~10%。
:::

## 价格总览

| 模型名称 | 输入价格 (元/百万Token) | 输出价格 (元/百万Token) | 缓存价格 (元/百万Token) |
|---------|------------------------|------------------------|------------------------|
| `qwen3.5-flash` | 0.2 | 2 | 0.02 |
| `qwen-plus` | 0.8 | 2 | 0.08 |
| `qwen3.5-plus` | 0.8 | 4.8 | 0.08 |
| `qwen3.5-35b-a3b` | 0.4 | 3.2 | -- |
| `qwen-flash` | 1 | 4 | 0.1 |
| `qwen3-coder-flash` | 1 | 4 | 0.1 |
| `qwen3.6-plus` | 2 | 12 | 0.2 |
| `deepseek-v3.2` | 2 | 3 | 0.4 |
| `qwen-max` | 2.4 | 9.6 | 0.48 |
| `qwen3-max` | 2.5 | 10 | 0.25 |
| `MiniMax-M2.5` | 2.1 | 8.4 | 0.42 |
| `MiniMax/MiniMax-M2.7` | 2.1 | 8.4 | 0.42 |
| `qwen3-coder-30b-a3b-instruct` | 3.75 | 15 | -- |
| `kimi-k2.5` | 4 | 21 | 0.8 |
| `qwen3-coder-plus` | 4 | 16 | 0.4 |
| `glm-5.1` | 8 | 28 | 1.6 |
| `qwen3-coder-480b-a35b-instruct` | 15 | 60 | -- |
| `farui-plus` | 20 | 20 | -- |

::: warning 注意
价格可能根据市场情况调整，请以控制台实时显示为准。大额使用可联系客服获取折扣优惠。
:::

## 分系列价格

### Qwen 系列

| 模型名称 | 输入价格 | 输出价格 | 缓存价格 | 推荐场景 |
|---------|---------|---------|---------|---------|
| `qwen3.5-flash` | ¥0.2 | ¥2 | ¥0.02 | 高并发、轻量对话 |
| `qwen-plus` | ¥0.8 | ¥2 | ¥0.08 | 通用对话、文本生成 |
| `qwen3.5-plus` | ¥0.8 | ¥4.8 | ¥0.08 | 通用对话、代码辅助 |
| `qwen3.5-35b-a3b` | ¥0.4 | ¥3.2 | -- | 中等复杂度任务 |
| `qwen-flash` | ¥1 | ¥4 | ¥0.1 | 快速响应场景 |
| `qwen-max` | ¥2.4 | ¥9.6 | ¥0.48 | 复杂推理、深度分析 |
| `qwen3.6-plus` | ¥2 | ¥12 | ¥0.2 | 高质量文本生成 |
| `qwen3-max` | ¥2.5 | ¥10 | ¥0.25 | 最新版本、全面能力 |

### Qwen Coder 系列

| 模型名称 | 输入价格 | 输出价格 | 缓存价格 | 推荐场景 |
|---------|---------|---------|---------|---------|
| `qwen3-coder-flash` | ¥1 | ¥4 | ¥0.1 | 代码补全、快速响应 |
| `qwen3-coder-30b-a3b-instruct` | ¥3.75 | ¥15 | -- | 代码生成、审查 |
| `qwen3-coder-plus` | ¥4 | ¥16 | ¥0.4 | 专业代码开发 |
| `qwen3-coder-480b-a35b-instruct` | ¥15 | ¥60 | -- | 复杂架构、大型项目 |

### DeepSeek 系列

| 模型名称 | 输入价格 | 输出价格 | 缓存价格 | 推荐场景 |
|---------|---------|---------|---------|---------|
| `deepseek-v3.2` | ¥2 | ¥3 | ¥0.4 | 代码生成、推理分析 |

### 其他模型

| 模型名称 | 输入价格 | 输出价格 | 缓存价格 | 推荐场景 |
|---------|---------|---------|---------|---------|
| `glm-5.1` | ¥8 | ¥28 | ¥1.6 | 中文理解、长文本 |
| `kimi-k2.5` | ¥4 | ¥21 | ¥0.8 | 超长文本处理 |
| `MiniMax-M2.5` | ¥2.1 | ¥8.4 | ¥0.42 | 多模态、创意写作 |
| `MiniMax/MiniMax-M2.7` | ¥2.1 | ¥8.4 | ¥0.42 | 最新版本 |
| `farui-plus` | ¥20 | ¥20 | -- | 法律咨询、合规分析 |

## 成本计算示例

以处理 10 万 Token（约 15 万汉字）为例：

::: code-tabs#calc

@tab qwen-plus

```
输入：5万Token × ¥0.8/百万 = ¥0.04
输出：5万Token × ¥2/百万 = ¥0.10
总计：¥0.14
```

@tab qwen3.5-flash（低成本）

```
输入：5万Token × ¥0.2/百万 = ¥0.01
输出：5万Token × ¥2/百万 = ¥0.10
总计：¥0.11
```

@tab 使用缓存（更省钱）

```
首次调用：
  输入：5万Token × ¥0.8/百万 = ¥0.04
  输出：5万Token × ¥2/百万 = ¥0.10
  
后续调用（缓存命中）：
  输入：5万Token × ¥0.08/百万 = ¥0.004
  输出：5万Token × ¥2/百万 = ¥0.10
  
节省：90% 输入成本
```

:::

## 计费周期与结算

* **计费周期**：实时计费，按请求结算
* **结算方式**：预付费余额扣款
* **账单查询**：控制台 → 账单管理 → 使用明细
* **余额充值**：支持支付宝、微信、银行卡

::: info 提示
建议开启用量预警，当余额低于设定阈值时自动提醒，避免服务中断。
:::
