> ## Documentation Index
> Fetch the complete documentation index at: https://duomi-docs.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# 充值与计费

> 充值流程、模型价格、分组倍率与缓存命中计费说明

哆米AI采用余额预充值模式。充值完成后，API 请求会根据实际使用的模型、输入 Token、输出 Token、缓存命中 Token 和对应的分组倍率自动扣除余额。

## 如何充值

1. 打开[钱包页面](https://api.duomi.ai/wallet)，登录哆米AI账户。
2. 在“添加资金”区域选择充值金额，也可以输入自定义金额。当前页面支持 1、10、50、100、500、1,000、2,000、5,000 元等常用金额。
3. 选择支付方式并完成支付。当前钱包页面显示的支付方式为支付宝，具体选项以页面实时显示为准。充值 1 元人民币即可获得按官方标价计算的 1 美元模型额度。
4. 支付完成后，余额会进入账户钱包。你可以在钱包页面查看余额和订单历史。

余额 **1 元即可起充，长期有效**，不会因为时间推移自动过期。

## 模型价格

模型的输入、输出和缓存 Token 单价以[模型与价格](https://api.duomi.ai/pricing)页面为准，并与对应模型的官方标价保持一致。模型价格可能随上游调整而变化，因此请以实时页面显示的价格为准。

在统一汇率基础上，哆米AI会根据模型和 Coding 方案配置不同的分组倍率。同样的官方用量，分组倍率不同，实际扣除的人民币余额也不同。

## 计费公式

基本计算方式为：

```text theme={null}
实际扣除余额（人民币） = 官方用量（美元） × 分组倍率
```

其中：

* **官方用量**：按照模型官方输入、输出和缓存 Token 单价计算出的美元用量。
* **分组倍率**：由模型和 Coding 方案决定，用于体现不同模型的折扣或加价策略。
* **实际扣除余额**：从哆米AI钱包中扣除的人民币金额。

按 1 美元约合 7 元人民币估算，在叠加分组倍率之前，哆米AI的基础扣费约为官方人民币成本的 1.5 折。最终价格仍以模型页面显示的单价和实际分组倍率为准。

例如，某次请求按照官方价格计算出的用量为 1 美元：

| 分组倍率  |   实际扣除余额 |
| ----- | -------: |
| 0.3 倍 | 0.3 元人民币 |
| 3 倍   |   3 元人民币 |

## 缓存命中计费

当上游将命中缓存的输入 Token 按普通输入 Token 价格的 10% 计费时，哆米AI也会使用相同的缓存单价，然后再叠加对应的分组倍率。

| 用量类型          | 计费方式                             |
| ------------- | -------------------------------- |
| 未命中的输入 Token  | 按模型官方输入 Token 单价计费，再乘以分组倍率       |
| 命中缓存的输入 Token | 按模型官方输入 Token 单价的 10% 计费，再乘以分组倍率 |
| 输出 Token      | 按模型官方输出 Token 单价计费，再乘以分组倍率       |

缓存命中通常取决于请求中可复用的上下文前缀是否保持一致，是否命中由上游模型和协议的实际处理结果决定。缓存命中后，只有命中的那部分输入 Token 使用缓存价格，其他输入和输出 Token 仍按各自的正常单价计算。

<Note>如果你主要使用 Coding 场景，建议优先使用 Codex 或 Claude Code 的官方客户端、CLI 端。它们通常能更稳定地复用会话上下文和固定提示前缀，从而提高缓存命中率，在相同任务量下减少实际计费。</Note>

## 计费示例

假设一次请求的官方用量如下：

* 未命中缓存的输入用量：0.20 美元
* 命中缓存的输入用量：0.50 美元
* 输出用量：0.30 美元
* 分组倍率：0.3 倍

如果缓存命中的 0.50 美元已经是按 10% 缓存单价折算后的官方用量，则实际扣费为：

```text theme={null}
(0.20 + 0.50 + 0.30) × 0.3 = 0.30 元人民币
```

实际请求可能使用不同模型、不同 Token 数量和不同分组倍率，请以模型价格页、接口返回的用量信息以及钱包余额变化为准。
