---
title: apiToken.sale 计费方式详解
description: "apiToken.sale 的计费方式：一份预付余额覆盖 Claude、GPT、Gemini 与 Kimi，按官方费率逐请求计量，统一 50% B2C 折扣，控制台提供汇总用量明细。"
url: https://apitoken.sale/zh/docs/learn/how-billing-works
language: zh-CN
---

# 计费如何运作

apiToken.sale 采用预付计费：一次性充值余额后，每个 Claude、GPT、Gemini 与 Kimi 请求都从中扣减。每次调用按提供商官方费率表计量，先算出官方费用，再减去统一的 50% B2C 折扣，只有净额才会扣你的余额。

## 一份预付余额，覆盖 Claude、GPT、Gemini 与 Kimi

apiToken.sale 的计费是预付制、按量付费：先充值余额，API 请求再从中扣减——没有月度账单，也没有订阅。同一份余额覆盖所有受支持的 Claude、GPT、Gemini 与 Kimi 模型，你不需要分别管理四个提供商账户，也不用面对四张账单。

充值金额可以是任意整数美元。余额永不过期，这会改变你的充值策略：没必要“以防万一”预存一大笔钱，也没必要囤着不用。按未来几周的实际用量充值即可，控制台提示余额偏低时再补。闲置不产生任何费用——这个月没花完的余额，下个季度还在。

## 一次请求如何变成一笔扣费

每次调用的价格都来自提供商实际回报的用量，而不是固定的按次收费。路由器会把响应中的 usage 字段逐项换算成官方费用：

- 输入 token——你的提示词、系统指令和对话历史，按模型的官方输入费率计费。
- 输出 token——模型的回复，按官方输出费率计费，通常高于输入费率。
- 缓存部分——缓存写入和缓存读取与普通输入分开计量，缓存读取便宜得多。
- 模型专属桶——当模型的费率表定义了长上下文附加费或图像部分时，单独计量。

由于计量遵循各提供商自己的费率表，一次 Claude 请求的定价与 Anthropic 官方完全一致，一次 Gemini 请求与 Google 官方完全一致——在折扣生效之前都是如此。流式响应与非流式响应的计量方式相同：最终用量随流一起到达，扣费金额也完全一样。

## 50% 折扣在计算的哪一步生效

折扣永远在官方费用算完之后才应用，绝不提前。先算出官方费用，再对所有受支持的提供商统一减去 50% B2C 折扣，净额从你的预付余额中扣除。以 Claude Haiku 4.5 为例（官方价：输入每百万 token $1，输出每百万 token $5）：

| 步骤 | 计算 | 金额 |
| --- | --- | --- |
| 输入部分（3,000 tokens） | 3,000 × $1 / 1M | $0.003 |
| 输出部分（800 tokens） | 800 × $5 / 1M | $0.004 |
| 官方提供商费用 | $0.003 + $0.004 | $0.007 |
| 统一 50% B2C 折扣 | $0.007 × 50% | −$0.0035 |
| 从你的余额扣除 | $0.007 − $0.0035 | $0.0035 |

同样的运算顺序也适用于 GPT、Gemini 与 Kimi 请求，分别对照各自的官方费率表。提示词缓存与折扣是叠加关系，而不是互相替代：缓存读取按官方费率本来就便宜，50% 折扣再在这个更便宜的数字上减。

## 充值方式：银行卡、加密货币与金额

结账时可以用银行卡支付，也可以通过安全的支付服务商用加密货币支付；加密货币充值在网络确认交易后到账。无论哪种方式，资金都会进入你账户的预付余额，只在请求实际运行时才被消耗——每次充值都可以在银行卡和加密货币之间自由切换。

如果奖励或充值没有按预期到账，可以通过 Telegram 联系支持（提供英文和俄文服务），或发邮件至 apitokensale@gmail.com。退款通过原支付服务商处理。

## 余额归零时会发生什么

请求会开始返回 HTTP 402 billing_error 和原文 insufficient balance or key spending limit reached for this request——你的密钥不会被吊销，账户也不会被关闭，只是调用在充值之前无法通过。充值任意整数美元即可立即恢复服务，所以解决办法是跑一趟结账页，而不是提工单。不要把 402 当成 429 去重试。

```
curl https://router.apitoken.sale/v1/messages \
  -H "x-api-key: sk-pool-•••" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-haiku-4-5",
    "max_tokens": 64,
    "messages": [{"role":"user","content":"ping"}]
  }'

# With an empty balance the response is:
# HTTP 402 billing_error — insufficient balance or key spending limit reached for this request
```

> 对于无人值守的工作负载——代理、定时任务、CI 评测——在长时间运行前先检查控制台余额。队列跑到一半遇到 402 就是一次失败的任务，而且重试解决不了空余额，不像限流那样可以靠重试扛过去。

## 审计钱花在了哪里

控制台 Usage 按模型、提供商、日期和客户密钥显示已结算用量。要逐条审计请求，请使用客户密钥调用 GET /activity；响应包含模型、提供商、token、扣费金额、公开错误和可选的 agent session 分组。

如果想提前规划充值而不是事后对账，先估算工作量：各模型的官方价与折后价都列在模型页面上，成本计算器可以在你花一分钱之前，把“提示词加回复”的 token 估算换算成美元金额。

[各模型费率、缓存定价与上下文窗口](/models)

[用 Claude API 成本计算器估算工作量](/tools/claude-api-cost-calculator)

## 常见问题

### apiToken.sale 的计费是预付还是后付？

预付。你预先以任意整数美元充值余额，请求从中扣减——没有月度账单，也没有订阅。

### 一份余额能同时覆盖 Claude、GPT、Gemini 与 Kimi 吗？

能。每个提供商按自己的官方费率表计量，统一应用 50% B2C 折扣，净额从同一份预付余额中扣除。

### 每次请求的 50% 折扣是怎么算的？

先把请求的用量项（输入、输出、缓存以及模型专属桶）换算成官方提供商费用，再减去 50%，只有剩余部分才从你的余额中扣除。

### apiToken.sale 余额用完会怎样？

请求会返回 HTTP 402 和余额不足错误。你的密钥仍然有效——充值任意整数美元即可立即恢复服务。

### 未用完的余额会过期吗？可以退款吗？

余额永不过期，未使用的资金会一直保留。退款通过原支付服务商处理——请通过 Telegram 或发送邮件至 apitokensale@gmail.com 联系支持。

### 我能看到每个请求的 token 级用量吗？

可以。使用客户密钥调用 GET /activity；响应包含每个请求的模型、提供商、token、扣费金额、公开错误和可选的 agent session 分组。

---
Get a key: https://apitoken.sale/register
More guides: https://apitoken.sale/zh/docs/learn
