计费如何运作
apiToken.sale 采用预付计费:一次性充值余额后,每个 Claude、GPT、Gemini 与 Kimi 请求都从中扣减。每次调用按提供商官方费率表计量,先算出官方费用,再减去统一的 50% B2C 折扣,只有净额才会扣你的余额。
·
一份预付余额,覆盖 Claude、GPT、Gemini 与 Kimi
apiToken.sale 的计费是预付制、按量付费:先充值余额,API 请求再从中扣减——没有月度账单,也没有订阅。同一份余额覆盖所有受支持的 Claude、GPT、Gemini 与 Kimi 模型,你不需要分别管理四个提供商账户,也不用面对四张账单。
充值金额可以是任意整数美元。余额永不过期,这会改变你的充值策略:没必要“以防万一”预存一大笔钱,也没必要囤着不用。按未来几周的实际用量充值即可,控制台提示余额偏低时再补。闲置不产生任何费用——这个月没花完的余额,下个季度还在。
一次请求如何变成一笔扣费
每次调用的价格都来自提供商实际回报的用量,而不是固定的按次收费。路由器会把响应中的 usage 字段逐项换算成官方费用:
- 输入 token——你的提示词、系统指令和对话历史,按模型的官方输入费率计费。
- 输出 token——模型的回复,按官方输出费率计费,通常高于输入费率。
- 缓存部分——缓存写入和缓存读取与普通输入分开计量,缓存读取便宜得多。
- 模型专属桶——当模型的费率表定义了长上下文附加费或图像部分时,单独计量。
由于计量遵循各提供商自己的费率表,一次 Claude 请求的定价与 Anthropic 官方完全一致,一次 Gemini 请求与 Google 官方完全一致——在折扣生效之前都是如此。流式响应与非流式响应的计量方式相同:最终用量随流一起到达,扣费金额也完全一样。
50% 折扣在计算的哪一步生效
折扣永远在官方费用算完之后才应用,绝不提前。先算出官方费用,再对所有受支持的提供商统一减去 50% B2C 折扣,净额从你的预付余额中扣除。以 Claude Haiku 4.5 为例(官方价:输入每百万 token $1,输出每百万 token $5):
| 步骤 | 计算 | 金额 |
|---|---|---|
| 输入部分(3,000 tokens) | 3,000 × $1 / 1M | $0.003 |
| 输出部分(800 tokens) | 800 × $5 / 1M | $0.004 |
| 官方提供商费用 | $0.003 + $0.004 | $0.007 |
| 统一 50% B2C 折扣 | $0.007 × 50% | −$0.0035 |
| 从你的余额扣除 | $0.007 − $0.0035 | $0.0035 |
同样的运算顺序也适用于 GPT、Gemini 与 Kimi 请求,分别对照各自的官方费率表。提示词缓存与折扣是叠加关系,而不是互相替代:缓存读取按官方费率本来就便宜,50% 折扣再在这个更便宜的数字上减。
充值方式:银行卡、加密货币与金额
结账时可以用银行卡支付,也可以通过安全的支付服务商用加密货币支付;加密货币充值在网络确认交易后到账。无论哪种方式,资金都会进入你账户的预付余额,只在请求实际运行时才被消耗——每次充值都可以在银行卡和加密货币之间自由切换。
如果奖励或充值没有按预期到账,可以通过 Telegram 联系支持(提供英文和俄文服务),或发邮件至 apitokensale@gmail.com。退款通过原支付服务商处理。
余额归零时会发生什么
请求会开始返回 HTTP 402 billing_error 和原文 insufficient balance or key spending limit reached for this request——你的密钥不会被吊销,账户也不会被关闭,只是调用在充值之前无法通过。充值任意整数美元即可立即恢复服务,所以解决办法是跑一趟结账页,而不是提工单。不要把 402 当成 429 去重试。
curl https://router.apitoken.sale/v1/messages \
-H "x-api-key: sk-pool-•••" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-haiku-4-5",
"max_tokens": 64,
"messages": [{"role":"user","content":"ping"}]
}'
# With an empty balance the response is:
# HTTP 402 billing_error — insufficient balance or key spending limit reached for this request对于无人值守的工作负载——代理、定时任务、CI 评测——在长时间运行前先检查控制台余额。队列跑到一半遇到 402 就是一次失败的任务,而且重试解决不了空余额,不像限流那样可以靠重试扛过去。
审计钱花在了哪里
控制台 Usage 按模型、提供商、日期和客户密钥显示已结算用量。要逐条审计请求,请使用客户密钥调用 GET /activity;响应包含模型、提供商、token、扣费金额、公开错误和可选的 agent session 分组。
如果想提前规划充值而不是事后对账,先估算工作量:各模型的官方价与折后价都列在模型页面上,成本计算器可以在你花一分钱之前,把“提示词加回复”的 token 估算换算成美元金额。
常见问题
apiToken.sale 的计费是预付还是后付?
预付。你预先以任意整数美元充值余额,请求从中扣减——没有月度账单,也没有订阅。
一份余额能同时覆盖 Claude、GPT、Gemini 与 Kimi 吗?
能。每个提供商按自己的官方费率表计量,统一应用 50% B2C 折扣,净额从同一份预付余额中扣除。
每次请求的 50% 折扣是怎么算的?
先把请求的用量项(输入、输出、缓存以及模型专属桶)换算成官方提供商费用,再减去 50%,只有剩余部分才从你的余额中扣除。
apiToken.sale 余额用完会怎样?
请求会返回 HTTP 402 和余额不足错误。你的密钥仍然有效——充值任意整数美元即可立即恢复服务。
未用完的余额会过期吗?可以退款吗?
余额永不过期,未使用的资金会一直保留。退款通过原支付服务商处理——请通过 Telegram 或发送邮件至 apitokensale@gmail.com 联系支持。
我能看到每个请求的 token 级用量吗?
可以。使用客户密钥调用 GET /activity;响应包含每个请求的模型、提供商、token、扣费金额、公开错误和可选的 agent session 分组。