工作原理

计费如何运作

apiToken.sale 采用预付计费:一次性充值余额后,每个 Claude、GPT、Gemini 与 Kimi 请求都从中扣减。每次调用按提供商官方费率表计量,先算出官方费用,再减去统一的 50% B2C 折扣,只有净额才会扣你的余额。

·

一份预付余额,覆盖 Claude、GPT、Gemini 与 Kimi

apiToken.sale 的计费是预付制、按量付费:先充值余额,API 请求再从中扣减——没有月度账单,也没有订阅。同一份余额覆盖所有受支持的 Claude、GPT、Gemini 与 Kimi 模型,你不需要分别管理四个提供商账户,也不用面对四张账单。

充值金额可以是任意整数美元。余额永不过期,这会改变你的充值策略:没必要“以防万一”预存一大笔钱,也没必要囤着不用。按未来几周的实际用量充值即可,控制台提示余额偏低时再补。闲置不产生任何费用——这个月没花完的余额,下个季度还在。

另见: Claude API 定价是如何运作的

一次请求如何变成一笔扣费

每次调用的价格都来自提供商实际回报的用量,而不是固定的按次收费。路由器会把响应中的 usage 字段逐项换算成官方费用:

  • 输入 token——你的提示词、系统指令和对话历史,按模型的官方输入费率计费。
  • 输出 token——模型的回复,按官方输出费率计费,通常高于输入费率。
  • 缓存部分——缓存写入和缓存读取与普通输入分开计量,缓存读取便宜得多。
  • 模型专属桶——当模型的费率表定义了长上下文附加费或图像部分时,单独计量。

由于计量遵循各提供商自己的费率表,一次 Claude 请求的定价与 Anthropic 官方完全一致,一次 Gemini 请求与 Google 官方完全一致——在折扣生效之前都是如此。流式响应与非流式响应的计量方式相同:最终用量随流一起到达,扣费金额也完全一样。

50% 折扣在计算的哪一步生效

折扣永远在官方费用算完之后才应用,绝不提前。先算出官方费用,再对所有受支持的提供商统一减去 50% B2C 折扣,净额从你的预付余额中扣除。以 Claude Haiku 4.5 为例(官方价:输入每百万 token $1,输出每百万 token $5):

步骤计算金额
输入部分(3,000 tokens)3,000 × $1 / 1M$0.003
输出部分(800 tokens)800 × $5 / 1M$0.004
官方提供商费用$0.003 + $0.004$0.007
统一 50% B2C 折扣$0.007 × 50%−$0.0035
从你的余额扣除$0.007 − $0.0035$0.0035

同样的运算顺序也适用于 GPT、Gemini 与 Kimi 请求,分别对照各自的官方费率表。提示词缓存与折扣是叠加关系,而不是互相替代:缓存读取按官方费率本来就便宜,50% 折扣再在这个更便宜的数字上减。

充值方式:银行卡、加密货币与金额

结账时可以用银行卡支付,也可以通过安全的支付服务商用加密货币支付;加密货币充值在网络确认交易后到账。无论哪种方式,资金都会进入你账户的预付余额,只在请求实际运行时才被消耗——每次充值都可以在银行卡和加密货币之间自由切换。

如果奖励或充值没有按预期到账,可以通过 Telegram 联系支持(提供英文和俄文服务),或发邮件至 apitokensale@gmail.com。退款通过原支付服务商处理。

余额归零时会发生什么

请求会开始返回 HTTP 402 billing_error 和原文 insufficient balance or key spending limit reached for this request——你的密钥不会被吊销,账户也不会被关闭,只是调用在充值之前无法通过。充值任意整数美元即可立即恢复服务,所以解决办法是跑一趟结账页,而不是提工单。不要把 402 当成 429 去重试。

curl https://router.apitoken.sale/v1/messages \
  -H "x-api-key: sk-pool-•••" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-haiku-4-5",
    "max_tokens": 64,
    "messages": [{"role":"user","content":"ping"}]
  }'

# With an empty balance the response is:
# HTTP 402 billing_error — insufficient balance or key spending limit reached for this request

对于无人值守的工作负载——代理、定时任务、CI 评测——在长时间运行前先检查控制台余额。队列跑到一半遇到 402 就是一次失败的任务,而且重试解决不了空余额,不像限流那样可以靠重试扛过去。

审计钱花在了哪里

控制台 Usage 按模型、提供商、日期和客户密钥显示已结算用量。要逐条审计请求,请使用客户密钥调用 GET /activity;响应包含模型、提供商、token、扣费金额、公开错误和可选的 agent session 分组。

如果想提前规划充值而不是事后对账,先估算工作量:各模型的官方价与折后价都列在模型页面上,成本计算器可以在你花一分钱之前,把“提示词加回复”的 token 估算换算成美元金额。

各模型费率、缓存定价与上下文窗口

用 Claude API 成本计算器估算工作量

常见问题

apiToken.sale 的计费是预付还是后付?

预付。你预先以任意整数美元充值余额,请求从中扣减——没有月度账单,也没有订阅。

一份余额能同时覆盖 Claude、GPT、Gemini 与 Kimi 吗?

能。每个提供商按自己的官方费率表计量,统一应用 50% B2C 折扣,净额从同一份预付余额中扣除。

每次请求的 50% 折扣是怎么算的?

先把请求的用量项(输入、输出、缓存以及模型专属桶)换算成官方提供商费用,再减去 50%,只有剩余部分才从你的余额中扣除。

apiToken.sale 余额用完会怎样?

请求会返回 HTTP 402 和余额不足错误。你的密钥仍然有效——充值任意整数美元即可立即恢复服务。

未用完的余额会过期吗?可以退款吗?

余额永不过期,未使用的资金会一直保留。退款通过原支付服务商处理——请通过 Telegram 或发送邮件至 apitokensale@gmail.com 联系支持。

我能看到每个请求的 token 级用量吗?

可以。使用客户密钥调用 GET /activity;响应包含每个请求的模型、提供商、token、扣费金额、公开错误和可选的 agent session 分组。

使用 Google 或 GitHub 创建账户并获得 $5 平台欢迎奖励余额,充值前先跑通配置。