工作原理

Claude API 定价如何运作

Claude 按 token 计费——输入和输出分别计价——对缓存内容有折扣。apitoken.sale 保持这些机制完全一致,并在其上叠加一层折扣。

·

Token、输入与输出

每次请求都按输入 token(你的提示和上下文)和输出 token(模型的回复)计量。输出 token 通常比输入更贵,更大的模型每 token 成本更高。

另见: 使用 Claude API 最省钱的方式

缓存与思考

  • 缓存写入和缓存读取分别计量,且缓存读取便宜得多。
  • 在重推理调用中,思考 token 计入输出。
  • 流式与非流式请求的计费方式相同。

apitoken.sale 的折扣

每次调用先换算为官方 Anthropic 消费,再减去你的折扣:B2C 从 60% 折扣起步,随累计充值增长最高可达 80%。每次请求都在控制台中以 token 级别的明细可见。

按模型划分的 Claude API token 价格

更大的模型每 token 更贵:Opus 是高端档,Sonnet 是均衡的默认选择,Haiku 最便宜。你的折扣适用于所有模型,因此排序不变,但每个价格都更低。

模型官方 输入 / 输出($ / 1M)本站起价(−60%)最优(−80%)
Claude Opus 4.8$5 / $25$2 / $10$1 / $5
Claude Opus 4.7$5 / $25$2 / $10$1 / $5
Claude Sonnet 5$3 / $15$1.20 / $6$0.60 / $3
Claude Sonnet 4.6$3 / $15$1.20 / $6$0.60 / $3
Claude Haiku 4.5$1 / $5$0.40 / $2$0.20 / $1

含缓存费率与上下文窗口的模型页面

常见问题

Claude API 如何定价?

按 token 计费,分为输入和输出,缓存读取另有更便宜的费率。更大的模型每 token 成本更高。

折扣如何套用?

先计算官方消费,再在扣减余额前减去你的 B2C 折扣(60% 直至 80%)。

Claude API 的 token 如何计价?

按 token 计费,分输入和输出,缓存读取更便宜。apiToken.sale 在官方 token 费率之上再套用你 60–80% 的折扣。

先试后付:通过 Google/GitHub 创建的新账户包含 $10 的 Claude 官方价格用量。