工作原理
Claude API 定价如何运作
Claude 按 token 计费——输入和输出分别计价——对缓存内容有折扣。apitoken.sale 保持这些机制完全一致,并在其上叠加一层折扣。
·
Token、输入与输出
每次请求都按输入 token(你的提示和上下文)和输出 token(模型的回复)计量。输出 token 通常比输入更贵,更大的模型每 token 成本更高。
缓存与思考
- 缓存写入和缓存读取分别计量,且缓存读取便宜得多。
- 在重推理调用中,思考 token 计入输出。
- 流式与非流式请求的计费方式相同。
apitoken.sale 的折扣
每次调用先换算为官方 Anthropic 消费,再减去你的折扣:B2C 从 60% 折扣起步,随累计充值增长最高可达 80%。每次请求都在控制台中以 token 级别的明细可见。
按模型划分的 Claude API token 价格
更大的模型每 token 更贵:Opus 是高端档,Sonnet 是均衡的默认选择,Haiku 最便宜。你的折扣适用于所有模型,因此排序不变,但每个价格都更低。
| 模型 | 官方 输入 / 输出($ / 1M) | 本站起价(−60%) | 最优(−80%) |
|---|---|---|---|
| Claude Opus 4.8 | $5 / $25 | $2 / $10 | $1 / $5 |
| Claude Opus 4.7 | $5 / $25 | $2 / $10 | $1 / $5 |
| Claude Sonnet 5 | $3 / $15 | $1.20 / $6 | $0.60 / $3 |
| Claude Sonnet 4.6 | $3 / $15 | $1.20 / $6 | $0.60 / $3 |
| Claude Haiku 4.5 | $1 / $5 | $0.40 / $2 | $0.20 / $1 |
常见问题
Claude API 如何定价?
按 token 计费,分为输入和输出,缓存读取另有更便宜的费率。更大的模型每 token 成本更高。
折扣如何套用?
先计算官方消费,再在扣减余额前减去你的 B2C 折扣(60% 直至 80%)。
Claude API 的 token 如何计价?
按 token 计费,分输入和输出,缓存读取更便宜。apiToken.sale 在官方 token 费率之上再套用你 60–80% 的折扣。