简短回答
一次 API 请求的费用 =(输入 token × 输入单价 + 输出 token × 输出单价)÷ 1,000,000。按每次请求 2,000 个输入 token、500 个输出 token、每天 1,000 次计算,截至 2026-10-10,Claude Sonnet 4.6 在 APIVAI 每次 $0.00517、每月 $155,按 Anthropic 官方标价则是每月 $405。同样的用量,下表中最便宜的模型(GPT-6 Luna)每月 $2.02。修改上面的数字即可计算你自己的用量。
这个用量用各个模型分别要花多少钱?
每次请求 2,000 个输入 token、500 个输出 token,每天 1,000 次,按 30 天计。从便宜到贵排列。
| 模型 | 每次请求 | 每月 | 官方价每月 | 节省 |
|---|---|---|---|---|
| GPT-6 Luna | $0.0000672 | $2.02 | $13.50 | 85% |
| GPT-5.6 Luna | $0.000151 | $4.52 | $30.00 | 85% |
| Claude Haiku 5.5 | $0.00086 | $25.80 | $13.50 | — |
| GPT-6.1 Sol | $0.00136 | $40.80 | $270 | 85% |
| GPT-6 Sol | $0.00136 | $40.80 | $270 | 85% |
| GPT-5.6 Terra | $0.00151 | $45.30 | $300 | 85% |
| Claude Haiku 4.5 | $0.00172 | $51.60 | $135 | 62% |
| GPT-5.6 Sol | $0.00304 | $91.35 | $540 | 83% |
| Claude Sonnet 5.5 | $0.00345 | $103 | $270 | 62% |
| Claude Sonnet 5 | $0.00345 | $103 | $270 | 62% |
| GPT-5.5 | $0.00382 | $115 | $750 | 85% |
| Claude Sonnet 4.6 | $0.00517 | $155 | $405 | 62% |
| GPT-6 Astra | $0.00684 | $205 | $1,350 | 85% |
| Claude Opus 5.5 | $0.0069 | $207 | $540 | 62% |
| Claude Opus 5 | $0.00863 | $259 | $675 | 62% |
| Claude Opus 4.8 | $0.00863 | $259 | $675 | 62% |
| Claude Opus 4.7 | $0.00863 | $259 | $675 | 62% |
| Claude Opus 4.6 | $0.00863 | $259 | $675 | 62% |
| Claude Fable 5.1 | $0.0199 | $596 | $1,350 | 56% |
| Claude Fable 5 | $0.0199 | $596 | $1,350 | 56% |
费用是怎么算的?
价格按每百万 token 计,输入(你的提示词、之前的对话、文件和工具结果)和输出(模型的回复)分开计价。一次请求的费用 = 输入 token × 输入单价 ÷ 1,000,000 + 输出 token × 输出单价 ÷ 1,000,000。每月费用 = 每次费用 × 每天请求数 × 30。
实际账单还受三件事影响:
- 思考 token。 思考默认开启,按输出计费,所以一次回复用掉的输出 token 可能比你看到的文字多。
- 对话历史。 聊天应用和编程 Agent 每次请求都会带上之前的消息,对话越长,输入越多。
- 提示缓存。 重复的提示前缀可以从缓存读取,价格低很多。计算器没有计入缓存;缓存价格和带缓存的算例见各模型页面。
一次常见请求大约用多少 token?
以下是用于估算的大致数字。1 个 token 约等于 4 个英文字符,约 3/4 个英文单词;中文和代码每个字词通常占用更多 token。
| 请求 | 输入 token | 输出 token |
|---|---|---|
| 一条带历史的聊天消息 | 2,000 | 500 |
| 编程 Agent 的一步(每次重发文件和历史) | 30,000 | 1,500 |
| 总结一份 15 页的文档 | 20,000 | 1,000 |
| 给一段短文本分类 | 500 | 20 |
API 响应里会给出准确数字(Anthropic 格式为 usage.input_tokens / usage.output_tokens,OpenAI 格式为 usage.prompt_tokens / usage.completion_tokens),控制台里也能看到每次请求的 token 数和费用。
常见问题
Claude API 一次请求多少钱?
取决于模型和请求大小。截至 2026-10-10,2,000 token 的提示词加 500 token 的回复,在 APIVAI 用 Claude Sonnet 4.6 是 $0.00517,用 Claude Haiku 4.5 是 $0.00172。
输入 token 和输出 token 价格一样吗?
不一样。所有模型的输出 token 都比输入 token 贵好几倍,所以长回复和思考比长提示词更费钱。
计算器算了提示缓存吗?
没有,按普通输入价计算。使用缓存后,重复的输入按低得多的缓存读取价计费,所以 Agent 和长对话的实际费用通常比这里显示的低。
有月费或最低消费吗?
没有。APIVAI 是预付余额、按量扣费:最低充值 $10,每次请求按价格页上的价格扣费,没有订阅。
官方价格从哪里来?
来自各厂商公布的每百万 token 标价,价格表每 6 小时与之核对一次。
注册账号,充值 $10 起,在控制台查看每次请求的实际费用。