简短回答
在 Claude Code、Cursor 或自己的脚本里使用 Claude 和 GPT 模型,最省钱的方式是以更低的单价按 token 付费,并选用能完成任务的最小模型。APIVAI 是一个按量付费的 API 网关:把工具的地址指向 https://api.apivai.com,截至 2026-10-06,Claude 模型比 Anthropic 官方标价低 58–66%,GPT 模型比 OpenAI 官方标价最多低 86%。用 Claude Sonnet 4.6 时,Claude Code 一条典型消息约 $0.012,官方价约 $0.0345。无需订阅,银行卡或加密货币 $10 起充,支付宝 / 微信 ¥20 起充。
AI API 的费用由什么决定?
每个请求都按 token 计费,分三类:
- 输入 token:你发送的全部内容,包括系统提示词、之前的对话、打开的文件和工具定义。编程智能体的输入量很大,因为每一轮都会重复上下文。
- 输出 token:模型写回的内容。每个输出 token 的价格是输入的好几倍,所以长回答和大段代码重写会很快累积费用。
- 缓存 token:同样的前缀(很长的系统提示词、某个文件、之前的轮次)再次发送时,可以先写入提示词缓存一次,之后的轮次从缓存读取,价格远低于普通输入。
另一个杠杆是模型选择。同一家提供商里,最强的模型每个 token 的价格可能是日常模型的数倍。在 APIVAI 上,Fable 是能力最强、价格最高的一档,Opus 用于复杂编程和分析,Sonnet 适合日常编程、性价比最高,Haiku 是快速且便宜的选择。OpenAI 方面,主力模型是 GPT-5.5 和 GPT-6 系列,Luna 系列是最小、最便宜的模型。
主要模型的官方价格与 APIVAI 价格
| 模型 | 官方 输入 / 输出(每百万 token) | APIVAI 输入 / 输出 | 低于官方 |
|---|---|---|---|
| Claude Fable 5.1 | $10.00 / $50.00 | $4.21 / $21.02 | 58% |
| Claude Opus 5.5 | $4.00 / $20.00 | $1.39 / $6.96 | 65% |
| Claude Sonnet 5.5 | $2.00 / $10.00 | $0.69 / $3.47 | 66% |
| Claude Sonnet 4.6 | $3.00 / $15.00 | $1.04 / $5.22 | 65% |
| Claude Haiku 4.5 | $1.00 / $5.00 | $0.35 / $1.74 | 65% |
| GPT-6 Sol | $2.00 / $10.00 | $0.30 / $1.52 | 85% |
| GPT-5.5 | $5.00 / $30.00 | $0.77 / $4.56 | 85% |
| GPT-6 Luna | $0.10 / $0.50 | $0.0144 / $0.0768 | 86% |
价格截至 2026-10-06。官方价格为各家公布的标价(Anthropic、OpenAI)。所有模型的当日价格(含缓存价格)见价格页。想进一步了解不同渠道的 Claude 价格,可以看 Claude API 价格对比。
Claude Code 每条消息、每月要花多少钱?
Claude Code 一轮对话大约是 4,000 个输入 token 和 1,500 个输出 token。需要读取很多文件的智能体轮次会更大,所以下表可视为下限:
| 用量 | 模型 | 官方 API | APIVAI |
|---|---|---|---|
| 一条消息 | Claude Sonnet 4.6 | $0.0345 | $0.012 |
| 一条消息 | Claude Opus 5.5 | $0.046 | $0.016 |
| 一条消息 | Claude Haiku 4.5 | $0.0115 | $0.00401 |
| 每天 20 条,一个月(600 条) | Claude Sonnet 4.6 | $20.70 | $7.19 |
| 每天 20 条,一个月(600 条) | Claude Opus 5.5 | $27.60 | $9.60 |
| 每月 1000 万输入 + 200 万输出 token | Claude Sonnet 4.6 | $60.00 | $20.84 |
| 每月 1000 万输入 + 200 万输出 token | GPT-5.5 | $110 | $16.82 |
价格截至 2026-10-06,当前价格见 /pricing。以上未计提示词缓存;重复发送相同上下文时,两边的费用都会更低。如果你在几种工具之间做选择,Claude Code 与 Cursor 费用对比里有更多场景的计算。
如何配置 Claude Code
Claude Code 使用 Anthropic Messages 格式,所以 Base URL 不带 /v1。设置两个环境变量后启动即可。
Mac/Linux:
ANTHROPIC_AUTH_TOKEN="你的密钥" \ ANTHROPIC_BASE_URL="https://api.apivai.com" \ claude
Windows PowerShell:
$env:ANTHROPIC_AUTH_TOKEN="你的密钥" $env:ANTHROPIC_BASE_URL="https://api.apivai.com" claude
如果环境里还设置了 ANTHROPIC_API_KEY,它会优先生效,导致请求返回 401,请先删除它。在 Claude Code 里用 /model 在 Sonnet、Opus 和 Haiku 之间切换。完整步骤见 Claude Code 配置指南。
如何配置 Cursor
- 打开 Cursor Settings > Models。
- 开启 Override OpenAI Base URL,填入
https://api.apivai.com/v1。 - 把 APIVAI 密钥填到 OpenAI API Key。
- 把需要的模型 ID 添加为自定义模型,例如
claude-sonnet-4-6或gpt-5.5。
更多细节见 Cursor 配置指南。
如何配置 Codex CLI
Codex CLI(0.121 及以上)从 ~/.codex/config.toml 读取提供商配置。加入:
model = "gpt-5.5" model_provider = "apivai" [model_providers.apivai] name = "APIVAI" base_url = "https://api.apivai.com/v1" env_key = "OPENAI_API_KEY" wire_api = "responses"
然后把 OPENAI_API_KEY 设为你的 APIVAI 密钥,运行 codex。
如何在 Python 中调用(OpenAI SDK)
任何兼容 OpenAI 的客户端,改 Base URL 即可。Claude 和 GPT 的模型 ID 都可以用:
from openai import OpenAI
client = OpenAI(
api_key="你的密钥",
base_url="https://api.apivai.com/v1"
)
response = client.chat.completions.create(
model="claude-sonnet-4-6",
messages=[{"role": "user", "content": "你好"}]
)
print(response.choices[0].message.content)如何在 Python 中调用(Anthropic SDK)
Anthropic SDK 使用不带 /v1 的 Base URL:
import anthropic
client = anthropic.Anthropic(
api_key="你的密钥",
base_url="https://api.apivai.com"
)
message = client.messages.create(
model="claude-sonnet-4-6",
max_tokens=1024,
messages=[{"role": "user", "content": "你好"}]
)
print(message.content[0].text)端点和参数说明见文档。
如何控制花费
- 为每个密钥单独设预算。 在控制台为每个工具、项目或同事分别创建密钥,并给每个密钥设预算。密钥用完预算后,请求会返回 401,而不会耗尽整个余额。
- 按任务选模型。 大部分编程用 Claude Sonnet 5.5(每百万 $0.69 / $3.47),只有疑难调试或架构设计才换 Claude Opus 5.5,快速修改、摘要和简单脚本用 Claude Haiku 4.5($0.35 / $1.74)。
- 使用提示词缓存。 以 Claude Sonnet 5.5 为例,缓存读取每百万 token $0.0688,缓存写入 $0.86,而普通输入是 $0.69。Claude Code 会自动使用缓存;在自己的 Anthropic SDK 代码里,用
cache_control标记较长且不变的前缀。 - 保持上下文简短。 不相关的任务开新会话;只需要一个函数时,不要粘贴整个文件。每个重复发送的 token 都会按输入或缓存计费。
- 查看控制台。 控制台列出每个请求的模型、token 和费用,可以看出是哪个工具或习惯在消耗预算。
需要了解的限制
- 每个密钥默认每分钟 60 次请求,需要更多可以联系客服。
- 支持 Messages、token 计数、Chat Completions、Responses 和模型列表,均支持流式输出、工具调用和图片。不提供 Batch API、Files API、向量嵌入、图片生成、音频和微调;这些请使用官方 API。
- 从预付余额中按输入、输出和缓存 token 扣费,没有月费,也没有最低消费。
- 银行卡或加密货币 $10 起充,支付宝 / 微信 ¥20 起充。已消费的额度不退。
- APIVAI 不保存请求和响应的内容,只保留用于计费的用量元数据。
常见问题
APIVAI 比 Claude Pro 或 Max 订阅便宜吗?
取决于你的用量。订阅是固定月费加用量上限(Claude 价格);按量付费适合用量不均或中等的情况,也不会碰到套餐上限。可以把你每月的 token 量和上面的示例对比一下。
应该用哪个 Base URL?
Anthropic 格式的工具(Claude Code、Anthropic SDK)用 https://api.apivai.com,OpenAI 格式的工具(Cursor、Codex CLI、OpenAI SDK)用 https://api.apivai.com/v1。出现 404 通常是 /v1 漏写或写了两次。
一个密钥能同时用 Claude 和 GPT 吗?
可以。同一个密钥两种格式都能用,只需更换模型 ID。
Claude Code 的使用体验和官方 API 一样吗?
一样,Claude Code 调用的是同一个 Messages 端点,支持流式输出和工具调用。只需要改两个环境变量。
如何防止失控的脚本花光余额?
给脚本单独一个预算较小的密钥。预算用完后,这个密钥停止工作,其他密钥不受影响。
每分钟需要超过 60 次请求怎么办?
发邮件到 w69787200@gmail.com 或在 Telegram 联系 @e3655,申请提高限额。
注册账号,几分钟内就能拿到第一个密钥。