简短回答
大多数 API 场景的合理默认选择是 Claude Sonnet 5.5:截至 2026-10-10,它在 APIVAI 上每百万输入 / 输出 token 价格为 $0.77 / $3.82,Anthropic 官方价为 $2.00 / $10.00。长时间运行的智能体编程和高难度推理可以升级到 Claude Opus 5.5($1.54 / $7.65),大批量的分类、信息抽取和路由则可以降到 Claude Haiku 4.5($0.38 / $1.92);Claude Fable 5.1 是能力最强也最贵的 Claude 档位,只有 Opus 做不好时才值得用。OpenAI 方面,GPT-6.1 Sol($0.30 / $1.52)是中等价位的选择,GPT-6 Luna($0.0144 / $0.0768)是列表中最便宜的模型。一个 APIVAI 密钥就能调用以上所有模型,因此可以按任务选模型,而不必绑定在一个模型上。
Haiku、Sonnet、Opus 和 Fable 有什么区别?
Anthropic 把 Claude 分为四个档位。以下描述依据 Anthropic 的模型概览和它的选型指南:
- Haiku:面向大批量、对延迟敏感的任务,例如分类、信息抽取和路由。它是最快、最便宜的档位,也适合作为子智能体,替更大的模型处理批量步骤。
- Sonnet:Anthropic 称之为速度与智能的最佳结合,适合日常代码生成、数据分析、内容创作和智能体工具调用。
- Opus:面向长时间运行的智能体编程和知识工作,例如持续数小时的编程智能体和大规模重构。速度比 Sonnet 慢。拿不准时,Anthropic 文档建议从 Claude Opus 5.5 开始。
- Fable:面向高难度推理和长周期智能体任务,例如持续数小时的智能体会话和多步骤研究。它是最慢、最贵的档位。
Claude Sonnet 5.5、Claude Opus 5.5 和 Claude Fable 5.1 都有 1M token 上下文窗口、最多 128K 输出 token;Claude Haiku 4.5 的上下文窗口为 200K。APIVAI 默认开启思考,思考 token 按输出 token 计费,所以即使可见回答很短,也可能消耗不少输出 token。如果回复为空或被截断,请把 max_tokens 调到 4096 或更高。
GPT 模型怎么比?
OpenAI 当前的模型页面列出三个档位:Astra(“我们能力最强的模型,适合最高要求的工作”)、Sol(GPT-6.1 Sol,“以更低成本为复杂工作提供接近 Astra 的表现”)和 Luna(GPT-6 Luna,“我们效率最高的模型,适合专注的大批量任务”)。按官方价格看,Astra 与 Fable 相当,Sol 与 Sonnet 相当,Luna 比 Haiku 更便宜。
APIVAI 还提供更早的 GPT 版本:GPT-6 Sol、GPT-5.6 Sol、GPT-5.6 Terra、GPT-5.6 Luna 和 GPT-5.5。OpenAI 当前的模型页面没有介绍它们,因此本文只按价格和上下文长度比较。一个实际区别是:在 APIVAI 上,Claude 模型同时支持 Anthropic 和 OpenAI 两种 API 格式,而 GPT 模型使用 OpenAI 格式(/v1/chat/completions 或 /v1/responses)。
每个模型每百万 token 多少钱?
| 模型 | APIVAI 输入 / 输出 | 官方输入 / 输出 | APIVAI 缓存读取 | 上下文 |
|---|---|---|---|---|
| Claude Fable 5.1 | $4.42 / $22.08 | $10.00 / $50.00 | $0.11 | 1M |
| Claude Opus 5.5 | $1.54 / $7.65 | $4.00 / $20.00 | $0.0768 | 1M |
| Claude Sonnet 5.5 | $0.77 / $3.82 | $2.00 / $10.00 | $0.0384 | 1M |
| Claude Sonnet 4.6 | $1.15 / $5.74 | $3.00 / $15.00 | $0.12 | 1M |
| Claude Haiku 4.5 | $0.38 / $1.92 | $1.00 / $5.00 | $0.0384 | 200K |
| GPT-6 Astra | $1.52 / $7.60 | $10.00 / $50.00 | $0.15 | 1M |
| GPT-6.1 Sol | $0.30 / $1.52 | $2.00 / $10.00 | $0.0144 | 1M |
| GPT-6 Sol | $0.30 / $1.52 | $2.00 / $10.00 | $0.0304 | 1M |
| GPT-5.5 | $0.77 / $4.56 | $5.00 / $30.00 | $0.0768 | 1M |
| GPT-6 Luna | $0.0144 / $0.0768 | $0.10 / $0.50 | $0.0016 | 1M |
所有模型的输出价格都是输入的数倍,所以长回答和长时间思考对账单的影响比长提示更大。缓存读取只需正常输入价格的一小部分,这正是缓存对智能体如此重要的原因(见下面的例 1)。Claude API 价格对比列出了所有 Claude 版本,包括缓存写入价格。
为什么好几个 Opus 模型价格一样?
Claude Opus 5、Claude Opus 4.8、Claude Opus 4.7 和 Claude Opus 4.6 价格相同:APIVAI 上为 $1.92 / $9.57(官方 $5.00 / $25.00)。最新的 Claude Opus 5.5 反而更便宜,为 $1.54 / $7.65。Sonnet 也一样:Claude Sonnet 5.5 比 Claude Sonnet 4.6 便宜,Claude Sonnet 5 的输入输出价格与 Sonnet 5.5 相同,但缓存读取更贵。Claude Fable 5 和 Claude Fable 5.1 的输入输出价格相同,5.1 的缓存读取更便宜。
价格相同或更低时,通常应选更新的模型。只有当你的提示是专门为旧版本调过的、并且你自己的测试显示旧版本效果更好,或者某个工具固定使用特定 ID 时,才继续用旧版本。Anthropic 列出了 Opus 5.5 的几项不兼容变更(例如强制工具调用和关闭思考),所以切换生产环境的集成之前请先测试。每个旧模型都有自己的页面:Opus 5、Opus 4.8、Opus 4.7、Opus 4.6、Sonnet 5、Fable 5。
一次带缓存的编程智能体会话要花多少钱?
假设:在 Claude Code 或 Cline 这类编程智能体里进行两小时会话,共发出 40 次请求。每次请求都会重发约 25,000 token 的上下文(系统提示、工具定义、打开的文件、之前的对话),这些内容从缓存读取,整个会话共读取 1,000,000 个缓存 token。此外还发送 60,000 个新的输入 token(新文件、工具结果),收到 30,000 个输出 token(含思考)。
| 模型 | 缓存读取(1M token) | 新输入 + 输出 | 同样会话不用缓存(APIVAI) | 不用缓存(官方) |
|---|---|---|---|---|
| Claude Sonnet 5.5 | $0.0384 | $0.161 | $0.931 | $2.42 |
| Claude Sonnet 4.6 | $0.12 | $0.241 | $1.39 | $3.63 |
| Claude Opus 5.5 | $0.0768 | $0.322 | $1.86 | $4.84 |
| Claude Fable 5.1 | $0.11 | $0.928 | $5.35 | $12.10 |
| GPT-6.1 Sol | $0.0144 | $0.0636 | $0.364 | $2.42 |
使用缓存时,会话费用等于前两列价格相加。第三、四列是同样的 token 完全不走缓存时的费用。Claude 的缓存写入比普通输入略贵(Sonnet 5.5 上每百万为 $0.96,普通输入为 $0.77),所以实际总额会比两列之和略高。只有工具重发完全相同的前缀时缓存才会命中,大多数编程智能体都是这样做的。如何把单次会话费用换算成月度预算,并与订阅制编辑器比较,请看 Claude Code 与 Cursor 费用对比。
每天 1,000 次对话的聊天机器人要花多少钱?
假设:一个客服机器人每天处理 1,000 次对话,每月 30 天。每次对话平均 2,500 个输入 token(指令、几段知识库内容、历史记录)和 350 个输出 token(含思考)。
| 模型 | 每天(APIVAI) | 每月(APIVAI) | 每月(官方) |
|---|---|---|---|
| GPT-6 Luna | $0.0629 | $1.89 | $12.75 |
| Claude Haiku 4.5 | $1.62 | $48.66 | $128 |
| GPT-6.1 Sol | $1.28 | $38.46 | $255 |
| Claude Sonnet 5.5 | $3.26 | $97.86 | $255 |
常规问题通常用 Haiku 或 Luna 这一级的模型就够了,很多团队只把难处理的工单交给 Sonnet。把固定指令放进缓存还能进一步降低这些费用。
摘要 2,000 份文档要花多少钱?
假设:一次性任务把 2,000 份约 15,000 token 的报告各压缩成 800 token 的摘要。这里输入占大头,所以输入价格最关键。
| 模型 | 总计(APIVAI) | 总计(官方) |
|---|---|---|
| GPT-6 Luna | $0.555 | $3.80 |
| Claude Haiku 4.5 | $14.47 | $38.00 |
| GPT-6.1 Sol | $11.43 | $76.00 |
| Claude Sonnet 5.5 | $29.21 | $76.00 |
| Claude Opus 5.5 | $58.44 | $152 |
跑整批之前,先抽 20 份文档在两三个模型上试一下,对比摘要质量:能通过你检查的最便宜模型就是正确选择。APIVAI 按普通请求处理这类任务,不提供 Batch API。Anthropic 自己的 Batch API 对可以等待的任务按低于标准费率计费,所以超大规模的离线任务也请比较一下这个价格。
不同任务该用哪个模型?
| 任务 | 起步模型 | 升级或降级 |
|---|---|---|
| 在智能体或 IDE 中日常编程 | Claude Sonnet 5.5 | 大规模重构和长时间自主运行用 Claude Opus 5.5 |
| 最难的推理、持续数小时的智能体任务 | Claude Opus 5.5 | Opus 不够时用 Claude Fable 5.1 或 GPT-6 Astra |
| 写作和内容 | Claude Sonnet 5.5 或 GPT-6.1 Sol | 长篇、结构化内容用 Claude Opus 5.5 |
一个好习惯是用自己的提示在相邻两个档位上各测一遍。便宜的能通过就留下;如果它需要反复重试,更强的模型算下来往往反而更省钱。模型 ID 请从 GET /v1/models 或价格页获取,不要照抄旧名称,因为列表会随时间变化。
常见问题
写代码用 Opus 比 Sonnet 更好吗?
长时间自主运行、大规模重构和疑难调试,Opus 是更强的档位。日常修改和简短的智能体任务通常用 Sonnet 就够了,价格为 $0.77 / $3.82,而 Opus 为 $1.54 / $7.65,所以很多开发者默认用 Sonnet,遇到具体任务再切换到 Opus。
什么时候用 Haiku 就够了,不需要 Sonnet?
Haiku 面向大批量的简单任务:分类、信息抽取、路由、简短的客服回复和子智能体步骤。如果输出需要多步推理或严谨的代码,请测试 Sonnet。
通过 API 用 Claude 便宜还是 GPT 便宜?
要看档位。截至 2026-10-10,在 APIVAI 上 GPT-6 Luna 为 $0.0144 / $0.0768,Claude Haiku 4.5 为 $0.38 / $1.92;GPT-6.1 Sol 为 $0.30 / $1.52,Claude Sonnet 5.5 为 $0.77 / $3.82。请用自己的提示比较质量,而不只看价格。
思考 token 要额外收费吗?
思考 token 按该模型的正常输出价格计为输出 token。APIVAI 默认开启思考,所以预算里要为可见回答之外的输出留出余量。
一个密钥能用多个模型吗?
可以。一个 APIVAI 密钥适用于所有 Claude 和 GPT 模型,每次请求只需更改模型 ID。
注册账号,充值 $10 起,用一个密钥试用每个模型。