← 博客
价格Claude APIGPT API对比

Claude Sonnet、Opus、Haiku 与 GPT:API 选型与费用对比

(文中价格随实时价格表更新)

简短回答

大多数 API 场景的合理默认选择是 Claude Sonnet 5.5:截至 2026-10-10,它在 APIVAI 上每百万输入 / 输出 token 价格为 $0.77 / $3.82,Anthropic 官方价为 $2.00 / $10.00。长时间运行的智能体编程和高难度推理可以升级到 Claude Opus 5.5($1.54 / $7.65),大批量的分类、信息抽取和路由则可以降到 Claude Haiku 4.5($0.38 / $1.92);Claude Fable 5.1 是能力最强也最贵的 Claude 档位,只有 Opus 做不好时才值得用。OpenAI 方面,GPT-6.1 Sol($0.30 / $1.52)是中等价位的选择,GPT-6 Luna($0.0144 / $0.0768)是列表中最便宜的模型。一个 APIVAI 密钥就能调用以上所有模型,因此可以按任务选模型,而不必绑定在一个模型上。

Haiku、Sonnet、Opus 和 Fable 有什么区别?

Anthropic 把 Claude 分为四个档位。以下描述依据 Anthropic 的模型概览和它的选型指南:

  • Haiku:面向大批量、对延迟敏感的任务,例如分类、信息抽取和路由。它是最快、最便宜的档位,也适合作为子智能体,替更大的模型处理批量步骤。
  • Sonnet:Anthropic 称之为速度与智能的最佳结合,适合日常代码生成、数据分析、内容创作和智能体工具调用。
  • Opus:面向长时间运行的智能体编程和知识工作,例如持续数小时的编程智能体和大规模重构。速度比 Sonnet 慢。拿不准时,Anthropic 文档建议从 Claude Opus 5.5 开始。
  • Fable:面向高难度推理和长周期智能体任务,例如持续数小时的智能体会话和多步骤研究。它是最慢、最贵的档位。

Claude Sonnet 5.5、Claude Opus 5.5 和 Claude Fable 5.1 都有 1M token 上下文窗口、最多 128K 输出 token;Claude Haiku 4.5 的上下文窗口为 200K。APIVAI 默认开启思考,思考 token 按输出 token 计费,所以即使可见回答很短,也可能消耗不少输出 token。如果回复为空或被截断,请把 max_tokens 调到 4096 或更高。

GPT 模型怎么比?

OpenAI 当前的模型页面列出三个档位:Astra(“我们能力最强的模型,适合最高要求的工作”)、Sol(GPT-6.1 Sol,“以更低成本为复杂工作提供接近 Astra 的表现”)和 Luna(GPT-6 Luna,“我们效率最高的模型,适合专注的大批量任务”)。按官方价格看,Astra 与 Fable 相当,Sol 与 Sonnet 相当,Luna 比 Haiku 更便宜。

APIVAI 还提供更早的 GPT 版本:GPT-6 Sol、GPT-5.6 Sol、GPT-5.6 Terra、GPT-5.6 Luna 和 GPT-5.5。OpenAI 当前的模型页面没有介绍它们,因此本文只按价格和上下文长度比较。一个实际区别是:在 APIVAI 上,Claude 模型同时支持 Anthropic 和 OpenAI 两种 API 格式,而 GPT 模型使用 OpenAI 格式(/v1/chat/completions 或 /v1/responses)。

每个模型每百万 token 多少钱?

以下为截至 2026-10-10 的每百万 token 价格。价格页列出所有模型,模型列表里每个模型都有单独页面。

模型APIVAI 输入 / 输出官方输入 / 输出APIVAI 缓存读取上下文
Claude Fable 5.1$4.42 / $22.08$10.00 / $50.00$0.111M
Claude Opus 5.5$1.54 / $7.65$4.00 / $20.00$0.07681M
Claude Sonnet 5.5$0.77 / $3.82$2.00 / $10.00$0.03841M
Claude Sonnet 4.6$1.15 / $5.74$3.00 / $15.00$0.121M
Claude Haiku 4.5$0.38 / $1.92$1.00 / $5.00$0.0384200K
GPT-6 Astra$1.52 / $7.60$10.00 / $50.00$0.151M
GPT-6.1 Sol$0.30 / $1.52$2.00 / $10.00$0.01441M
GPT-6 Sol$0.30 / $1.52$2.00 / $10.00$0.03041M
GPT-5.5$0.77 / $4.56$5.00 / $30.00$0.07681M
GPT-6 Luna$0.0144 / $0.0768$0.10 / $0.50$0.00161M

所有模型的输出价格都是输入的数倍,所以长回答和长时间思考对账单的影响比长提示更大。缓存读取只需正常输入价格的一小部分,这正是缓存对智能体如此重要的原因(见下面的例 1)。Claude API 价格对比列出了所有 Claude 版本,包括缓存写入价格。

为什么好几个 Opus 模型价格一样?

Claude Opus 5、Claude Opus 4.8、Claude Opus 4.7 和 Claude Opus 4.6 价格相同:APIVAI 上为 $1.92 / $9.57(官方 $5.00 / $25.00)。最新的 Claude Opus 5.5 反而更便宜,为 $1.54 / $7.65。Sonnet 也一样:Claude Sonnet 5.5 比 Claude Sonnet 4.6 便宜,Claude Sonnet 5 的输入输出价格与 Sonnet 5.5 相同,但缓存读取更贵。Claude Fable 5 和 Claude Fable 5.1 的输入输出价格相同,5.1 的缓存读取更便宜。

价格相同或更低时,通常应选更新的模型。只有当你的提示是专门为旧版本调过的、并且你自己的测试显示旧版本效果更好,或者某个工具固定使用特定 ID 时,才继续用旧版本。Anthropic 列出了 Opus 5.5 的几项不兼容变更(例如强制工具调用和关闭思考),所以切换生产环境的集成之前请先测试。每个旧模型都有自己的页面:Opus 5、Opus 4.8、Opus 4.7、Opus 4.6、Sonnet 5、Fable 5。

一次带缓存的编程智能体会话要花多少钱?

假设:在 Claude Code 或 Cline 这类编程智能体里进行两小时会话,共发出 40 次请求。每次请求都会重发约 25,000 token 的上下文(系统提示、工具定义、打开的文件、之前的对话),这些内容从缓存读取,整个会话共读取 1,000,000 个缓存 token。此外还发送 60,000 个新的输入 token(新文件、工具结果),收到 30,000 个输出 token(含思考)。

模型缓存读取(1M token)新输入 + 输出同样会话不用缓存(APIVAI)不用缓存(官方)
Claude Sonnet 5.5$0.0384$0.161$0.931$2.42
Claude Sonnet 4.6$0.12$0.241$1.39$3.63
Claude Opus 5.5$0.0768$0.322$1.86$4.84
Claude Fable 5.1$0.11$0.928$5.35$12.10
GPT-6.1 Sol$0.0144$0.0636$0.364$2.42

使用缓存时,会话费用等于前两列价格相加。第三、四列是同样的 token 完全不走缓存时的费用。Claude 的缓存写入比普通输入略贵(Sonnet 5.5 上每百万为 $0.96,普通输入为 $0.77),所以实际总额会比两列之和略高。只有工具重发完全相同的前缀时缓存才会命中,大多数编程智能体都是这样做的。如何把单次会话费用换算成月度预算,并与订阅制编辑器比较,请看 Claude Code 与 Cursor 费用对比。

每天 1,000 次对话的聊天机器人要花多少钱?

假设:一个客服机器人每天处理 1,000 次对话,每月 30 天。每次对话平均 2,500 个输入 token(指令、几段知识库内容、历史记录)和 350 个输出 token(含思考)。

模型每天(APIVAI)每月(APIVAI)每月(官方)
GPT-6 Luna$0.0629$1.89$12.75
Claude Haiku 4.5$1.62$48.66$128
GPT-6.1 Sol$1.28$38.46$255
Claude Sonnet 5.5$3.26$97.86$255

常规问题通常用 Haiku 或 Luna 这一级的模型就够了,很多团队只把难处理的工单交给 Sonnet。把固定指令放进缓存还能进一步降低这些费用。

摘要 2,000 份文档要花多少钱?

假设:一次性任务把 2,000 份约 15,000 token 的报告各压缩成 800 token 的摘要。这里输入占大头,所以输入价格最关键。

模型总计(APIVAI)总计(官方)
GPT-6 Luna$0.555$3.80
Claude Haiku 4.5$14.47$38.00
GPT-6.1 Sol$11.43$76.00
Claude Sonnet 5.5$29.21$76.00
Claude Opus 5.5$58.44$152

跑整批之前,先抽 20 份文档在两三个模型上试一下,对比摘要质量:能通过你检查的最便宜模型就是正确选择。APIVAI 按普通请求处理这类任务,不提供 Batch API。Anthropic 自己的 Batch API 对可以等待的任务按低于标准费率计费,所以超大规模的离线任务也请比较一下这个价格。

不同任务该用哪个模型?

任务起步模型升级或降级
在智能体或 IDE 中日常编程Claude Sonnet 5.5大规模重构和长时间自主运行用 Claude Opus 5.5
最难的推理、持续数小时的智能体任务Claude Opus 5.5Opus 不够时用 Claude Fable 5.1 或 GPT-6 Astra
写作和内容Claude Sonnet 5.5 或 GPT-6.1 Sol长篇、结构化内容用 Claude Opus 5.5

一个好习惯是用自己的提示在相邻两个档位上各测一遍。便宜的能通过就留下;如果它需要反复重试,更强的模型算下来往往反而更省钱。模型 ID 请从 GET /v1/models 或价格页获取,不要照抄旧名称,因为列表会随时间变化。

常见问题

写代码用 Opus 比 Sonnet 更好吗?

长时间自主运行、大规模重构和疑难调试,Opus 是更强的档位。日常修改和简短的智能体任务通常用 Sonnet 就够了,价格为 $0.77 / $3.82,而 Opus 为 $1.54 / $7.65,所以很多开发者默认用 Sonnet,遇到具体任务再切换到 Opus。

什么时候用 Haiku 就够了,不需要 Sonnet?

Haiku 面向大批量的简单任务:分类、信息抽取、路由、简短的客服回复和子智能体步骤。如果输出需要多步推理或严谨的代码,请测试 Sonnet。

通过 API 用 Claude 便宜还是 GPT 便宜?

要看档位。截至 2026-10-10,在 APIVAI 上 GPT-6 Luna 为 $0.0144 / $0.0768,Claude Haiku 4.5 为 $0.38 / $1.92;GPT-6.1 Sol 为 $0.30 / $1.52,Claude Sonnet 5.5 为 $0.77 / $3.82。请用自己的提示比较质量,而不只看价格。

思考 token 要额外收费吗?

思考 token 按该模型的正常输出价格计为输出 token。APIVAI 默认开启思考,所以预算里要为可见回答之外的输出留出余量。

一个密钥能用多个模型吗?

可以。一个 APIVAI 密钥适用于所有 Claude 和 GPT 模型,每次请求只需更改模型 ID。

注册账号,充值 $10 起,用一个密钥试用每个模型。

准备好了吗?

30 秒获取 API 密钥,按量付费使用 Claude 和 GPT

开始使用