AIREITER

Claude Sonnet 5 定价:$2/$10 已成永久价格(2026)

最后更新: 2026-08-16 19:22:09

如果你的 Q4 API 预算仍按 6 月发布报道中的 $3/$15 计算,现在该改了。Anthropic 在 2026 年 8 月 10 日取消了 Claude Sonnet 5 原定于 9 月 1 日生效的调价:每百万输入 token $2、每百万输出 token $10,不再是限时引介价,而是永久标准费率。此前为了避开所谓“正式价格”而继续使用 Sonnet 4.6 的团队,如今也需要重新评估。

Claude Sonnet 5 当前完整费率表

通过 Anthropic 第一方 API 使用 Claude Sonnet 5,输入价格为每百万 token $2,输出价格为每百万 token $10;缓存和批处理等优惠价格均以此为基准。我们于 2026 年 8 月 16 日查阅的 Claude Platform 定价文档已明确说明:“此前计划的价格上调……将不会发生。”

计费项目每 100 万 token 价格相对基础输入价格
基础输入$2.001.0x
基础输出$10.00输入价格的 5 倍
5 分钟缓存写入$2.501.25x
1 小时缓存写入$4.002x
缓存读取(命中)$0.200.1x
批处理输入$1.00五折
批处理输出$5.00五折
Anthropic 官方 Claude Platform 定价文档,摄于 2026 年 8 月 16 日

还有三项容易被标题费率掩盖的细节。完整的 100 万 token 上下文窗口仍按相同单价计费:90 万 token 的请求和 9000 token 的请求,每个 token 的价格一致,没有长上下文附加费。若通过 inference_geo: "us" 将推理限定在美国,输入、输出和缓存费率都会乘以 1.1x。服务端网页搜索则在正常 token 费用之外,按每 1000 次搜索 $10 计费。

原定 9 月 1 日的涨价为何取消

Claude Sonnet 5 于 2026 年 6 月 30 日发布时,$2/$10 被明确标注为引介价,原计划在 2026 年 9 月 1 日恢复至 $3/$15,也就是 Sonnet 4.6 的同等费率。因此,许多 7 月初发布的价格表至今仍保留了这项调整。2026 年 8 月 10 日,发布公告的更新日志新增了一行:引介价转为永久价格;TechCrunch 的发布报道也已加入更新说明,反映当前常规费率。

如果某张价格表还把 $3/$15 写成“即将生效”或“8 月 31 日后”的价格,它就是 8 月 10 日之前的信息,且将两项标准费率都高估了 50%。截止日期取消后,产品分层本身没有变化:Sonnet 5 的 $2/$10 比 Sonnet 4.6 的 $3/$15 低一个档位,输入成本降低 33%。

Sonnet 5 对比 Sonnet 4.6:迁移账该重算了

此前观望 Sonnet 5,核心顾虑在于分词器。Sonnet 5 使用了随 Opus 4.7 引入的新版分词器系列;Anthropic 的发布公告称,相同文本的 token 倍数会因内容类型不同处于 1.0x 至 1.35x 之间,平台文档则将典型增幅定在约 30%。按原计划,$3/$15 的标准价格会让等效提示词的输入成本最高达到每百万 token $4.05,输出达到 $20.25,高于 Sonnet 4.6 的 $3/$15。

但在永久 $2/$10 的价格下,即使按最高 1.35x 的 token 膨胀计算,等效文本的输入价格也只有每百万 token $2.70,输出为 $13.50,两端都低于 Sonnet 4.6。更不用说 Sonnet 5 在发布时的对比表中得分更高:SWE-bench Pro 为 63.2%,对比 58.1%;Terminal-Bench 2.1 为 80.4%,对比 67.0%;OSWorld-Verified 为 81.2%,对比 78.5%。

计入分词器影响后 Sonnet 5 与 Sonnet 4.6 的成本对比

不过,真正值得持续关注的反驳点不是每 token 成本,而是每个已解决问题的成本。eesel AI 引用的 Artificial Analysis 测试显示,Sonnet 5 在其 Intelligence Index 中每项任务的成本约为 $2.29;如果没有促销价,由于高推理强度任务会消耗按输出价格计费的 thinking token,它的单任务成本可能高于 Opus 4.8。社区的评价很直接:

“简而言之:Sonnet 5 每 token 更便宜,但每解决一个问题反而更贵,而且整体智能水平依旧落后于 Opus 4.8。”——u/Chubby,r/accelerate

固定价格改变的是这道题的参数,而不是结论:effort 设置和每项任务消耗的 token 数,依然决定最终账单。有关迁移时能力表现的比较,请参阅我们的 Sonnet 5 vs Sonnet 4.6 对比。

标价不变,账单仍会因 effort 和缓存拉开差距

影响 Sonnet 5 账单的因素中,有两个比任何价格公告都更关键。第一是 effort 档位。Sonnet 5 提供 low、medium、high、xhigh 和 max 五个 effort 级别;发布公告称 medium effort 下的成本效率显著提升,而发布报道将其概括为:Sonnet 5 的 medium 大致可达到 Sonnet 4.6 的 high 水平。因此值得测试,在你的实际工作负载中下调一级 effort 后,是否仍能满足质量要求。第二是提示词缓存。5 分钟缓存写入价格为 $2.50,后续只要读取一次即可回本;1 小时缓存写入为 $4.00,读取两次即可回本;此后每次缓存读取仅需 $0.20,相较输入费用优惠 90%。平台文档还指出,缓存和批处理的倍率可以叠加。

在永久基础价下,批处理尤其值得重新审视。异步 Sonnet 5 批处理的价格是每百万 token 输入 $1、输出 $5,结果在 24 小时内返回;这与 Haiku 4.5 的标准按需费率相同,但前者在 SWE-bench Pro 上达到 63.2%。对于彼此独立、无需低延迟的评测任务、历史数据回填和文档处理,批处理通常是成本最低的方案。

2026 年 8 月 Claude 各模型 API 每百万 token 定价对比

同一模型,不同服务商的实际价格

在托管 Sonnet 5 的七家服务商中,费率并不完全一致。CloudPrice 的服务商价格表显示,Anthropic 直连、Amazon Bedrock、Azure AI Foundry、Google Vertex AI、OpenRouter 和 Vercel AI Gateway 均为 $2.00/$10.00;Snowflake 则收取 $2.40/$12.00,溢价 20%。根据平台文档,无论使用哪个供应商,还有两项附加费用:Bedrock 和 Vertex 的区域或多区域端点比全球端点约贵 10%,仅限美国的推理则适用 1.1x 倍率。

服务商输入 / 100 万输出 / 100 万备注
Anthropic API$2.00$10.00批处理 $1/$5,支持完整缓存费率
Amazon Bedrock$2.00$10.00区域端点 +10%
Google Vertex AI$2.00$10.00区域端点 +10%
Azure AI Foundry$2.00$10.00提供 US Data Zone 部署
OpenRouter$2.00$10.00批处理版本 $1/$5
Vercel AI Gateway$2.00$10.00-
Snowflake$2.40$12.00较标准费率高 20%

跨目录比价时要当心一个陷阱:有些列表为 Sonnet 5 标注的“$1.00/$5.00 起”,指的是批处理路径,并非按需价格。同一目录将 Sonnet 4.6 列为 $1.50/$7.50,这恰好也是 Sonnet 4.6 的批处理费率,而不是其 $3/$15 的标准费率。

永久 $2/$10 对 API 预算意味着什么

接下来要做的决策回到了模型本身,而不再取决于某个涨价截止日。根据发布公告,Sonnet 5 是 Claude Free 和 Pro 方案的默认模型,也包含在 Max、Team 和 Enterprise 中。订阅用户不会直接接触这些 API 费率;Claude API 定价指南则说明了订阅和 API 使用的成本交叉点。对 API 采购方而言:

使用场景建议
生产级 Agent、对延迟敏感使用 $2/$10 的 Sonnet 5,并为系统提示词启用 5 分钟缓存
夜间回填、评测任务、批量处理使用 $1/$5 的 Sonnet 5 Batch
最困难的编程任务(依据 Anthropic 发布对比表,Opus 4.8 在 SWE-bench Pro 上为 69.2%,Sonnet 5 为 63.2%)使用 $5/$25 的 Opus 4.8
分类、路由、摘要使用 $1/$5 的 Haiku 4.5
生产环境仍在使用 Sonnet 4.6启动迁移试点——Anthropic 记录的 1.0-1.35x 分词器范围下,Sonnet 5 的等效 token 成本仍低于 4.6;但应先用真实流量验证质量和单任务 token 消耗

在 xhigh 和 max 档位,按每百万 $10 计费的 thinking token 仍会随问题难度推高账单。Artificial Analysis 发现,在旧 $3/$15 费率下,高 effort 的 Sonnet 5 单任务成本可能超过 Opus 4.8;永久降价将这一成本下限降低三分之一,但并未消除这个问题。在确定季度预算前,先测量每项任务的 token 消耗。建议以生产环境的 effort 设置,将一周真实流量接入Claude API endpoint,按工作负载实际报价,而非只盯着每百万 token 的美元单价。

延伸阅读:Claude Sonnet 5 vs Sonnet 4.6 - Claude API Pricing Guide 2026 - Claude Sonnet 5 Guide