AIREITER
AnthropicText Chat

Claude Sonnet 5.5

Claude Sonnet 5.5 API 价格仅为 Anthropic 官方定价的一半:每 1M tokens 输入 $1,输出 $5。了解相比 Sonnet 5 的更新、基准测试、破坏性变更及可用代码示例。

输入官方 $2.00 每 100 万 TokensAIReiter $1.00 每 100 万 Tokens输出官方 $10.00 每 100 万 TokensAIReiter $5.00 每 100 万 Tokens缓存读取官方 $0.20 每 100 万 TokensAIReiter $0.10 每 100 万 Tokens缓存创建官方 $2.50 每 100 万 TokensAIReiter $1.25 每 100 万 Tokens
使用 API 运行

输入

输出

Example
Generated in
42.7 seconds
输入 Token
134
输出 Token
2354
Tokens per second
55.13 tokens / second
Time to first token
-

模型详情

在 Playground、API 请求和内部工作流中使用相同的模型 key。

模型 ID
claude-sonnet-5-5
供应商
Anthropic
协议
Anthropic Messages
上下文窗口
1,000,000 Token
最大输出
128,000 Token
输入 Token
100 credits / 1M Token
输出 Token
500 credits / 1M Token
缓存读取
10 credits / 1M Token
缓存写入
125 credits / 1M Token

Claude Sonnet 5.5 的新增特性

Anthropic 于 2026 年 9 月 28 日发布了 Claude Sonnet 5.5,作为 Sonnet 5 的直接升级版。官方标价保持不变,但其处理能力以及完成任务所需的 tokens 消耗量均得到了显著优化。

在知识型工作上接近 Opus 5.5

Anthropic 报告 Sonnet 5.5 的 GDPval-AA 得分为 1844 分,仅比 Opus 5.5(1846 分)低 2 分,且领先 Sonnet 5(1449 分)约 400 分。Anthropic 还表示,在需要持续判断的开放式任务中,Opus 5.5 仍具有明显优势。

代码能力大幅提升

在 CursorBench 4.0 测试中,Anthropic 报告 Sonnet 5.5 得分为 55.5%,而 Sonnet 5 为 34.1%,Opus 5.5 为 57.8%。Anthropic 将其定位用于范围明确的日常工作:构建功能、修复 Bug 以及生成文档、幻灯片和电子表格。

完成相同任务消耗更少 tokens

早期客户报告了在其实际工作负载中的节省情况:Slack 在未修改 Prompt 的情况下输出 tokens 减少了约 14%;Balyasny Asset Management 在 2,441 项金融任务中测得每个回答仅需约 121K tokens,而 Sonnet 5 则需要 497K。

输出速度更快,Tokenizer 保持一致

Anthropic 表示其输出速度比 Sonnet 5 快 30% 以上;Artificial Analysis 测得其每秒输出约 139 个 tokens。Tokenizer 未作改动,因此相同文本在两个模型中计费的 tokens 数量完全相同。

Claude Sonnet 5.5 对比 Sonnet 5 对比 Opus 5.5

三者均使用相同的 AIReiter Key 运行。简而言之:一旦您的请求通过了下方的迁移检查,即可停止使用 Sonnet 5;而将 Opus 5.5 留给最困难的开放式任务。

Sonnet 5.5 对比 Sonnet 5:同等价格,完成更多

两者的官方标价均为每百万 tokens 输入 $2、输出 $10。Sonnet 5.5 在上述编程和知识工作基准测试中得分更高,且通常消耗更少的 tokens 即可完成任务,因此完成相同工作的成本往往更低。

Sonnet 5.5 对比 Opus 5.5:价格仅为其一半

在这里,Sonnet 5.5 的价格为每百万 tokens 输入 $1.00、输出 $5.00;Opus 5.5 为 $2.00 和 $10.00。两者均具备 1M-token 上下文窗口和 128K 最大输出,因此切换模型只需修改 model 字段即可。

何时依然值得使用 Opus 5.5

适用于需要模型进行规划、自我纠错并持续推进的漫长且模糊的任务。Base44 报告在 Sonnet 5.5 上每次构建应用平均需要 3.6 次迭代,而 Opus 5 为 7.7 次,因此建议先尝试 Sonnet 5.5,仅对失败的任务升级到 Opus 5.5。

何时暂时继续使用 Sonnet 5

如果您的代码中禁用了 thinking、强制指定了特定 tool,或者设置了 temperature,这些请求在修改前将在 Sonnet 5.5 上失败。安全工具也可能会遇到更多拒绝响应。请先修复这些问题再进行切换。

从 Sonnet 5 迁移:现在哪些操作会报错

仅将模型字符串更改为 claude-sonnet-5-5 并不总是足够。这些在 Sonnet 5 上可行的请求格式已被 Sonnet 5.5 拒绝。

thinking: disabled 返回 400 错误

自适应思考(Adaptive thinking)默认始终开启。请将 {"type": "disabled"} 替换为最低设置 {"type": "between_tools"},该设置会在首次响应前跳过思考。between_tools 仅在 low、medium 或 high effort 下有效;对于 xhigh 或 max,请省略 thinking 或发送 {"type": "adaptive"}。

手动设置 thinking budget 返回 400 错误

thinking: {"type": "enabled", "budget_tokens": N} 将被拒绝。请改用 effort 等级来控制深度。Thinking tokens 仍计入 max_tokens 并作为输出计费,因此如果回答开始被截断,请调高 max_tokens。

强制选择工具(tool choice)将被拒绝

强制指定某个特定工具的 tool_choice 现在会报错。请使用严格的工具定义配合自动工具选择(automatic tool choice),让模型自行决定何时调用。

自定义 temperature、top_p 和 top_k 返回 400 错误

仅接受默认采样参数。请直接从请求中移除这些字段,而不是将其设置为固定值。还有一项有利于您的改动:最小可缓存 Prompt 阈值从 1,024 tokens 降低到了 512 tokens。

在上线前选定 effort 级别

Effort 现在是调节成本和延迟的主要控制项。共有五个档位:low、medium、high、xhigh 和 max。

API 默认值为 high

如果不传递 effort,API 将默认以 high 运行。Claude Code 和 Claude 应用程序默认使用 medium。请显式设置 output_config.effort,以免账单受默认值影响。

max 模式成本高昂

在 max effort 下,Artificial Analysis 测算出按官方标价每个任务需 $7.60,整个索引的输出 Token 达 4.1 亿,而中位数仅为 8800 万。Anthropic 宣传的效率优势主要针对较低档位,而非 max。

建议从 medium 开始,评估后再做调整

在真实任务中先以 medium 运行并检查质量,仅在效果不足时再升级。对于注重延迟的工具循环(tool loops),使用 low 或 medium 并配合 between_tools thinking 可确保快速返回首次响应。

AIReiter 上的 Claude Sonnet 5.5 API 价格

所有项目均按 Anthropic 官方标价的 5 折计费。相同的模型,相同的 Messages 协议。

各项费用均仅为官方标价的一半

输入 $1.00(官方标价 $2.00)。输出 $5.00(官方标价 $10.00)。缓存读取 $0.10(官方标价 $0.20)。缓存写入 $1.25(官方标价 $2.50)。所有价格均按每百万 Token 计算。

真实调用示例:仅需 $1.50,而非 $3.00

一百万输入 Token 加上十万输出 Token,在这里花费 $1.50,而 Anthropic 官方标价为 $3.00。同样的调用在 Opus 5.5 上这里仅需 $3.00。

按实际使用的 Token 计费

调用开始时会预扣预估费用,响应完成后根据实际 Token 数量进行结算并退还差额。从第一个 Token 到第一百万个 Token 费率保持一致,不设长上下文加价阶梯。

如何调用 Claude Sonnet 5.5 API

该端点支持 Anthropic Messages 协议,因此现有的 Claude 客户端只需更改基础 URL 和密钥即可。

01

获取密钥并将客户端指向 AIReiter

在您的 AIReiter 控制面板中创建 API 密钥。在官方 Anthropic SDK 中将基础 URL 设置为 https://aireiter.com/api —— SDK 会自动追加 /v1/messages。

02

使用 curl 发送请求

curl https://aireiter.com/api/v1/messages \ -H "x-api-key: $AIREITER_API_KEY" \ -H "anthropic-version: 2023-06-01" \ -H "content-type: application/json" \ -d '{ "model": "claude-sonnet-5-5", "max_tokens": 4096, "output_config": {"effort": "medium"}, "messages": [{"role": "user", "content": "Hello"}] }'

03

或使用 Python SDK

from anthropic import Anthropic client = Anthropic(api_key="YOUR_AIREITER_KEY", base_url="https://aireiter.com/api") msg = client.messages.create( model="claude-sonnet-5-5", max_tokens=4096, messages=[{"role": "user", "content": "Hello"}], ) print(msg.content[0].text)

Claude Sonnet 5.5 API 常见问题

/ 01

Claude Sonnet 5.5 何时发布?模型 ID 是什么?

Anthropic 于 2026 年 9 月 28 日发布。API 模型 ID 为 claude-sonnet-5-5,其知识截止日期为 2026 年 6 月。

/ 02

上下文窗口和最大输出是多少?

支持 1M Token 的上下文窗口,每次请求最多支持 128K 输出 Token。支持文本和图像输入,并返回文本。

/ 03

Claude Sonnet 5.5 API 的价格是多少?

Anthropic 官方定价为每百万 token 输入 $2、输出 $10,与 Sonnet 5 相同。AIReiter 仅收取半价:输入 $1、输出 $5,缓存读取 $0.10,缓存写入 $1.25。

/ 04

我可以关闭思考过程吗?

不完全支持。thinking disabled 会返回 400 错误。最低设置为 between_tools,可在 low、medium 和 high effort 下工作。

/ 05

Sonnet 5.5 比 Sonnet 5 更好吗?

在 Anthropic 公布的代码和知识工作基准测试中,在相同定价下优势非常显著。切换前请先查看上方的迁移变更,因为部分 Sonnet 5 的请求格式现已不再支持。

/ 06

为什么我的安全问题被拒绝或由 Sonnet 5 回答?

Sonnet 5.5 是首个搭载 Anthropic 最强模型网络安全防护措施的 Sonnet 模型。部分较高风险的请求会降级回退至 Sonnet 5,且良性安全任务可能会遇到更多拒绝。这是上游行为。

/ 07

我需要 Anthropic 账户吗?

不需要。AIReiter key 适用于 AIReiter 端点,在编写任何代码之前,您可以在此页面的 playground 中试用该模型。

/ 08

支持哪些 API?

/api/v1/messages 处的 Anthropic Messages 是主要协议,支持流式传输。此外还支持 OpenAI 风格的 Chat Completions 和 Responses API,而 /api/v1/models 会列出您当前 key 可用的模型。