直连通道
官方直连链路,适合需要原生体验与完整上下文的请求。
| 输入 | 输出 | 缓存命中 | 缓存写入 |
|---|---|---|---|
| 2.00/M | 10.00/M | 0.10/M | 2.50/M |
输出速度比 Sonnet 5 快 30% 以上,同时因为完成同一任务用的 token 和工具调用更少
同一模型能力,多条服务通道;按延迟、稳定性与成本灵活选择。
价格单位:$ / 1M tokensprovider 字段,例如 "provider": { "channel": "direct" }。可选 direct / stable / economical;不传则使用默认通道。官方直连链路,适合需要原生体验与完整上下文的请求。
| 输入 | 输出 | 缓存命中 | 缓存写入 |
|---|---|---|---|
| 2.00/M | 10.00/M | 0.10/M | 2.50/M |
Claude Sonnet 5.5 是 Anthropic 于 2026 年 9 月 28 日发布的 Sonnet 系列新一代模型,在 Opus 5.5 之后六天上线,是 Claude 5.5 家族的第二个成员。官方给它的定位是"速度与智能的最佳组合":单价与 Sonnet 5 持平、只有 Opus 5.5 的一半,输出速度比 Sonnet 5 快 30% 以上,同时因为完成同一任务用的 token 和工具调用更少,Anthropic 给出的单任务成本估算是最多再降 30%。
能力上最醒目的是智能体编码:Terminal-Bench 4.0 拿到 70.6%,Sonnet 5 只有 10.3%,甚至高于 Opus 5.5 在 xhigh 档的 66.4%。知识工作评测 GDPval-AA v2.1 为 1844 分,与 Opus 5.5 的 1846 分几乎持平,远高于 Sonnet 5 的 1449 分和 GPT-6 Sol 的 1487 分。
它支持文本与图像输入、100 万 token 上下文窗口、128K 最大输出,自适应思考默认开启,用 low 到 max 五档 Effort 控制推理深度。
海鲸AI 通过 OpenAI 兼容接口与 Anthropic 原生 Messages API 提供 Claude Sonnet 5.5,支持推理 Effort 控制、工具调用、流式输出、图像与 PDF 输入。
获取 API 密钥 · 模型 ID:
claude-sonnet-5-5
xhigh),Sonnet 5 为 10.3%这一代相对 Sonnet 5 提升最大的就是编码。Terminal-Bench 4.0 从 10.3% 提到 70.6%,CursorBench 4.0 从 34.1% 提到 55.5%(Opus 5.5 为 57.8%),FrontierCode 1.1 在 xhigh 档拿到 52.1%(Sonnet 5 为 42.4%,GPT-6 Sol 为 49.3%,Opus 5.5 为 54.4%)。Anthropic 称它在 Terminal-Bench 上用 medium 档就超过了 Sonnet 5 的最好成绩,而单任务成本不到后者的十分之一。
GDPval-AA v2.1 1844 分、AA-Briefcase v1.1 1811 分,两项都贴近 Opus 5.5;Humanity's Last Exam 带工具 64.5%(Sonnet 5 为 54.9%,Opus 5.5 为 67.7%)。Anthropic 的内部测试里,它根据财务材料和模板生成了一份 10 页的业绩回顾幻灯片,两位专业评审认为初稿无需修改即可发送。
Chartography 无工具图表识别 61.6%,是 Sonnet 5(15.6%)的近四倍,接近 Opus 5.5 的 64.4%。OSWorld 2.1 计算机操作 80.1%(部分得分),Sonnet 5 为 57.0%,Opus 5.5 为 81.8%。它也是第一个仅凭屏幕截图通关《宝可梦 红》的 Sonnet 模型。
单价没变,省钱来自三处:token 用得更少、工具调用更少、缓存读取降到 Sonnet 5 的一半(基础输入价的 0.05 倍)。最小可缓存提示长度也从 1,024 token 降到 512 token,短系统提示也能吃到缓存。
| 场景 | 说明 |
|---|---|
| 生产级编码智能体 | Terminal-Bench 4.0 高于 Opus 5.5,单价只有一半 |
| 企业知识工作 | GDPval-AA 与 AA-Briefcase 均贴近 Opus 5.5,文档、表格、幻灯片直出 |
| 客服与对话产品 | 输出更快,low / medium 档延迟可控 |
| 图表与截图理解 | Chartography 61.6%,无需裁剪工具 |
| 计算机操作智能体 | OSWorld 2.1 80.1%,与 Opus 5.5 相差不到 2 个百分点 |
| 从 Opus 档位降本 | 大多数编码和知识工作表现相近,价格档位为 Opus 5.5 的 0.5 倍 |
| 能力 | Claude Sonnet 5.5 | Claude Sonnet 5 | Claude Opus 5.5 |
|---|---|---|---|
| 模型 ID | claude-sonnet-5-5 |
claude-sonnet-5 |
claude-opus-5-5 |
| 发布日期 | 2026 年 9 月 28 日 | — | 2026 年 9 月 22 日 |
| Terminal-Bench 4.0 | 70.6% | 10.3% | 66.4%(xhigh) |
| CursorBench 4.0 | 55.5% | 34.1% | 57.8% |
| GDPval-AA v2.1 | 1844 | 1449 | 1846 |
| AA-Briefcase v1.1 | 1811 | 1359 | 1822 |
| Humanity's Last Exam(带工具) | 64.5% | 54.9% | 67.7% |
| OSWorld 2.1(部分得分) | 80.1% | 57.0% | 81.8% |
| Chartography(无工具) | 61.6% | 15.6% | 64.4% |
| 上下文窗口 | 100 万 token | 100 万 token | 100 万 token |
| 最大输出 | 128K token | 128K token | 128K token |
| 思考模式 | 自适应,默认开启;最低为 between_tools |
自适应,可关闭 | 始终开启,不可关闭 |
| 默认 Effort | high |
high |
medium |
强制工具调用 tool_choice: any/tool |
不支持,返回 400 | 支持 | 不支持,返回 400 |
| 最小可缓存提示 | 512 token | 1,024 token | — |
| 缓存读取相对单价 | 基础输入价的 0.05 倍 | 基础输入价的 0.1 倍 | 基础输入价的 0.05 倍 |
| 相对价格档位 | Opus 5.5 的 0.5 倍 | 与 Sonnet 5.5 相同 | 1 |
| 相对延迟 | 快 | — | 中等 |
| 定位 | 速度与智能的最佳组合 | 上一代 Sonnet | 长周期编码与知识工作 |
评测数据均为 Anthropic 公布值。具体计费以页面上方的实时价格卡片为准。
Claude Sonnet 5.5 什么时候发布的? 2026 年 9 月 28 日。发布当天即在 Claude API、Amazon Bedrock、Google Cloud 和 Microsoft Foundry 上线,Sonnet 5 继续保留。
和 Sonnet 5 比升级了什么? 三块。一是能力:Terminal-Bench 4.0 从 10.3% 提到 70.6%,GDPval-AA 从 1449 提到 1844,OSWorld 2.1 从 57.0% 提到 80.1%,Chartography 从 15.6% 提到 61.6%。二是速度和成本:输出快 30% 以上,单价不变但 token 用量更少,缓存读取减半。三是新功能:按消息切换 Effort、会话中途的系统消息和工具变更、按需压缩(beta)。分词器与 Sonnet 5 相同,迁移后 token 数不变。
从 Sonnet 5 迁移要改代码吗?
有五处破坏性变更。一,thinking: disabled 返回 400,改用 between_tools,且它只在 low、medium、high 档可用,xhigh 和 max 必须用自适应思考。二,tool_choice 的 any 和 tool 返回 400,改用 auto 加 strict: true 或结构化输出。三,思考块绑定到产生它的模型和会话:Sonnet 5.5 能读 Sonnet 5、Opus 4.8 及更早模型的思考块,读不了 Opus 5、Opus 5.5、Fable 和 Mythos 的;2026 年 8 月 31 日之后创建的账户,在修改了更早的历史后重放思考块会返回 400,会话要保持只追加。四,计算机操作在 Claude API 和 Google Cloud 上只接受 computer_toolset_20260801,旧的 computer_20251124 返回 400。五,advisor 工具不再接受 Opus 4.8、Opus 4.7 和 Sonnet 5 作为顾问。
为什么工具调用之间前端没有输出了?
工具调用之间较长的说明文字现在以 thinking 块返回,默认 display: "omitted" 时文本为空,不报错但界面会"静音"。使用自适应思考时设置 thinking.display 取回文本,或改用 between_tools,文本会直接返回。
Effort 档位怎么选?
五档:low、medium、high、xhigh、max,API 默认 high。这一代的档位重新校准过,同一档位的思考量与 Sonnet 5 不同,不要直接沿用旧设置。Anthropic 的建议是:定义清楚的智能体编码和多步工具调用从 medium 起步,更难更长的任务升到 high;聊天等延迟敏感场景用 medium 或 low。
有落后或要注意的地方吗?
有。FrontierCode 1.1 在 max 档只有 46.2%,反而低于 xhigh 的 52.1%,Anthropic 的解释是最高档下更容易出现超范围修改和超时——档位不是越高越好。OSWorld、Chartography、Humanity's Last Exam 仍略低于 Opus 5.5。安全过滤方面,它是第一个带网络安全防护的 Sonnet,高风险的网络安全请求会被拒或回退到 Sonnet 5;部分微生物学、病毒学请求可能被误判;试图让模型在正文里复现内部推理的请求会以 reasoning_extraction 类别拒答。被拒的请求返回 HTTP 200 和 stop_reason: "refusal",客户端需要处理。
和 Opus 5.5 怎么选? 大多数编码和知识工作两者相近,Sonnet 5.5 更快、价格减半,是默认选择。Opus 5.5 的优势在最长周期的自主任务、读图和计算机操作的最后几个百分点,以及 FrontierCode 这类最难的编码评测。会话从 Sonnet 5.5 升级到 Opus 5.5 时思考块可以保留,反向则会被丢弃。
claude-sonnet-5-5https://api.haijingai.com/v2/"provider": { "channel": "direct" }海鲸AI 兼容 OpenAI 接口协议,可直接使用 OpenAI SDK 或 HTTP 请求接入,默认开启流式输出。
curl https://api.haijingai.com/v2/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer <API_KEY>" \
-d '{
"model": "claude-sonnet-5-5",
"messages": [
{"role": "system", "content": "你是一个有帮助的助手。"},
{"role": "user", "content": "你好!"}
],
"provider": { "channel": "direct" },
"stream": true
}'
# provider 为可选字段,删除该行即使用默认通道from openai import OpenAI
client = OpenAI(
base_url="https://api.haijingai.com/v2",
api_key="<API_KEY>",
)
stream = client.chat.completions.create(
model="claude-sonnet-5-5",
messages=[
{"role": "system", "content": "你是一个有帮助的助手。"},
{"role": "user", "content": "你好!"},
],
stream=True,
# 可选:指定服务通道,不传则使用默认通道
extra_body={"provider": {"channel": "direct"}},
)
for chunk in stream:
if chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)import OpenAI from 'openai'
const client = new OpenAI({
baseURL: 'https://api.haijingai.com/v2',
apiKey: '<API_KEY>',
})
const stream = await client.chat.completions.create({
model: 'claude-sonnet-5-5',
messages: [
{ role: 'system', content: '你是一个有帮助的助手。' },
{ role: 'user', content: '你好!' },
],
stream: true,
// 可选:指定服务通道,不传则使用默认通道
// @ts-expect-error provider 为海鲸AI 扩展字段,不在 OpenAI SDK 类型定义内
provider: { channel: 'direct' },
})
for await (const chunk of stream) {
process.stdout.write(chunk.choices[0]?.delta?.content ?? '')
}