Skip to content
登录/注册

Claude Sonnet 5.5

claude-sonnet-5-5

输出速度比 Sonnet 5 快 30% 以上,同时因为完成同一任务用的 token 和工具调用更少

上下文窗口1.0M
提供商Claude
创建时间2026/10/08

在线体验

定价

同一模型能力,多条服务通道;按延迟、稳定性与成本灵活选择。

价格单位:$ / 1M tokens
指定服务通道:在请求体加入 provider 字段,例如 "provider": { "channel": "direct" }。可选 direct / stable / economical;不传则使用默认通道。

直连通道

官方直连链路,适合需要原生体验与完整上下文的请求。

输入输出缓存命中缓存写入
2.00/M10.00/M0.10/M2.50/M

介绍

输入
文本 图像
输出
文本

Claude Sonnet 5.5 API:逼近 Opus 5.5 的速度与智能平衡档

Claude Sonnet 5.5 是 Anthropic 于 2026 年 9 月 28 日发布的 Sonnet 系列新一代模型,在 Opus 5.5 之后六天上线,是 Claude 5.5 家族的第二个成员。官方给它的定位是"速度与智能的最佳组合":单价与 Sonnet 5 持平、只有 Opus 5.5 的一半,输出速度比 Sonnet 5 快 30% 以上,同时因为完成同一任务用的 token 和工具调用更少,Anthropic 给出的单任务成本估算是最多再降 30%。

能力上最醒目的是智能体编码:Terminal-Bench 4.0 拿到 70.6%,Sonnet 5 只有 10.3%,甚至高于 Opus 5.5 在 xhigh 档的 66.4%。知识工作评测 GDPval-AA v2.1 为 1844 分,与 Opus 5.5 的 1846 分几乎持平,远高于 Sonnet 5 的 1449 分和 GPT-6 Sol 的 1487 分。

它支持文本与图像输入、100 万 token 上下文窗口、128K 最大输出,自适应思考默认开启,用 low 到 max 五档 Effort 控制推理深度。

海鲸AI 通过 OpenAI 兼容接口与 Anthropic 原生 Messages API 提供 Claude Sonnet 5.5,支持推理 Effort 控制、工具调用、流式输出、图像与 PDF 输入。

获取 API 密钥 · 模型 ID:claude-sonnet-5-5


为什么选择 Claude Sonnet 5.5

  • 智能体编码反超 Opus 5.5 —— Terminal-Bench 4.0 拿到 70.6%,Opus 5.5 为 66.4%(xhigh),Sonnet 5 为 10.3%
  • 知识工作接近 Opus 5.5 —— GDPval-AA v2.1 为 1844 分对 1846 分,AA-Briefcase v1.1 为 1811 分对 1822 分
  • 迄今最快的 Sonnet —— 输出速度比 Sonnet 5 快 30% 以上
  • 同价更省 —— 单价与 Sonnet 5 相同、为 Opus 5.5 的一半,缓存读取再降到 Sonnet 5 的一半,单任务成本最多低 30%
  • 读图能力大幅提升 —— Chartography 图表识别 61.6%,Sonnet 5 为 15.6%,GPT-6 Sol 为 53.6%
  • 100 万 token 上下文 + 128K 输出 —— Batch API 下可扩展到 300K 输出

核心能力

01 智能体编码

这一代相对 Sonnet 5 提升最大的就是编码。Terminal-Bench 4.0 从 10.3% 提到 70.6%,CursorBench 4.0 从 34.1% 提到 55.5%(Opus 5.5 为 57.8%),FrontierCode 1.1 在 xhigh 档拿到 52.1%(Sonnet 5 为 42.4%,GPT-6 Sol 为 49.3%,Opus 5.5 为 54.4%)。Anthropic 称它在 Terminal-Bench 上用 medium 档就超过了 Sonnet 5 的最好成绩,而单任务成本不到后者的十分之一。

  • 多文件功能开发与仓库级重构
  • 更少的工具调用和 shell 执行次数完成同样的任务
  • 数小时级的长任务也能持续推进

02 知识工作与文档产出

GDPval-AA v2.1 1844 分、AA-Briefcase v1.1 1811 分,两项都贴近 Opus 5.5;Humanity's Last Exam 带工具 64.5%(Sonnet 5 为 54.9%,Opus 5.5 为 67.7%)。Anthropic 的内部测试里,它根据财务材料和模板生成了一份 10 页的业绩回顾幻灯片,两位专业评审认为初稿无需修改即可发送。

  • 财务、研究、法务类文档密集型分析
  • 报告、表格、幻灯片的端到端产出
  • 写作比前代更清晰,对话更自然

03 视觉理解与计算机操作

Chartography 无工具图表识别 61.6%,是 Sonnet 5(15.6%)的近四倍,接近 Opus 5.5 的 64.4%。OSWorld 2.1 计算机操作 80.1%(部分得分),Sonnet 5 为 57.0%,Opus 5.5 为 81.8%。它也是第一个仅凭屏幕截图通关《宝可梦 红》的 Sonnet 模型。

  • 密集图表、界面截图、PDF 内嵌表格解析
  • 浏览器与桌面应用的多步自主操作
  • 为旧模型搭建的视觉预处理脚手架可以重新评估是否还需要

04 更快的输出与更低的单任务成本

单价没变,省钱来自三处:token 用得更少、工具调用更少、缓存读取降到 Sonnet 5 的一半(基础输入价的 0.05 倍)。最小可缓存提示长度也从 1,024 token 降到 512 token,短系统提示也能吃到缓存。

  • 输出速度比 Sonnet 5 快 30% 以上
  • 缓存前缀越长、复用越多,成本优势越大
  • 支持会话中途按消息切换 Effort(beta),难的一步升档、常规步骤降档

最佳使用场景

场景 说明
生产级编码智能体 Terminal-Bench 4.0 高于 Opus 5.5,单价只有一半
企业知识工作 GDPval-AA 与 AA-Briefcase 均贴近 Opus 5.5,文档、表格、幻灯片直出
客服与对话产品 输出更快,low / medium 档延迟可控
图表与截图理解 Chartography 61.6%,无需裁剪工具
计算机操作智能体 OSWorld 2.1 80.1%,与 Opus 5.5 相差不到 2 个百分点
从 Opus 档位降本 大多数编码和知识工作表现相近,价格档位为 Opus 5.5 的 0.5 倍

Claude Sonnet 5.5 与 Sonnet 5、Opus 5.5 的差异

能力 Claude Sonnet 5.5 Claude Sonnet 5 Claude Opus 5.5
模型 ID claude-sonnet-5-5 claude-sonnet-5 claude-opus-5-5
发布日期 2026 年 9 月 28 日 — 2026 年 9 月 22 日
Terminal-Bench 4.0 70.6% 10.3% 66.4%(xhigh)
CursorBench 4.0 55.5% 34.1% 57.8%
GDPval-AA v2.1 1844 1449 1846
AA-Briefcase v1.1 1811 1359 1822
Humanity's Last Exam(带工具) 64.5% 54.9% 67.7%
OSWorld 2.1(部分得分) 80.1% 57.0% 81.8%
Chartography(无工具) 61.6% 15.6% 64.4%
上下文窗口 100 万 token 100 万 token 100 万 token
最大输出 128K token 128K token 128K token
思考模式 自适应,默认开启;最低为 between_tools 自适应,可关闭 始终开启,不可关闭
默认 Effort high high medium
强制工具调用 tool_choice: any/tool 不支持,返回 400 支持 不支持,返回 400
最小可缓存提示 512 token 1,024 token —
缓存读取相对单价 基础输入价的 0.05 倍 基础输入价的 0.1 倍 基础输入价的 0.05 倍
相对价格档位 Opus 5.5 的 0.5 倍 与 Sonnet 5.5 相同 1
相对延迟 快 — 中等
定位 速度与智能的最佳组合 上一代 Sonnet 长周期编码与知识工作

评测数据均为 Anthropic 公布值。具体计费以页面上方的实时价格卡片为准。


常见问题

Claude Sonnet 5.5 什么时候发布的? 2026 年 9 月 28 日。发布当天即在 Claude API、Amazon Bedrock、Google Cloud 和 Microsoft Foundry 上线,Sonnet 5 继续保留。

和 Sonnet 5 比升级了什么? 三块。一是能力:Terminal-Bench 4.0 从 10.3% 提到 70.6%,GDPval-AA 从 1449 提到 1844,OSWorld 2.1 从 57.0% 提到 80.1%,Chartography 从 15.6% 提到 61.6%。二是速度和成本:输出快 30% 以上,单价不变但 token 用量更少,缓存读取减半。三是新功能:按消息切换 Effort、会话中途的系统消息和工具变更、按需压缩(beta)。分词器与 Sonnet 5 相同,迁移后 token 数不变。

从 Sonnet 5 迁移要改代码吗? 有五处破坏性变更。一,thinking: disabled 返回 400,改用 between_tools,且它只在 low、medium、high 档可用,xhigh 和 max 必须用自适应思考。二,tool_choice 的 any 和 tool 返回 400,改用 auto 加 strict: true 或结构化输出。三,思考块绑定到产生它的模型和会话:Sonnet 5.5 能读 Sonnet 5、Opus 4.8 及更早模型的思考块,读不了 Opus 5、Opus 5.5、Fable 和 Mythos 的;2026 年 8 月 31 日之后创建的账户,在修改了更早的历史后重放思考块会返回 400,会话要保持只追加。四,计算机操作在 Claude API 和 Google Cloud 上只接受 computer_toolset_20260801,旧的 computer_20251124 返回 400。五,advisor 工具不再接受 Opus 4.8、Opus 4.7 和 Sonnet 5 作为顾问。

为什么工具调用之间前端没有输出了? 工具调用之间较长的说明文字现在以 thinking 块返回,默认 display: "omitted" 时文本为空,不报错但界面会"静音"。使用自适应思考时设置 thinking.display 取回文本,或改用 between_tools,文本会直接返回。

Effort 档位怎么选? 五档:low、medium、high、xhigh、max,API 默认 high。这一代的档位重新校准过,同一档位的思考量与 Sonnet 5 不同,不要直接沿用旧设置。Anthropic 的建议是:定义清楚的智能体编码和多步工具调用从 medium 起步,更难更长的任务升到 high;聊天等延迟敏感场景用 medium 或 low。

有落后或要注意的地方吗? 有。FrontierCode 1.1 在 max 档只有 46.2%,反而低于 xhigh 的 52.1%,Anthropic 的解释是最高档下更容易出现超范围修改和超时——档位不是越高越好。OSWorld、Chartography、Humanity's Last Exam 仍略低于 Opus 5.5。安全过滤方面,它是第一个带网络安全防护的 Sonnet,高风险的网络安全请求会被拒或回退到 Sonnet 5;部分微生物学、病毒学请求可能被误判;试图让模型在正文里复现内部推理的请求会以 reasoning_extraction 类别拒答。被拒的请求返回 HTTP 200 和 stop_reason: "refusal",客户端需要处理。

和 Opus 5.5 怎么选? 大多数编码和知识工作两者相近,Sonnet 5.5 更快、价格减半,是默认选择。Opus 5.5 的优势在最长周期的自主任务、读图和计算机操作的最后几个百分点,以及 FrontierCode 这类最难的编码评测。会话从 Sonnet 5.5 升级到 Opus 5.5 时思考块可以保留,反向则会被丢弃。


为什么选择海鲸AI 使用 Claude Sonnet 5.5 API

  • 原生 Messages API 完整透传 —— Effort 控制、按消息切换 Effort、思考块、提示缓存与 beta 特性均可直接使用
  • 双接口接入 —— 原生 Messages API 与 OpenAI 兼容接口任选,迁移成本低
  • 国内直连 —— 无需海外账户和自建代理,稳定性与延迟由平台侧保障
  • 一套密钥多模型 —— 日常用 Sonnet 5.5,难任务切 Opus 5.5,大流量切 Haiku 5.5,同一账户统一账单

API

API 接入信息 ​

Model ID在推理接口中指定模型
claude-sonnet-5-5
API Key推理接口的 Bearer Token(鉴权令牌)
Base URL兼容 OpenAI 协议 · /chat/completions
OpenAIhttps://api.haijingai.com/v2/
provider 可选指定服务通道,不传则由系统选择默认通道
"provider": { "channel": "direct" }

claude-sonnet-5-5 接入示例 ​

海鲸AI 兼容 OpenAI 接口协议,可直接使用 OpenAI SDK 或 HTTP 请求接入,默认开启流式输出。

js
curl https://api.haijingai.com/v2/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer <API_KEY>" \
  -d '{
    "model": "claude-sonnet-5-5",
    "messages": [
      {"role": "system", "content": "你是一个有帮助的助手。"},
      {"role": "user", "content": "你好!"}
    ],
    "provider": { "channel": "direct" },
    "stream": true
  }'
# provider 为可选字段,删除该行即使用默认通道
js
from openai import OpenAI

client = OpenAI(
    base_url="https://api.haijingai.com/v2",
    api_key="<API_KEY>",
)

stream = client.chat.completions.create(
    model="claude-sonnet-5-5",
    messages=[
        {"role": "system", "content": "你是一个有帮助的助手。"},
        {"role": "user", "content": "你好!"},
    ],
    stream=True,
    # 可选:指定服务通道,不传则使用默认通道
    extra_body={"provider": {"channel": "direct"}},
)

for chunk in stream:
    if chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)
js
import OpenAI from 'openai'

const client = new OpenAI({
  baseURL: 'https://api.haijingai.com/v2',
  apiKey: '<API_KEY>',
})

const stream = await client.chat.completions.create({
  model: 'claude-sonnet-5-5',
  messages: [
    { role: 'system', content: '你是一个有帮助的助手。' },
    { role: 'user', content: '你好!' },
  ],
  stream: true,
  // 可选:指定服务通道,不传则使用默认通道
  // @ts-expect-error provider 为海鲸AI 扩展字段,不在 OpenAI SDK 类型定义内
  provider: { channel: 'direct' },
})

for await (const chunk of stream) {
  process.stdout.write(chunk.choices[0]?.delta?.content ?? '')
}
联系客服