直连通道
官方直连链路,适合需要原生体验与完整上下文的请求。
| 输入 | 输出 | 缓存命中 | 缓存写入 |
|---|---|---|---|
| 4.00/M | 20.00/M | 0.20/M | 5.00/M |
Claude Opus 5.5 专为长时间运行的智能体编码和知识工作而构建,在长周期编码与知识工作上做到 Fable 5.1 级别的表现
同一模型能力,多条服务通道;按延迟、稳定性与成本灵活选择。
价格单位:$ / 1M tokensprovider 字段,例如 "provider": { "channel": "direct" }。可选 direct / stable / economical;不传则使用默认通道。官方直连链路,适合需要原生体验与完整上下文的请求。
| 输入 | 输出 | 缓存命中 | 缓存写入 |
|---|---|---|---|
| 4.00/M | 20.00/M | 0.20/M | 5.00/M |
Claude Opus 5.5 是 Anthropic 于 2026 年 9 月 22 日发布的 Opus 系列新一代模型,距 Opus 5 发布不到两个月。它的定位很明确:在长周期编码与知识工作上做到 Fable 5.1 级别的表现,同时把单价再往下压——输入输出比 Opus 5 便宜 20%,缓存读取便宜 60%,Anthropic 给出的典型工作负载总成本估算是比 Opus 5 低约 40%。
能力上最醒目的是智能体编码:Terminal-Bench 4.0 拿到 66.4%(xhigh 档),高于 Fable 5.1 的 55.8% 和 GPT-6 Astra 的 57.9%;GDPval-AA v2.1 真实职业任务评测 1846 分,比 Fable 5.1 高 111 分。Artificial Analysis 智能指数 v4.3.2 上它以 58 分登顶,领先并列第二的 Fable 5.1 和 GPT-6 Astra 各 5 分。
另一件对生产环境有实际影响的事:这一代针对"Claude 腔"做了专门调整——最重要的信息放前面、少用术语和套话,Anthropic 称输出比 Opus 5 精简 40% 而准确性不变。输出速度也比 Opus 5 快 30% 以上。
海鲸AI 通过 OpenAI 兼容接口与 Anthropic 原生 Messages API 提供 Claude Opus 5.5,支持推理 Effort 控制、工具调用、流式输出、图像与 PDF 输入。
获取 API 密钥 · 模型 ID:
claude-opus-5-5
low 档位读图精度已超过 Opus 5 最高档,且不需要裁剪缩放工具Opus 5.5 是为跑数小时的编码会话设计的。Terminal-Bench 4.0 66.4%、FrontierCode v1.1 54.4%、CursorBench 4.0 57.8%,三项都高于 Fable 5.1。Anthropic 给出的测试案例里,一位测试者用它在一天内完成了 68 万行代码的迁移;网页加载优化任务 40 次成功 39 次,而 Opus 5 的改动常伴随行为变化。
GDPval-AA v2.1 1846 分、AA-Briefcase 1822 分,两项知识工作评测都是当前第一。Humanity's Last Exam 带工具 67.7%(Fable 5.1 为 65.6%),SciCode 66.9%(此前最高为 Fable 5.1 的 63.1%)。AutomationBench 自动化任务 40.0%,比 Opus 5 的 26.9% 高出 13 个百分点。
这一代读图能力有实质变化:密集图表上的数值、依赖位置的语义(箭头连接哪两个框、两版图有什么差异、日历截图里的会议起止时间),不用裁剪缩放工具就能读准。Anthropic 测试中 low 档位读图精度已超过 Opus 5 的最高档,输出 token 只用约十分之一。OSWorld 2.0 计算机操作 81.8%(部分得分),默认档位就达到 Opus 5 高档位的成功率,步骤更少、token 少约 40%。
写作风格是这一代刻意优化的方向:结论前置、少术语、少套话,执行智能体任务时的阶段汇报和最终总结会直说做了什么、发现了什么、需要什么。配合缓存读取降到 Opus 5 的 40%,工具调用密集的长会话是省钱最多的场景。
| 场景 | 说明 |
|---|---|
| 通宵自主编码 | Terminal-Bench 4.0 领先 Fable 5.1 超过 10 个百分点,大型迁移可一天完成 |
| 企业知识工作 | GDPval-AA v2.1 与 AA-Briefcase 双第一,文档、表格、报告端到端产出 |
| 图表与截图理解 | 无需工具即可读准密集图表,low 档位就能用 |
| 计算机操作智能体 | OSWorld 2.0 81.8%,默认档位即达 Opus 5 高档位效果 |
| 缓存密集的长会话 | 缓存读取按 Opus 5 的 40% 计费,智能体循环总成本降约 40% |
| 从 Fable 5.1 降本 | 大多数任务表现相当,价格档位只有 Fable 5.1 的 0.4 倍 |
| 能力 | Claude Opus 5.5 | Claude Opus 5 | Claude Fable 5.1 |
|---|---|---|---|
| 模型 ID | claude-opus-5-5 |
claude-opus-5 |
claude-fable-5-1 |
| 发布日期 | 2026 年 9 月 22 日 | 2026 年 7 月 24 日 | 2026 年 9 月 1 日 |
| AA 智能指数 v4.3.2 | 58 | 51 | 53 |
| Terminal-Bench 4.0 | 66.4% | 52.3% | 55.8% |
| GDPval-AA v2.1 | 1846 | 1708 | 1735 |
| Terminal-Bench-Science 0.1 | 58.7% | 29.0% | 52.6% |
| OSWorld 2.0(部分得分) | 81.8% | 74.0% | 80.7% |
| 上下文窗口 | 100 万 token | 100 万 token | 100 万 token |
| 最大输出 | 128K token | 128K token | 128K token |
| 思考模式 | 始终开启,不可关闭 | 默认开启,high 以下可关闭 |
始终开启,不可关闭 |
| 默认 Effort | medium |
high |
high |
强制工具调用 tool_choice: any/tool |
不支持,返回 400 | 支持 | 不支持,返回 400 |
| 缓存读取相对单价 | 基础输入价的 0.05 倍 | 基础输入价的 0.1 倍 | 基础输入价的 0.025 倍 |
| 相对价格档位 | Opus 5 的 0.8 倍 | 1 | Opus 5 的 2 倍 |
| 定位 | 长周期编码与知识工作的性价比首选 | 上一代 Opus | 最强公开发布模型 |
具体计费以页面上方的实时价格卡片为准。
Claude Opus 5.5 什么时候发布的? 2026 年 9 月 22 日。发布当天即在 Claude API、Amazon Bedrock、Google Cloud 和 Microsoft Foundry 上线,Opus 5 继续保留。Anthropic 表示 Sonnet 5.5 和 Haiku 5.5 会在数周内跟进。
和 Opus 5 比升级了什么? 四块。一是能力:Terminal-Bench 4.0 从 52.3% 提到 66.4%,GDPval-AA 从 1708 提到 1846,Terminal-Bench-Science 翻了一倍,读图不再依赖裁剪工具。二是成本:输入输出降 20%,缓存读取降 60%,典型负载总成本降约 40%。三是输出速度快 30% 以上,写作精简 40%。四是安全性:行为审计各项指标优于近期所有 Claude 模型,越界尝试比 Opus 5 少 85%,Gray Swan 提示注入评测与 Fable 5.1 并列最低。
从 Opus 5 迁移要改代码吗?
有四处破坏性变更。思考模式不能再关闭,thinking: disabled 和 budget_tokens 都返回 400,改用 effort 调深浅。tool_choice 的 any 和 tool 返回 400,改用 auto 加提示词,或 strict: true、结构化输出。思考块绑定到产生它的模型,只有 Fable 5.1 和 Mythos 5.1 能读 Opus 5.5 的思考块,回退到 Opus 5 或 4.8 时会静默丢弃;2026 年 8 月 31 日之后创建的账户还会校验历史是否被编辑过,会话要保持只追加。计算机操作只接受 computer_toolset_20260801,旧的 computer_20251124 返回 400。另外,工具调用之间的进度文本现在以 thinking 块返回,默认为空,需要 display: "updates" 取回,否则前端在长任务中会"静音"。
上下文和输出上限多大?
上下文 100 万 token,默认即最大,全窗口统一单价。同步接口最大输出 128K token,Batch API 加 output-300k-2026-03-24 beta 头可到 300K。分词器与 Opus 5 相同,从 Opus 5 迁移 token 数不变。知识截止 2026 年 6 月。
有落后的地方吗?
有。Terminal-Bench-Science 0.1 拿到 58.7%,低于 GPT-6 Astra 的 64.6%;AutomationBench 40.0% 也略低于 Astra 的 41.4%。Artificial Analysis 指出它在 CritPt、AA-LCR 长上下文推理和 GDP.pdf 三项上落后,并且 max 档位下每任务约消耗 11.9 万输出 token,是 Opus 5 的 1.6 倍、GPT-6 Astra 的 4 倍以上——单价降了,高档位的总花费未必降。AA 自己测的 Terminal-Bench 4.0 是 59.6%,与 GPT-6 Astra 持平,低于 Anthropic 公布的 66.4%。安全过滤方面新增了生物学分类器,病毒学、毒理学、分子设计类的双重用途研究请求会被拒;网络安全类请求大多会被路由到 Opus 4.8 处理;试图让模型在正文里复现内部推理的请求会以 reasoning_extraction 类别拒答,且不会回退到其他模型。
Effort 档位怎么选?
五档:low、medium、high、xhigh、max,默认 medium——注意 Opus 5 默认是 high,迁移时要显式指定。同一档位下它比 Opus 5 想得更多,xhigh 和 max 尤其明显,max_tokens 要给思考留余量。原先关闭思考的路由从 low 起步测;读图和计算机操作在 low、medium 就够用;长周期编码上 xhigh 收益最大。支持会话中途按消息切换 Effort(beta),难的一步升档、常规步骤降档,不会让缓存失效。
和 Fable 5.1 怎么选? 大多数编码和知识工作任务两者表现相当,Opus 5.5 在 Terminal-Bench 4.0、GDPval-AA 上还更高,价格只有 Fable 5.1 的 0.4 倍。Fable 5.1 的优势在缓存读取更便宜(0.025 倍对 0.05 倍)、Terminal-Bench-Science 之外的科研类任务,以及它能读取 Opus 5.5 的思考块而反向不行——如果流程里需要从 Opus 5.5 升级到更强模型接着做,Fable 5.1 是唯一不丢推理的选择。
claude-opus-5-5https://api.haijingai.com/v2/"provider": { "channel": "direct" }海鲸AI 兼容 OpenAI 接口协议,可直接使用 OpenAI SDK 或 HTTP 请求接入,默认开启流式输出。
curl https://api.haijingai.com/v2/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer <API_KEY>" \
-d '{
"model": "claude-opus-5-5",
"messages": [
{"role": "system", "content": "你是一个有帮助的助手。"},
{"role": "user", "content": "你好!"}
],
"provider": { "channel": "direct" },
"stream": true
}'
# provider 为可选字段,删除该行即使用默认通道from openai import OpenAI
client = OpenAI(
base_url="https://api.haijingai.com/v2",
api_key="<API_KEY>",
)
stream = client.chat.completions.create(
model="claude-opus-5-5",
messages=[
{"role": "system", "content": "你是一个有帮助的助手。"},
{"role": "user", "content": "你好!"},
],
stream=True,
# 可选:指定服务通道,不传则使用默认通道
extra_body={"provider": {"channel": "direct"}},
)
for chunk in stream:
if chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)import OpenAI from 'openai'
const client = new OpenAI({
baseURL: 'https://api.haijingai.com/v2',
apiKey: '<API_KEY>',
})
const stream = await client.chat.completions.create({
model: 'claude-opus-5-5',
messages: [
{ role: 'system', content: '你是一个有帮助的助手。' },
{ role: 'user', content: '你好!' },
],
stream: true,
// 可选:指定服务通道,不传则使用默认通道
// @ts-expect-error provider 为海鲸AI 扩展字段,不在 OpenAI SDK 类型定义内
provider: { channel: 'direct' },
})
for await (const chunk of stream) {
process.stdout.write(chunk.choices[0]?.delta?.content ?? '')
}