Skip to content
登录/注册

Claude Opus 5.5

claude-opus-5-5

Claude Opus 5.5 专为长时间运行的智能体编码和知识工作而构建,在长周期编码与知识工作上做到 Fable 5.1 级别的表现

上下文窗口1.0M
提供商Claude
创建时间2026/09/23

在线体验

定价

同一模型能力,多条服务通道;按延迟、稳定性与成本灵活选择。

价格单位:$ / 1M tokens
指定服务通道:在请求体加入 provider 字段,例如 "provider": { "channel": "direct" }。可选 direct / stable / economical;不传则使用默认通道。

直连通道

官方直连链路,适合需要原生体验与完整上下文的请求。

输入输出缓存命中缓存写入
4.00/M20.00/M0.20/M5.00/M

介绍

输入
文本 图像
输出
文本

Claude Opus 5.5 API:Fable 级能力、Opus 价位的长周期智能体模型

Claude Opus 5.5 是 Anthropic 于 2026 年 9 月 22 日发布的 Opus 系列新一代模型,距 Opus 5 发布不到两个月。它的定位很明确:在长周期编码与知识工作上做到 Fable 5.1 级别的表现,同时把单价再往下压——输入输出比 Opus 5 便宜 20%,缓存读取便宜 60%,Anthropic 给出的典型工作负载总成本估算是比 Opus 5 低约 40%。

能力上最醒目的是智能体编码:Terminal-Bench 4.0 拿到 66.4%(xhigh 档),高于 Fable 5.1 的 55.8% 和 GPT-6 Astra 的 57.9%;GDPval-AA v2.1 真实职业任务评测 1846 分,比 Fable 5.1 高 111 分。Artificial Analysis 智能指数 v4.3.2 上它以 58 分登顶,领先并列第二的 Fable 5.1 和 GPT-6 Astra 各 5 分。

另一件对生产环境有实际影响的事:这一代针对"Claude 腔"做了专门调整——最重要的信息放前面、少用术语和套话,Anthropic 称输出比 Opus 5 精简 40% 而准确性不变。输出速度也比 Opus 5 快 30% 以上。

海鲸AI 通过 OpenAI 兼容接口与 Anthropic 原生 Messages API 提供 Claude Opus 5.5,支持推理 Effort 控制、工具调用、流式输出、图像与 PDF 输入。

获取 API 密钥 · 模型 ID:claude-opus-5-5


为什么选择 Claude Opus 5.5

  • 智能体编码第一 —— Terminal-Bench 4.0 拿到 66.4%,Fable 5.1 为 55.8%,Opus 5 为 52.3%,GPT-6 Astra 为 57.9%
  • 知识工作评测第一 —— GDPval-AA v2.1 拿到 1846 分,Fable 5.1 为 1735 分,Opus 5 为 1708 分
  • AA 智能指数榜首 —— v4.3.2 指数 58 分,Fable 5.1 与 GPT-6 Astra 并列 53 分,Opus 5 为 51 分
  • 价格反向下调 —— 输入输出比 Opus 5 低 20%,缓存读取低 60%,约为 Fable 5.1 的 0.4 倍价格档位
  • 写作更像人 —— 输出比 Opus 5 精简 40%,结论前置、少术语,智能体汇报更易读
  • 看图更准 —— Chartography 图表识别 89.0%,low 档位读图精度已超过 Opus 5 最高档,且不需要裁剪缩放工具
  • 100 万 token 上下文 + 128K 输出 —— 全窗口统一单价,Batch API 下可扩展到 300K 输出

核心能力

01 长周期自主编码

Opus 5.5 是为跑数小时的编码会话设计的。Terminal-Bench 4.0 66.4%、FrontierCode v1.1 54.4%、CursorBench 4.0 57.8%,三项都高于 Fable 5.1。Anthropic 给出的测试案例里,一位测试者用它在一天内完成了 68 万行代码的迁移;网页加载优化任务 40 次成功 39 次,而 Opus 5 的改动常伴随行为变化。

  • 多文件重构与大规模代码迁移
  • 跨会话的缺陷定位与代码审查
  • 无人值守的长时间自主执行

02 知识工作与深度研究

GDPval-AA v2.1 1846 分、AA-Briefcase 1822 分,两项知识工作评测都是当前第一。Humanity's Last Exam 带工具 67.7%(Fable 5.1 为 65.6%),SciCode 66.9%(此前最高为 Fable 5.1 的 63.1%)。AutomationBench 自动化任务 40.0%,比 Opus 5 的 26.9% 高出 13 个百分点。

  • 财务、政策、法律类文档密集型分析
  • 多步骤的科研与技术调研
  • 从一个问题直出完整报告与表格

03 视觉理解与计算机操作

这一代读图能力有实质变化:密集图表上的数值、依赖位置的语义(箭头连接哪两个框、两版图有什么差异、日历截图里的会议起止时间),不用裁剪缩放工具就能读准。Anthropic 测试中 low 档位读图精度已超过 Opus 5 的最高档,输出 token 只用约十分之一。OSWorld 2.0 计算机操作 81.8%(部分得分),默认档位就达到 Opus 5 高档位的成功率,步骤更少、token 少约 40%。

  • 密集图表、技术图纸、PDF 内嵌表格解析
  • 浏览器与桌面应用的多步自主操作
  • 为旧模型搭建的视觉预处理脚手架可以重新评估是否还需要

04 更清晰的沟通与更低的运行成本

写作风格是这一代刻意优化的方向:结论前置、少术语、少套话,执行智能体任务时的阶段汇报和最终总结会直说做了什么、发现了什么、需要什么。配合缓存读取降到 Opus 5 的 40%,工具调用密集的长会话是省钱最多的场景。

  • 智能体任务的进度汇报与结果总结
  • 对写作指令的遵循度更高
  • 缓存前缀越长、复用越多,成本优势越大

最佳使用场景

场景 说明
通宵自主编码 Terminal-Bench 4.0 领先 Fable 5.1 超过 10 个百分点,大型迁移可一天完成
企业知识工作 GDPval-AA v2.1 与 AA-Briefcase 双第一,文档、表格、报告端到端产出
图表与截图理解 无需工具即可读准密集图表,low 档位就能用
计算机操作智能体 OSWorld 2.0 81.8%,默认档位即达 Opus 5 高档位效果
缓存密集的长会话 缓存读取按 Opus 5 的 40% 计费,智能体循环总成本降约 40%
从 Fable 5.1 降本 大多数任务表现相当,价格档位只有 Fable 5.1 的 0.4 倍

Claude Opus 5.5 与 Opus 5、Fable 5.1 的差异

能力 Claude Opus 5.5 Claude Opus 5 Claude Fable 5.1
模型 ID claude-opus-5-5 claude-opus-5 claude-fable-5-1
发布日期 2026 年 9 月 22 日 2026 年 7 月 24 日 2026 年 9 月 1 日
AA 智能指数 v4.3.2 58 51 53
Terminal-Bench 4.0 66.4% 52.3% 55.8%
GDPval-AA v2.1 1846 1708 1735
Terminal-Bench-Science 0.1 58.7% 29.0% 52.6%
OSWorld 2.0(部分得分) 81.8% 74.0% 80.7%
上下文窗口 100 万 token 100 万 token 100 万 token
最大输出 128K token 128K token 128K token
思考模式 始终开启,不可关闭 默认开启,high 以下可关闭 始终开启,不可关闭
默认 Effort medium high high
强制工具调用 tool_choice: any/tool 不支持,返回 400 支持 不支持,返回 400
缓存读取相对单价 基础输入价的 0.05 倍 基础输入价的 0.1 倍 基础输入价的 0.025 倍
相对价格档位 Opus 5 的 0.8 倍 1 Opus 5 的 2 倍
定位 长周期编码与知识工作的性价比首选 上一代 Opus 最强公开发布模型

具体计费以页面上方的实时价格卡片为准。


常见问题

Claude Opus 5.5 什么时候发布的? 2026 年 9 月 22 日。发布当天即在 Claude API、Amazon Bedrock、Google Cloud 和 Microsoft Foundry 上线,Opus 5 继续保留。Anthropic 表示 Sonnet 5.5 和 Haiku 5.5 会在数周内跟进。

和 Opus 5 比升级了什么? 四块。一是能力:Terminal-Bench 4.0 从 52.3% 提到 66.4%,GDPval-AA 从 1708 提到 1846,Terminal-Bench-Science 翻了一倍,读图不再依赖裁剪工具。二是成本:输入输出降 20%,缓存读取降 60%,典型负载总成本降约 40%。三是输出速度快 30% 以上,写作精简 40%。四是安全性:行为审计各项指标优于近期所有 Claude 模型,越界尝试比 Opus 5 少 85%,Gray Swan 提示注入评测与 Fable 5.1 并列最低。

从 Opus 5 迁移要改代码吗? 有四处破坏性变更。思考模式不能再关闭,thinking: disabled 和 budget_tokens 都返回 400,改用 effort 调深浅。tool_choice 的 any 和 tool 返回 400,改用 auto 加提示词,或 strict: true、结构化输出。思考块绑定到产生它的模型,只有 Fable 5.1 和 Mythos 5.1 能读 Opus 5.5 的思考块,回退到 Opus 5 或 4.8 时会静默丢弃;2026 年 8 月 31 日之后创建的账户还会校验历史是否被编辑过,会话要保持只追加。计算机操作只接受 computer_toolset_20260801,旧的 computer_20251124 返回 400。另外,工具调用之间的进度文本现在以 thinking 块返回,默认为空,需要 display: "updates" 取回,否则前端在长任务中会"静音"。

上下文和输出上限多大? 上下文 100 万 token,默认即最大,全窗口统一单价。同步接口最大输出 128K token,Batch API 加 output-300k-2026-03-24 beta 头可到 300K。分词器与 Opus 5 相同,从 Opus 5 迁移 token 数不变。知识截止 2026 年 6 月。

有落后的地方吗? 有。Terminal-Bench-Science 0.1 拿到 58.7%,低于 GPT-6 Astra 的 64.6%;AutomationBench 40.0% 也略低于 Astra 的 41.4%。Artificial Analysis 指出它在 CritPt、AA-LCR 长上下文推理和 GDP.pdf 三项上落后,并且 max 档位下每任务约消耗 11.9 万输出 token,是 Opus 5 的 1.6 倍、GPT-6 Astra 的 4 倍以上——单价降了,高档位的总花费未必降。AA 自己测的 Terminal-Bench 4.0 是 59.6%,与 GPT-6 Astra 持平,低于 Anthropic 公布的 66.4%。安全过滤方面新增了生物学分类器,病毒学、毒理学、分子设计类的双重用途研究请求会被拒;网络安全类请求大多会被路由到 Opus 4.8 处理;试图让模型在正文里复现内部推理的请求会以 reasoning_extraction 类别拒答,且不会回退到其他模型。

Effort 档位怎么选? 五档:low、medium、high、xhigh、max,默认 medium——注意 Opus 5 默认是 high,迁移时要显式指定。同一档位下它比 Opus 5 想得更多,xhigh 和 max 尤其明显,max_tokens 要给思考留余量。原先关闭思考的路由从 low 起步测;读图和计算机操作在 low、medium 就够用;长周期编码上 xhigh 收益最大。支持会话中途按消息切换 Effort(beta),难的一步升档、常规步骤降档,不会让缓存失效。

和 Fable 5.1 怎么选? 大多数编码和知识工作任务两者表现相当,Opus 5.5 在 Terminal-Bench 4.0、GDPval-AA 上还更高,价格只有 Fable 5.1 的 0.4 倍。Fable 5.1 的优势在缓存读取更便宜(0.025 倍对 0.05 倍)、Terminal-Bench-Science 之外的科研类任务,以及它能读取 Opus 5.5 的思考块而反向不行——如果流程里需要从 Opus 5.5 升级到更强模型接着做,Fable 5.1 是唯一不丢推理的选择。


为什么选择海鲸AI 使用 Claude Opus 5.5 API

  • 原生 Messages API 完整透传 —— Effort 控制、按消息切换 Effort、思考块、提示缓存、任务预算与 beta 特性均可直接使用
  • 国内直连 —— 无需海外账户和自建代理,稳定性与延迟由平台侧保障
  • 按量计费 —— 只为实际用量付费,无最低消费门槛
  • 一套密钥多模型 —— 日常用 Opus 5.5,需要顶配时切 Fable 5.1,大流量切 Sonnet 5,同一账户统一账单

API

API 接入信息 ​

Model ID在推理接口中指定模型
claude-opus-5-5
API Key推理接口的 Bearer Token(鉴权令牌)
Base URL兼容 OpenAI 协议 · /chat/completions
OpenAIhttps://api.haijingai.com/v2/
provider 可选指定服务通道,不传则由系统选择默认通道
"provider": { "channel": "direct" }

claude-opus-5-5 接入示例 ​

海鲸AI 兼容 OpenAI 接口协议,可直接使用 OpenAI SDK 或 HTTP 请求接入,默认开启流式输出。

js
curl https://api.haijingai.com/v2/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer <API_KEY>" \
  -d '{
    "model": "claude-opus-5-5",
    "messages": [
      {"role": "system", "content": "你是一个有帮助的助手。"},
      {"role": "user", "content": "你好!"}
    ],
    "provider": { "channel": "direct" },
    "stream": true
  }'
# provider 为可选字段,删除该行即使用默认通道
js
from openai import OpenAI

client = OpenAI(
    base_url="https://api.haijingai.com/v2",
    api_key="<API_KEY>",
)

stream = client.chat.completions.create(
    model="claude-opus-5-5",
    messages=[
        {"role": "system", "content": "你是一个有帮助的助手。"},
        {"role": "user", "content": "你好!"},
    ],
    stream=True,
    # 可选:指定服务通道,不传则使用默认通道
    extra_body={"provider": {"channel": "direct"}},
)

for chunk in stream:
    if chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)
js
import OpenAI from 'openai'

const client = new OpenAI({
  baseURL: 'https://api.haijingai.com/v2',
  apiKey: '<API_KEY>',
})

const stream = await client.chat.completions.create({
  model: 'claude-opus-5-5',
  messages: [
    { role: 'system', content: '你是一个有帮助的助手。' },
    { role: 'user', content: '你好!' },
  ],
  stream: true,
  // 可选:指定服务通道,不传则使用默认通道
  // @ts-expect-error provider 为海鲸AI 扩展字段,不在 OpenAI SDK 类型定义内
  provider: { channel: 'direct' },
})

for await (const chunk of stream) {
  process.stdout.write(chunk.choices[0]?.delta?.content ?? '')
}
联系客服