直连通道
官方直连链路,适合需要原生体验与完整上下文的请求。
| 输入上下文 | 输入 | 输出 | 缓存命中 | 缓存写入 |
|---|---|---|---|---|
| ≤ 272K | 2.00/M | 10.00/M | 0.20/M | 2.50/M |
| > 272K | 4.00/M | 15.00/M | 0.40/M | 5.00/M |
同一模型能力,多条服务通道;按延迟、稳定性与成本灵活选择。
价格单位:$ / 1M tokensprovider 字段,例如 "provider": { "channel": "direct" }。可选 direct / stable / economical;不传则使用默认通道。官方直连链路,适合需要原生体验与完整上下文的请求。
| 输入上下文 | 输入 | 输出 | 缓存命中 | 缓存写入 |
|---|---|---|---|---|
| ≤ 272K | 2.00/M | 10.00/M | 0.20/M | 2.50/M |
| > 272K | 4.00/M | 15.00/M | 0.40/M | 5.00/M |
GPT-6 Sol 是 OpenAI 于 2026 年 9 月 22 日发布的 GPT-6 系列主力档,与同日发布的 GPT-6 Luna 一起,补齐了 9 月初 GPT-6 Astra 之下的两档。它面向开发者和知识工作者每天反复在做的复杂任务——写功能、审代码、排查缺陷、分析数据。
这一代最直接的变化是价格:官方定价恰好是 GPT-5.6 Sol 的一半,输入输出两个方向都是,且 OpenAI 确认这是长期价格而非限时优惠。Artificial Analysis 实测跑完整套智能指数的单任务成本从 1.99 美元降到 1.06 美元。能力上,智能指数 48 分,与 GPT-5.6 Sol 的 47 分基本持平;OpenAI 内部事实性评测显示错误数约减半,达到 Astra 级别的可靠性。
需要说清楚的是:Sol 不是全面升级。DeepSWE、OSWorld 2.0、GDPval-AA 几项都比 GPT-5.6 Sol 低。它的卖点是"同等智能、一半成本、更少出错",不是能力跃升。
海鲸AI 通过 OpenAI 兼容接口提供 GPT-6 Sol,支持工具调用、推理强度控制、流式输出、结构化输出与图文输入。
获取 API 密钥 · 模型 ID:
gpt-6-sol
AutomationBench 1.0.6(Zapier 出品,覆盖 47 个跨职能业务工具)上,Sol 在 xhigh 档得分 33.2%,比 GPT-6 Astra(low 档)高 2.9 个百分点,比 Claude Opus 5(max 档)的 26.9% 高 6.3 个百分点,单任务成本不到 Opus 5 的 1/11。多工具串联的重复性业务流程是 Sol 性价比最突出的方向。
AA 编码智能体指数 57 分,比 GPT-5.6 Sol 高 2 分,主要进步在终端任务(Terminal-Bench 4.0 43% vs 37%)和代码库问答(SWE-Atlas-QnA 58% vs 54%)。另一面是 DeepSWE v1.1 在 max 档为 68.8%,低于 GPT-5.6 Sol 的 72.7%。更适合日常的功能开发、代码审查和问题定位,而不是冲击最难的软件工程基准。
这是 OpenAI 这次最强调的一点:内部事实性评测(基于用户标记过错误的真实对话)中,Sol 的错误数约为 GPT-5.6 Sol 的一半。第三方数据方向一致——AA-Omniscience 得分从 22 提升到 27,幻觉率从 92% 降到 60%。编码场景的欺骗率从 10.4% 降到 1.3%。
Agents' Last Exam(覆盖 55 个细分行业的长周期经济任务)在 max 档得分 56.4%,OpenAI 称超过 Claude Opus 5 的最好成绩,单任务成本低 60%。OSWorld 2.0 在 xhigh 档 60.5%,与 Opus 5(medium 档)的 60.3% 持平,成本约低 80%——但低于 GPT-5.6 Sol 的 65.7%。
| 场景 | 说明 |
|---|---|
| 业务流程自动化 | AutomationBench 33.2%,多工具串联任务单价低 |
| 日常编码主力 | 编码智能体指数 57,终端任务明显进步 |
| 代码审查与问答 | SWE-Atlas-QnA 58%,适合读懂现有代码库 |
| 对准确性敏感的分析 | 错误数约为上一代一半,幻觉率降到 60% |
| 从 GPT-5.6 Sol 迁移降本 | 智能指数持平,成本减半 |
| 长文档处理 | 105 万 token 上下文,最大输入 92.2 万 token |
| 能力 | GPT-6 Sol | GPT-5.6 Sol | GPT-6 Astra |
|---|---|---|---|
| 模型 ID | gpt-6-sol |
gpt-5.6-sol |
gpt-6-astra |
| 发布时间 | 2026 年 9 月 22 日 | — | 2026 年 9 月 3 日 |
| AA 智能指数(v4.3) | 48 | 47 | 53 |
| AA 编码智能体指数 | 57 | 55 | — |
| DeepSWE v1.1 | 68.8% | 72.7% | 74.1% |
| OSWorld 2.0 | 60.5% | 65.7% | 72.6% |
| AA-Omniscience 幻觉率 | 60% | 92% | — |
| 上下文窗口 | 105 万 token | — | 105 万 token |
| 最大输出 | 12.8 万 token | — | 12.8 万 token |
| 知识截止 | 2026 年 4 月 20 日 | — | 2026 年 4 月 30 日 |
| 价格档位 | GPT-5.6 Sol 的 1/2 | 基准 | 最高档 |
| 定位 | 高性价比的主力档 | 上一代主力档 | 计算机操作与安全旗舰 |
具体计费以页面上方的实时价格卡片为准。
GPT-6 Sol 什么时候发布的? 2026 年 9 月 22 日,与 GPT-6 Luna 同日发布,当天即在 API、Codex 和 ChatGPT 付费账户中上线。
和 GPT-5.6 Sol 比升级了什么? 三点:价格减半;事实性错误约减半,幻觉率从 92% 降到 60%;编码智能体指数 +2,终端任务进步最明显。综合智能指数只是从 47 到 48,基本持平——这一代的主线是降本和可靠性,不是能力跃升。
有落后的地方吗? 有,而且不少。DeepSWE v1.1 68.8%,低于 GPT-5.6 Sol 的 72.7%;OSWorld 2.0 60.5%,低于上一代的 65.7%;GDPval-AA v2.1 从 1588 Elo 退到 1487。另外,单次提示超过 27.2 万 token 时,输入按 2 倍、输出按 1.5 倍计费,超长上下文场景的降价幅度基本被抵消。需要最强计算机操作或软件工程能力,应该选 GPT-6 Astra。
上下文和输出上限是多少? 上下文窗口 105 万 token,最大输入 92.2 万、最大输出 12.8 万 token。输入支持文本与图像,输出为纯文本。知识截止 2026 年 4 月 20 日。
推理强度怎么设?
reasoning_effort 支持 none、low、medium(默认)、high、xhigh、max 六档,可以设为 none 完全关闭思考。官方基准多在 xhigh 或 max 档测得,日常任务用默认档即可。注意:通过 Chat Completions 接口使用函数调用时,官方要求 reasoning_effort 设为 none;需要推理和工具调用同时开启,建议走 Responses 接口。
支持哪些工具和特性? 函数调用、流式输出、结构化输出、Prompt 缓存、图像输入、Batch 均支持。官方托管工具覆盖网页搜索、文件检索、图像生成、代码解释器、hosted shell、apply patch、skills、computer use、MCP 与 tool search。缓存命中的输入按未缓存价格的 10% 计费。
该选 Sol 还是 Luna? 按任务复杂度分。摘要、抽取、简单问答这类目标明确的高频任务用 Luna,价格档位约为 Sol 的 1/20;写功能、审代码、多工具业务流程这类需要持续推理的任务用 Sol。
gpt-6-solhttps://api.haijingai.com/v2/"provider": { "channel": "direct" }海鲸AI 兼容 OpenAI 接口协议,可直接使用 OpenAI SDK 或 HTTP 请求接入,默认开启流式输出。
curl https://api.haijingai.com/v2/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer <API_KEY>" \
-d '{
"model": "gpt-6-sol",
"messages": [
{"role": "system", "content": "你是一个有帮助的助手。"},
{"role": "user", "content": "你好!"}
],
"provider": { "channel": "direct" },
"stream": true
}'
# provider 为可选字段,删除该行即使用默认通道from openai import OpenAI
client = OpenAI(
base_url="https://api.haijingai.com/v2",
api_key="<API_KEY>",
)
stream = client.chat.completions.create(
model="gpt-6-sol",
messages=[
{"role": "system", "content": "你是一个有帮助的助手。"},
{"role": "user", "content": "你好!"},
],
stream=True,
# 可选:指定服务通道,不传则使用默认通道
extra_body={"provider": {"channel": "direct"}},
)
for chunk in stream:
if chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)import OpenAI from 'openai'
const client = new OpenAI({
baseURL: 'https://api.haijingai.com/v2',
apiKey: '<API_KEY>',
})
const stream = await client.chat.completions.create({
model: 'gpt-6-sol',
messages: [
{ role: 'system', content: '你是一个有帮助的助手。' },
{ role: 'user', content: '你好!' },
],
stream: true,
// 可选:指定服务通道,不传则使用默认通道
// @ts-expect-error provider 为海鲸AI 扩展字段,不在 OpenAI SDK 类型定义内
provider: { channel: 'direct' },
})
for await (const chunk of stream) {
process.stdout.write(chunk.choices[0]?.delta?.content ?? '')
}