Skip to content
登录/注册

GPT Image 2

gpt-image-2

GPT Image 2支持丰富的多模式工作流程,允许用户在同一交互中在推理、编码和视觉生成之间无缝移动。

上下文窗口272K
提供商OpenAI
创建时间2026/04/26

在线体验

定价

计费项价格
生成图像$0.1100 / 张
计费说明:
  • 按生成次数计费
  • 失败的请求不计费
示例:生成一张图像,费用为 $0.1100

介绍

输入
文本
输出
图像

GPT Image 2 API:会先思考再作画的智能体图像模型

GPT Image 2 是 OpenAI 于 2026 年 4 月发布的原生图像生成模型,也是业界第一个真正意义上的智能体式图像模型——在生成之前,它会主动研究、规划并推理图像结构,而不是直接把提示词映射成像素。

这带来了几个实际差异:文字渲染大幅可靠(包括非拉丁字符)、输出分辨率最高 2K、单次可返回最多 8 张风格一致的图像,以及在照片写实和界面截图这两类最考验细节的场景上明显更强。

海鲸AI 通过 OpenAI 兼容的图像接口提供 GPT Image 2,支持文生图、图像编辑与多图生成。

获取 API 密钥 · 模型 ID:gpt-image-2


为什么选择 GPT Image 2

  • 先推理后生成 —— 首个把推理能力融入图像生成的模型,复杂构图更可控
  • 文字渲染可靠 —— 海报、UI、信息图中的文字终于能正确显示,包括中文
  • 最高 2K 输出分辨率 —— 直接可用于生产,不必再做超分
  • 单次最多 8 张一致图像 —— 系列插图、多视角素材一次生成
  • 照片写实与界面截图 —— 两类最考验细节的场景表现突出

核心能力

01 智能体式生成流程

GPT Image 2 在动笔之前会先规划:理解需求、研究构图、推理元素之间的空间关系。这让它在处理"图中要有哪些东西、按什么关系排列"这类结构化需求时明显更准。

  • 复杂构图与多元素布局
  • 空间关系与遮挡的正确处理
  • 结构化需求的忠实还原

02 文字渲染

过往图像模型最大的短板是文字。GPT Image 2 能可靠地渲染指定文案,并且支持非拉丁字符集,这让它可以直接用于海报、Banner、信息图和 UI 稿。

  • 海报、Banner 与营销素材
  • 信息图与图表标注
  • 非拉丁字符(含中文)渲染

03 高分辨率与多图一致性

最高 2K 输出分辨率,单次可返回最多 8 张保持风格与主体一致的图像,适合需要成套素材的场景。

  • 2K 分辨率直接交付
  • 系列插图与多视角素材
  • 风格与角色一致性

04 照片写实与界面设计

在照片级写实和 UI 截图这两类场景上表现突出,可用于产品概念图、场景合成和界面原型可视化。

  • 产品概念图与场景合成
  • UI 原型与界面截图生成
  • 真实感材质与光照

最佳使用场景

场景 说明
营销素材生成 带文案的海报、Banner、社交媒体图
电商与产品图 产品概念图、场景合成、多角度素材
信息图与图表 需要准确文字标注的可视化内容
UI/UX 原型 界面截图、设计概念稿
内容配图 文章、课件、报告的配套插图
系列素材 需要风格一致的成套图像

GPT Image 2 与其他图像模型的差异

能力 GPT Image 2 Nano Banana Pro FLUX.2 Pro
模型 ID gpt-image-2 gemini-3-pro-image-preview flux-2-pro
厂商 OpenAI Google Black Forest Labs
生成方式 先推理后生成 多模态原生生成 扩散模型
文字渲染 强(含非拉丁字符) 一般
最高分辨率 2K
单次多图 最多 8 张一致图像 支持 支持

图像模型按次计费,具体价格以页面上方的实时价格卡片为准。


如何使用 GPT Image 2 API

1. 创建海鲸AI API 密钥 在控制台生成密钥并充值。

2. 提示词写清结构,而不只是风格 GPT Image 2 会先推理构图,把"画面里有什么、按什么关系排列、文字写什么"说清楚,比堆砌风格词收益更大。

3. 调用接口

curl -X POST https://api.haijingai.com/images/generations \
  -H 'Authorization: Bearer YOUR_API_KEY' \
  -H 'Content-Type: application/json' \
  -d '{
    "model": "gpt-image-2",
    "prompt": "一张产品发布海报:深色背景,居中放置一台银色笔记本,顶部大字写「海鲸AI 开发者大会」,底部小字写日期与地点,整体风格简洁现代。",
    "n": 1,
    "size": "1024x1024"
  }'

图像编辑请使用 /images/edits,图像变体请使用 /images/variations


常见问题

GPT Image 2 什么时候发布的? 2026 年 4 月,API 和 Codex 于 21 日上线,ChatGPT 于 22 日全量开放。

它和 DALL·E 是什么关系? GPT Image 系列是 OpenAI 的原生图像生成模型,直接内置在模型能力中,而不是像 DALL·E 那样作为独立系统运行。

文字真的能渲染对吗? 这是这一代最大的改进之一。指定文案基本能正确渲染,且支持非拉丁字符集,中文场景可用。

最高能出多大的图? 最高 2K 分辨率,单次最多返回 8 张风格一致的图像。

支持图像编辑吗? 支持。海鲸AI 同时提供 /images/generations(文生图)、/images/edits(编辑)和 /images/variations(变体)三个接口。

怎么计费? 图像模型按次计费,与 token 计费的文本模型分开统计,具体单价见页面上方的价格卡片。


为什么选择海鲸AI 使用 GPT Image 2 API

  • 图像与文本统一账户 —— 一个密钥同时调用图像模型和对话模型
  • OpenAI 兼容接口 —— 现有图像生成代码改 base URL 即可
  • 多图像模型可选 —— GPT Image 2、Nano Banana、FLUX 系列横向对比
  • 按次计费透明 —— 生成量与花费在同一看板查看

API

API 接入信息

Model ID
gpt-image-2
用于在图像生成接口中指定模型
API Key
前往 API Key 管理查看
用于设置图像生成接口的 Bearer Token(OAuth 2.0 认证令牌)
Image API
OpenAIhttps://api.haijingai.com/v2/images/generations
图像尺寸
1:1
正方形 - 适用于头像、图标
2:3
竖版 - 适用于手机壁纸、海报
3:2
横版 - 适用于风景照、横幅
3:4
竖版 - 适用于Instagram竖屏
4:5
竖版 - 适用于社交媒体内容
5:4
横版 - 适用于演示文稿
9:16
竖屏 - 适用于手机全屏、Stories
16:9
宽屏 - 适用于视频封面、电脑壁纸
21:9
超宽屏 - 适用于电影画幅
支持多种宽高比,适配不同场景需求(如社交媒体、广告、壁纸等)

gpt-image-2 接入示例

海鲸AI 图像生成接口兼容 OpenAI Images API,可直接使用标准 HTTP 请求接入。

js
curl https://api.haijingai.com/v2/images/generations \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer <API_KEY>" \
  -d '{
    "model": "gpt-image-2",
    "prompt": "一只可爱的小猫在阳光下玩耍",
    "aspect_ratio": "1:1"
  }'
js
import requests

url = "https://api.haijingai.com/v2/images/generations"
headers = {
    "Content-Type": "application/json",
    "Authorization": "Bearer <API_KEY>",
}
payload = {
    "model": "gpt-image-2",
    "prompt": "一只可爱的小猫在阳光下玩耍",
    "aspect_ratio": "1:1",
}

response = requests.post(url, json=payload, headers=headers)
response.raise_for_status()

data = response.json()
print(data["data"][0]["url"])
js
const response = await fetch('https://api.haijingai.com/v2/images/generations', {
  method: 'POST',
  headers: {
    'Content-Type': 'application/json',
    'Authorization': 'Bearer <API_KEY>',
  },
  body: JSON.stringify({
    model: 'gpt-image-2',
    prompt: '一只可爱的小猫在阳光下玩耍',
    aspect_ratio: '1:1',
  }),
})

const data = await response.json()
console.log(data.data[0].url)