在线体验
定价
| 计费项 | 价格 |
|---|---|
| 生成图像 | $0.1100 / 张 |
- 按生成次数计费
- 失败的请求不计费
介绍
GPT Image 2 API:会先思考再作画的智能体图像模型
GPT Image 2 是 OpenAI 于 2026 年 4 月发布的原生图像生成模型,也是业界第一个真正意义上的智能体式图像模型——在生成之前,它会主动研究、规划并推理图像结构,而不是直接把提示词映射成像素。
这带来了几个实际差异:文字渲染大幅可靠(包括非拉丁字符)、输出分辨率最高 2K、单次可返回最多 8 张风格一致的图像,以及在照片写实和界面截图这两类最考验细节的场景上明显更强。
海鲸AI 通过 OpenAI 兼容的图像接口提供 GPT Image 2,支持文生图、图像编辑与多图生成。
获取 API 密钥 · 模型 ID:
gpt-image-2
为什么选择 GPT Image 2
- 先推理后生成 —— 首个把推理能力融入图像生成的模型,复杂构图更可控
- 文字渲染可靠 —— 海报、UI、信息图中的文字终于能正确显示,包括中文
- 最高 2K 输出分辨率 —— 直接可用于生产,不必再做超分
- 单次最多 8 张一致图像 —— 系列插图、多视角素材一次生成
- 照片写实与界面截图 —— 两类最考验细节的场景表现突出
核心能力
01 智能体式生成流程
GPT Image 2 在动笔之前会先规划:理解需求、研究构图、推理元素之间的空间关系。这让它在处理"图中要有哪些东西、按什么关系排列"这类结构化需求时明显更准。
- 复杂构图与多元素布局
- 空间关系与遮挡的正确处理
- 结构化需求的忠实还原
02 文字渲染
过往图像模型最大的短板是文字。GPT Image 2 能可靠地渲染指定文案,并且支持非拉丁字符集,这让它可以直接用于海报、Banner、信息图和 UI 稿。
- 海报、Banner 与营销素材
- 信息图与图表标注
- 非拉丁字符(含中文)渲染
03 高分辨率与多图一致性
最高 2K 输出分辨率,单次可返回最多 8 张保持风格与主体一致的图像,适合需要成套素材的场景。
- 2K 分辨率直接交付
- 系列插图与多视角素材
- 风格与角色一致性
04 照片写实与界面设计
在照片级写实和 UI 截图这两类场景上表现突出,可用于产品概念图、场景合成和界面原型可视化。
- 产品概念图与场景合成
- UI 原型与界面截图生成
- 真实感材质与光照
最佳使用场景
| 场景 | 说明 |
|---|---|
| 营销素材生成 | 带文案的海报、Banner、社交媒体图 |
| 电商与产品图 | 产品概念图、场景合成、多角度素材 |
| 信息图与图表 | 需要准确文字标注的可视化内容 |
| UI/UX 原型 | 界面截图、设计概念稿 |
| 内容配图 | 文章、课件、报告的配套插图 |
| 系列素材 | 需要风格一致的成套图像 |
GPT Image 2 与其他图像模型的差异
| 能力 | GPT Image 2 | Nano Banana Pro | FLUX.2 Pro |
|---|---|---|---|
| 模型 ID | gpt-image-2 |
gemini-3-pro-image-preview |
flux-2-pro |
| 厂商 | OpenAI | Black Forest Labs | |
| 生成方式 | 先推理后生成 | 多模态原生生成 | 扩散模型 |
| 文字渲染 | 强(含非拉丁字符) | 强 | 一般 |
| 最高分辨率 | 2K | 高 | 高 |
| 单次多图 | 最多 8 张一致图像 | 支持 | 支持 |
图像模型按次计费,具体价格以页面上方的实时价格卡片为准。
如何使用 GPT Image 2 API
1. 创建海鲸AI API 密钥 在控制台生成密钥并充值。
2. 提示词写清结构,而不只是风格 GPT Image 2 会先推理构图,把"画面里有什么、按什么关系排列、文字写什么"说清楚,比堆砌风格词收益更大。
3. 调用接口
curl -X POST https://api.haijingai.com/images/generations \
-H 'Authorization: Bearer YOUR_API_KEY' \
-H 'Content-Type: application/json' \
-d '{
"model": "gpt-image-2",
"prompt": "一张产品发布海报:深色背景,居中放置一台银色笔记本,顶部大字写「海鲸AI 开发者大会」,底部小字写日期与地点,整体风格简洁现代。",
"n": 1,
"size": "1024x1024"
}'
图像编辑请使用 /images/edits,图像变体请使用 /images/variations。
常见问题
GPT Image 2 什么时候发布的? 2026 年 4 月,API 和 Codex 于 21 日上线,ChatGPT 于 22 日全量开放。
它和 DALL·E 是什么关系? GPT Image 系列是 OpenAI 的原生图像生成模型,直接内置在模型能力中,而不是像 DALL·E 那样作为独立系统运行。
文字真的能渲染对吗? 这是这一代最大的改进之一。指定文案基本能正确渲染,且支持非拉丁字符集,中文场景可用。
最高能出多大的图? 最高 2K 分辨率,单次最多返回 8 张风格一致的图像。
支持图像编辑吗?
支持。海鲸AI 同时提供 /images/generations(文生图)、/images/edits(编辑)和 /images/variations(变体)三个接口。
怎么计费? 图像模型按次计费,与 token 计费的文本模型分开统计,具体单价见页面上方的价格卡片。
为什么选择海鲸AI 使用 GPT Image 2 API
- 图像与文本统一账户 —— 一个密钥同时调用图像模型和对话模型
- OpenAI 兼容接口 —— 现有图像生成代码改 base URL 即可
- 多图像模型可选 —— GPT Image 2、Nano Banana、FLUX 系列横向对比
- 按次计费透明 —— 生成量与花费在同一看板查看
API
API 接入信息
gpt-image-2https://api.haijingai.com/v2/images/generationsgpt-image-2 接入示例
海鲸AI 图像生成接口兼容 OpenAI Images API,可直接使用标准 HTTP 请求接入。
curl https://api.haijingai.com/v2/images/generations \
-H "Content-Type: application/json" \
-H "Authorization: Bearer <API_KEY>" \
-d '{
"model": "gpt-image-2",
"prompt": "一只可爱的小猫在阳光下玩耍",
"aspect_ratio": "1:1"
}'import requests
url = "https://api.haijingai.com/v2/images/generations"
headers = {
"Content-Type": "application/json",
"Authorization": "Bearer <API_KEY>",
}
payload = {
"model": "gpt-image-2",
"prompt": "一只可爱的小猫在阳光下玩耍",
"aspect_ratio": "1:1",
}
response = requests.post(url, json=payload, headers=headers)
response.raise_for_status()
data = response.json()
print(data["data"][0]["url"])const response = await fetch('https://api.haijingai.com/v2/images/generations', {
method: 'POST',
headers: {
'Content-Type': 'application/json',
'Authorization': 'Bearer <API_KEY>',
},
body: JSON.stringify({
model: 'gpt-image-2',
prompt: '一只可爱的小猫在阳光下玩耍',
aspect_ratio: '1:1',
}),
})
const data = await response.json()
console.log(data.data[0].url)