1. 概述
OpenAI 图片生成模型(gpt-image-2)支持两种生成模式:
生成任务为同步流程:发送请求 → 直接返回图片结果(base64 或 URL)。
2. 接口地址
环境地址:
下文示例统一以
$BASE_URL 表示,实际调用请替换为对应环境地址。
3. 认证
所有请求均需携带 API Key:4. 文生图接口(/v1/images/generations)
无参考图时调用此接口,请求体为 JSON 格式。4.1 请求参数
5. 图片编辑接口(/v1/images/edits)
有参考图时调用此接口,请求体为multipart/form-data 格式,参考图以文件形式上传。
5.1 请求参数
5.2 参考图素材要求
- 格式:JPEG / JPG / PNG / WEBP
- 大小:无硬性上限,建议 ≤ 10MB / 张
- 数量:支持多张参考图,同名
image字段多值上传
6. 请求示例
6.1 文生图(generations)
6.2 图片编辑(edits)
7. 响应格式
7.1 成功响应
data[] 元素字段:
usage 字段:
7.2 错误响应
8. 错误码
9. 计费说明
- 计费单位:按 token(
input_tokens+output_tokens) - 命中缓存的 token 按缓存价格计费,低于正常输入价格
- 任务失败不计费
- 具体价格请查看平台「模型价格」页面
10. 常见问题
Q1:gpt-image-2 支持哪些输出格式? A:支持png(默认)、jpeg、webp,通过 output_format 参数指定。
Q2:如何生成透明背景图片? A:设置 background 为 transparent,输出格式建议使用 png(仅 gpt-image-* 支持)。
Q3:generations 和 edits 接口如何选择? A:无参考图(纯文生图)使用 /v1/images/generations;有参考图(图片编辑/融合)使用 /v1/images/edits。
Q4:edits 接口如何上传多张参考图? A:使用同名 image 字段多值上传,如 -F "image=@ref1.png" -F "image=@ref2.png"。
Q5:revised_prompt 是什么? A:模型可能对原始 prompt 做了改写或扩展,revised_prompt 即为模型实际使用的提示词文本。
Q6:quality 参数支持哪些值? A:字符串枚举 high / medium / low / auto。
11. 快速接入清单
- 获取 API Key
- 确认调用环境,可访问 OpenAI API Base URL
- 选择接口:文生图 →
/v1/images/generations;图片编辑 →/v1/images/edits - 图片编辑场景准备参考图文件,以
multipart/form-data上传 - 发送请求,同步获取图片结果(
b64_json或url) - 解码 base64 数据或下载 URL 保存图片