Skip to main content

1. 概述

OpenAI 图片生成模型(gpt-image-2)支持两种生成模式: 生成任务为同步流程:发送请求 → 直接返回图片结果(base64 或 URL)。

2. 接口地址

环境地址 下文示例统一以 $BASE_URL 表示,实际调用请替换为对应环境地址。

3. 认证

所有请求均需携带 API Key:

4. 文生图接口(/v1/images/generations)

无参考图时调用此接口,请求体为 JSON 格式。

4.1 请求参数


5. 图片编辑接口(/v1/images/edits)

有参考图时调用此接口,请求体为 multipart/form-data 格式,参考图以文件形式上传。

5.1 请求参数

5.2 参考图素材要求

  • 格式:JPEG / JPG / PNG / WEBP
  • 大小:无硬性上限,建议 ≤ 10MB / 张
  • 数量:支持多张参考图,同名 image 字段多值上传

6. 请求示例

6.1 文生图(generations)

6.2 图片编辑(edits)


7. 响应格式

7.1 成功响应

顶层字段 data[] 元素字段 usage 字段

7.2 错误响应


8. 错误码


9. 计费说明

  • 计费单位:按 token(input_tokens + output_tokens
  • 命中缓存的 token 按缓存价格计费,低于正常输入价格
  • 任务失败不计费
  • 具体价格请查看平台「模型价格」页面

10. 常见问题

Q1:gpt-image-2 支持哪些输出格式? A:支持 png(默认)、jpegwebp,通过 output_format 参数指定。 Q2:如何生成透明背景图片? A:设置 backgroundtransparent,输出格式建议使用 png(仅 gpt-image-* 支持)。 Q3:generations 和 edits 接口如何选择? A:无参考图(纯文生图)使用 /v1/images/generations;有参考图(图片编辑/融合)使用 /v1/images/edits Q4:edits 接口如何上传多张参考图? A:使用同名 image 字段多值上传,如 -F "image=@ref1.png" -F "image=@ref2.png" Q5:revised_prompt 是什么? A:模型可能对原始 prompt 做了改写或扩展,revised_prompt 即为模型实际使用的提示词文本。 Q6:quality 参数支持哪些值? A:字符串枚举 high / medium / low / auto

11. 快速接入清单

  • 获取 API Key
  • 确认调用环境,可访问 OpenAI API Base URL
  • 选择接口:文生图 → /v1/images/generations;图片编辑 → /v1/images/edits
  • 图片编辑场景准备参考图文件,以 multipart/form-data 上传
  • 发送请求,同步获取图片结果(b64_jsonurl
  • 解码 base64 数据或下载 URL 保存图片