图片2 接入总览
本文档说明图片2 系列模型的调用方式。客户端统一使用 OpenAI 风格接口,平台按模型名自动分流;不同模型同步/异步返回方式不同,但文生图、图生图、图文生图的请求字段一致。
文档目录
| 文档 | 适用模型 | 返回方式 |
|---|---|---|
| 图片2(同步) | gpt-image-2-1k-同步 | 同步返回图片 |
| 香蕉模型(异步) | nano_banana_*-异步、gpt-image-2*-异步 | 异步任务,需查询 |
| Gemini 原生图片 | gemini-3-*-image-preview-同步 | Gemini 原生格式 |
| 异步任务查询 | 异步任务通用 | 查询任务结果 |
认证方式
http
Authorization: Bearer sk-xxxxxx
Content-Type: application/json一、能力分类
以下三种能力均通过 model + prompt 发起;是否传入 image 决定是文生图还是图生图/图文生图。
1. 文生图
根据纯文本提示词生成图片,不传 image。
| 项 | 说明 |
|---|---|
| 典型接口 | POST /v1/images/generations |
| 必填 | model、prompt |
| 可选 | size |
| 适用模型 | gpt-image-2-1k-同步、nano_banana_*-异步、gpt-image-2*-异步 |
json
{
"model": "gpt-image-2-1k-同步",
"prompt": "生成一张海报风格的城市夜景",
"size": "1024x1792"
}- 同步模型
gpt-image-2-1k-同步:响应体直接返回图片,见 图片2(同步)——文生图。 - 异步模型:返回
task_id,需 查询任务,见 香蕉模型——文生图。
2. 图生图
基于一张或多张参考图生成新图片,必须传 image。
| 项 | 说明 |
|---|---|
| 典型接口 | POST /v1/images/generations(带 image)或 POST /v1/images/edits |
| 必填 | model、prompt、image |
| 可选 | size |
| 场景 | 风格迁移、主体保留、重绘、融合多图 |
json
{
"model": "nano_banana_2-异步",
"prompt": "把这张图改成油画风格",
"image": "https://example.com/reference.jpg",
"size": "1024x1024"
}详见 图片2(同步)——图生图 / 香蕉模型——图生图。
3. 图文生图
不是单独接口,而是「参考图 + 文本描述」的组合用法:
- 文本(
prompt):说明要改什么、生成什么风格/内容 - 图片(
image):提供主体、构图、配色等视觉参考 - 最终输出新图
通常走:
POST /v1/images/generations(prompt+image)- 或
POST /v1/images/edits(偏编辑、改背景、局部修改)
json
{
"model": "gpt-image-2-1k-同步",
"prompt": "保留人物主体,背景改成赛博朋克霓虹街道",
"image": "https://example.com/portrait.jpg",
"size": "1024x1792"
}详见 图片2(同步)——图文生图 / 香蕉模型——图文生图。
能力对照
| 能力 | 是否传 image | 推荐接口 | gpt-image-2-1k-同步 返回 | 香蕉/GPT 异步返回 |
|---|---|---|---|---|
| 文生图 | 否 | generations | 同步图片 | 任务 ID |
| 图生图 | 是 | generations 或 edits | 同步图片 | 任务 ID |
| 图文生图 | 是 | generations 或 edits | 同步图片 | 任务 ID |
二、模型路由
图片2(同步)— gpt-image-2-1k-同步
- 接口:
/v1/images/generations、/v1/images/edits - 文生图 / 图生图 / 图文生图均支持
- 提交后直接返回图片,不走任务查询
香蕉模型(异步)
- 模型:
nano_banana_2-异步、nano_banana_pro-*-异步、gpt-image-2*-异步 - 接口:同上,内部转异步任务
- 提交返回
task_id,结果见 异步任务查询
Gemini 原生图片
- 不使用 OpenAI 的
prompt/image字段,走 Geminicontents格式
三、统一请求字段(适用部分 key)
| 字段 | 文生图 | 图生图 / 图文生图 | 说明 |
|---|---|---|---|
model | 必填 | 必填 | 决定路由与同步/异步 |
prompt | 必填 | 必填 | 文本描述或编辑意图 |
size | 可选 | 可选 | 转为内部 aspect_ratio |
image | 不传 | 必填 | URL 或 base64,可数组 |
n / quality / response_format | — | — | 当前不支持 |
size 映射
OpenAI size | aspect_ratio |
|---|---|
1024x1024 | 1:1 |
1024x1792 | 9:16 |
1792x1024 | 16:9 |
1024x1536 | 2:3 |
1536x1024 | 3:2 |
image 输入形式
- 单张 URL:
"image": "https://..." - Base64:
"image": "data:image/jpeg;base64,..." - 多张:
"image": ["url1", "url2"]
四、计费与限制
- 按次计费:提交一次扣一次;异步任务查询通常不重复扣费
- 仅支持
application/json,暂不支持multipart/form-data - 通用图片说明见 图片生成