PoloAPI 接口文档
首页
Polo首页
首页
Polo首页
  1. Openai
  • 站点操作指南-快速上手调用大模型API
  • claudecode安装教程(win/mac)
  • GPT-codex安装教程
  • VScode安装Claudecode教程
  • openclaw-cn接入教程
  • chatbox接入教程
  • cherry studio接入教程
  • 入门
    • 快速开始
    • 常见问题
  • AI编辑器
    • Cursor
    • Windsurf
  • 命令行工具
    • Claude Code
    • CC Switch
    • CC MAX
    • Aider
    • Codex
  • IDE 插件
    • Cline
    • Continue
  • 模型接口
    • 调用基础
      • 常见问题及解决办法
      • 批量请求示例
    • Openai
      • 文本生成
        POST
      • 文本生成---上下文阅读
        POST
      • 图片理解
        POST
      • 图片生成(gpt-image系列/sora_image/flux-kontext-pro)
        POST
      • 图片编辑/edits
        POST
      • 图片生成&编辑(gpt-image-2,异步)
        POST
      • 图片异步调用获取(gpt-image-2)
        POST
      • 图片编辑 / 网页版
        POST
      • 函数调用 tools
        POST
      • v1/Responses / 通用
        POST
      • 创建文本嵌入
        POST
      • 批量创建嵌入
        POST
      • 文本转语音 / TTS
        POST
      • 语音转文本 / whisper-1
        POST
      • 语音转文本 / gpt-4o-transcribe
        POST
      • 音频翻译
        POST
      • Audio接口 / 输出
        POST
      • Audio接口 / 输入
        POST
      • PDF文件分析
        POST
      • 内容补全接口
        POST
      • 创建内容审核
        POST
      • deep-research / 深度研究
        POST
      • Web search / 联网搜索
        POST
      • response_format
        POST
    • Anthropic Claude
      • 原生接口
        • 文本生成
        • 图片理解
        • 文本生成 / 强制返回思考
        • 函数调用
        • Web search / 联网搜索
        • 文本生成 (思考配置)
        • PDF传输
      • OpenAI兼容接口
        • 文本生成
        • 图片理解
        • 文本生成 / 强制返回思考
        • 函数调用
        • Web search / 联网搜索
    • Google Gemini
      • OpenAI兼容接口(推荐)
        • 文本生成
        • 文本生成 / 强制返回思考
        • 图片理解
        • 图片生成
        • 图片修改
        • 图片生成 / Imagen 4
        • 音频理解
        • 视频理解
        • 文本转语音 / TTS
        • 图片编辑(Nano-banana)
        • 图片编辑(Nano-banana) base64格式
      • Google Gemini接口
        • 文本生成
        • 文本生成(PDF)
        • 联网搜索
        • 文字转语音
        • 音频转文
        • 视频转文
        • 图片理解
        • 图片编辑(nano banana)
        • 图片编辑(nano banana pro)
        • embedding
    • Midjourney
      • Openai兼容/chat格式
        • MJ视频 (chat格式)
      • 原生接口
        • 文生图(Imagine)
        • 图片融合(Blend)
        • 按钮点击(Action)
        • 窗口执行(Modal)
        • 上传(upload)
        • 图生文(Describe)
        • 编辑图片(Edit)
        • 生成视频(Video)
        • 换脸(FaceSwap)
        • 缩短提示词(Shorten)
        • 查询
        • 获取种子(Seed)接口
        • 批量查询
        • 文生图 / OpenAI兼容
    • veo/omini
      • veo创建视频
      • omni创建视频
      • 查询veo/omni视频状态和详情
      • 下载veo/omni视频
      • 图生视频(chat格式)
      • 创建视频 /v1/videos
      • 图生视频
      • 文生视频
      • 查询视频生成状态
    • sora
      • 异步格式
        • 创建视频 (sora-2-guan)
        • 创建视频 (创建角色用)
        • 转存视频
        • 查询视频任务详情
        • 生成视频(sora-2逆向)
        • 创建视频(带 Character)
        • 文生视频
        • 图生视频
        • 图生视频 删除首帧
        • 创建视频 /v1/videos
        • 编辑视频(remix)
        • 查询视频任务详情 Copy
        • 查询视频任务详情 Copy
      • chat格式(不推荐使用)
        • 创建绘画
      • 创建角色接口
        • 角色创建
        • 角色创建 (使用url)
        • 创建角色
    • Grok
      • 视频生成
      • 查询视频进度
      • 图片生成
      • 图片编辑
      • 视频生成(官)
      • 查询视频进度(官)
      • 视频编辑(官)
    • 文生图接口
      • flux / OpenAI兼容接口
      • flux-kontext-pro / OpenAI兼容接口
      • stable-diffusion / OpenAI兼容接口
      • ideogram / OpenAI兼容接口
      • recraftv3 / OpenAI兼容接口
      • flux携带参考图 / OpenAI兼容接口
    • 豆包
      • 豆包图片(文生图/图生图/多图)
      • 豆包视频
      • 查询视频
      • 视频生成(/v1/videos兼容接口)
      • 文生视频
      • 图生视频
      • doubao-seedream-4-0-250828-文生图
      • doubao-seedream-4-0-250828-图生图
      • doubao-seedream-4-0-250828-多图生图
    • 小米MIMO
      • Openai兼容
    • Suno
      • 场景一:stems声曲分离 Vocals Instrumental
      • 生成歌曲
      • 生成歌词
      • 查询任务状态(批量)
      • 查询任务状态(单个)
    • wan 阿里万相
      • 创建视频 /v1/videos
      • 查询视频
    • 语音克隆
      • 获取模型列表
      • 创建模型
      • 获取指定模型
      • 删除模型
      • 更新模型
    • FLUX
      • Flux(Dalle3 Edits(图生图&文生图))
    • 3D模型
      • Hunyuan3D-2
    • FLUX
      • /fal-ai/nano-banana 文生图
      • /fal-ai/nano-banana/edit 图片编辑
  • 数据模型
    • 示例数据模型
      • Pet
      • Category
      • Tag
  1. Openai

图片生成&编辑(gpt-image-2,异步)

开发中
正式环境
https://poloai.top
正式环境
https://poloai.top
POST
https://poloai.top
/v1/videos
最后修改时间:2026-07-24 02:31:24
仅限AIGC分组的gpt-image-2-c

功能说明#

通过 /v1/videos 接口调用 GPT 图片生成能力(与视频生成共用接口,通过 model 参数区分),支持文生图和图生图两种模式,采用异步任务方式,先提交返回任务 ID,再轮询获取结果。

画幅 / 宽高比#

支持两种控制方式:
1.
aspect_ratio 传入固定比例字符串(如 9:16、16:9 等),精确控制输出比例
2.
aspect_ratio 传 "auto",或不传该参数 —— 两者等价,均根据提示词内容自动推断,无固定比例;提示词中若写明了比例(如“竖屏 9:16”),模型也会据此生成

支持的模型#

model 参数说明
gpt-image-2GPT 图片生成(标准档)
gpt-image-2-2K2K 分辨率
gpt-image-2-4K4K 分辨率
三者均走同一套 /v1/videos 异步流程,仅 model 不同;下游计费与上游路由以 model 区分档位。

请求头#

参数名类型必填说明
Authorizationstring是Bearer YOUR_API_KEY
Content-Typestring是application/json

请求参数#

参数名类型必填说明
modelstring是模型名称,取值为 gpt-image-2、gpt-image-2-2K、gpt-image-2-4K 之一(大小写须与上表一致,其中 2K / 4K 为大写 K)
promptstring是文本提示词
aspect_ratiostring否宽高比。传固定比例字符串(见下表支持的 10 种值)则精确控制;传 "auto" 或不传则根据提示词内容自动推断,没有固定比例
imagesstring[]否参考图片数组(支持 Base64 或 URL),最多 5 张。传此参数为图生图模式,不传或传空数组为文生图模式

aspect_ratio 支持的值#

值方向适用场景
auto自动不指定比例,根据提示词内容自动推断(与不传等价)
1:1正方形通用、社交媒体
16:9横向(宽屏)横屏内容、PC 端
9:16竖向短视频、手机竖屏
4:3横向传统屏幕
3:4竖向竖屏内容
3:2横向摄影常用
2:3竖向竖版海报
5:4横向大幅横图
4:5竖向Instagram 竖图
21:9超宽横向影院宽幅

宽高比控制方式对比#

方式用法效果
固定比例"aspect_ratio": "9:16"精确输出指定比例
自动推断"aspect_ratio": "auto" 或不传根据提示词内容自动决定,无固定比例
提示词描述不传或传 "auto",prompt 中写明比例模型从提示词中读取比例并遵循

images 数组元素传法#

方式示例
图片 URL"https://example.com/reference.jpg"
Base64"data:image/jpeg;base64,/9j/4AAQSkZJRg..."
注意:传入图片 URL 时,网关会自动将其下载并转为 Base64 后发给上游,请确保 URL 为可公网访问的图片直链。

请求示例#

文生图 — 固定宽高比(竖屏 9:16)#

{
  "model": "gpt-image-2",
  "prompt": "生成抖音带货风格主图,主体 xxx",
  "aspect_ratio": "9:16"
}

文生图 — 自动推断宽高比(传 auto)#

{
  "model": "gpt-image-2",
  "prompt": "一只可爱的柴犬坐在草地上",
  "aspect_ratio": "auto"
}
传 "auto" 与不传 aspect_ratio 完全等价,由官方根据内容自动决定比例,无固定值。

文生图 — 自动推断宽高比(不传参数)#

{
  "model": "gpt-image-2",
  "prompt": "一只可爱的柴犬坐在草地上"
}

文生图 — 提示词描述比例(配合自动推断)#

{
  "model": "gpt-image-2",
  "prompt": "生成一张 16:9 横屏风景图,美丽的日出,金色阳光洒在宁静湖面上,远处连绵山脉",
  "aspect_ratio": "auto"
}
不指定固定比例,模型从提示词中读取“16:9”并按此生成。

文生图 — 2K / 4K 档位#

{
  "model": "gpt-image-2-4K",
  "prompt": "生成抖音带货风格主图,主体 xxx",
  "aspect_ratio": "9:16"
}
将 model 改为 gpt-image-2-2K 或 gpt-image-2-4K 即可,aspect_ratio 用法与标准档相同。

图生图 — Base64 格式#

{
  "model": "gpt-image-2",
  "prompt": "将这张图片转换成油画风格",
  "aspect_ratio": "9:16",
  "images": [
    "data:image/jpeg;base64,/9j/4AAQSkZJRg...",
    "data:image/png;base64,iVBORw0KGgoAAAANSU..."
  ]
}

图生图 — URL 格式#

{
  "model": "gpt-image-2",
  "prompt": "将这张图片转换成油画风格",
  "aspect_ratio": "16:9",
  "images": [
    "https://example.com/images/reference1.jpg",
    "https://example.com/images/reference2.png"
  ]
}

请求参数

Header 参数

Body 参数application/json

示例
{
    "model": "gpt-image-2-c",
    "prompt": "根据图片做一个广告",
    "aspect_ratio": "16:9",
    "images": [
        "https://xxx.cc/xxx.jpg",
        "https://www.baidu.com/img/PCtm_d9c8750bed0b3c7d089fa7d55720d6cf.png"
    ]
}

请求示例代码

Shell
JavaScript
Java
Swift
Go
PHP
Python
HTTP
C
C#
Objective-C
Ruby
OCaml
Dart
R
请求示例请求示例
Shell
JavaScript
Java
Swift
curl --location 'https://poloai.top/v1/videos' \
--header 'Authorization: sk-' \
--header 'Content-Type: application/json' \
--data '{
    "model": "gpt-image-2-c",
    "prompt": "根据图片做一个广告",
    "aspect_ratio": "16:9",
    "images": [
        "https://xxx.cc/xxx.jpg",
        "https://www.baidu.com/img/PCtm_d9c8750bed0b3c7d089fa7d55720d6cf.png"
    ]
}'

返回响应

🟢200成功
application/json
Bodyapplication/json

示例
{
    "created": 1713833628,
    "data": [
        {
            "b64_json": "..."
        }
    ]
}
修改于 2026-07-24 02:31:24
上一页
图片编辑/edits
下一页
图片异步调用获取(gpt-image-2)
Built with