1. v2 接入说明
快跑科技
  • 默认模块
    • 引言
    • 目录
    • 常见问题
    • 从0开始使用Codex
    • API 快速开始指南
    • 快跑后台令牌创建
    • 网站使用
      • 操练场
      • 模型广场(选择模型和分组)
      • 令牌管理
      • 快跑画布使用教程
      • 快跑画布生成视频教程
    • 聊天与生图
      • ChatBox 移动端
      • Chatbox生图设置
      • Cherry Studio生图使用
    • Codex进阶
      • Codex 安装skill 使用图片模型生成图片
      • Codex 使用记忆功能恢复历史对话
    • CCSwitch配置(新手推荐 简单快速)
      • CCSwitch快速配置ChatGPT Codex
      • CCSwitch快速配置Claude
      • CCSwitch快速配置在Claude中使用GPT模型
      • CCSwitch配置DeepSeek在Claude中使用
      • CCSwitch配置Grok在Claude中使用
      • CCSwitch配置Grok在Codex中使用
      • CCSwitch配置DeepSeek在Codex中使用
    • OpenClaw / Hermes配置教程
      • OpenClaw配置ChatGPT教程
      • OpenClaw配置Claude教程
      • OpenClaw安装Skill教程
      • Hermes配置ChatGPT教程
    • WorkBuddy配置教程
      • WorkBuddy配置教程
    • 各种插件/软件使用教程
      • Codex 配置教程
      • Trae配置教程
      • OpenClaw Clawdbot 自定义中转站配置教程
      • N8N 工作流使用中转API 教程
      • opencode 配置教程
      • Gemini CLI 中转站配置使用教程
      • Claude Code 安装使用教程
      • CherryStudio调用cluade MCP
      • Cherry Studio配置教程
      • Cherry Studio配置 banana pro 4K和分辨率教程
      • CherryStudio配置o4推理级别
      • 扣子工作流简单配置从输入到获取url
      • dify添加模型
      • cline 配置教程
      • aider 配置教程
      • Cursor 免费版配置教程
      • Cursor 配置教程
      • lobechat 设置教程
      • ChatBox(推荐使用)
      • 开源gpt_academic
      • nextchat 设置教程
      • zotero gpt 配置方法
      • CLAUDE DEV 配置教程
      • 沉浸式翻译 设置gpt翻译
      • 浏览器插件ChatGPT Sidebar
      • chatgpt-on-wechat 配置教程
      • chatgpt GPT Academic 学术优化配置gpt教程
      • RikkaHub 配置教程
      • coze 工作流使用中转API 教程
      • n8n 工作流获取本地图片生成视频例子
      • OpenClaw 最新版本 自定义中转站配置教程
      • Codex更新后不显示新模型的解决方法
    • 图像API接入文档
      • 1. gpt-image-2 生成图像
      • 2. gpt-image-2-1k 生成图像
      • 3. gpt-image-2-1k 编辑图像
      • 4. Gemini 图像生成
    • 接口文档
      • 聊天(Chat)
        • ChatGpt 接口
          • ChatGPT音频(Audio)
            • GPT-4o-audio
            • 音频转文字 whisper-1
            • 音频转文字 gpt-4o-transcribe
            • 创建语音 gpt-4o-mini-tts
            • 创建翻译 (不支持)
          • ChatGPT聊天(Chat)
            • 聊天完成对象
            • 聊天完成块对象
            • 创建聊天补全 (流式)
            • 创建聊天补全 (非流)
            • 创建聊天识图 (流式)
            • 创建聊天识图 (流式) best64
            • 创建聊天识图 (非流)
            • 创建聊天创作图 (非流)
            • 官方Function calling调用
            • 官方N测试
            • 列出模型
            • 创建聊天函数调用
            • 创建结构化输出
            • 控制推理模型努力程度
            • 创建聊天补全 qwen-mt-turbo
            • 创建聊天补全 deepseek v3.1思考程度 (流式)
            • deepseek-ocr 识别
          • ChatGPT自动补全(Completions)
            • 完成对象
            • 创建完成
          • ChatGPT嵌入(Embeddings)
            • 嵌入对象
            • 创建嵌入
          • Web 搜索
            • web搜索
        • Anthropic Claude 接口
          • 聊天完成对象
          • 聊天完成块对象
          • 原生格式
            • 创建聊天补全 (流式)
            • 创建函数调用 (流式)
            • 创建格式化输出
            • 创建思考聊天
            • PDF支持
            • PDF支持 base64格式
            • 联网搜索
          • chat兼容格式
            • 创建思考聊天
            • 创建聊天补全 (流式)
            • 创建聊天补全 (非流)
            • 创建聊天识图 (流式)
            • 创建聊天识图 (非流)
        • 谷歌Gemini 接口
          • 原生格式
            • 文本生成
            • 文本生成-流
            • 文本生成+思考-流
            • 图片生成
            • 图片生成 gemini-2.5-flash-image
            • 图片生成 gemini-2.5-flash-image 控制宽高比
            • 图片生成 gemini-3-pro-image-preview 控制宽高比 +清晰度
            • 图片编辑
            • 图片理解
            • 格式化输出
            • 函数调用
            • 文档理解
            • URL context [原生格式]
            • 代码执行
            • google search
            • 视频理解
            • URL context
            • 音频理解
            • Embeddings
            • TTS 文本转语音
            • 文本生成 gemini-3-pro-preview:generateContent
            • Imagen 生成图片
            • gemini-tts文本转语音
            • 文本嵌入
          • chat兼容格式
            • gemini图片创作接口 [chat兼容格式]
            • 聊天接口 [chat兼容格式]
            • 聊天接口-思考1 [chat兼容格式]
            • 聊天接口-思考2 [chat兼容格式]
            • 识图接口 [chat兼容格式]
            • 聊天+读取文件接口 [chat兼容格式]
            • 文本嵌入 [chat兼容格式]
      • 聊天(Responses)
        • Responses API与Chat API对比
        • 创建模型响应
        • 创建函数调用
        • 创建模型响应(流式返回)
        • 创建模型响应 (控制思考长度)
        • 创建网络搜索
        • 创建模型响应 gpt-5启用思考
        • 创建函数调用 Copy
      • 生图
        • API接口调用
    • Python配置方式
      • python 使用 语音转文本
      • python 使用文本转语音
      • python 使用Embeddings 向量化
      • python 调用DALL·E
      • python简单调用 openai function-calling demo
      • python 简单langchain 调用openai demo
      • python llama_index 配置
      • Python基础对话
      • Python使用gpt-4o识别图片-本地图片
      • Python使用gpt-4o识别图片
      • Python使用Claude识别图片
      • python 库流式输出
      • gpt realtime模型调用
      • python request 请求 流式输出demo
      • python 使用gpt-image-1 创建编辑图片
      • python openai官方库(使用AutoGPT,langchain等)
      • python 连续对话
    • nodejs 配置方式
      • nodejs 基础对话
    • 帮助中心
      • AI返回字段: 思考相关
      • HTTP状态码及其含义
      • 联系我们
    • 数据模型
      • ImageGenerationRequest
      • AsyncImageGenerationRequest
      • ImageGenerationResponse
      • ImageResult
      • AsyncImageTask
      • GeminiGenerateContentRequest
      • GeminiContent
      • GeminiPart
      • GeminiInlineData
      • GeminiGenerationConfig
      • GeminiImageConfig
      • GeminiGenerateContentResponse
      • GeminiCandidate
      • ErrorObject
      • ErrorResponse
      • GptImage1GenerationRequest
      • GptImage1EditRequest
      • GptImage1EditMultipartRequest
      • GptImage1EditJsonRequest
  • 视频接入文档
    • Seedance视频接入文档
      • 1. 创建视频生成任务
      • 2. 查询视频生成任务
      • 3. 完整演示代码
    • Grok视频接入文档
      • 1. 创建视频生成任务
      • 2. 查询视频生成任务
      • 3. 完整演示代码
  • 图像与视频统一接入文档v2
    • v2 接入说明
      • 0. 接入须知(先看这里)
        GET
      • 1. 视频模型能力表
        GET
      • 2. 图像模型能力表
        GET
      • 3. 错误码
        GET
      • 4. 从 v1 迁移
        GET
    • v2 视频生成
      • 1. 创建视频任务
      • 2. 查询视频任务
      • 3. 下载视频文件
      • 4. 视频完整示例代码
    • v2 图像生成
      • 1. 文生图
      • 2. 图生图 / 多图参考 / 局部重绘
      • 3. 图像完整示例代码
    • 数据模型
      • ImageInputReference
      • CreateVideoRequest
      • CreateVideoMultipartRequest
      • VideoError
      • Video
      • CreateImageRequest
      • EditImageJsonRequest
      • EditImageMultipartRequest
      • ImageData
      • ImageUsage
      • ImagesResponse
      • ErrorObject
      • ErrorResponse
  1. v2 接入说明

2. 图像模型能力表

GET
/docs/v2/image-models
本条目只用于在 Apifox 中展示说明,不对应线上接口,无需请求。
下表列出 v2 图像接口支持的模型和能力,实际可用模型以控制台「模型广场」为准。表中标 ❌ 的字段,对应模型不支持,传了会返回 400。

1. 能力总览#

模型文生图参考图 image局部重绘 masknqualitybackgroundoutput_format / output_compressionwatermark
gpt-image-2✅✅ 最多 10 张✅1–10auto、low、medium、highauto、opaquepng、jpeg、webp✅ 默认 false
gpt-image-2-1k(及同系列 -2k、-4k 档位模型)✅✅ 最多 10 张✅1–10同上同上同上✅ 默认 false
gemini-3-pro-image-preview-token✅✅ 最多 14 张❌仅 1❌❌❌(输出 png)❌
gemini-2.5-flash-image-token / gemini-3.1-flash-image-preview-token✅✅ 最多 3 张❌仅 1❌❌❌(输出 png)❌
以下模型目前不支持 v2 接口(返回 unsupported_model),请继续使用 v1 接口:gpt-image-2.5 系列、gpt-image-1.5、gpt-image-2-az、带「超分」的模型。
所有模型都支持 response_format(url 或 b64_json,默认 url)。平台图片存储暂时不可用时,要求 url 的请求会改为返回 b64_json,建议两种字段都做兼容。
Gemini 系列一次只出 1 张,需要多张请并发多个请求。
gpt-image-2 不支持透明背景(background=transparent)。

2. 尺寸#

模型sizeresolutionaspect_ratio都不传时
gpt-image-2auto 或任意宽x高:宽和高都是 16 的倍数,最长边 ≤ 3840,宽高比不超过 3:1,总像素 655,360–8,294,4001K、2K、4K1:1、2:3、3:2、3:4、4:3、9:16、16:9、21:9size=auto(由模型决定)
gpt-image-2-1k / -2k / -4k同上,且总像素不能超过档位上限:1K ≤ 1024×1024,2K ≤ 2048×2048,4K ≤ 3840×2160由模型名固定同上按档位输出 1:1(例如 -1k 为 1024x1024)
Gemini 系列可以传,按最接近的比例和档位换算gemini-3-pro-image-preview-token:1K、2K;其余:1K1:1、16:9、9:16、4:3、3:4、3:2、2:3、21:91:1 + 1K
gpt-image 系列使用 aspect_ratio + resolution 时按下表输出(在档位像素上限内,取比例完全一致、宽高为 16 倍数的最大尺寸):
resolution1:12:33:23:44:39:1616:921:9
1K1024x1024832x12481248x832864x11521152x864720x12801280x7201456x624
2K2048x20481664x24962496x16641728x23042304x17281440x25602560x14403024x1296
4K2880x28802336x35043504x23362448x32643264x24482160x38403840x21603808x1632
Gemini 系列的实际像素由模型按比例和档位决定(1K 约 100 万像素,2K 约 400 万像素),以返回的 size 为准。

3. 参考图与 mask 要求#

image:jpg、png、webp,单张不超过 30MB。JSON 请求里的链接由平台下载后转发给模型,链接需要可公网访问。
多张参考图时,提示词里可以按顺序称为图片1、图片2……
mask(仅 gpt-image 系列):PNG,小于 4MB,尺寸与第一张 image 相同;完全透明的区域表示需要重绘的部分。传多张 image 时,mask 作用于第一张。

请求参数

无

请求示例代码

Shell
JavaScript
Java
Swift
Go
PHP
Python
HTTP
C
C#
Objective-C
Ruby
OCaml
Dart
R
请求示例请求示例
Shell
JavaScript
Java
Swift
curl --location '/docs/v2/image-models'

返回响应

🟢200
application/json
文档说明,无需请求
Bodyapplication/json

示例
{}
修改于 2026-09-30 13:54:50
上一页
1. 视频模型能力表
下一页
3. 错误码
Built with