1. 生图
快跑科技
  • 默认模块
    • 引言
    • 目录
    • 常见问题
    • 从0开始使用Codex
    • API 快速开始指南
    • 快跑后台令牌创建
    • Codex使用GPT-5.6
    • 网站使用
      • 操练场
      • 模型广场(选择模型和分组)
      • 令牌管理
      • 快跑画布使用教程
      • 快跑画布生成视频教程
    • 聊天与生图
      • ChatBox 移动端
      • Chatbox生图设置
      • Cherry Studio生图使用
      • Codex 调用绘图模型
    • CCSwitch配置(新手推荐 简单快速)
      • CCSwitch快速配置ChatGPT Codex
      • CCSwitch快速配置Claude
      • CCSwitch快速配置在Claude中使用GPT模型
      • CCSwitch配置DeepSeek在Claude中使用
      • CCSwitch配置Grok在Claude中使用
      • CCSwitch配置Grok在Codex中使用
      • CCSwitch配置DeepSeek在Codex中使用
    • OpenClaw / Hermes配置教程
      • OpenClaw配置ChatGPT教程
      • OpenClaw配置Claude教程
      • OpenClaw安装Skill教程
      • Hermes配置ChatGPT教程
    • WorkBuddy配置教程
      • WorkBuddy配置教程
    • 各种插件/软件使用教程
      • Codex 配置教程
      • Trae配置教程
      • OpenClaw Clawdbot 自定义中转站配置教程
      • N8N 工作流使用中转API 教程
      • opencode 配置教程
      • Gemini CLI 中转站配置使用教程
      • Claude Code 安装使用教程
      • CherryStudio调用cluade MCP
      • Cherry Studio配置教程
      • Cherry Studio配置 banana pro 4K和分辨率教程
      • CherryStudio配置o4推理级别
      • 扣子工作流简单配置从输入到获取url
      • dify添加模型
      • cline 配置教程
      • aider 配置教程
      • Cursor 免费版配置教程
      • Cursor 配置教程
      • lobechat 设置教程
      • ChatBox(推荐使用)
      • 开源gpt_academic
      • nextchat 设置教程
      • zotero gpt 配置方法
      • CLAUDE DEV 配置教程
      • 沉浸式翻译 设置gpt翻译
      • 浏览器插件ChatGPT Sidebar
      • chatgpt-on-wechat 配置教程
      • chatgpt GPT Academic 学术优化配置gpt教程
      • RikkaHub 配置教程
      • coze 工作流使用中转API 教程
      • n8n 工作流获取本地图片生成视频例子
      • OpenClaw 最新版本 自定义中转站配置教程
    • 图像API接入文档
      • 1. gpt-image-2 生成图像
      • 2. gpt-image-2-1k 生成图像
      • 3. gpt-image-2-1k 编辑图像
      • 4. Gemini 图像生成
      • 5. 图像异步生成
      • 6. 图像异步任务查询
    • 接口文档
      • 聊天(Chat)
        • ChatGpt 接口
          • ChatGPT音频(Audio)
            • GPT-4o-audio
            • 音频转文字 whisper-1
            • 音频转文字 gpt-4o-transcribe
            • 创建语音 gpt-4o-mini-tts
            • 创建翻译 (不支持)
          • ChatGPT聊天(Chat)
            • 聊天完成对象
            • 聊天完成块对象
            • 创建聊天补全 (流式)
            • 创建聊天补全 (非流)
            • 创建聊天识图 (流式)
            • 创建聊天识图 (流式) best64
            • 创建聊天识图 (非流)
            • 创建聊天创作图 (非流)
            • 官方Function calling调用
            • 官方N测试
            • 列出模型
            • 创建聊天函数调用
            • 创建结构化输出
            • 控制推理模型努力程度
            • 创建聊天补全 qwen-mt-turbo
            • 创建聊天补全 deepseek v3.1思考程度 (流式)
            • deepseek-ocr 识别
          • ChatGPT自动补全(Completions)
            • 完成对象
            • 创建完成
          • ChatGPT嵌入(Embeddings)
            • 嵌入对象
            • 创建嵌入
          • Web 搜索
            • web搜索
        • Anthropic Claude 接口
          • 聊天完成对象
          • 聊天完成块对象
          • 原生格式
            • 创建聊天补全 (流式)
            • 创建函数调用 (流式)
            • 创建格式化输出
            • 创建思考聊天
            • PDF支持
            • PDF支持 base64格式
            • 联网搜索
          • chat兼容格式
            • 创建思考聊天
            • 创建聊天补全 (流式)
            • 创建聊天补全 (非流)
            • 创建聊天识图 (流式)
            • 创建聊天识图 (非流)
        • 谷歌Gemini 接口
          • 原生格式
            • 文本生成
            • 文本生成-流
            • 文本生成+思考-流
            • 图片生成
            • 图片生成 gemini-2.5-flash-image
            • 图片生成 gemini-2.5-flash-image 控制宽高比
            • 图片生成 gemini-3-pro-image-preview 控制宽高比 +清晰度
            • 图片编辑
            • 图片理解
            • 格式化输出
            • 函数调用
            • 文档理解
            • URL context [原生格式]
            • 代码执行
            • google search
            • 视频理解
            • URL context
            • 音频理解
            • Embeddings
            • TTS 文本转语音
            • 文本生成 gemini-3-pro-preview:generateContent
            • Imagen 生成图片
            • gemini-tts文本转语音
            • 文本嵌入
          • chat兼容格式
            • gemini图片创作接口 [chat兼容格式]
            • 聊天接口 [chat兼容格式]
            • 聊天接口-思考1 [chat兼容格式]
            • 聊天接口-思考2 [chat兼容格式]
            • 识图接口 [chat兼容格式]
            • 聊天+读取文件接口 [chat兼容格式]
            • 文本嵌入 [chat兼容格式]
      • 聊天(Responses)
        • Responses API与Chat API对比
        • 创建模型响应
        • 创建函数调用
        • 创建模型响应(流式返回)
        • 创建模型响应 (控制思考长度)
        • 创建网络搜索
        • 创建模型响应 gpt-5启用思考
        • 创建函数调用 Copy
      • 生图
        • API接口调用
    • Python配置方式
      • python 使用 语音转文本
      • python 使用文本转语音
      • python 使用Embeddings 向量化
      • python 调用DALL·E
      • python简单调用 openai function-calling demo
      • python 简单langchain 调用openai demo
      • python llama_index 配置
      • Python基础对话
      • Python使用gpt-4o识别图片-本地图片
      • Python使用gpt-4o识别图片
      • Python使用Claude识别图片
      • python 库流式输出
      • gpt realtime模型调用
      • python request 请求 流式输出demo
      • python 使用gpt-image-1 创建编辑图片
      • python openai官方库(使用AutoGPT,langchain等)
      • python 连续对话
    • nodejs 配置方式
      • nodejs 基础对话
    • 帮助中心
      • AI返回字段: 思考相关
      • HTTP状态码及其含义
      • 联系我们
    • 数据模型
      • ImageGenerationRequest
      • AsyncImageGenerationRequest
      • ImageGenerationResponse
      • ImageResult
      • AsyncImageTask
      • GeminiGenerateContentRequest
      • GeminiContent
      • GeminiPart
      • GeminiInlineData
      • GeminiGenerationConfig
      • GeminiImageConfig
      • GeminiGenerateContentResponse
      • GeminiCandidate
      • ErrorObject
      • ErrorResponse
      • GptImage1GenerationRequest
      • GptImage1EditRequest
      • GptImage1EditMultipartRequest
      • GptImage1EditJsonRequest
  • 视频接入文档
    • Seedance视频接入文档
      • 1. 创建视频生成任务
      • 2. 查询视频生成任务
      • 3. 完整演示代码
    • Grok视频接入文档
      • 1. 创建视频生成任务
      • 2. 查询视频生成任务
      • 3. 完整演示代码
    • 数据模型
      • CreateVideoTaskRequest
      • CreateGrokVideoTaskRequest
      • ContentItem
      • GrokVideoTask
      • CreateVideoTaskResponse
      • ErrorObject
      • VideoTask
      • ErrorResponse
      • FileObject
  1. 生图

API接口调用

image-2 调用文档#

基于 OpenAI 兼容接口封装,使用 kuaipao.pro 作为接入域名。

接口说明#

接口地址:POST https://kuaipao.pro/v1/images/generations
鉴权方式:Authorization: Bearer YOUR_API_KEY
请求格式:application/json
输出方式:默认返回 Base64 图片数据
模型名称:gpt-image-2
适用场景:
文生图
海报生成
商品图生成
封面图生成
高分辨率图片生成

请求头#

请求参数#

参数名类型必填说明
modelstring是固定填写 gpt-image-2
promptstring是图片生成提示词
sizestring否输出尺寸,默认 auto
qualitystring否生成质量,可选 low、medium、high、auto
ninteger否生成图片数量,默认 1
output_formatstring否输出格式,可选 png、jpeg、webp
output_compressioninteger否jpeg 或 webp 压缩率,范围 0-100
backgroundstring否背景模式,可选 auto、opaque、transparent
moderationstring否审核强度,可选 auto、low
userstring否业务侧用户标识,便于追踪

尺寸说明#

gpt-image-2 支持灵活分辨率,常用推荐值如下:
1024x1024
1536x1024
1024x1536
2048x2048
2048x1152
3840x2160
2160x3840
auto
尺寸约束:
单边最大不超过 3840
宽高都必须是 16 的倍数
长边与短边比例不超过 3:1
总像素需在 655,360 到 8,294,400 之间

Curl 示例#

如果需要直接保存图片:

Python 示例#

Node.js 示例#

请求示例#

{
  "model": "gpt-image-2",
  "prompt": "生成一张高端咖啡品牌宣传海报,暖色灯光,真实摄影风格,画面包含英文标题 COFFEE HOUSE",
  "size": "1024x1536",
  "quality": "high",
  "n": 1,
  "output_format": "png",
  "moderation": "auto"
}

返回示例#

{
  "created": 1710000000,
  "data": [
    {
      "b64_json": "iVBORw0KGgoAAAANSUhEUgAA..."
    }
  ],
  "usage": {
    "input_tokens": 123,
    "output_tokens": 1056,
    "total_tokens": 1179
  }
}

返回字段说明#

字段类型说明
createdinteger时间戳
dataarray图片结果列表
data[].b64_jsonstringBase64 编码后的图片内容
usage.input_tokensinteger输入消耗
usage.output_tokensinteger输出消耗
usage.total_tokensinteger总消耗

错误响应示例#

{
  "error": {
    "message": "Invalid API key provided.",
    "type": "invalid_request_error",
    "param": null,
    "code": "invalid_api_key"
  }
}

常见问题#

1. 为什么返回的是 b64_json?#

图片接口默认返回 Base64 内容,服务端或前端需要自行解码并保存成图片文件。

2. 哪种格式更适合线上使用?#

png:无损,适合海报、UI、文字较多的图
jpeg:体积更小,适合普通展示图
webp:兼顾质量和体积,适合网页场景

3. 质量怎么选?#

low:草稿预览,速度更快
medium:日常业务图
high:正式出图、广告图、封面图

4. 延迟大概多久?#

复杂提示词或高分辨率图片通常耗时更长,复杂请求可能接近 1 到 2 分钟。

接入建议#

优先从 1024x1024 + medium 开始联调
生产环境建议开启超时重试
如果主要关注速度,优先使用 jpeg
如果对画面中文字要求高,建议在提示词中明确字体布局、文案内容和排版位置

兼容性说明#

本文档按 OpenAI 兼容 Images API 组织,适合直接用于以下 SDK 接入:
OpenAI Python SDK
OpenAI Node.js SDK
任何兼容 OpenAI 协议的 HTTP 客户端
如果你的实际网关不是 https://kuaipao.pro/v1,只需要替换 base_url 或请求域名即可,其他请求结构通常保持不变。
修改于 2026-05-22 01:24:34
上一页
创建函数调用 Copy
下一页
python 使用 语音转文本
Built with