Skip to main content
新接入建议使用 图片生成,通过 /ai/v1/images/generations 调用统一的图片生成、任务查询、Webhook 和错误协议。 本页现有的 OpenAI 兼容、zimage 与厂商适配接口继续可用。调用前请通过模型 Schema 接口查询模型支持的端点, 按返回的 path 选择协议并读取该项的 request.schema,不要依赖 endpoints 数组位置。

可用模型列表

OpenAI 模型

  • gpt-image-2 —— 已支持通过 OpenAI 兼容接口调用图片编辑,模型 ID 需要写完整为 gpt-image-2,不能简写为 image2
  • gpt-image-2-free
  • gpt-image-1.5
  • gpt-image-1 —— 多模态语言模型,它接受文本和图像输入,并生成图像输出。
  • gpt-image-1-mini —— gpt-image-1 的经济型版本。
  • dall-e-3 —— 能够根据自然语言描述创建逼真的图像和艺术作品,支持根据提示创建指定尺寸的新图像。
  • dall-e-2

Google Gemini 模型

Imagen 模型

阿里云模型

Wan(万相)系列

  • wan2.7-image-pro —— 万相 2.7 专业版,支持思考模式与最高 4K 分辨率
  • wan2.7-image —— 万相 2.7 标准版,最高支持 2K 分辨率
  • wan2.6-t2i —— 万相 2.6 文生图

Qwen-Image(千问图像)系列

GLM 模型

  • glm-image —— 智谱 AI 发布的图像生成模型,支持高清(hd)和标准(standard)两种质量模式。

Doubao 模型

  • doubao-seedream-5.0-pro
  • doubao-seedream-5.0-lite —— 字节跳动发布的最新图像创作模型,该模型首次搭载联网检索功能,能融合实时网络信息,提升生图时效性。
  • doubao-seedream-4-5 —— 字节跳动推出的图像多模态模型,整合了文生图、图生图、组图输出等能力。
  • doubao-seedream-4-0 —— 字节跳动SOTA级多模态图像创作模型,支持多图融合创作、图像编辑、组图生成等多样玩法。

Microsoft 模型

Ideogram 模型

Stable Diffusion 模型

Baidu 模型

Flux 模型

Agnes 模型

API 接口

zimage 接口

<model_path> 为<供应商/模型id>,如<openai/gpt-image-1.5>,<qianfan/qwen-image>。

openai 兼容接口

文生图
图片编辑

请求头

请求参数

通用参数

OpenAI 模型参数

Imagen 模型参数

FLUX-1.1-pro 模型参数

prompt_upsamplingsafety_toleranceseed 需放在请求体的 extra_body 字段内传递。

阿里云模型参数

阿里云模型支持两种调用方式:OpenAI 兼容接口和 zimage 原生接口。 OpenAI 兼容接口 — 标准参数 OpenAI 兼容接口 — 扩展参数(与 modelprompt 同级传递) zimage 原生接口参数(位于 input 对象内) 各模型 nsize 取值范围

GLM 模型参数

Doubao 模型参数

实际可生成的图片数量,除受到 max_images 影响外,还受到输入的参考图数量影响。输入的参考图数量+最终生成的图片数量 ≤ 15 张。

使用示例

OpenAI

gpt-image-2

这是 OpenAI 图片编辑模型,调用时请填写完整模型名 gpt-image-2,不能简写为 image2。该接口返回 b64_json 时,可按下面示例保存为 edited.png

Google Imagen

阿里云模型

  • 支持两种调用方式:OpenAI 兼容接口(/v1/images/generations/v1/images/edits)和 zimage 原生接口(/v1/models/bailian/:model/predictions
  • 返回的图片 URL 有效期 24 小时,请及时下载保存

GLM

Doubao

Flux

  • flux-2-flexflux-2-pro 为异步端口,需要分 2 步请求。该系列速度极快,几乎秒出。
  • Azure 渠道的FLUX-1.1-pro 等 BFL 模型均为同步绘图,而非异步。

FLUX 一步绘图

FLUX-1.1-pro

Ideogram V3

错误响应与兼容错误码

本节适用于本页的 Legacy /v1/images/* 接口。新版 /ai/v1/images/* 使用独立的 图片错误合同。两套接口的响应结构和 错误码需要分别处理。 Legacy 图片接口的一般错误响应如下。param 是可选字段,tid 通常附加在 message 末尾,不单独返回:

提交 HTTP 5xx 错误反馈

请求返回 HTTP 5xx 时,请提交反馈并附上 message 中的 tid
除上表中的稳定兼容错误码外,Legacy 图片接口还可能返回其他动态 code 和经过脱敏的 message,来源包括模型推理厂商和兼容链路。这些动态 code 属于开放集合,客户端不要把 表外 code 作为稳定枚举。message 中的 tid 是请求追踪 ID。
更新时间:2026-09-01