Create image
最近更新:2026年9月1日
用 gpt-image-2 出图,OpenAI 兼容端点,官方 SDK 直接可用。
openai/gpt-image-2 的文生图。走 OpenAI 兼容端点,官方 SDK 把 base_url
指过来即可。
https://gateway.amux.ai/v1/images/generations鉴权
headerAuthorizationstring必填Bearer <你的 Amux 密钥> 站内 API Key。
请求
application/jsonmodelstring必填站内模型 ID,可带 :供应商 后缀锁定供应商。
promptstring必填提示词。
ninteger默认 1出几张(1–10,默认 1)。按张计费,预扣也按张乘。 流式时必须是 1。
sizestring精确像素串或 auto(默认)。常用档位:1024x1024(1:1)、
1536x1024 / 1024x1536(3:2 横 / 竖)、2048x2048(2K 见方)、
2048x1152(16:9)、3840x2160 / 2160x3840(4K 16:9 横 / 竖)。
除此之外,任意满足下列约束的像素串都可以:两边都是 16 的倍数、
长边 ≤ 3840、宽高比 ≤ 3:1、总像素数在 655,360 – 8,294,400 之间。
3840x2160 正好压在像素上限上,所以 4K 只有 16:9 这一种比例。
⚠️ 尺寸直接决定出图 token 数,也就是价格。
auto 不受这些约束——实际出了多大,看响应里的 size。
它与 Google 系的「比例 + 分辨率档」并列,打到只认另一套的上游时
我们会换算并在 amux.notes 里说明。
aspect_ratiostring1:1 / 3:2 / 2:3 / 16:9 / 9:16。size 的另一种写法(Google 生态的说法), 两者给一个就够;同时给时以 size 为准,并在 amux.notes 里说明。 折成精确像素是有损的,折不出对应档位时会丢掉并记 note——不会替你猜一个尺寸。
image_sizestring1K / 2K / 4K。和 aspect_ratio 搭配用,规则同上。
quality"low" | "medium" | "high" | "auto"默认 "auto"渲染质量。它决定出图 token 数,因而直接影响价格—— 档位之间可以差一个数量级。
background"transparent" | "opaque" | "auto"默认 "auto"透明背景要配 png 或 webp,jpeg 没有 alpha 通道。 透明背景目前仍是预览能力。
output_format"png" | "jpeg" | "webp"默认 "png"输出格式,默认 png。
output_compressioninteger默认 100压缩级别,只对 jpeg / webp 有意义。
moderation"auto" | "low"默认 "auto"内容审核强度。只有生成端点有这个参数。
userstring端用户标识,用于滥用追踪。不需要就整个别传。
streamboolean默认 false以 SSE 流式返回。要求 n 为 1,且这个模型至少有一条支持流式的供应商。
partial_imagesinteger默认 0流式时给几张低清预览。0(默认)表示只发最后那一个完成事件。 实际可能比要的少——图出得快时上游会直接发完成事件。
响应
200response出图成功。data 与 usage 与 OpenAI 一致,amux 是我们的扩展。
400response请求不合法。也包括「要流式但没有支持流式的供应商」与「流式时 n 大于 1」 ——两者都会说清怎么改。
402response可用余额不足以覆盖这次请求的预扣上界。可用 = 余额 − 已过期批次 − 已冻结的预扣。
503response没有可用供应商。两种常见原因:这个模型还没有配图像供应商,
或者你要的尺寸档位在该供应商上没有配价——后者的细节在 metadata 里。
尺寸与成本
常用档位:
1024x1024(1:1)· 1536x1024 / 1024x1536(3:2 横 / 竖)·
2048x2048(2K 见方)· 2048x1152(16:9)·
3840x2160 / 2160x3840(4K 16:9 横 / 竖)
除此之外,任意满足下面四条的像素串都合法:两边都是 16 的倍数、 长边 ≤ 3840、宽高比 ≤ 3:1、总像素数在 655,360 – 8,294,400 之间。
3840x2160 正好压在像素上限上,所以 4K 只有 16:9 这一种比例。
auto 不受这些约束——想知道实际出了多大,读响应里的 size。
size 和 quality 会直接影响图像 token 数,也就是主要成本;在意成本时,
建议把这两个参数显式写出来。
产物会被清理
响应的 amux.images 里是可直接访问的地址,data[].b64_json 是这一次的图。
存储产物会被清理——需要长期保存请尽快下载,到期之后地址返回 404。
流式
stream: true 按 SSE 返回,partial_images(0–3)决定给几张低清预览。
最终图与 usage 在同一个完成事件里;如果出图很快,预览张数可能少于请求值。
流式时 n 必须是 1。
错误
错误体形状与 OpenAI 一致,type 取值与重试语义见错误与重试。
curl https://gateway.amux.ai/v1/images/generations \
-H "Authorization: Bearer $AMUX_API_KEY" \
-d '{
"model": "openai/gpt-image-2",
"prompt": "A red fox sitting in snow, photorealistic",
"size": "1024x1024"
}'{
"created": 1786000000,
"size": "<string>",
"quality": "<string>",
"background": "<string>",
"output_format": "<string>",
"data": [
{
"b64_json": "<string>",
"revised_prompt": "<string>"
}
],
"usage": {
"input_tokens": 0,
"output_tokens": 0,
"total_tokens": 0
},
"amux": {
"task_id": "<string>",
"generation_id": "<string>",
"provider": "<string>",
"cost_nano": "<string>",
"images": [
{
"index": 0,
"url": "<string>"
}
],
"notes": [
"<string>"
]
}
}