Create image
最近更新:2026年9月1日
用 gpt-image-1.5 出图,OpenAI 兼容端点,官方 SDK 直接可用。
openai/gpt-image-1.5 的文生图。走 OpenAI 兼容端点,官方 SDK 把 base_url
指过来即可。
https://gateway.amux.ai/v1/images/generations鉴权
headerAuthorizationstring必填Bearer <你的 Amux 密钥> 站内 API Key。
请求
application/jsonmodelstring必填站内模型 ID,可带 :供应商 后缀锁定供应商。
promptstring必填提示词。
ninteger默认 1出几张(1–10,默认 1)。按张计费,预扣也按张乘。 流式时必须是 1。
size"1024x1024" | "1536x1024" | "1024x1536" | "auto"仅这几档,或 auto(默认):
1024x1024(1:1)· 1536x1024(3:2 横)· 1024x1536(3:2 竖)
⚠️ 只收上面这几档。 发别的像素串会被上游拒。
也可以用「比例 + 分辨率档」那套写法(aspect_ratio /
image_size),我们折算成上面三档之一;要 2K/4K 时降到最近的
合法档,并在 amux.notes 里说明。
aspect_ratiostring1:1 / 3:2 / 2:3。size 的另一种写法(Google 生态的说法), 两者给一个就够;同时给时以 size 为准,并在 amux.notes 里说明。 折成精确像素是有损的,折不出对应档位时会丢掉并记 note——不会替你猜一个尺寸。
image_sizestring1K。和 aspect_ratio 搭配用,规则同上。
quality"low" | "medium" | "high" | "auto"默认 "auto"渲染质量。它决定出图 token 数,因而直接影响价格—— 档位之间可以差一个数量级。
background"transparent" | "opaque" | "auto"默认 "auto"透明背景要配 png 或 webp,jpeg 没有 alpha 通道。
output_format"png" | "jpeg" | "webp"默认 "png"输出格式,默认 png。
output_compressioninteger默认 100压缩级别,只对 jpeg / webp 有意义。
moderation"auto" | "low"默认 "auto"内容审核强度。只有生成端点有这个参数。
userstring端用户标识,用于滥用追踪。不需要就整个别传。
streamboolean默认 false以 SSE 流式返回。要求 n 为 1,且这个模型至少有一条支持流式的供应商。
partial_imagesinteger默认 0流式时给几张低清预览。0(默认)表示只发最后那一个完成事件。 实际可能比要的少——图出得快时上游会直接发完成事件。
响应
200response出图成功。data 与 usage 与 OpenAI 一致,amux 是我们的扩展。
400response请求不合法。也包括「要流式但没有支持流式的供应商」与「流式时 n 大于 1」 ——两者都会说清怎么改。
402response可用余额不足以覆盖这次请求的预扣上界。可用 = 余额 − 已过期批次 − 已冻结的预扣。
503response没有可用供应商。两种常见原因:这个模型还没有配图像供应商,
或者你要的尺寸档位在该供应商上没有配价——后者的细节在 metadata 里。
尺寸只有三档
1024x1024(1:1)· 1536x1024(3:2 横)· 1024x1536(3:2 竖),外加 auto。
⚠️ 它不收任意像素串——那是 gpt-image-2 才有的能力。发 2048x2048
或 3840x2160 会被上游拒。
用「比例 + 分辨率档」那套写法(aspect_ratio / image_size)也可以,我们会
折算成上面三档之一;要 2K/4K 时会降到最近的合法档,并在 amux.notes 里说明。
成本
size 和 quality 决定图像 token 数,是主要成本。
⚠️ 这个模型还会产生文本输出 token——那是它内部的推理过程,不出现在响应里,
但会计费(按输出文本价)。gpt-image-2 没有这一块。
产物会被清理
响应的 amux.images 里是可直接访问的地址,data[].b64_json 是这一次的图。
存储产物会被清理——需要长期保存请尽快下载,到期之后地址返回 404。
流式
stream: true 按 SSE 返回,partial_images(0–3)决定给几张低清预览;
每张预览额外计 100 个图像输出 token。出图很快时预览张数可能少于请求值。
流式时 n 必须是 1。
错误
错误体形状与 OpenAI 一致,type 取值与重试语义见错误与重试。
curl https://gateway.amux.ai/v1/images/generations \
-H "Authorization: Bearer $AMUX_API_KEY" \
-d '{
"model": "openai/gpt-image-1.5",
"prompt": "A red fox sitting in snow, photorealistic",
"size": "1024x1024"
}'{
"created": 1786000000,
"size": "<string>",
"quality": "<string>",
"background": "<string>",
"output_format": "<string>",
"data": [
{
"b64_json": "<string>",
"revised_prompt": "<string>"
}
],
"usage": {
"input_tokens": 0,
"output_tokens": 0,
"total_tokens": 0
},
"amux": {
"task_id": "<string>",
"generation_id": "<string>",
"provider": "<string>",
"cost_nano": "<string>",
"images": [
{
"index": 0,
"url": "<string>"
}
],
"notes": [
"<string>"
]
}
}