Amux

Create image

最近更新:2026年9月7日

用 qwen/qwen-image-3.0 直接出图,走阿里云百炼原生形状,DashScope 客户端改个 base_url 就能用。

使用 qwen/qwen-image-3.0 直接生成图像,请求体与响应均为阿里云百炼原生形状 (嵌套的 input.* / parameters.*)。现有 DashScope 客户端只需把 base_url 指向本站。

这条是同步的:请求会挂到图出来为止,实测 35–70 秒。

POSThttps://gateway.amux.ai/api/v1/services/aigc/multimodal-generation/generation

鉴权

header
Authorizationstring必填

Bearer <你的 Amux 密钥> 站内 API Key。

请求

application/json
modelstring必填

上游模型名。这条端点上写 qwen-image-3.0;站内 ID qwen/qwen-image-3.0 同样收。

inputobject必填

输入。提示词与参考图都在这里,沿用多模态对话的消息形状。

inputobject
messagesarray<object>必填

消息数组。出图只需要一条 user 消息。

messagesarray<object>
rolestring

恒为 user

contentarray<object>

内容项。参考图在前、提示词在后,照官方示例的顺序。

- {"image": "..."} —— 参考图,1–3 张。收公开 https 地址,也收

data:image/png;base64,... 形式的内联图。官方限制:JPG / JPEG / PNG / BMP /

TIFF / WEBP / GIF,单张 ≤10MB,边长建议 384–2048 像素;

- {"text": "..."} —— 提示词。给了多条会按换行拼起来,不会丢。

图生图就是在提示词那项前面再放一项:

```json

"content": [

{ "image": "https://example.com/ref.png" },

{ "text": "把这只狗换成一只橘猫" }

]

```

⚠️ 一项里不要同时imagetext——照官方示例分成两项写。

contentarray<object>
textstring

提示词。官方建议不超过 4,500 token

parametersobject

生成参数,均为可选。未提供的字段沿用上游自己的默认值,本站不代为设置。

parametersobject
sizestring

输出尺寸,写成 宽*高宽x高 同样收,我们会归一成上游的写法)。

两条硬约束,超出当场 400,不会被静默改成一个我们猜的尺寸:

- 面积 宽 × 高 落在 262,144(512*512)到 6,553,600(2560*2560) 之间;

- 宽高比在 1:8 到 8:1 之间。

站内在操练场里按常用比例 × 两档分辨率给了预设——但不限于这几个

任何满足上面两条约束的尺寸都收:

比例1K2K
1:11024*10242048*2048
16:91280*7202560*1440
9:16720*12801440*2560
4:31152*8642304*1728
3:4864*11521728*2304
3:21248*8322496*1664
2:3832*12481664*2496

这里的 1K / 2K 只是面积档的叫法,不是一个可传的参数——上游没有

image_size,档位由它按输出面积自己算。

⚠️ 判据是面积,不是最长边:2048*512 面积只有 1,048,576,上游按 1K 算。

ninteger默认 1

出几张(1–6)。按张计费,预扣也按张乘。

seedinteger

随机种子,用于复现结果。未提供时随机生成。

negative_promptstring

不想要什么。自由文本。

prompt_extendboolean默认 true

是否让模型在生成前先把提示词改写扩写一遍。

prompt_extend_mode"direct" | "agent"默认 "direct"

改写用哪种方式,只在 prompt_extend 开着时有意义。

- direct —— 直接扩写,文生图与图生图都可用;

- agent —— 智能扩写,只支持文生图。带了参考图时这一项当场报错,

而不是被静默换成 direct——那样你以为开的是 agent,出来的却不是。

enable_thinkingboolean默认 true

出图之前先想一轮。关掉更快,开着构图通常更稳。

watermarkboolean默认 false

是否在输出图右下角打上「AI 生成」水印。

响应

200response

出图成功。

400response

参数不合法。取值超出这个模型的范围时,报错里会写明可接受的取值。

402response

可用余额不足以覆盖这次的预扣。

503response

当前没有可用的供应商能服务这个模型。

生成与图生图是同一条调用

content 里不带 image 就是生成,带了就是图生图,参数是同一套, 所以只有这一页。参考图最多 3 张,收公开 https 地址,也收 data:image/png;base64,... 形式的内联图。

参考图按张计费。

这个模型的三条调用方式

地址交付什么时候用
官方同步POST …/multimodal-generation/generation挂着等,35–70 秒已有 DashScope 代码,且能接受长连接
官方异步POST …/image-generation/generationtask_id已有 DashScope 代码,不想守着连接
Amux TasksPOST /v1/tasksid + 可选回调新接入建议这条,与厂商无关

三条走的是同一套路由、定价、预扣与任务记录,差别只在请求体形状与交付方式。

⚠️ 同步这条的取舍

同步链路上任何一环超时(反向代理、网关、客户端默认值)都会让你拿不到图, 而钱已经花了——上游那一侧已经跑完并收了我们的钱。35–70 秒在多数 默认超时之内,但不在所有的之内。

计费

计价,不按 token——这个模型的三个 token 字段恒为 0。计费项是 输入图(参考图)输出图两项,提示词不计价。

⚠️ 单价不写在这里。 价格会调整,而这份文档是跟着代码走的:改一次价要记得 回来改四份 spec 加二十页,漏一处就是文档上标着一个已经不收的价——那比不写更坏。 当前单价见模型详情页与定价页,它们直接读价格表。

提交时按上界预扣,完成后按实际用量结算并退还差额;可用余额不足以覆盖预扣时 返回 402。失败与过期不计费,预扣已释放。

输出不分档

qwen/qwen-image-3.0 的输出图不按分辨率分价。上游内部仍分 1K / 2K,但在这个模型上两档 同价,因此 size 只影响画面,不影响这一项的费用。

错误

错误体形状与阿里云百炼一致,type 取值与重试语义见错误与重试

cURL
curl https://gateway.amux.ai/api/v1/services/aigc/multimodal-generation/generation \
  -H "Authorization: Bearer $AMUX_API_KEY" \
  -d '{
    "model": "qwen-image-3.0",
    "input": {
      "messages": [
        {
          "role": "user",
          "content": [
            {
              "text": "一只戴着墨镜的柴犬坐在冲浪板上,阳光明媚的海滩"
            }
          ]
        }
      ]
    },
    "parameters": {
      "size": "1024*1024"
    }
  }'
{
  "output": {
    "choices": [
      {
        "finish_reason": "stop",
        "message": {
          "role": "assistant",
          "content": [
            {
              "type": "image",
              "image": "https://cdn.amux.ai/gen/20260907/task_01M1CG35C16CJ790D00BV1RBVM-0.png"
            }
          ]
        }
      }
    ]
  },
  "request_id": "gen_01M1CG35C16CJ790D00BV1RBVM"
}