Skip to content

文生图V1版

POST  v1/images/generations

官方文档:https://help.aliyun.com/zh/model-studio/z-image-api-reference?spm=a2c4g.11186623.help-menu-2400256.d_2_2_3.5183699dL6MJpu&scm=20140722.H_3002354._.OR_help-T_cn~zh-V_1

请求参数

Authorization

在 Header 添加参数 Authorization,其值为在 Bearer 之后拼接 Token。

Authorization: Bearer ******************

Header 参数

参数类型必填说明示例
Content-Typestring可选请求体的数据格式类型application/json
Acceptstring可选客户端期望接收的响应数据格式application/json

Body 参数

Content-Type: application/json

参数名类型必填说明
modelstring必需模型名称。指定使用的图像生成模型 ID(例如 doubao-seedream-4-5 等)。
inputobject必需输入的内容,包含prompt提示词和messages聊天记录
parametersobject必需参数
sizestring必需图片尺寸。支持两种格式: 1. 预设代号:如 2K, 3K。 2. 具体分辨率:如 2048x2048(需符合像素总数限制)。
sequential_image_generationstring必需组图生成模式。控制是否开启多图连续生成功能: • disabled:关闭(默认,单次生成一张)。 • auto:自动判断,根据提示词决定生成一组关联图片。
streamboolean必需流式输出。是否以流式方式返回结果(通常用于实时展示生成进度)。
response_formatstring必需响应格式。指定返回数据的格式,通常为 url(图片链接)或 b64_json(Base64编码)。
watermarkboolean必需水印设置。是否在生成的图片上添加平台水印(如“AI生成”标识)。

请求示例 (JSON)

{
    "model": "wanx-v1",
    "input": {
        "prompt": "近景镜头,18岁的中国女孩,古代服饰,圆脸,正面看着镜头,民族优雅的服装,商业摄影,室外,电影级光照,半身特写,精致的淡妆,锐利的边缘。"
    },
    "parameters": {
        "style": "<auto>",
        "size": "1024*1024",
        "n": 1
    }
}

返回响应

200 成功

Content-Type: application/json

响应参数

字段名类型必填说明
createdinteger必需创建时间戳。任务创建时的 Unix 时间戳。
backgroundstring必需背景信息。可能指代生成的背景色、背景图 URL 或特定的背景处理模式。
dataarray [object]必需数据列表。包含生成的图像信息数组(通常包含 url 或 b64_json)。
├─ b64_jsonstring可选Base64 数据。如果请求指定了该格式,这里会包含图片的 Base64 编码字符串。
output_formatstring必需输出格式。返回图片的具体格式(例如 "png", "jpg", "webp")。
qualitystring必需图片质量。生成图片的质量等级(例如 "standard", "hd")。
sizestring必需图片尺寸。生成图片的分辨率(例如 "1024x1024")。
usageobject必需用量统计。本次请求的资源消耗详情。
├─ input_tokensinteger必需输入 Token 总数。请求中消耗的总输入 Token 数。
├─ input_tokens_detailsobject必需输入 Token 详情。细分的输入 Token 构成(可能包含缓存命中的 token 等)。
├─ image_tokensinteger必需图像 Token 数。专门用于处理图像生成或图像理解所消耗的 Token 数量。
├─ text_tokensinteger必需文本 Token 数。处理提示词等文本内容所消耗的 Token 数量。
├─ output_tokensinteger必需输出 Token 总数。生成的响应内容消耗的 Token 数。
└─ total_tokensinteger必需总 Token 数。此次请求的总消耗量(通常 input + output)。

响应示例

{
    "created": 1760483912,
    "background": "opaque",
    "data": [
        {
            "b64_json": "“
            }
    ],
    "output_format": "png",
    "quality": "high",
    "size": "1024x1024",
    "usage": {
        "input_tokens": 11,
        "input_tokens_details": {
            "image_tokens": 0,
            "text_tokens": 11
        },
        "output_tokens": 4160,
        "total_tokens": 4171
    }
}

示例代码

python
import http.client
import json

conn = http.client.HTTPSConnection("nxaiapp.com")
payload = json.dumps({
   "model": "wanx-v1",
   "input": {
      "prompt": "近景镜头,18岁的中国女孩,古代服饰,圆脸,正面看着镜头,民族优雅的服装,商业摄影,室外,电影级光照,半身特写,精致的淡妆,锐利的边缘。"
   },
   "parameters": {
      "style": "<auto>",
      "size": "1024*1024",
      "n": 1
   }
})
headers = {
   'Accept': 'application/json',
   'Authorization': 'Bearer <token>',
   'Content-Type': 'application/json'
}
conn.request("POST", "/v1/images/generations", payload, headers)
res = conn.getresponse()
data = res.read()
print(data.decode("utf-8"))