Skip to main content
POST

授权

Authorization
string
header
必填

在请求头中传入 Authorization: Bearer <token>

请求体

application/json
model
enum<string>
必填

图像生成模型名称。支持的模型包括 dola-seedream-5-0-pro-260628(Seedream 5.0 pro,支持交互编辑与分层解析,不支持组图生成)。

可用选项:
dola-seedream-5-0-pro-260628
prompt
string
必填

用于生成图像的提示词或分层意图描述,支持中英文。建议不超过 300 个汉字或 600 个英文单词。字数过多信息容易分散,模型可能因此忽略细节,只关注重点,造成图片缺失部分元素。

  • 图像生成场景(必填):描述希望生成的内容。
  • 分层解析场景(可选):指定希望分层的意图。若不传,模型将自动识别图中主要元素并拆分为独立图层。
示例:

"充满活力的特写编辑肖像,模特眼神犀利,头戴雕塑感帽子,色彩拼接丰富。"

image
必填

输入的图片信息,支持 URL 或 Base64 编码。

  • 图片 URL:请确保图片 URL 可被访问。
  • Base64 编码:请遵循此格式 data:image/<图片格式>;base64,<Base64编码>。注意 <图片格式> 需小写,如 data:image/png;base64,<base64_image>

图像生成场景(可选)

  • Seedream 5.0 pro 最多支持传入 10 张参考图。
  • 传入单张图片要求:
    • 图片格式:jpeg、png、webp、bmp、tiff、gif、heic、heif
    • 宽高比(宽/高)范围:[1/16, 16]
    • 宽高长度(px) > 14
    • 大小:不超过 30MB
    • 总像素:不超过 6000×6000 = 36000000 px(对单张图宽度和高度的像素乘积限制,而不是对宽度或高度的单独值进行限制)

分层解析场景(必填)

  • 当开启分层解析模式(layer_decompositiontrue)时,image 为必填项,且仅支持传入 1 张待分层图片。传入多张图片会报错。
  • 传入单张图片要求:
    • 图片格式:png 或 jpeg
    • 宽高比:[1/16, 16]
    • 大小:不超过 30MB
    • 总像素(宽 × 高):[512×512 (262,144), 6000×6000 (36,000,000)]
size
string
默认值:auto

指定生成图像的尺寸信息。不同场景下的配置方式和支持取值如下:

图像生成场景 支持以下两种方式,不可混用:

  • 方式 1(推荐):指定分辨率档位,并在 prompt 中用自然语言描述图片宽高比、图片形状或图片用途,最终由模型判断生成图片的大小。

    • 默认值:auto
    • 可选值:1K1.5K2K
    • 计费说明1.5K 价格与 1K 相同,且能提供更高的出图质量。
  • 方式 2:指定宽高像素值(宽x高)。

    • 总像素取值范围:[1280x720(921600), 2048x2048×1.1025(4624220)]
    • 宽高比取值范围:[1/16, 16]
    • 说明:采用方式 2 时,需同时满足总像素取值范围和宽高比取值范围。其中,总像素是对单张图宽度和高度的像素乘积限制,而不是对宽度或高度的单独值进行限制。
      • 有效示例:2048x1024(总像素值 2048x1024=2097152,符合 [921600, 4624220];宽高比 2048/1024=2,符合 [1/16, 16],故有效)
      • 无效示例:512x512(总像素值 512x512=262144,未达 921600 最低要求,故无效)

方式 1 实际映射的宽高像素参考值

分层解析场景 仅支持指定分辨率档位:

  • 底图:输出底图分辨率与 size 指定档位一致,保持原图宽高比。
  • 图层:每个图层分辨率贴近 size 指定档位,保持对应区域宽高比。
  • 默认值:auto
  • 可选值:1K1.5K2Kauto
  • auto 自适应规则
    • 原图尺寸在 [1280x720 (921600), 2048x2048x1.1025 (4624220)] 之间时,按原尺寸输出。
    • 小于 1K 则按 1K 输出。
    • 大于 2K 则按 2K 输出。
示例:

"auto"

background
enum<string>
默认值:opaque

控制是否生成带透明通道(Alpha 通道)的图片。可选值:

  • opaque:不透明背景模式(默认)。生成的图片为常规不透明背景。
  • transparent:透明背景模式。生成的图片为透明背景。

使用限制

  • 仅在单图生图且输入图片自带透明通道时支持该参数。
  • 在透明背景模式下,输出格式默认为 png;若将 output_format 设为 jpeg,请求将报错。
  • 若输入图片格式不支持透明通道(如 jpeg),请求将报错。

支持模型dola-seedream-5-0-pro-260628(Seedream 5.0 pro)。

可用选项:
opaque,
transparent
layer_decomposition
boolean
默认值:false

控制是否开启图层分解。将单张图片中的主体、背景、文字等内容自动分解为 1 张底图与最多 16 个可独立编辑的图层(每个图层均为带透明通道的 PNG 图片)。

  • true:开启分层解析模式。模型将输入图片分解为底图与多个图层。
  • false:图像生成模式(默认)。不进行分层解析。

使用注意事项

  • 开启分层解析时,image 为必填项且仅支持传入单张图片。传入多张图片会报错。
  • 若任意图层生成失败,整次请求将失败,不支持部分成功。
  • 若提示词要求图层数超过上限(16层),可能会丢失部分图层信息。
  • data 响应对象中将返回每个图层的层级顺序(z_index)、边界框坐标(bounding_box)、图层名称(name)及描述(description)。

支持模型dola-seedream-5-0-pro-260628(Seedream 5.0 pro)。

response_format
enum<string>
默认值:url

指定生成图像的返回格式。支持以下两种返回方式:

  • url:返回图片下载链接;链接在图片生成后 24 小时内有效,请及时下载图片。
  • b64_json:以 Base64 编码字符串的 JSON 格式返回图像数据。
可用选项:
url,
b64_json
watermark
boolean
默认值:true

是否在生成的图片中添加水印。

  • false:不添加水印。
  • true:在图片右下角添加「AI生成」字样的水印标识。

响应

调用成功,返回图像生成结果。

model
string

本次请求使用的模型 ID(模型名称-版本)。

created
integer<int64>

创建时间的 Unix 时间戳(秒)。

data
object[]

生成的图像列表。在分层解析场景下包含底图与各图层。

usage
object

本次请求的用量信息。