Seedream 5.0 Pro 图生图
支持模型包括 dola-seedream-5-0-pro-260628。本文档覆盖图生图、多图参考生成与分层解析场景。公开字段包括 model、prompt、image、size、background、layer_decomposition、response_format、watermark。
模型能力
- 生成单图(不支持配置 sequential_image_generation)
- 分层解析:支持将单张图片分解为 1 张底图与多个输出图层(最多 16 层)。
- 交互编辑:支持通过坐标、选框、箭头等多种方式精准指定编辑位置。
- 多图生图:输入多张参考图片(2-10)+ 文本提示词,生成单张图片。
- 单图生图:输入单张参考图片 + 文本提示词,生成单张图片。
- 暂不支持组图生成、联网搜索、流式输出。
授权
在请求头中传入 Authorization: Bearer <token>。
请求体
图像生成模型名称。支持的模型包括 dola-seedream-5-0-pro-260628(Seedream 5.0 pro,支持交互编辑与分层解析,不支持组图生成)。
dola-seedream-5-0-pro-260628 用于生成图像的提示词或分层意图描述,支持中英文。建议不超过 300 个汉字或 600 个英文单词。字数过多信息容易分散,模型可能因此忽略细节,只关注重点,造成图片缺失部分元素。
- 图像生成场景(必填):描述希望生成的内容。
- 分层解析场景(可选):指定希望分层的意图。若不传,模型将自动识别图中主要元素并拆分为独立图层。
"充满活力的特写编辑肖像,模特眼神犀利,头戴雕塑感帽子,色彩拼接丰富。"
输入的图片信息,支持 URL 或 Base64 编码。
- 图片 URL:请确保图片 URL 可被访问。
- Base64 编码:请遵循此格式
data:image/<图片格式>;base64,<Base64编码>。注意<图片格式>需小写,如data:image/png;base64,<base64_image>。
图像生成场景(可选):
- Seedream 5.0 pro 最多支持传入 10 张参考图。
- 传入单张图片要求:
- 图片格式:jpeg、png、webp、bmp、tiff、gif、heic、heif
- 宽高比(宽/高)范围:[1/16, 16]
- 宽高长度(px) > 14
- 大小:不超过 30MB
- 总像素:不超过 6000×6000 = 36000000 px(对单张图宽度和高度的像素乘积限制,而不是对宽度或高度的单独值进行限制)
分层解析场景(必填):
- 当开启分层解析模式(
layer_decomposition为true)时,image为必填项,且仅支持传入 1 张待分层图片。传入多张图片会报错。 - 传入单张图片要求:
- 图片格式:png 或 jpeg
- 宽高比:[1/16, 16]
- 大小:不超过 30MB
- 总像素(宽 × 高):[
512×512(262,144),6000×6000(36,000,000)]
指定生成图像的尺寸信息。不同场景下的配置方式和支持取值如下:
图像生成场景 支持以下两种方式,不可混用:
-
方式 1(推荐):指定分辨率档位,并在 prompt 中用自然语言描述图片宽高比、图片形状或图片用途,最终由模型判断生成图片的大小。
- 默认值:
auto - 可选值:
1K、1.5K、2K - 计费说明:
1.5K价格与1K相同,且能提供更高的出图质量。
- 默认值:
-
方式 2:指定宽高像素值(宽x高)。
- 总像素取值范围:[
1280x720(921600),2048x2048×1.1025(4624220)] - 宽高比取值范围:[1/16, 16]
- 说明:采用方式 2 时,需同时满足总像素取值范围和宽高比取值范围。其中,总像素是对单张图宽度和高度的像素乘积限制,而不是对宽度或高度的单独值进行限制。
- 有效示例:
2048x1024(总像素值 2048x1024=2097152,符合 [921600, 4624220];宽高比 2048/1024=2,符合 [1/16, 16],故有效) - 无效示例:
512x512(总像素值 512x512=262144,未达 921600 最低要求,故无效)
- 有效示例:
- 总像素取值范围:[
方式 1 实际映射的宽高像素参考值:
分层解析场景 仅支持指定分辨率档位:
- 底图:输出底图分辨率与
size指定档位一致,保持原图宽高比。 - 图层:每个图层分辨率贴近
size指定档位,保持对应区域宽高比。 - 默认值:
auto - 可选值:
1K、1.5K、2K、auto auto自适应规则:- 原图尺寸在 [
1280x720(921600),2048x2048x1.1025(4624220)] 之间时,按原尺寸输出。 - 小于 1K 则按 1K 输出。
- 大于 2K 则按 2K 输出。
- 原图尺寸在 [
"auto"
控制是否生成带透明通道(Alpha 通道)的图片。可选值:
opaque:不透明背景模式(默认)。生成的图片为常规不透明背景。transparent:透明背景模式。生成的图片为透明背景。
使用限制:
- 仅在单图生图且输入图片自带透明通道时支持该参数。
- 在透明背景模式下,输出格式默认为
png;若将output_format设为jpeg,请求将报错。 - 若输入图片格式不支持透明通道(如
jpeg),请求将报错。
支持模型:dola-seedream-5-0-pro-260628(Seedream 5.0 pro)。
opaque, transparent 控制是否开启图层分解。将单张图片中的主体、背景、文字等内容自动分解为 1 张底图与最多 16 个可独立编辑的图层(每个图层均为带透明通道的 PNG 图片)。
true:开启分层解析模式。模型将输入图片分解为底图与多个图层。false:图像生成模式(默认)。不进行分层解析。
使用注意事项:
- 开启分层解析时,
image为必填项且仅支持传入单张图片。传入多张图片会报错。 - 若任意图层生成失败,整次请求将失败,不支持部分成功。
- 若提示词要求图层数超过上限(16层),可能会丢失部分图层信息。
data响应对象中将返回每个图层的层级顺序(z_index)、边界框坐标(bounding_box)、图层名称(name)及描述(description)。
支持模型:dola-seedream-5-0-pro-260628(Seedream 5.0 pro)。
指定生成图像的返回格式。支持以下两种返回方式:
url:返回图片下载链接;链接在图片生成后 24 小时内有效,请及时下载图片。b64_json:以 Base64 编码字符串的 JSON 格式返回图像数据。
url, b64_json 是否在生成的图片中添加水印。
false:不添加水印。true:在图片右下角添加「AI生成」字样的水印标识。