> ## Documentation Index
> Fetch the complete documentation index at: https://powower.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# Seedance 2.5 多模态参考生视频

> 适用于 `dreamina-seedance-2-5-260628` 模型。提交任务后，请通过 `GET /v1/videos/{task_id}` 查询状态。



## OpenAPI

````yaml api-reference/zh-Hans/zmodelVideo/byteplus/dreamina-seedance-2-5-multimodal-reference-to-video.json POST /v1/videos
openapi: 3.0.1
info:
  title: Seedance 2.5 多模态参考生视频
  version: 1.0.0
  description: >-
    Dreamina Seedance 2.5
    多模态参考生视频能力。通过提供图片、视频或音频作为参考来生成视频。支持仅传入音频。支持生成全新视频、编辑视频、延长视频，支持 30 秒视频连贯直出。
  license:
    name: Project License
    url: https://github.com/QuantumNous/new-api/blob/main/LICENSE
servers:
  - url: https://baze-api.powerbuyin.top
    description: Baze API 服务地址
security: []
tags:
  - name: Seedance Video
    description: Seedance 系列视频生成能力
paths:
  /v1/videos:
    post:
      tags:
        - Seedance Video
      summary: Seedance 2.5 多模态参考生视频
      description: >-
        适用于 `dreamina-seedance-2-5-260628` 模型。提交任务后，请通过 `GET
        /v1/videos/{task_id}` 查询状态。
      operationId: seedance25MultimodalReferenceToVideoZh
      requestBody:
        required: true
        content:
          application/json:
            schema:
              $ref: '#/components/schemas/MultimodalReferenceRequest'
            examples:
              multimodal_reference:
                summary: 多模态参考生视频
                value:
                  model: dreamina-seedance-2-5-260628
                  media:
                    - type: text
                      text: >-
                        全程使用视频1的第一视角构图，全程使用音频1作为背景音乐。第一人称视角果茶宣传广告，seedance牌「苹苹安安」苹果果茶限定款；首帧为图片1，你的手摘下一颗带晨露的阿克苏红苹果，轻脆的苹果碰撞声；2-4
                        秒：快速切镜，你的手将苹果块投入雪克杯，加入冰块与茶底，用力摇晃，冰块碰撞声与摇晃声卡点轻快鼓点，背景音：「鲜切现摇」；4-6
                        秒：第一人称成品特写，分层果茶倒入透明杯，你的手轻挤奶盖在顶部铺展，在杯身贴上粉红包标，镜头拉近看奶盖与果茶的分层纹理；6-8
                        秒：第一人称手持举杯，你将图片2中的果茶举到镜头前（模拟递到观众面前的视角），杯身标签清晰可见，背景音「来一口鲜爽」，尾帧定格为图片2。背景声音统一为女生音色。
                    - type: reference_image
                      url: https://example.com/ref-pic1.jpg
                    - type: reference_image
                      url: https://example.com/ref-pic2.jpg
                    - type: reference_video
                      url: https://example.com/ref-video.mp4
                    - type: reference_audio
                      url: https://example.com/ref-audio.mp3
                  seconds: '11'
                  size: 720p
                  ratio: '16:9'
                  generate_audio: true
                  watermark: false
      responses:
        '200':
          description: 提交成功，返回视频任务对象。
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/VideoTaskResponse'
        '400':
          description: 请求参数不合法。
        '401':
          description: 鉴权失败。
        '429':
          description: 请求频率超限。
        '500':
          description: 服务端内部错误。
      security:
        - BearerAuth: []
components:
  schemas:
    MultimodalReferenceRequest:
      type: object
      required:
        - model
        - media
      properties:
        model:
          type: string
          enum:
            - dreamina-seedance-2-5-260628
          description: 您需要调用的模型的 ID （Model ID）
        media:
          type: array
          minItems: 1
          description: >-
            多模态输入数组。Seedance 2.5 支持
            `text`、`first_frame`、`last_frame`、`reference_image`、`reference_video`、`reference_audio`。支持仅传入音频。
          items:
            $ref: '#/components/schemas/VideoMediaInput'
        seconds:
          type: string
          description: >-
            生成视频时长，仅支持整数，单位：秒。


            * Seedance 2.5 系列: [4, 30] s 或设置为 -1


            **注意**


            Seedance 2.5 系列支持两种配置方法

            * 指定具体时长：支持有效范围内的任一整数。

            * 智能指定：设置为 -1，表示由模型在有效范围内自主选择合适的视频长度（整数秒）。实际生成视频的时长可通过查询视频生成任务 API
            返回的 duration 字段获取。注意视频时长与计费相关，请谨慎设置。
          default: '5'
          example: '5'
          enum:
            - '4'
            - '5'
            - '6'
            - '7'
            - '8'
            - '9'
            - '10'
            - '11'
            - '12'
            - '13'
            - '14'
            - '15'
            - '16'
            - '17'
            - '18'
            - '19'
            - '20'
            - '21'
            - '22'
            - '23'
            - '24'
            - '25'
            - '26'
            - '27'
            - '28'
            - '29'
            - '30'
            - '-1'
        size:
          type: string
          enum:
            - 480p
            - 720p
            - 1080p
          description: |-
            视频分辨率，枚举值：

            * 480p
            * 720p
            * 1080p

            默认值：`720p`
          default: 720p
        ratio:
          type: string
          enum:
            - '16:9'
            - '4:3'
            - '1:1'
            - '3:4'
            - '9:16'
            - '21:9'
            - adaptive
          description: >-
            > Seedance 2.5 系列默认值为 `adaptive`


            生成视频的宽高比例。不同宽高比对应的宽高像素值见下方表格。


            * adaptive：根据输入自动选择最合适的宽高比（详见下文说明）


            **adaptive 适配规则**


            当配置 ratio 为 adaptive 时，模型会根据生成场景自动适配宽高比；实际生成的视频宽高比可通过查询视频生成任务 API
            返回的 ratio 字段获取。


            **支持模型：**

            * Seedance 2.5 系列支持


            **取值规则：**

            * 文生视频：根据输入的提示词，智能选择最合适的宽高比。

            * 首帧 / 首尾帧生视频：根据上传的首帧图片比例，自动选择最接近的宽高比。

            *
            多模态参考生视频：根据用户提示词意图判断，如果是首帧生视频/编辑视频/延长视频，以该图片/视频为准选择最接近的宽高比；否则，以传入的第一个媒体文件为准（优先级：视频＞图片）选择最接近的宽高比。


            不同宽高比对应的宽高像素值


            注意：图生视频，选择的宽高比与您上传的图片宽高比不一致时，方舟会对您的图片进行裁剪，裁剪时会居中裁剪。


            | 分辨率 | 宽高比 | 宽高像素值 Seedance 2.5 系列 |

            |---|---|---|

            | 480p | 16:9 | 864×496 |

            | | 4:3 | 752×560 |

            | | 1:1 | 640×640 |

            | | 3:4 | 560×752 |

            | | 9:16 | 496×864 |

            | | 21:9 | 992×432 |

            | 720p | 16:9 | 1280×720 |

            | | 4:3 | 1112×834 |

            | | 1:1 | 960×960 |

            | | 3:4 | 834×1112 |

            | | 9:16 | 720×1280 |

            | | 21:9 | 1470×630 |

            | 1080p | 16:9 | 1920×1080 |

            | | 4:3 | 1664×1248 |

            | | 1:1 | 1440×1440 |

            | | 3:4 | 1248×1664 |

            | | 9:16 | 1080×1920 |

            | | 21:9 | 2206×946 |
          default: adaptive
        output_format:
          type: string
          description: >-
            输出视频的格式。


            * mp4：通用格式，兼容性最好，采用标准色彩精度，可在网页、移动端、各类播放器及分发平台直接播放。

            *
            mov：面向专业场景的高色彩精度格式，更好地保持画面色彩与亮度一致性、适用于调色、抠像、合成等对色彩还原要求高的专业后期加工。推荐在视频编辑、视频延长场景使用
            mov 格式作为输入和输出。


            **mov 格式播放兼容性**


            mov 格式采用专业编码（H.264 视频编码 + yuv444p 色度采样 + PCM
            音频编码），部分播放器可能不兼容。以下为常见的支持播放 mov 格式的播放器：


            | 播放器 | macOS | Windows |

            |---|---|---|

            | IINA | ✓ | ✕ |

            | VLC | ✓ | ✓ |

            | mpv | ✓ | ✓ |

            | ffplay | ✓ | ✓ |


            **模型支持：** Seedance 2.5
          enum:
            - mp4
            - mov
          default: mp4
        watermark:
          type: boolean
          description: |-
            生成视频是否包含水印。

            * false：生成视频不含水印。
            * true：生成视频右下角会展示 AI 生成 水印。
          default: false
        generate_audio:
          type: boolean
          description: >-
            > 仅 Seedance 2.5 系列支持


            控制生成的视频是否包含与画面同步的声音。


            *
            true：模型输出的视频包含同步音频。模型会基于文本提示词与视觉内容，自动生成与之匹配的人声、音效及背景音乐。建议将对话部分置于双引号内，以优化音频生成效果。例如：男人叫住女人说："你记住，以后不可以用手指指月亮。"

            * false：模型输出的视频为无声视频。


            注意：生成的有声视频均为单声道，和传入的音频声道数无关。
          default: true
        return_last_frame:
          type: boolean
          description: >-
            true：返回生成视频的尾帧图像。设置为 true 后，可通过查询视频生成任务接口获取视频的尾帧图像。尾帧图像的格式为
            png，宽高像素值与生成的视频保持一致，无水印。


            使用该参数可实现生成多个连续视频：以上一个生成视频的尾帧作为下一个视频任务的首帧，快速生成多个连续视频。


            false：不返回生成视频的尾帧图像。
          default: false
        safety_identifier:
          type: string
          description: >-
            终端用户的唯一标识符，用于协助平台检测您的应用中可能违反火山方舟使用政策的用户。该标识符为英文字符串，需保证对单个用户固定且唯一，长度不超过
            64 个字符。推荐传入对用户名、用户 ID 或邮箱进行哈希处理后生成的字符串，避免泄露用户隐私信息。
        omni_reference_task_type:
          type: string
          enum:
            - auto
            - reference
            - edit
            - extend
          default: auto
          description: >-
            > 仅 Seedance 2.5 系列支持


            **任务类型引导**


            Seedance 2.5 **全模态参考生视频任务** 包括参考生视频、视频编辑和视频延长 3
            类子任务。不同任务类型对参数有特殊限制，为减少任务创建后异步报错的情况，可通过本参数指定子任务类型，以提前校验对应限制。


            * 默认情况下，即
            `omni_reference_task_type=auto`：模型根据输入素材和提示词自动判定任务类型，再校验参数取值。如果参数与实际任务类型不兼容，任务将触发异步报错（错误码：`InvalidParameter.TaskTypeMismatch`）。


            * 显式指定任务类型，即 `omni_reference_task_type` 为 `reference`、`edit` 或
            `extend`：接口在提交任务时提前校验对应任务的特殊参数限制。不符合要求时，接口立即报错，任务不会创建。


            **注意**


            实际处理任务时，模型仍会进一步结合提示词判断任务类型。若实际判定的任务类型和指定的不一致，仍会触发异步报错（错误码：`InvalidParameter.TaskTypeMismatch`）。建议遵循各任务类型的提示词写法，降低报错概率。


            **可选值：**


            * `auto`：由模型根据输入素材和提示词自动判定任务类型。

            * `reference`：参考生视频任务，即基于参考图片、参考视频或参考音频生成新视频。设置 `reference`
            时，`ratio` 或 `duration` 无特殊限制。

            * `edit`：视频编辑任务，即对原视频的画面或音频进行编辑操作。设置 `edit` 时，`content` 中必须至少包含一个
            `reference_video`，且视频时长必须为 4–30 秒；`ratio` 必须为 `adaptive`；`duration`
            必须为 `-1`。

            * `extend`：视频延长任务，即对原视频向前或向后延长。设置 `extend` 时，`content` 中必须至少包含一个
            `reference_video`；`ratio` 必须为 `adaptive`。


            **模型支持**：


            * `Seedance 2.5`
    VideoTaskResponse:
      type: object
      properties:
        id:
          type: string
          description: >-
            视频生成任务 ID 。仅保存 7 天（从 created at 时间戳开始计算），超时后将自动清除。


            * 设置 "draft": true，为 Draft 视频任务 ID。

            * 设置 "draft": false，为正常视频任务 ID。


            创建视频生成任务为异步接口，获取 ID 后，需要通过查询视频生成任务 API 来查询视频生成任务的状态。任务成功后，会输出生成视频的
            video_url。
    VideoMediaInput:
      type: object
      required:
        - type
      properties:
        type:
          type: string
          enum:
            - text
            - reference_image
            - reference_video
            - reference_audio
          description: 媒体类型。`text` 需要 `text` 字段；其他类型需要 `url` 字段。
        url:
          type: string
          description: 媒体地址。`type=text` 时不需要；其他类型必填。
        text:
          type: string
          description: 文本内容。`type=text` 时必填；其他类型不需要。
  securitySchemes:
    BearerAuth:
      type: http
      scheme: bearer
      bearerFormat: JWT
      description: '在请求头中传入 `Authorization: Bearer <token>`。'

````