典名词元典名词元首页
API 文档三方工具教程
AI 模型接口视频豆包

seedance 2.0系列

POST/api/v1/video/generation

Header Parameters

Authorization?string

格式: Authorization: Bearer sk-xxxxxx

Request Body

application/json

model*string

模型名称,固定值

doubao-seedance-2-0-260128 haiwai/doubao-seedance-2-0-260128 volc01/doubao-seedance-2-0-260128 volc03/doubao-seedance-2-0-260128

doubao-seedance-2-0-fast-260128 haiwai/doubao-seedance-2-0-fast-260128 volc01/doubao-seedance-2-0-fast-260128 volc03/doubao-seedance-2-0-fast-260128

doubao-seedance-2-0-mini-260615 volc01/doubao-seedance-2-0-mini-260615 volc03/doubao-seedance-2-0-mini-260615

参考相同模型不同渠道的区别:https://api-doc.aa.com.cn/zh/docs/docs/%E8%A7%86%E9%A2%91/%E8%B0%83%E7%94%A8%20Seedance%202.0%20%E6%A8%A1%E5%9E%8B%E5%BF%85%E8%AF%BB

content*array<object>

输入给模型,生成视频的信息,支持文本、图片、音频、视频。支持以下几种组合:

纯文本

文本(可选)+ 图片(1-9 张)

文本(可选)+ 视频(0-3 个)

文本(可选)+ 音频(0-3 个)——不可单独传入音频,需至少包含 1 个参考视频或图片

文本(可选)+ 图片 + 音频

文本(可选)+ 图片 + 视频

文本(可选)+ 视频 + 音频

文本(可选)+ 图片 + 视频 + 音频

[]?object
type*string

输入内容的类型

Value in"text" | "image_url" | "video_url" | "audio_url"
text?string

输入给模型的文本提示词,描述期望生成的视频。

提示词语言支持:中文、英文、日语、印度尼西亚语、西班牙语、葡萄牙语。

提示词字数建议:中文提示词不超过500字,英文提示词不超过1000词。字数过多易导致信息分散,模型可能忽略细节、仅关注重点,进而造成视频缺失部分元素。

role?string

图片/视频/音频的位置或用途。

图片场景:

首帧:first_frame(或不填),需要传入1个image_url对象

首尾帧:first_frame和last_frame,需要传入2个image_url对象

传入的首尾帧图片可相同。首尾帧图片的宽高比不一致时,以首帧图片为主,尾帧图片会自动裁剪适配。

参考图:reference_image,可传入1~9 个image_url对象

视频场景:

固定reference_video

音频场景:

固定reference_audio

image_url?object
url*string

图片信息,可以是图片URL/图片Base64 编码/素材ID。

传入单张图片要求:

格式:jpeg、png、webp、bmp、tiff、gif、heic、heif

宽高比(宽/高):[0.4, 2.5]

宽高长度(px):[300, 6000]

大小:单张图片小于 30 MB。请求体大小不超过 64 MB。大文件请勿使用Base64编码。

video_url?object
url*string

视频信息,可以是视频URL/素材ID

传入单个视频要求:

视频格式:mp4、mov(H.264/H.265 视频编码,AAC/MP3 音频编码)

分辨率:480p,720p,1080p

时长:单个视频时长 [2, 15] s,最多传入 3 个参考视频,所有视频总时长不超过 15s

尺寸:

宽高比(宽/高):[0.4, 2.5]

宽高长度(px):[300, 6000]

总像素数:[614×664=407696, 3326×2494=8295044],即宽和高的乘积符合 [407696, 8295044]的区间要求。

大小:单个视频不超过 200 MB。

帧率 (FPS):[24, 60]

audio_url?object
url*string

音频信息,可以是音频URL/Base64编码/素材ID

传入单个音频要求:

格式:wav、mp3

时长:单个音频时长 [2, 15] s,最多传入 3 段参考音频,所有音频总时长不超过 15 s。

大小:单个音频不超过 15 MB,请求体大小不超过 64 MB。大文件请勿使用Base64编码。

resolution*string

视频分辨率

Seedance2.0:480p/720p/1080p/4K,默认值:720P

Seedance2.0 fast:480P/720P,默认值:720P

Seedance2.0 mini:480P/720P,默认值:720P

说明:Seedance 2.0 的 4k 视频采用 10bit 位深与 H.265/HEVC 编码,在少数播放环境中可能不兼容,建议使用 VLC、MPV、QuickTime Player 等播放器。

ratio*string

生成视频的宽高比例,默认值 adaptive。

adaptive:根据输入自动选择最合适的宽高比

图生视频,选择的宽高比和图片宽高比不一致时,会对输入图片进行裁剪,裁剪规则参考火山官网文档。

Value in"16:9" | "4:3" | "1:1" | "3:4" | "9:16" | "21:9" | "adaptive"
duration?integer

生成视频时长,单位:秒。

可选范围 [4, 15] 或 -1(-1 表示自适应时长)

duration = -1 适配规则:

模型在 duration 的有效取值范围内,自主选择合适的视频长度(整数秒)。

generate_audio?boolean

控制生成的视频是否包含与画面同步的声音。

注意:生成的有声视频均为单声道、和传入的音频声道数无关。

true:模型输出的视频包含同步音频。模型会基于文本提示词与视觉内容,自动生成与之匹配的人声、音效及背景音乐。建议将对话部分置于双引号内,以优化音频生成效果。例如:男人叫住女人说:“你记住,以后不可以用手指指月亮。”

false:模型输出的视频为无声视频。

watermark*boolean

生成视频是否包含水印。枚举值:

false:不含水印。

true:含有水印。

return_last_frame?boolean

重要:需要配合return_original参数返回原厂数据使用

true:返回生成视频的尾帧图像。设置为 true 后,可通过 查询视频生成任务接口 获取视频的尾帧图像。尾帧图像的格式为 png,宽高像素值与生成的视频保持一致,无水印。

false:不返回生成视频的尾帧图像。

callback_url?string

填写本次生成任务结果的回调通知地址。当视频生成任务有状态变化时,方舟将向此地址推送 POST 请求。

回调请求内容结构与查询任务API的返回体一致。

回调返回的 status 包括以下状态:

queued:排队中。

running:任务运行中。

succeeded: 任务成功。(如发送失败,即5秒内没有接收到成功发送的信息,回调三次)

failed:任务失败。(如发送失败,即5秒内没有接收到成功发送的信息,回调三次)

expired:任务超时,即任务处于运行中或排队中状态超过过期时间。可通过 execution_expires_after 字段设置过期时间。

execution_expires_after?integer

任务超时阈值。指定任务提交后的过期时间(单位:秒),从 created at 时间戳开始计算。默认值 172800 秒,即 48 小时。取值范围:[3600,259200]。

不论使用哪种 service_tier,都建议根据业务场景设置合适的超时时间。超过该时间后任务会被自动终止,并标记为expired状态。

safety_identifier?string

终端用户的唯一标识符,用于协助平台检测您的应用中可能违反火山方舟使用政策的用户。该标识符为英文字符串,需保证对单个用户固定且唯一,长度不超过 64 个字符。推荐传入对用户名、用户 ID 或邮箱进行哈希处理后生成的字符串,避免泄露用户隐私信息。

tools?array<object>

配置模型要调用的工具。

[]?object
type*string

指定使用的工具类型

Value in"web_search"

Response Body

application/json

成功

TypeScript Definitions

Use the response body type in TypeScript.

code*integer

状态码

data*object

数据对象

urls*array<string>

结果集

[]?string
usage*object

消耗信息

images*integer

图片张数

seconds*integer

视频秒数

input_tokens*integer

输入token数

total_tokens*integer

总token数

output_tokens*integer

输出token数

expired*string

有效期

task_id*string

任务ID

task_status*string

任务状态

message*string

状态信息

request_id*string

请求ID

curl -X POST "https://api.aa.com.cn/api/v1/video/generation" \  -H "Content-Type: application/json" \  -d '{    "model": "string",    "content": [      {        "type": "text"      }    ],    "resolution": "string",    "ratio": "16:9",    "watermark": true  }'
{
  "code": 0,
  "data": {
    "urls": [
      "string"
    ],
    "usage": {
      "images": 0,
      "seconds": 0,
      "input_tokens": 0,
      "total_tokens": 0,
      "output_tokens": 0
    },
    "expired": "string",
    "task_id": "string",
    "task_status": "string"
  },
  "message": "string",
  "request_id": "string"
}
Empty