seedance 2.0系列
/api/v1/video/generationHeader Parameters
格式: Authorization: Bearer sk-xxxxxx
Request Body
application/json
模型名称,固定值
doubao-seedance-2-0-260128 haiwai/doubao-seedance-2-0-260128 volc01/doubao-seedance-2-0-260128 volc03/doubao-seedance-2-0-260128
doubao-seedance-2-0-fast-260128 haiwai/doubao-seedance-2-0-fast-260128 volc01/doubao-seedance-2-0-fast-260128 volc03/doubao-seedance-2-0-fast-260128
doubao-seedance-2-0-mini-260615 volc01/doubao-seedance-2-0-mini-260615 volc03/doubao-seedance-2-0-mini-260615
输入给模型,生成视频的信息,支持文本、图片、音频、视频。支持以下几种组合:
纯文本
文本(可选)+ 图片(1-9 张)
文本(可选)+ 视频(0-3 个)
文本(可选)+ 音频(0-3 个)——不可单独传入音频,需至少包含 1 个参考视频或图片
文本(可选)+ 图片 + 音频
文本(可选)+ 图片 + 视频
文本(可选)+ 视频 + 音频
文本(可选)+ 图片 + 视频 + 音频
输入内容的类型
"text" | "image_url" | "video_url" | "audio_url"输入给模型的文本提示词,描述期望生成的视频。
提示词语言支持:中文、英文、日语、印度尼西亚语、西班牙语、葡萄牙语。
提示词字数建议:中文提示词不超过500字,英文提示词不超过1000词。字数过多易导致信息分散,模型可能忽略细节、仅关注重点,进而造成视频缺失部分元素。
图片/视频/音频的位置或用途。
图片场景:
首帧:first_frame(或不填),需要传入1个image_url对象
首尾帧:first_frame和last_frame,需要传入2个image_url对象
传入的首尾帧图片可相同。首尾帧图片的宽高比不一致时,以首帧图片为主,尾帧图片会自动裁剪适配。
参考图:reference_image,可传入1~9 个image_url对象
视频场景:
固定reference_video
音频场景:
固定reference_audio
图片信息,可以是图片URL/图片Base64 编码/素材ID。
传入单张图片要求:
格式:jpeg、png、webp、bmp、tiff、gif、heic、heif
宽高比(宽/高):[0.4, 2.5]
宽高长度(px):[300, 6000]
大小:单张图片小于 30 MB。请求体大小不超过 64 MB。大文件请勿使用Base64编码。
视频信息,可以是视频URL/素材ID
传入单个视频要求:
视频格式:mp4、mov(H.264/H.265 视频编码,AAC/MP3 音频编码)
分辨率:480p,720p,1080p
时长:单个视频时长 [2, 15] s,最多传入 3 个参考视频,所有视频总时长不超过 15s
尺寸:
宽高比(宽/高):[0.4, 2.5]
宽高长度(px):[300, 6000]
总像素数:[614×664=407696, 3326×2494=8295044],即宽和高的乘积符合 [407696, 8295044]的区间要求。
大小:单个视频不超过 200 MB。
帧率 (FPS):[24, 60]
音频信息,可以是音频URL/Base64编码/素材ID
传入单个音频要求:
格式:wav、mp3
时长:单个音频时长 [2, 15] s,最多传入 3 段参考音频,所有音频总时长不超过 15 s。
大小:单个音频不超过 15 MB,请求体大小不超过 64 MB。大文件请勿使用Base64编码。
视频分辨率
Seedance2.0:480p/720p/1080p/4K,默认值:720P
Seedance2.0 fast:480P/720P,默认值:720P
Seedance2.0 mini:480P/720P,默认值:720P
说明:Seedance 2.0 的 4k 视频采用 10bit 位深与 H.265/HEVC 编码,在少数播放环境中可能不兼容,建议使用 VLC、MPV、QuickTime Player 等播放器。
生成视频的宽高比例,默认值 adaptive。
adaptive:根据输入自动选择最合适的宽高比
图生视频,选择的宽高比和图片宽高比不一致时,会对输入图片进行裁剪,裁剪规则参考火山官网文档。
"16:9" | "4:3" | "1:1" | "3:4" | "9:16" | "21:9" | "adaptive"生成视频时长,单位:秒。
可选范围 [4, 15] 或 -1(-1 表示自适应时长)
duration = -1 适配规则:
模型在 duration 的有效取值范围内,自主选择合适的视频长度(整数秒)。
控制生成的视频是否包含与画面同步的声音。
注意:生成的有声视频均为单声道、和传入的音频声道数无关。
true:模型输出的视频包含同步音频。模型会基于文本提示词与视觉内容,自动生成与之匹配的人声、音效及背景音乐。建议将对话部分置于双引号内,以优化音频生成效果。例如:男人叫住女人说:“你记住,以后不可以用手指指月亮。”
false:模型输出的视频为无声视频。
生成视频是否包含水印。枚举值:
false:不含水印。
true:含有水印。
重要:需要配合return_original参数返回原厂数据使用
true:返回生成视频的尾帧图像。设置为 true 后,可通过 查询视频生成任务接口 获取视频的尾帧图像。尾帧图像的格式为 png,宽高像素值与生成的视频保持一致,无水印。
false:不返回生成视频的尾帧图像。
填写本次生成任务结果的回调通知地址。当视频生成任务有状态变化时,方舟将向此地址推送 POST 请求。
回调请求内容结构与查询任务API的返回体一致。
回调返回的 status 包括以下状态:
queued:排队中。
running:任务运行中。
succeeded: 任务成功。(如发送失败,即5秒内没有接收到成功发送的信息,回调三次)
failed:任务失败。(如发送失败,即5秒内没有接收到成功发送的信息,回调三次)
expired:任务超时,即任务处于运行中或排队中状态超过过期时间。可通过 execution_expires_after 字段设置过期时间。
任务超时阈值。指定任务提交后的过期时间(单位:秒),从 created at 时间戳开始计算。默认值 172800 秒,即 48 小时。取值范围:[3600,259200]。
不论使用哪种 service_tier,都建议根据业务场景设置合适的超时时间。超过该时间后任务会被自动终止,并标记为expired状态。
终端用户的唯一标识符,用于协助平台检测您的应用中可能违反火山方舟使用政策的用户。该标识符为英文字符串,需保证对单个用户固定且唯一,长度不超过 64 个字符。推荐传入对用户名、用户 ID 或邮箱进行哈希处理后生成的字符串,避免泄露用户隐私信息。
配置模型要调用的工具。
指定使用的工具类型
"web_search"Response Body
application/json
成功
TypeScript Definitions
Use the response body type in TypeScript.
状态码
数据对象
结果集
消耗信息
图片张数
视频秒数
输入token数
总token数
输出token数
有效期
任务ID
任务状态
状态信息
请求ID
curl -X POST "https://api.aa.com.cn/api/v1/video/generation" \ -H "Content-Type: application/json" \ -d '{ "model": "string", "content": [ { "type": "text" } ], "resolution": "string", "ratio": "16:9", "watermark": true }'{
"code": 0,
"data": {
"urls": [
"string"
],
"usage": {
"images": 0,
"seconds": 0,
"input_tokens": 0,
"total_tokens": 0,
"output_tokens": 0
},
"expired": "string",
"task_id": "string",
"task_status": "string"
},
"message": "string",
"request_id": "string"
}