典名词元典名词元首页
API 文档三方工具教程
AI 模型接口视频万相

wan3.0系列

POST/api/v1/video/generation

Header Parameters

X-DashScope-Async*string

异步调用标识,固定值 enable

Value in"enable"

Request Body

application/json

model*string

模型名称。wan3.0-video=标准版,wan3.0-video-prime=高速版(能力对齐标准版,端到端速度显著提升)。

Value in"wan3.0-video" | "wan3.0-video-prime"
input*object

输入的基本信息。prompt 和 media 必填其一。

prompt?string

文本提示词,用来描述期望生成的视频内容。和 media 必填其一。 支持中英文,每个汉字/字母占一个字符,不超过 20000 个字符,超过部分会自动截断。 在全能参考模式下,prompt 中可以用"图1""视频1"等指代 media 数组中对应顺序的媒体素材。

media?array<object>

媒体素材数组,支持图像、视频、音频、文件和网页作为输入。和 prompt 必填其一。 数组中每个元素为一个媒体对象,包含 type 与 url 字段。 在参考生视频模式下,按照数组顺序定义 prompt 中素材引用的顺序。图和视频分别计数,即可同时存在图1、视频1。 数组中的第 1 个 reference_video 对应视频1,第 2 个对应视频2,以此类推。 数组中的第 1 个 reference_image 对应图1,第 2 个对应图2,以此类推。 数组中的第 1 个 reference_audio 对应音频1,第 2 个对应音频2,以此类推。

注意:reference_xx/file/link 类型和 first_frame/last_frame 类型互斥,不能在同一请求中混用。

[]?object
type?string

媒体素材类型。

  • first_frame:首帧图像,严格作为视频第一帧,最多 1 张
  • last_frame:尾帧图像,严格作为视频最后一帧,最多 1 张
  • reference_image:参考图像,最多 10 张
  • reference_video:参考视频,最多 5 段,总时长 ≤15s
  • reference_audio:参考音频,最多 5 段,总时长 ≤15s
  • file:文件,最多 1 个,不可与 link 同时输入
  • link:网页链接,最多 1 个,不可与 file 同时输入
Value in"first_frame" | "last_frame" | "reference_image" | "reference_video" | "reference_audio" | "file" | "link"
url?string

媒体素材 URL 或 Base64 编码数据。

图像(first_frame/last_frame/reference_image):格式 JPEG/JPG/PNG(不支持透明通道)/BMP/WEBP;单边 [240,8000]px;长宽比 ≤8:1;≤20MB。支持公网URL/OSS临时URL/Base64(data:{MIME_type};base64,{base64_data})。

视频(reference_video):格式 mp4/mov;单个[1,15]s,总时长≤15s;单边[240,4096]px;长宽比≤8:1;≤100MB。支持公网URL/OSS临时URL。

音频(reference_audio):格式 wav/mp3;单个[1,15]s,总时长≤15s;≤15MB。支持公网URL/OSS临时URL。

文件(file):格式 docx/doc/xlsx/xls/pptx/ppt/pdf/txt/key/pages/numbers/md;≤100MB;≤50页。支持公网URL/OSS临时URL。

网页链接(link):公开网页URL,仅支持无需登录的公开网页。支持HTTP/HTTPS。

parameters?object

视频处理参数。

resolution?string

生成视频的分辨率档位。默认 1080P。

Default"1080P"
Value in"1080P" | "720P" | "480P"
ratio?string

生成视频的宽高比。默认 adaptive(自适应长宽比,根据输入媒体比例和意图自动推荐)。

Default"adaptive"
Value in"adaptive" | "16:9" | "4:3" | "1:1" | "3:4" | "9:16"
duration?integer

生成视频的时长(秒)。默认 5。

  • 无视频输入时:取值范围 [2, 30] 的整数
  • 有视频输入时:输入视频总时长 + 输出视频时长不超过 30 秒
  • 传 -1 时:智能时长模式,模型根据输入的 prompt、内容和富媒体自动推荐合适时长
Default5
audio?boolean

输出视频是否包含音频。默认 true。false 时不包含音轨。开关声音价格相同。

Defaulttrue
seed?integer

随机种子,用于复现生成结果。取值范围 [0, 2147483647]。

prompt_extend?boolean

是否开启 prompt 智能改写。开启后使用大模型对输入 prompt 进行智能改写,对较短 prompt 效果提升明显,但会增加耗时。默认 true。

Defaulttrue
watermark?boolean

是否添加水印标识。默认 false。

Defaultfalse
return_original?boolean

返回原厂数据。默认 false:返回中继站标准响应格式(code+data+message+request_id);true:返回原厂格式(output+request_id)。

Defaultfalse

Response Body

application/json

成功

TypeScript Definitions

Use the response body type in TypeScript.

code?integer

状态码

data?object

响应数据

urls?array<string>

生成结果URL列表

[]?string
usage?object
video_count?integer

生成视频数量,固定为1

duration?number

生成视频时长(秒)

input_video_duration?number

输入视频时长(秒),无视频输入时为0

output_video_duration?number

输出视频时长(秒)

fps?integer

帧率,默认30

SR?integer

分辨率,示例值720

ratio?string

宽高比,示例值16:9

expired?string

过期时间

task_id?string

任务ID

task_status?string

任务状态。

  • PENDING:排队中
  • RUNNING:处理中
  • SUCCEEDED:成功
  • FAILED:失败
  • CANCELED:已取消
  • UNKNOWN:不存在或状态未知
message?string

提示信息

request_id?string

请求ID

curl -X POST "https://api.aa.com.cn/api/v1/video/generation" \  -H "X-DashScope-Async: enable" \  -H "Content-Type: application/json" \  -d '{    "model": "wan3.0-video",    "input": {},    "return_original": false  }'
{
  "code": 0,
  "data": {
    "urls": [
      "string"
    ],
    "usage": {
      "video_count": 0,
      "duration": 0,
      "input_video_duration": 0,
      "output_video_duration": 0,
      "fps": 0,
      "SR": 0,
      "ratio": "string"
    },
    "expired": "string",
    "task_id": "string",
    "task_status": "string"
  },
  "message": "string",
  "request_id": "string"
}