首帧生成视频接口
OpenAPI Specification
yaml
openapi: 3.0.1
info:
title: ''
description: "本页接口说明详见下方接口定义;参数取值与返回以本平台实测为准。"
version: 1.0.0
paths:
/qwen/api/v1/services/aigc/video-generation/video-synthesis:
post:
summary: 首帧生成视频接口
deprecated: false
description: "通义万相图生视频模型根据首帧图像与文本提示词生成流畅的视频。基础能力:可选视频时长 3–10 秒、指定分辨率 480P/720P/1080P、智能改写 prompt、添加水印;音频能力:支持自动配音或传入自定义音频实现音画同步(仅 wan2.5 支持);视频特效:部分模型内置「魔法悬浮」「气球膨胀」等特效模板可直接调用。参数与返回以本平台实测为准。"
tags:
- 视频模型/qwen视频模型
parameters:
- name: X-DashScope-Async
in: header
description: "该字段的取值与含义以本平台实际返回为准。"
required: true
example: enable
schema:
type: string
- name: Content-Type
in: header
description: "该字段的取值与含义以本平台实际返回为准。"
required: true
example: application/json
schema:
type: string
- name: Authorization
in: header
description: "该字段的取值与含义以本平台实际返回为准。"
required: false
example: Bearer {{YOUR_API_KEY}}
schema:
type: string
default: Bearer {{YOUR_API_KEY}}
requestBody:
content:
application/json:
schema:
type: object
properties:
model:
type: string
input:
type: object
properties:
prompt:
type: string
description: "文本提示词,描述期望生成的画面元素与视觉特点,支持中英文,超出部分自动截断。长度限制随模型版本不同:wan2.5-i2v-preview 不超过 2000 个字符;wan2.2 及以下版本不超过 800 个字符。使用视频特效参数(template 不为空)时本参数无效。"
img_url:
type: string
description: "首帧图像 URL 或 Base64。限制:格式 JPEG、JPG、PNG(不支持透明通道)、BMP、WEBP;宽高均在 360–2000 像素;不超过 10MB;URL 需公网可访问(HTTP/HTTPS),本地文件可先上传获取临时 URL。"
negative_prompt:
type: string
description: "反向提示词,用于描述不希望在视频画面中出现的内容;支持中英文,长度不超过 500 个字符,超出部分自动截断。"
audio_url:
type: string
description: "仅 wan2.5-i2v-preview 支持。音频文件的 URL,模型将使用该音频生成视频,支持 HTTP/HTTPS(本地文件可先上传获取临时 URL)。限制:格式 wav、mp3;时长 3–30s;不超过 15MB。音频长于视频时长时自动截取前 5s 或 10s,不足则超出部分为无声。"
template:
type: string
description: "视频特效模板的名称;不填写表示不使用任何视频特效。不同模型支持的特效模板不同,调用前请对照视频特效列表以免调用失败。"
required:
- img_url
parameters:
type: object
properties:
resolution:
type: string
description: "生成视频的分辨率档位,用于调整清晰度(总像素);模型会按档位自动缩放至相近总像素,宽高比尽量与输入图像保持一致。默认值与可用枚举值依赖 model 参数,具体以模型广场与实测为准。"
prompt_extend:
type: boolean
description: "是否开启 prompt 智能改写:true(默认)开启,对较短 prompt 提升明显但会增加耗时;false 不开启。"
duration:
type: integer
description: "生成视频的时长,单位秒,取值依赖 model:wan2.5-i2v-preview 可选 5 或 10(默认 5);wan2.2-i2v-plus、wan2.2-i2v-flash、wanx2.1-i2v-plus 固定 5 秒且不支持修改;wanx2.1-i2v-turbo 可选 3、4 或 5(默认 5)。"
audio:
type: boolean
description: "仅 wan2.5-i2v-preview 支持,用于控制是否添加音频;优先级 audio_url > audio,仅在 audio_url 为空时生效。true(默认)自动为视频添加音频;false 输出无声视频。"
watermark:
type: boolean
description: "是否添加水印,水印位于视频右下角,文案固定为「AI 生成」。false(默认)不添加,true 添加。"
seed:
type: integer
description: "随机数种子,取值范围 [0, 2147483647];未指定时系统自动生成。建议固定 seed 以提升可复现性;由于模型生成具有概率性,相同 seed 也不保证结果完全一致。"
required:
- model
- input
example:
model: wan2.5-i2v-preview
input:
prompt: >-
一幅都市奇幻艺术的场景。一个充满动感的涂鸦艺术角色。一个由喷漆所画成的少年,正从一面混凝土墙上活过来。他一边用极快的语速演唱一首英文rap,一边摆着一个经典的、充满活力的说唱歌手姿势。场景设定在夜晚一个充满都市感的铁路桥下。灯光来自一盏孤零零的街灯,营造出电影般的氛围,充满高能量和惊人的细节。视频的音频部分完全由他的rap构成,没有其他对话或杂音。
img_url: >-
https://files.example.com/file-manage-files/zh-CN/20250925/wpimhv/rap.png
parameters:
resolution: 480P
prompt_extend: true
duration: 10
audio: true
responses:
'200':
description: "该字段的取值与含义以本平台实际返回为准。"
content:
application/json:
schema:
type: object
properties: {}
headers: {}
security: []
components:
schemas: {}
securitySchemes: {}
servers: []
security: []
使用提示:本页接口的 Base URL 为
https://api.allyang.cn,请求头需携带Authorization: Bearer <令牌>(令牌在控制台「令牌管理」中创建)。示例中的任务 ID、时间戳与文件地址均为示意值,实际以平台返回为准。模型名请在「模型广场」复制后填入,不要手输;计费、限流与在售清单以平台实测为准(部分数值待补)。