众扬汇 AI 开放平台 API 文档

Wan图生视频带音频

OpenAPI Specification

带音频的图生视频:在首帧图像与提示词基础上,可自动配音或传入自定义音频,实现音画同步(仅 wan2.5 系列模型支持)。

请求方式:POST

接口地址

text
https://api.allyang.cn/v2/videos/generations

请求头

  • Authorization(可选):鉴权头,使用控制台创建的令牌,格式为 Bearer + 令牌。(示例:Bearer {{YOUR_API_KEY}})

请求参数(application/json)

  • prompt(string,必填)
  • model(string,必填)
    • 可选值:wan2.5-i2v-preview。
    • wan2.5-i2v-preview:新增音频能力:可自动配音,也可传入自定义音频文件。
  • duration(integer,可选)
    • 可选值:5、10。
  • resolution(string,可选):wan2.5-i2v-preview 可选 480P、720P、1080P,缺省 1080P。
    • 可选值:720P、480P、1080P。
  • images(array,必填):参考图,支持公网可访问 URL(HTTP/HTTPS)或 base64(data:{MIME_type};base64,{base64_data});本地文件可先通过上传接口换取临时 URL。仅支持一张参考图。(示例地址待补)
  • watermark(boolean,可选)
  • template(string,可选)
  • negative_prompt(string,可选)
  • prompt_extend(string,可选)
  • seed(integer,可选)
  • audio_url(string,可选):仅 wan2.5-i2v-preview 支持:音频文件 URL,模型据此为视频配乐。支持 HTTP/HTTPS。格式 wav、mp3;时长 3~30 秒;大小 ≤15MB。音频长于 duration 时自动截取前 5 或 10 秒,不足则超出部分为无声画面。
  • audio(string,可选):仅 wan2.5-i2v-preview 支持:是否添加音频。优先级 audio_url > audio(audio_url 为空时本参数才生效)。true 为缺省值,自动配音;false 输出无声视频。

请求示例

json
{
  "model": "wan2.5-i2v-preview",
  "prompt": "一幅都市奇幻艺术的场景。一个充满动感的涂鸦艺术角色。一个由喷漆所画成的少年,正从一面混凝土墙上活过来。他一边用极快的语速演唱一首英文rap,一边摆着一个经典的、充满活力的说唱歌手姿势。场景设定在夜晚一个充满都市感的铁路桥下。灯光来自一盏孤零零的街灯,营造出电影般的氛围,充满高能量和惊人的细节。视频的音频部分完全由少年的rap构成,没有其他对话或杂音。",
  "images": [
    ">-"
  ],
  "audio_url": "https://example.com/…",
  "resolution": "480P",
  "prompt_extend": true,
  "duration": 5
}

返回字段

  • task_id(string,必填)

返回示例

json
{
  "task_id": "e7bed961-d1b9-4b3f-8ef9-5f441bde28c8"
}

使用提示:audio_url 优先于 audio;音频超长会自动截取,不足则剩余画面无声;提交后请用查询接口轮询结果;耗时、限流与计费数值以本平台实测与计费页为准(待补)。