众扬汇 AI 开放平台 API 文档

Wan文生视频带音频

OpenAPI Specification

带音频的文生视频:在提示词基础上可自动配音或传入自定义音频,实现音画同步(仅 wan2.5 系列模型支持)。

请求方式:POST

接口地址

text
https://api.allyang.cn/v2/videos/generations

请求头

  • Authorization(可选):鉴权头,使用控制台创建的令牌,格式为 Bearer + 令牌。(示例:Bearer {{YOUR_API_KEY}})

请求参数(application/json)

  • prompt(string,必填):文本提示词,中英文均可,最长 800 字符(汉字与字母均按 1 个字符计),超出部分会被截断。示例:一只小猫在月光下奔跑。
  • model(string,必填):模型名称,例如 wan2.1-t2v-turbo。
    • 可选值:wan2.5-t2v-preview。
    • wan2.5-t2v-preview:新增音频能力:可自动配音,也可传入自定义音频文件。
  • duration(integer,可选):生成视频的时长(秒);该模型固定输出 5 秒,不可修改。
    • 可选值:5、10。
  • size(string,可选):各档位可选分辨率与宽高比:480P — 832480(16:9)、480832(9:16)、624624(1:1);720P — 1280720(16:9)、7201280(9:16)、960960(1:1)、1088832(4:3)、8321088(3:4);1080P — 19201080(16:9)、10801920(9:16)、14401440(1:1)、16321248(4:3)、1248*1632(3:4)。
  • watermark(boolean,可选):是否添加水印;开启后在画面右下角标注“由人工智能生成”。
  • template(string,可选)
  • negative_prompt(string,可选):反向提示词,用于排除不希望出现的画面内容,中英文均可,最长 500 字符,超出截断。示例:低分辨率、错误、质量最差、缺陷、多余手指、比例失调。
  • prompt_extend(boolean,可选):是否启用提示词重写;开启后由大模型改写输入提示,短提示的成片效果更好,但处理耗时增加。
  • seed(integer,可选):随机种子,取值范围 [0, 2147483647];不传时由算法随机生成。需要结果相对稳定时可复用同一取值。
  • audio_url(string,可选):仅 wan2.5-t2v-preview 支持:音频文件 URL,模型据此生成带配乐的视频。支持 HTTP/HTTPS;格式 wav、mp3;时长 3~30 秒;大小 ≤15MB。超出 duration 的部分自动截取,不足则剩余画面无声。
  • audio(string,可选):仅 wan2.5-t2v-preview 支持:是否添加音频。优先级 audio_url > audio(audio_url 为空时本参数才生效)。true 为缺省值,自动配音;false 输出无声视频。

请求示例

json
{
  "model": "wan2.5-t2v-preview",
  "prompt": "一幅史诗级可爱的场景。一只小巧可爱的卡通小猫将军,身穿细节精致的金色盔甲,头戴一个稍大的头盔,勇敢地站在悬崖上。他骑着一匹虽小但英勇的战马,说:”青海长云暗雪山,孤城遥望玉门关。黄沙百战穿金甲,不破楼兰终不还。“。悬崖下方,一支由老鼠组成的、数量庞大、无穷无尽的军队正带着临时制作的武器向前冲锋。这是一个戏剧性的、大规模的战斗场景,灵感来自中国古代的战争史诗。远处的雪山上空,天空乌云密布。整体氛围是“可爱”与“霸气”的搞笑和史诗般的融合。",
  "audio_url": "https://example.com/…",
  "size": "832*480",
  "prompt_extend": true,
  "duration": 10
}

返回字段

  • task_id(string,必填)

返回示例

json
{
  "task_id": "e7bed961-d1b9-4b3f-8ef9-5f441bde28c8"
}

使用提示:audio_url 优先于 audio;音频超长会自动截取,不足则剩余画面无声;提交后请用查询接口轮询结果;耗时、限流与计费数值以本平台实测与计费页为准(待补)。