众扬汇 AI 开放平台 API 文档

首帧生成视频接口

OpenAPI Specification

yaml
openapi: 3.0.1
info:
  title: ''
  description: "本页接口说明详见下方接口定义;参数取值与返回以本平台实测为准。"
  version: 1.0.0
paths:
  /qwen/api/v1/services/aigc/video-generation/video-synthesis:
    post:
      summary: 首帧生成视频接口
      deprecated: false
      description: "通义万相图生视频模型根据首帧图像与文本提示词生成流畅的视频。基础能力:可选视频时长 3–10 秒、指定分辨率 480P/720P/1080P、智能改写 prompt、添加水印;音频能力:支持自动配音或传入自定义音频实现音画同步(仅 wan2.5 支持);视频特效:部分模型内置「魔法悬浮」「气球膨胀」等特效模板可直接调用。参数与返回以本平台实测为准。"
      tags:
        - 视频模型/qwen视频模型
      parameters:
        - name: X-DashScope-Async
          in: header
          description: "该字段的取值与含义以本平台实际返回为准。"
          required: true
          example: enable
          schema:
            type: string
        - name: Content-Type
          in: header
          description: "该字段的取值与含义以本平台实际返回为准。"
          required: true
          example: application/json
          schema:
            type: string
        - name: Authorization
          in: header
          description: "该字段的取值与含义以本平台实际返回为准。"
          required: false
          example: Bearer {{YOUR_API_KEY}}
          schema:
            type: string
            default: Bearer {{YOUR_API_KEY}}
      requestBody:
        content:
          application/json:
            schema:
              type: object
              properties:
                model:
                  type: string
                input:
                  type: object
                  properties:
                    prompt:
                      type: string
                      description: "文本提示词,描述期望生成的画面元素与视觉特点,支持中英文,超出部分自动截断。长度限制随模型版本不同:wan2.5-i2v-preview 不超过 2000 个字符;wan2.2 及以下版本不超过 800 个字符。使用视频特效参数(template 不为空)时本参数无效。"
                    img_url:
                      type: string
                      description: "首帧图像 URL 或 Base64。限制:格式 JPEG、JPG、PNG(不支持透明通道)、BMP、WEBP;宽高均在 360–2000 像素;不超过 10MB;URL 需公网可访问(HTTP/HTTPS),本地文件可先上传获取临时 URL。"
                    negative_prompt:
                      type: string
                      description: "反向提示词,用于描述不希望在视频画面中出现的内容;支持中英文,长度不超过 500 个字符,超出部分自动截断。"
                    audio_url:
                      type: string
                      description: "仅 wan2.5-i2v-preview 支持。音频文件的 URL,模型将使用该音频生成视频,支持 HTTP/HTTPS(本地文件可先上传获取临时 URL)。限制:格式 wav、mp3;时长 3–30s;不超过 15MB。音频长于视频时长时自动截取前 5s 或 10s,不足则超出部分为无声。"
                    template:
                      type: string
                      description: "视频特效模板的名称;不填写表示不使用任何视频特效。不同模型支持的特效模板不同,调用前请对照视频特效列表以免调用失败。"
                  required:
                    - img_url
                parameters:
                  type: object
                  properties:
                    resolution:
                      type: string
                      description: "生成视频的分辨率档位,用于调整清晰度(总像素);模型会按档位自动缩放至相近总像素,宽高比尽量与输入图像保持一致。默认值与可用枚举值依赖 model 参数,具体以模型广场与实测为准。"
                    prompt_extend:
                      type: boolean
                      description: "是否开启 prompt 智能改写:true(默认)开启,对较短 prompt 提升明显但会增加耗时;false 不开启。"
                    duration:
                      type: integer
                      description: "生成视频的时长,单位秒,取值依赖 model:wan2.5-i2v-preview 可选 5 或 10(默认 5);wan2.2-i2v-plus、wan2.2-i2v-flash、wanx2.1-i2v-plus 固定 5 秒且不支持修改;wanx2.1-i2v-turbo 可选 3、4 或 5(默认 5)。"
                    audio:
                      type: boolean
                      description: "仅 wan2.5-i2v-preview 支持,用于控制是否添加音频;优先级 audio_url > audio,仅在 audio_url 为空时生效。true(默认)自动为视频添加音频;false 输出无声视频。"
                    watermark:
                      type: boolean
                      description: "是否添加水印,水印位于视频右下角,文案固定为「AI 生成」。false(默认)不添加,true 添加。"
                    seed:
                      type: integer
                      description: "随机数种子,取值范围 [0, 2147483647];未指定时系统自动生成。建议固定 seed 以提升可复现性;由于模型生成具有概率性,相同 seed 也不保证结果完全一致。"
              required:
                - model
                - input
            example:
              model: wan2.5-i2v-preview
              input:
                prompt: >-
                  一幅都市奇幻艺术的场景。一个充满动感的涂鸦艺术角色。一个由喷漆所画成的少年,正从一面混凝土墙上活过来。他一边用极快的语速演唱一首英文rap,一边摆着一个经典的、充满活力的说唱歌手姿势。场景设定在夜晚一个充满都市感的铁路桥下。灯光来自一盏孤零零的街灯,营造出电影般的氛围,充满高能量和惊人的细节。视频的音频部分完全由他的rap构成,没有其他对话或杂音。
                img_url: >-
                  https://files.example.com/file-manage-files/zh-CN/20250925/wpimhv/rap.png
              parameters:
                resolution: 480P
                prompt_extend: true
                duration: 10
                audio: true
      responses:
        '200':
          description: "该字段的取值与含义以本平台实际返回为准。"
          content:
            application/json:
              schema:
                type: object
                properties: {}
          headers: {}
      security: []
components:
  schemas: {}
  securitySchemes: {}
servers: []
security: []

使用提示:本页接口的 Base URL 为 https://api.allyang.cn,请求头需携带 Authorization: Bearer <令牌>(令牌在控制台「令牌管理」中创建)。示例中的任务 ID、时间戳与文件地址均为示意值,实际以平台返回为准。

模型名请在「模型广场」复制后填入,不要手输;计费、限流与在售清单以平台实测为准(部分数值待补)。