众扬汇 AI 开放平台 API 文档

Higgsfield 视频模型

🎬 Higgsfield 视频生成 API 使用指南

📋 概述

Higgsfield 覆盖三类能力:基础图生视频、演说视频、广告视频。本页给出三者的选型依据,以及调用前需要先备好的模板参数。

🎯 接口使用场景

1. 基础图生视频 - /higgsfield/generate

适用场景:

  • 静态图片转动态画面
  • 短视频素材生产
  • 动画效果制作
  • 社媒内容创作

何时使用:

  • ✅ 手上已有图片,只缺动作
  • ✅ 想要可循环的动画
  • ✅ 产品展示类短视频
  • ✅ 艺术动画创作

不适用:

  • ❌ 人物开口说话
  • ❌ 商业广告特效

2. 演说视频 - /higgsfield/speak

适用场景:

  • 数字人口播
  • 培训与教学素材
  • 客服应答视频
  • 个人 vlog

何时使用:

  • ✅ 画面里的人物需要说话
  • ✅ 教学视频制作
  • ✅ 客服自动应答
  • ✅ 虚拟主播内容
  • ✅ 已有音频要对齐口型

音频来源选择:

  • 上传音频文件:已经录好 wav/mp3 的情况
  • 文本转语音:需要由文字合成时,可选不同的语音 ID 与音效

3. 广告视频 - /higgsfield/ads

适用场景:

  • 广告片制作
  • 电商推广
  • 品牌宣传
  • 营销活动

何时使用:

  • ✅ 需要专业广告质感
  • ✅ 电商商品推广
  • ✅ 品牌营销素材
  • ✅ 特殊商品展示动效

注意:

  • 单价明显高于基础档
  • 需先取得广告模板再发起调用
  • 针对商业广告场景专门优化

🔄 标准工作流程

方案A:基础图生视频

mermaid
graph TD
    A[备好素材图] --> B[拉取动作模板]
    B --> C[挑定 motion_id]
    C --> D[发起生成任务]
    D --> E[轮询任务状态]
    E --> F{已结束?}
    F -->|否| E
    F -->|是| G[取回视频地址]

方案B:演说视频

mermaid
graph TD
    A[备好人物图] --> B[拉取演说模板]
    B --> C[挑定 avatar_preset_id]
    C --> D{音频从哪来}
    D -->|已有音频| E[给出音频 URL]
    D -->|文本转语音| F[选语音模板]
    F --> G[选音效模板]
    G --> H[组装 speak 参数]
    E --> I[发起演说任务]
    H --> I
    I --> J[轮询任务状态]
    J --> K[取回视频地址]

方案C:广告视频

mermaid
graph TD
    A[备好产品图] --> B[取得广告模板]
    B --> C[挑定 product_placement_sample_id]
    C --> D[发起广告任务]
    D --> E[轮询任务状态]
    E --> F[取回视频地址]

💰 成本考虑

各档位与功能的相对成本差别较大,按用途挑即可:

  • 基础视频 lite:成本最低,适合测试与简单动画;
  • 基础视频 standard:高于 lite,适合正式内容与高质量需求;
  • 基础视频 turbo:居中,适合赶时间又要一定质量的场合;
  • 演说视频:明显更高,适合重要的说话视频;
  • 广告视频:高于基础档,适合商业推广。

待补:各档位的具体计费单价(人民币),以本平台计费页面为准。原页面给出的相对倍数未经我方实测,未直接采用。


🎨 模板获取策略

1. 动作模板 (Motion)

text
GET {{BASE_URL}}/higgsfield/tpl/motions?size=30&search=关键词

先浏览全部模板,再按想要的动作效果搜索,最后记下合适的 motion_id。

2. 演说模板 (Avatar)

text
GET {{BASE_URL}}/higgsfield/tpl/avatar-presets?size=30

挑选合适的人物形象,结合受众偏好,记下 avatar_preset_id。

3. 语音和音效模板

text
GET {{BASE_URL}}/higgsfield/tpl/voices
GET {{BASE_URL}}/higgsfield/tpl/sounds

挑好语音风格,再配一条音效增强体验。


⚡ 快速决策指南

我有一张图片,想要...

  • 让图片动起来 → /generate,关键参数 motion_id
  • 让人物说话 → /speak,关键参数 avatar_preset_id 加音频/文本
  • 制作产品广告 → /ads,关键参数 product_placement_sample_id
  • 快速测试效果 → /generate 并且 model 用 lite
  • 高质量输出 → /generate 并且 model 用 standard
  • 紧急项目 → /generate 并且 model 用 turbo

🔍 常见问题

Q: 模型档位怎么挑?

  • lite 用于测试与预览,花费最少;
  • standard 用于正式发布,画质最好;
  • turbo 用于时间紧但仍有质量要求的场合。

Q: 演说视频该传音频还是用文本转语音?

  • 已有专业录音设备 → 直接上传音频文件;
  • 想尽快拿到结果 → 用文本转语音;
  • 对语音风格有特定要求 → 选对应的 voice_id。

Q: 广告模板去哪里找?

  • 通过广告模板接口或我方控制台取得(原页面引用的第三方官网链接已按合规要求移除);
  • 挑好效果后记下模板 ID,供 API 调用使用。

Q: 视频质量和文件大小怎么控制?

  • 用 width、height 两个参数调分辨率;
  • 选合适的档位,在质量与成本之间取平衡。

使用提示(通用建议,具体以实测为准):三类接口的鉴权方式一致,都需要在请求头携带 Bearer 令牌。模板 ID 有生命周期,官方下架的模板继续调用会失败,建议把模板列表结果缓存一段时间后定期刷新。发起生成前先确认图片可被公网访问(或使用平台支持的上传方式),否则任务会因取不到素材而失败。批量生成时请控制并发。

使用提示(通用建议,具体以实测为准):可先用 lite 档位试跑,确认动作模板选得对,再换 standard 或 turbo 重跑,避免在错误模板上反复花钱。正文里提到的 motion_id、avatar_preset_id、product_placement_sample_id 都是动态数据,请以接口实时返回为准,不要写死在代码里。提交任务后建议按秒级间隔轮询,任务完成再取地址。