众扬汇 AI 开放平台 API 文档

简介

上传自己的形象

效果想更好,请注意:

  • 画面里要有人像
  • 图片、视频都行,推荐用视频

上传自己的声音

录一段或传一段 60 秒的音频,就能得到属于自己的音色。想效果更好,注意:

  • 人声清楚,不要糊
  • 背景别有多余噪音
  • 长度不少于 20 秒

使用场景

  1. 直接喂音频文件(音频里已经是你本人读好的内容)
text
{
    "audio_url": "<音频地址>",
    "avatar_url": "<形象视频地址>"
}
  1. 先建音色,再指定要读的文本与语言(音频只取音色,不用把内容读出来)
text
{
    "create_voice": {
        "audio_url": "https://example.com/voice.mp3",
        "language": "cn",
        "text": "你好,我是数字人!"
    },
    "avatar_url": "https://example.com/avatar.jpg"
}
  1. 直接用预设音色,并指定要读的文本与语言

先调查询默认音色列表接口,拿到 voice_engine_id 和 audio_id。

text
{
    "use_voice": {
        "voice_engine_id": "nina",
        "audio_id": "b92d7e1c40d0447eb563a13ec92d9042",
        "language": "en",
        "text": "Hello, world!"
    },
    "avatar_url": "https://example.com/avatar.mp4"
}