众扬汇 AI 开放平台 API 文档

创建翻译(whisper

OpenAPI Specification

音频翻译接口(whisper):上传音频文件,将其内容翻译为英文文本,可指定输出格式。

请求方式:POST

接口地址

text
https://api.allyang.cn/v1/audio/translations

请求头

  • Authorization(可选):鉴权头,使用控制台创建的令牌,格式为 Bearer + 令牌。(示例:Bearer {{YOUR_API_KEY}})

请求参数(multipart/form-data)

  • file(string,必填):待翻译的音频文件对象(不是文件名),格式支持 flac、mp3、mp4、mpeg、mpga、m4a、ogg、wav、webm。
  • model(string,必填):要使用的模型 ID;当前仅 whisper-1 可用。
  • prompt(string,可选):可选提示文本,用于指定风格或承接上一段音频;建议使用英文。
  • response_format(string,可选):翻译结果格式,可选 json、text、srt、verbose_json、vtt。
  • temperature(number,可选):缺省 0。采样温度,取值 0~1;数值越大输出越随机(如 0.8),越小越聚焦确定(如 0.2);设为 0 时由模型按对数概率自动调整温度。

返回字段

  • text(string,必填)

使用提示:当前仅 whisper-1 可用;上传文件需满足格式要求。