黑马天启 · 多模型 Token 平台

语音接口 audio

端点 用途
POST /v1/audio/speech 文本转语音(TTS)
POST /v1/audio/transcriptions 语音转文本(ASR,multipart 上传)
POST /v1/audio/translations 语音翻译成文本

文本转语音

curl https://api.token.heimatianqi.com/v1/audio/speech \
  -H "Authorization: Bearer sk-heima-xxxxxxxx" \
  -H "Content-Type: application/json" \
  -d '{"model":"tts-1","input":"你好,这是语音合成测试。","voice":"alloy"}' \
  --output speech.mp3

语音转文本

curl https://api.token.heimatianqi.com/v1/audio/transcriptions \
  -H "Authorization: Bearer sk-heima-xxxxxxxx" \
  -F model=whisper-1 \
  -F file=@audio.mp3

计费

音频模型按音频 tokens(输入/输出分别计价)计费,具体价格以「模型与价格」为准; 计费过程同样能在「使用日志 → 计费过程」里逐项核对。

注意事项

  • 上传音频请控制体积(大文件先压缩),避免超时;平台对请求体有上限。
  • 部分音频模型需要实名认证(见「实名认证」一篇的清单)。
  • 语音接口的模型可用性依赖上游,详情页会标注支持的端点类型。

常见问题

  • 返回二进制还是 JSON? speech 返回音频二进制;transcriptions / translations 返回 JSON。
  • 格式不支持:换用上游支持的容器/编码(如 mp3、wav),报错信息里会说明。