语音接口 audio
| 端点 | 用途 |
|---|---|
POST /v1/audio/speech |
文本转语音(TTS) |
POST /v1/audio/transcriptions |
语音转文本(ASR,multipart 上传) |
POST /v1/audio/translations |
语音翻译成文本 |
文本转语音
curl https://api.token.heimatianqi.com/v1/audio/speech \
-H "Authorization: Bearer sk-heima-xxxxxxxx" \
-H "Content-Type: application/json" \
-d '{"model":"tts-1","input":"你好,这是语音合成测试。","voice":"alloy"}' \
--output speech.mp3
语音转文本
curl https://api.token.heimatianqi.com/v1/audio/transcriptions \
-H "Authorization: Bearer sk-heima-xxxxxxxx" \
-F model=whisper-1 \
-F file=@audio.mp3
计费
音频模型按音频 tokens(输入/输出分别计价)计费,具体价格以「模型与价格」为准; 计费过程同样能在「使用日志 → 计费过程」里逐项核对。
注意事项
- 上传音频请控制体积(大文件先压缩),避免超时;平台对请求体有上限。
- 部分音频模型需要实名认证(见「实名认证」一篇的清单)。
- 语音接口的模型可用性依赖上游,详情页会标注支持的端点类型。
常见问题
- 返回二进制还是 JSON?
speech返回音频二进制;transcriptions/translations返回 JSON。 - 格式不支持:换用上游支持的容器/编码(如 mp3、wav),报错信息里会说明。