实时会话 WebSocket /v1/realtime
低延迟双向语音/文本会话。
请求
| 字段 | 必填 | 说明 |
|---|---|---|
model |
是 | 查询参数指定模型 |
Authorization |
是 | 握手头 Bearer |
# 用 wscat 快速验证握手
wscat -c "wss://api.token.heimatianqi.com/v1/realtime?model=deepseek-v4-flash" \
-H "Authorization: Bearer sk-heima-xxxxxxxx"
计费口径
按音频/文本 tokens 计费;中途断开仍按已产生用量结算。
错误
| 状态 | 典型原因 |
|---|---|
| 401 | 握手鉴权失败 |
| 404 | 模型未开放 Realtime |
错误响应里会带 request id,排查与对账时请保留(见错误码与限流)。
验证方式:这是 WebSocket 端点,HTTP 探针覆盖不到,本页由生成器强制校验其路径 确实存在于
relay-router.go(不存在即生成失败)。
常见问题
- 这个端点要额外开通吗? 取决于模型与上游:模型详情页会标注支持的端点;未开放时会返回明确错误, 不会静默降级到别的接口。
- 并发/限流如何? 平台有三层保护(模型 RPM、渠道容量、临时黑名单), 拒绝时返回 429/403 且不消耗上游。
相关端点
- 对话补全 POST /v1/chat/completions
- 文本补全 POST /v1/completions
- 向量化 POST /v1/embeddings
- 重排 POST /v1/rerank
- 文生图 POST /v1/images/generations
- 图像编辑 POST /v1/images/edits
- 图像变体 POST /v1/images/variations
- 语音合成 POST /v1/audio/speech
- 语音转写 POST /v1/audio/transcriptions
- 语音翻译 POST /v1/audio/translations
- 模型清单 GET /v1/models
- 模型详情 GET /v1/models/{model}
- Anthropic 协议 POST /v1/messages
- Responses 接口 POST /v1/responses
- 内容审核 POST /v1/moderations
- 联网检索 POST /v1/alpha/search
- 文件接口 /v1/files
- 微调接口 /v1/fine-tunes
- 操练场接口 POST /pg/chat/completions
- 绘图任务 /mj/*
- 音乐任务 /suno/*
- 任务查询 GET /mj/task/{id}/fetch