多媒体与向量接口
除对话接口外,当前还提供图像生成、语音转写、语音合成、Embedding 与 Rerank 路径。能否得到有效结果取决于所选渠道是否配置并支持对应模型。
已实现的路径
| 方法 | 路径 | 用途 |
|---|---|---|
| POST | /v1/images/generations | 图像生成 |
| POST | /v1/audio/transcriptions | 语音转写 |
| POST | /v1/audio/speech | 文本转语音 |
| POST | /v1/embeddings | 文本向量化 |
| POST | /v1/rerank | 结果重排序 |
请求要求
- 请求体、文件上传格式和响应字段应按对应接口协议构造。
- 传递的 model 必须是当前 API Key 可访问且渠道已配置的模型。
- 文件大小、音频格式、向量维度和图像参数由当前模型与渠道的实际限制决定。
失败排查
先调用 GET /v1/models 确认模型是否可用,再检查路径、Content-Type、请求体和 API Key 授权范围。若仍失败,结合返回的 HTTP 状态码及用量统计中的请求记录排查。