跳转到主要内容
🎉 限时免费 — MiniMax: MiniMax M3 Free 现在体验 🔥

MiniMax 音频入站协议

方法路径用途
POST/minimax/v1/t2a_v2目录公示的 MiniMax T2A 入站
POST/v1/t2a_v2MiniMax SDK 别名,语义相同

这是 MiniMax 同步语音合成(T2A V2) 的原厂入站协议。请求体按 MiniMax T2aV2Req 原样接收(model、text、voice_setting、audio_setting、stream 等),响应体也按 MiniMax T2aV2Resp 渲染,照 MiniMax 官方文档写的客户端可以直接解析。

model 填写平台逻辑模型名,策略、路由与计费照常生效。逻辑模型必须在 public_protocols 中声明 minimax_t2a,否则网关返回协议不匹配。

只需要 OpenAI 形态的二进制音频时,见语音合成。

合成

两条路径等价,任选其一:

bash
curl https://api.modelgo.com/minimax/v1/t2a_v2 \
  -H "Authorization: Bearer $MODELGO_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "<model>",
    "text": "你好,欢迎使用 ModelGo。",
    "voice_setting": { "voice_id": "female-shaonv", "speed": 1, "vol": 1, "pitch": 0 },
    "audio_setting": { "sample_rate": 32000, "bitrate": 128000, "format": "mp3", "channel": 1 }
  }'

非流式成功响应是 MiniMax JSON,音频在 data.audio,为十六进制字符串(不是 audio/mpeg 直出):

json
{
  "base_resp": { "status_code": 0, "status_msg": "success" },
  "data": { "audio": "<hex mp3 bytes>", "status": 2, "ced": "" },
  "extra_info": {
    "audio_length": 2448,
    "audio_sample_rate": 32000,
    "audio_size": 40884,
    "bitrate": 128000,
    "word_count": 16,
    "usage_characters": 22,
    "audio_format": "mp3",
    "audio_channel": 1
  }
}

2026-09-10 国内生产用 speech-2.8-turbo 打 POST /minimax/v1/t2a_v2 得到上述形态(hex 已截断)。同一模型打 POST /v1/audio/speech 返回 model_protocol_not_offered。

base_resp.status_code 只有数字 0 表示成功。HTTP 200 但 status_code != 0 仍按调用失败处理。

流式

请求里加 "stream": true,响应为 SSE,每帧仍是 MiniMax JSON(含增量 hex 音频),不是 OpenAI chat 的 choices[].delta。

失败与 HTTP

带内错误会把 MiniMax JSON 回传给调用方,并按 status_code 映射 HTTP 状态:

MiniMax status_codeHTTP
1004401
1002 / 1039429
2013 / 1042400
其余非 0502

计费

按上游报告的 字符数 计量(usage.characters,否则 extra_info.usage_characters),不会用 text 的字符串长度估算。

关键约定

  • model 填写平台逻辑模型名;是否可走本通道以该模型的 public_protocols 为准。
  • 路径不参与选路:由逻辑模型的路由决定 MiniMax 直连或百炼等 adaptor。
  • 路由上的 Provider 必须声明支持 MiniMax T2A;仅 OpenAI 兼容中继时会返回 provider_unsupported。