接口列表
支持的模型
请求参数
情感枚举(emotion)
happy、sad、angry、fearful、disgusted、surprised、calm、fluent、whisper
该能力受模型与音色组合限制,并非所有 voice_id 都支持。
音效枚举(sound_effects)
spacious_echo、auditorium_echo、lofi_telephone、robotic
音色别名
为与 OpenAI 风格保持一致,平台为常见音色提供别名到 MiniMax 实际音色的映射:
在
voice_id 中填写上述别名时,平台会自动转换为 MiniMax 实际音色;当该音色存在默认情感时,会在未显式指定 emotion 时自动补全。
返回格式(audio_mode)
通过渠道自定义参数可设置音频返回模式:audio_mode = json(默认):响应体以 JSON 返回,data.audio为 hex 或 URL(由output_format决定)。audio_mode = hex:当output_format=hex时返回裸音频流;当output_format=url时仍返回 JSON。
同步合成示例
output_format=hex 时,响应体为裸音频十六进制流,可直接落盘为 .mp3。
output_format=url 时,响应体以 JSON 返回,从 data.audio 读取音频 URL。
异步合成示例
voice_id 与参数;若使用了别名,平台会在上游请求前完成一次转换与情感补全。
计费说明
- 按成功合成的音频计费,具体价格以控制台「模型价格」页面的 MiniMax 语音条目为准。
- 以上游消费日志的实际结算金额为准。