Skip to main content
使用 MiniMax 语音合成(TTS)能力,支持同步与异步两种调用方式。所有请求由 GregAPI 转发到 MiniMax,无需自行签名,只需在 Header 中携带 GregAPI API Key。
统一使用:

接口列表

支持的模型

请求参数

情感枚举(emotion)

happy、sad、angry、fearful、disgusted、surprised、calm、fluent、whisper 该能力受模型与音色组合限制,并非所有 voice_id 都支持。

音效枚举(sound_effects)

spacious_echo、auditorium_echo、lofi_telephone、robotic

音色别名

为与 OpenAI 风格保持一致,平台为常见音色提供别名到 MiniMax 实际音色的映射: 在 voice_id 中填写上述别名时,平台会自动转换为 MiniMax 实际音色;当该音色存在默认情感时,会在未显式指定 emotion 时自动补全。

返回格式(audio_mode)

通过渠道自定义参数可设置音频返回模式:
  • audio_mode = json(默认):响应体以 JSON 返回,data.audio 为 hex 或 URL(由 output_format 决定)。
  • audio_mode = hex:当 output_format=hex 时返回裸音频流;当 output_format=url 时仍返回 JSON。

同步合成示例

output_format=hex 时,响应体为裸音频十六进制流,可直接落盘为 .mp3。 output_format=url 时,响应体以 JSON 返回,从 data.audio 读取音频 URL。

异步合成示例

查询结果:
异步合成在返回 JSON 载荷中会原样保留你的 voice_id 与参数;若使用了别名,平台会在上游请求前完成一次转换与情感补全。

计费说明

  • 按成功合成的音频计费,具体价格以控制台「模型价格」页面的 MiniMax 语音条目为准。
  • 以上游消费日志的实际结算金额为准。