Skip to main content

支持模型

以下为 MiniMax 提供的语音模型及其特性说明。

支持语言

MiniMax 的语音合成模型具备卓越的跨语言能力,全面支持 40 种全球广泛使用的语言。我们致力于打破语言壁垒,构建真正意义上的全球通用人工智能模型。 目前支持的语言包含:

接入地址

同步语音合成的 3 个接口均支持以下域名,华北地区建议接入 api-bj.minimaxi.com,首包延迟更低。

流式请求示例

本指南指导,流式播放返回的音频文件,并保存完整音频文件。 ⚠️ 注意,为实时播放音频流,需要先安装 mpv 播放器。并且,需要先将密钥信息写入环境变量 MINIMAX_API_KEY。 请求示例

推荐阅读

同步语音合成(HTTP)

通过 HTTP 请求一次提交完整文本并返回合成音频,支持流式输出。

同步语音合成(WebSocket)

通过 WebSocket 连接由客户端按句发送文本,流式返回合成音频,适合低延迟的实时播报。

双向流式语音合成(WebSocket)

通过 WebSocket 连接按任意粒度(含逐字)流式发送文本,由服务端自动攒句合成,适合对接大模型流式输出。

产品定价

各模型的定价说明、计费方式及使用限制。

速率限制

为保证资源的高效使用,引入速率限制,以确保服务的可用性、稳定性。