同步语音合成指南

同步语音合成支持基于文本到语音的同步生成,单次可处理最长 500 字符的文本。

支持模型

以下为 VUILabs 提供的语音模型及其特性说明。

支持语言

VUILabs 的语音合成模型具备卓越的跨语言能力,全面支持 40 种全球广泛使用的语言。我们致力于打破语言壁垒,构建真正意义上的全球通用人工智能模型。 目前支持的语言包含:

流式请求示例

本指南指导,流式播放返回的音频文件,并保存完整音频文件。 ⚠️ 注意,为实时播放音频流,需要先安装 mpv 播放器。并且,需要先将密钥信息写入环境变量 MINIMAX_API_KEY 请求示例

推荐阅读

同步语音合成 WebSocket

使用 API 接口,在WebSocket网络通信协议下进行同步语音合成。

同步语音合成 HTTP

使用 API 接口,在HTTP网络通信协议下进行同步语音合成。

产品定价

各模型的定价说明、计费方式及使用限制。

资源保障

为保证资源的高效使用,引入速率限制,以确保服务的可用性、稳定性。

To find navigation and other pages in this documentation, fetch the llms.txt file at: https://platform.minimaxi.com/docs/llms.txt