概述
Tokenhub 已上线 MiniMax 音色设计(文生音色)能力,通过语音合成接口下的
sync_design 端点实现,本文基于 MiniMax 官方 voice_design 接口编写,调用参数与原厂基本一致,详情请参见 MiniMax API 文档。功能说明:音色设计(voice design / 文生音色)指用自然语言描述您期望的音色(如性别、年龄、音色特征、情绪、场景等),由系统据此生成一个全新的虚拟音色(返回唯一
voice_id),无需任何参考音频。后续在 TTS 语音合成接口传入该 voice_id,即可让任意文本以此音色朗读。适用于从零创造角色声音、虚拟主播、特定风格配音等场景。试听音频由平台默认 TTS 引擎合成。说明:
设计得到的临时音色若 7 天内未正式调用,系统会删除该音色。
调用本接口获得设计音色时,不会立即收取音色设计费用。音色的设计费用将在首次使用此音色进行语音合成时收取。试听按字符计费。具体价格请参见 模型价格。
前提条件
已 注册腾讯云 账号并开通 TokenHub 服务。
已在 TokenHub 控制台 获取 API Key。
接口信息
项 | 值 |
地址 | https://tokenhub.tencentmaas.com/v1/wand/minimax-tts/sync_design |
方法 | POST |
Content-Type | application/json |
鉴权 | Authorization: Bearer YOUR_API_KEY |
请求体
请求示例
curl -X POST 'https://tokenhub.tencentmaas.com/v1/wand/minimax-tts/sync_design' \\-H 'Authorization: Bearer YOUR_API_KEY' \\-H 'Content-Type: application/json' \\-d '{"model": "minimax-voice-design","prompt": "讲述悬疑故事的播音员,声音低沉富有磁性,语速时快时慢,营造紧张神秘的氛围。","preview_text": "夜深了,古屋里只有他一人。窗外传来若有若无的脚步声,他屏住呼吸,慢慢地,慢慢地,走向那扇吱呀作响的门……"}'
请求参数
说明:
参数 | 类型 | 必选 | 说明 |
model | string | 是 | 固定传 minimax-voice-design。 |
prompt | string | 是 | 音色描述(自然语言),描述性别、年龄、音色特征、情绪、场景等。 |
preview_text | string | 是 | 试听音频文本,≤ 500 字符(试听由平台默认 TTS 引擎合成,按 T2A 标准计费)。 |
voice_id | string | 否 | 自定义生成音色的 id;不传则自动生成并返回唯一 id。 |
output_format | string | 否 | 试听音频返回形式,默认 hex,可选 url / hex(url 有效期 24h)。 |
aigc_watermark | boolean | 否 | 末尾添加音频节奏标识,默认 false。 |
返回体
返回示例
{"voice_id": "ttv-voice-2025060717322425-xxxxxxxx","trial_audio": "<hex 编码音频或音频 URL,取决于 output_format>","base_resp": {"status_code": 0,"status_msg": "success"},"usage":{"total_token":1920}}
返回字段
说明:
字段 | 类型 | 说明 |
voice_id | string | 生成的音色 id,可用于后续语音合成。 |
trial_audio | string | 使用生成音色合成的试听音频(hex 编码或 URL,取决于 output_format)。 |
base_resp | object | 本次请求的状态码与详情。 |
base_resp.status_code | integer | 状态码( 0 表示正常,详见下方错误码)。 |
base_resp.status_msg | string | 状态详情。 |
usage | object | 用量。 |
usage.total_token | integer | 消耗 token 数。 |
错误码