帮你快速理解、总结文档立即下载

天籁 ASR(正式版)

最近更新时间:2026-09-09 15:42:14
本文档已由 AI 辅助审校
我的收藏

天籁语音识别

本文将介绍天籁 ASR(正式版)的信息,本次上线的引擎支持录音文件识别,以接口形式(PaaS 级)提供产品服务,计费详情仅适用于大模型2.0计费方案,详情请参见 计费概述(在线版)
语音识别
基础产品
功能简介
免费并发路数 / QPS 额度
时效性
常见应用场景
支持语种(算法引擎)
可对时长5小时以内的录音文件进行识别
接口限频:20次/秒(异步回调产品,仅限制接口请求频次)
非实时
说明:异步回调,最长在3小时内完成识别,大多数情况下1小时音频约3分钟以内完成识别(半小时内发送超过1000小时录音或者2万条识别任务的除外)
录音卡转写、会议转写、庭审数据录入、直播语音转写质检、课堂语音内容转写等时效性要求不高的场景
大模型2.0引擎:
16k_zh_en_meeting 中英大模型:中文普通话+英语+多方言混合引擎,除中英外,31种方言(粤语、武汉话、贵阳话、西安话、郑州话、太原话、兰州话、银川话、西宁话、南京话、合肥话、南昌话、长沙话、苏州话、杭州话、济南话、天津话、石家庄话、黑龙江话、吉林话、辽宁话、闽南语、客家话、南宁话、潮汕话、宁波话、无锡话、吴语、上海话、四川话、昆明话)
说明:
在多人对话场景下,16k_zh_en_meeting 引擎对于多说话人重叠发声的转写准确率与说话人分离准确率均表现突出,建议使用时配合开启说话人分离。目前已应用在腾讯会议、元宝录音笔等产品。
以下功能正在开发中:
阿拉伯数字智能转换:当前支持根据场景智能转换为阿拉伯数字,暂不支持直接输出中文数字。
角色分离:当前支持说话人分离能力,暂不支持角色分离能力。

快速接入

1. 开通语音识别服务

请先参考 一分钟接入服务端 API,开通语音识别服务。


2. 新建密钥

进入 控制台 新建密钥,生成 AppID、SecretID 和 SecretKey,用于 API 调用时生成签名,签名将用来进行接口鉴权。




3. 调用服务

调用服务时请参考录音文件识别 API 文档 录音文件识别请求 进行调用,engine_model_type 参数选择 16k_zh_en_meeting 即为使用天籁语音识别。