天籁语音识别
语音识别 基础产品 | 功能简介 | 免费并发路数 / QPS 额度 | 时效性 | 常见应用场景 | 支持语种(算法引擎) |
可对时长5小时以内的录音文件进行识别 | 接口限频:20次/秒(异步回调产品,仅限制接口请求频次) | 非实时 说明:异步回调,最长在3小时内完成识别,大多数情况下1小时音频约3分钟以内完成识别(半小时内发送超过1000小时录音或者2万条识别任务的除外) | 录音卡转写、会议转写、庭审数据录入、直播语音转写质检、课堂语音内容转写等时效性要求不高的场景 | 大模型2.0引擎: 16k_zh_en_meeting 中英大模型:中文普通话+英语+多方言混合引擎,除中英外,31种方言(粤语、武汉话、贵阳话、西安话、郑州话、太原话、兰州话、银川话、西宁话、南京话、合肥话、南昌话、长沙话、苏州话、杭州话、济南话、天津话、石家庄话、黑龙江话、吉林话、辽宁话、闽南语、客家话、南宁话、潮汕话、宁波话、无锡话、吴语、上海话、四川话、昆明话) |
说明:
在多人对话场景下,16k_zh_en_meeting 引擎对于多说话人重叠发声的转写准确率与说话人分离准确率均表现突出,建议使用时配合开启说话人分离。目前已应用在腾讯会议、元宝录音笔等产品。
以下功能正在开发中:
阿拉伯数字智能转换:当前支持根据场景智能转换为阿拉伯数字,暂不支持直接输出中文数字。
角色分离:当前支持说话人分离能力,暂不支持角色分离能力。
快速接入
1. 开通语音识别服务

2. 新建密钥


3. 调用服务