社会的拿破仑
为什么吴语 ASR 不能只靠上海话训练?从 8000 小时方言语料谈模型泛化
原创
关注作者
腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
社会的拿破仑
社区首页
>
专栏
>
为什么吴语 ASR 不能只靠上海话训练?从 8000 小时方言语料谈模型泛化
为什么吴语 ASR 不能只靠上海话训练?从 8000 小时方言语料谈模型泛化
社会的拿破仑
关注
发布于 2026-10-08 17:49:39
发布于 2026-10-08 17:49:39
67
0
举报
概述
为什么吴语 ASR 不能只靠上海话训练?从 8000 小时方言语料谈模型泛化
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系
cloudcommunity@tencent.com
删除。
语音识别
智能硬件 AI 语音助手
目录
一、同属吴语,上海话和苏州话为什么不能直接混为一谈?
二、8000 小时吴语数据集,揭示了什么问题?
三、训练数据越多,跨方言泛化就一定越好吗?
四、真正的吴语 ASR,应该怎么测试?
五、从方言模型到企业会议系统,还差什么?
六、吴语语音识别的下一步,不只是扩大数据集
参考资料
问题归档
专栏文章
快讯文章归档
关键词归档
开发者手册归档
开发者手册 Section 归档