首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >混元Hy ASR 3.0把方言WER打到3%,但一线语音质检的坎从来不在识别率上

混元Hy ASR 3.0把方言WER打到3%,但一线语音质检的坎从来不在识别率上

作者头像
用户12531518
修改2026-08-06 16:34:12
修改2026-08-06 16:34:12
1550
举报
概述
腾讯混元8月4日放出Hy ASR 3.0 preview,8月6日又追加了一版更新,主打方言、噪声、远场三个场景的识别能力,中文普通话WER压到3.34%,粤语3.12%。同一周,行业里另一条线也在动:语音交互正从"ASR+NLP+TTS"三段式级联,往端到端的Speech-to-Speech方向迁移,云端延迟压到250ms-700ms区间。

原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。

如有侵权,请联系 cloudcommunity@tencent.com 删除。

目录
  • 一线录音和标准测试集不是一回事
  • 质检系统不该和某一版ASR模型强绑定
  • 换模型不等于全量重测
  • 方言场景还有一层容易被忽略的东西
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档