腾讯发布语音识别模型Hy ASR 3.0 preview:中文普通话词错误率为3.34%
科技
科技 > 人工智能 > 正文

腾讯发布语音识别模型Hy ASR 3.0 preview:中文普通话词错误率为3.34%

凤凰网科技讯 8月4日,腾讯混元发布新一代语音识别模型Hy ASR 3.0 preview。该模型基于最新大语言模型Hy3,融合语音识别与深度语义理解,旨在从“逐字转写”演进为“理解语境、兼容场景”。在开源评测集中,Hy ASR 3.0 preview的中文普通话WER(词错误率)为3.34%,英语为2.62%,粤语为3.12%。

技术层面,模型采用MoE架构,基座模型升级为Hy3,自研无监督语音Encoder通过数千万小时级语音数据训练,并引入多阶段强化学习优化。Hy ASR 3.0重点提升了通用识别、上下文意图理解(如智能纠错同音词)、专词识别(支持热词注入)及复杂声学环境(高噪、耳语)下的稳定性。

目前该模型已上线腾讯云提供API服务,元宝已首发上线并免费开放方言识别、上下文纠错等功能,WorkBuddy等产品也在陆续接入中。

亲爱的凤凰网用户:

您当前使用的浏览器版本过低,导致网站不能正常访问,建议升级浏览器

第三方浏览器推荐:

谷歌(Chrome)浏览器 下载

360安全浏览器 下载