云知声语音大模型U2-ASR与U2-TTS全面升级 新增13种国际语言识别能力

来源:爱集微 #云知声#
1206

云知声于7月28日发布自愿性公告,宣布公司已全面完成U2-ASR与U2-TTS的能力升级,在语音大模型领域实现从“百种方言”本土深耕到“全球多语种”的广域覆盖,进一步夯实全球化语音交互基础设施能力。

此次升级中,U2-ASR新增13种国际语言识别能力,覆盖欧洲、东南亚、中东及拉美等重点出海市场;U2-TTS新增8种东南亚语言语音合成能力。至此,U2语音大模型已支持超100种中国方言及超15种国际语言,企业只需接入一个模型、一套接口,即可处理不同语言的音频内容,大幅降低多语种语音业务的开发、部署和维护门槛。

在性能表现方面,公告显示,在统一评测口径下,U2-ASR在113种语言的平均字错率(CER)仅为6.58%。在未传入语种标签的真实业务场景中,凭借自动语种识别与闲集路由能力依然保持高准确率。同时,在ChinaVoices Challenge 2026中文多方言语音识别挑战赛中,U2-ASR以CER 9.235%获得限定数据方案第1名、开放数据方案第2名的双榜领先成绩。U2-TTS在可信度与自然度主观评测中综合表现领先业界主流模型,并采用流式神经网络声学模型实现逐chunk实时输出24kHz高保真语音,首包延迟显著降低,可满足实时语音对话等强时效交互需求。

公司表示,此次升级使U2-ASR与U2-TTS能够无缝协同,为企业构建面向智能体的完整多语种语音交互链路。目前,升级后的U2-ASR与U2-TTS已全量上线公司TokenHub大模型服务平台并开放标准API。公司将持续践行“智能向善”理念,以科技之力打破语言壁垒,推动AI技术普惠共享。

责编: 张轶群
来源:爱集微 #云知声#
THE END

*此内容为集微网原创,著作权归集微网所有,爱集微,爱原创

关闭
加载

PDF 加载中...