实时转录首次实现多语言支持
Azure AI Speech 已发布多语言流后优化功能,进入公开预览版。该新功能消除了实时转录中预先选择单一语言的先前要求,允许单个流在同一会话中自动检测并转录多种语言。这是一项重大进步,因为现实世界的语音往往涉及语言间的代码转换。优化后的转录稿在无需增加初始流式延迟的情况下,提供了更高的准确性。内部测试显示,在 Tier-1 区域中,平均词错误率相对降低了约 10%。对于长句和专有名词等挑战性内容,其降低幅度更大。该系统支持在 29 个市场区域中的 25 种语言上自动进行语言检测。该公开预览版可在六个 Azure 区域中使用。用户可使用 Speech SDK 1.50 或更高版本,并在支持的区域中配置语音资源来利用此功能。启用该功能仅需对 SpeechConfig 进行简单的配置更改。此增强功能尤其适用于存储或处理最终转录稿的应用程序。来自各个行业的客户已报告转录质量显著提升。随着该功能迈向一般可用性,我们欢迎用户反馈。