微软人工智能部门正式发布MAI-Transcribe-2-Streaming模型,该模型专为低延迟实时转录场景设计。与此同时,微软还推出了两款全新语音模型——MAI-Voice-2.1与MAI-Voice-2.1-Flash。

这一系列模型以高精度、高速度及低成本为核心竞争力,在音频理解与生成领域表现卓越,旨在赋能开发者打造业界顶尖的对话式语音智能体。