微软于2026年10月2日推出语音生成AI模型,官方称其成本更低、准确率高于ElevenLabs、SpaceXAI及谷歌的竞品。

该模型可驱动Teams会议通话转写等场景,微软表示其语音识别词错率较上一代降低18%,推理成本仅为同类模型的60%。

成本降至竞品六成,将降低企业部署AI语音智能体的门槛,会议转写等场景的规模化落地进一步加速。

来源:权威科技媒体