在 Microsoft Foundry 中推出 MAI-Image-2.5 Pro 和 MAI-Voice-2 Flash
微软正在扩展其 AI 模型系列,以根据特定工作负载需求为客户提供更多选择。开发者和企业寻求针对高质量、响应速度或成本效益进行优化的模型。今天,微软推出两款新增模型:MAI-Image-2.5 Pro 和 MAI-Voice-2 Flash。MAI-Image-2.5 Pro 是一款高保真图像生成模型,专为需要视觉准确性和控制力的专业创意工作流而设计。它在活动资产创建、产品摄影和故事板制作等场景中表现卓越,这些场景对物体一致性和对创意意图的遵循至关重要。该模型优先考虑保真度而非吞吐量,因此非常适合生成无需过多编辑即可达到专业水准的成品资产。MAI-Voice-2 Flash 是一款专为实时语音应用构建的低延迟文本转语音模型,在这些应用中速度至关重要。它在 15 多种语言中提供更快的响应时间和更高的成本效益。该模型适用于呼叫中心坐席、对话式语音助手和交互式语音应答系统,以创造更自然、更即时的用户体验。MAI-Image-2.5 Pro 与其前身 MAI-Image-2.5 之间的选择取决于对最大保真度和创意质量与吞吐量的需求权衡。同样,MAI-Voice-2 Flash 适用于优先考虑低延迟和响应速度的场景,而 MAI-Voice-2 则更侧重于语音身份。MAI-Image-2.5 Pro 可通过 Microsoft Foundry 访问,MAI-Voice-2 Flash 则通过 Azure Speech 提供。