Microsoft FoundryにおけるMAI-Image-2.5 ProおよびMAI-Voice-2 Flashの紹介
Microsoftは、特定のワークロードのニーズに基づいた、より多くの選択肢をお客様に提供するために、AIモデルファミリーを拡大しています。開発者や企業は、高い品質または応答性とコスト効率のいずれかに最適化されたモデルを求めています。本日、Microsoftは2つの新しいモデルを発表します:MAI-Image-2.5 ProとMAI-Voice-2 Flashです。MAI-Image-2.5 Proは、視覚的な精度と制御を必要とするプロフェッショナルなクリエイティブワークフロー向けに設計された、高忠実度の画像生成モデルです。オブジェクトの一貫性とクリエイティブな意図への準拠が重要な、キャンペーンアセット作成、製品写真撮影、ストーリーボードなどのシナリオで優れています。このモデルはスループットよりも忠実度を優先するため、最小限の編集で洗練されたプロフェッショナルなアセットを作成するのに理想的です。MAI-Voice-2 Flashは、速度が最優先されるリアルタイム音声アプリケーション向けに構築された、新しい低遅延テキスト読み上げモデルです。15以上の言語で、より高速な応答時間と高いコスト効率を提供します。このモデルは、コールセンターエージェント、会話型音声アシスタント、およびインタラクティブボイスレスポンスシステムに適しており、より自然で即時的なユーザーエクスペリエンスを作成できます。MAI-Image-2.5 Proとその前身であるMAI-Image-2.5の選択は、スループットに対する最大の忠実度とクリエイティブ品質の必要性によって異なります。同様に、MAI-Voice-2 Flashは低遅延と応答性を優先するシナリオ向けであり、MAI-Voice-2は音声IDにより焦点を当てています。MAI-Image-2.5 ProはMicrosoft Foundryを通じて、MAI-Voice-2 FlashはAzure Speechを通じて利用可能です。