Microsoft Teams Blog articles на русском
Подписаться
Представляем MAI-Image-2.5 Pro и MAI-Voice-2 Flash в Microsoft Foundry
Microsoft расширяет семейство своих ИИ-моделей, чтобы предложить клиентам больший выбор, основанный на конкретных потребностях рабочих нагрузок. Разработчики и предприятия ищут модели, оптимизированные либо для высокого качества, либо для отзывчивости и экономической эффективности. Сегодня Microsoft представляет два новых дополнения: MAI-Image-2.5 Pro и MAI-Voice-2 Flash.MAI-Image-2.5 Pro — это модель генерации изображений с высокой точностью, разработанная для профессиональных творческих рабочих процессов, требующих визуальной точности и контроля. Она отлично подходит для таких сценариев, как создание рекламных материалов, предметная фотография и раскадровка, где важны согласованность объектов и соответствие творческому замыслу. Эта модель отдает приоритет точности над пропускной способностью, что делает ее идеальной для создания отполированных, профессиональных материалов с минимальным редактированием.MAI-Voice-2 Flash — это новая модель преобразования текста в речь с низкой задержкой, созданная для приложений голосового взаимодействия в реальном времени, где скорость имеет первостепенное значение. Она предлагает более быстрое время отклика и большую экономическую эффективность более чем на 15 языках. Эта модель подходит для операторов колл-центров, голосовых помощников и систем интерактивного голосового ответа для создания более естественного и немедленного пользовательского опыта.Выбор между MAI-Image-2.5 Pro и ее предшественницей, MAI-Image-2.5, зависит от необходимости максимальной точности и творческого качества по сравнению с пропускной способностью. Аналогично, MAI-Voice-2 Flash предназначена для сценариев, где приоритет отдается низкой задержке и отзывчивости, в то время как MAI-Voice-2 больше фокусируется на голосовой идентичности. MAI-Image-2.5 Pro доступна через Microsoft Foundry, а MAI-Voice-2 Flash — через Azure Speech.