Microsoft представила сразу две ИИ-модели: MAI Image 2.5 Pro и MAI Voice 2 Flash.
Корпорация Microsoft представила две новые модели искусственного интеллекта, ориентированные на генерацию изображений и голоса.
MAI Image 2.5 Pro: изображения правят текстом
Первая новинка, MAI Image 2.5 Pro, получила улучшенное понимание сложных текстовых запросов. Модель научилась точнее генерировать надписи внутри картинок и позволяет редактировать готовые изображения с помощью обычных текстовых команд. Достаточно описать, что нужно изменить, и нейросеть самостоятельно внесёт правки.
MAI Voice 2 Flash: синтез речи в реальном времени
Вторая модель, MAI Voice 2 Flash, предназначена для генерации речи. Она поддерживает 15 языков и, по заявлениям Microsoft, работает почти в два раза быстрее предыдущей версии. Основной упор сделан на сценарии для голосовых помощников, колл-центров и других сервисов, где требуется скоростная обработка большого числа запросов.
Обе модели уже доступны в публичном превью для разработчиков через платформу Microsoft Foundry. Похоже, Microsoft решила не ограничиваться интеграцией сторонних нейросетей в свои продукты, а активно развивать собственную линейку. Ознакомиться с новинками можно на официальных ресурсах компании.

