На мероприятии второго июня в Сан-Франциско Microsoft представит семейство моделей MAI. Команда Мустафы Сулеймана создает эти решения в рамках стратегии по снижению зависимости от OpenAI.
В линейку войдет MAI-Image-2.5 для генерации и редактирования изображений по загруженным файлам. Модель уже заняла третье место в рейтинге Arena после решений OpenAI и Google. Разработчики также выпустят быструю версию MAI-Image-2.5e.
Для работы со звуком готовят MAI-Transcribe-1.5 и MAI-Voice-2. Голосовая модель поддерживает пятнадцать языков и умеет передавать эмоции, включая шепот и гнев. Новинки интегрируют в Copilot, Teams и Azure Speech.
