Google официально представила мультимодальную модель Gemini Omni. Она объединяет логическое рассуждение с генерацией видео, изображений, аудио и текста. Первой стала доступна версия Gemini Omni Flash.
Модель уже открыта подписчикам Google AI Plus, Pro и Ultra, а также бесплатно встроена в YouTube Shorts и приложение YouTube Create. Доступ к API для разработчиков откроется в ближайшие недели.
Главное отличие от обычных генераторов заключается в понимании физики и контекста. Модель позволяет редактировать видео через диалог, сохраняя постоянство персонажей и сцены. Все сгенерированные материалы автоматически маркируются цифровым водяным знаком SynthID.

