Содержание
MAI-Image-2.6: что улучшила Microsoft и где попробовать модель
Microsoft представила MAI-Image-2.6 — новую версию своей модели для генерации изображений. В слепом пользовательском рейтинге Arena она заняла второе место среди text-to-image моделей и, по данным компании, опередила решения Meta*, Google и xAI.
Что изменилось в MAI-Image-2.6
По сравнению с MAI-Image-2.5 общий рейтинг модели вырос на 79 пунктов Elo. Самый заметный скачок произошёл в генерации текста внутри картинки: здесь прибавка составила 91 пункт. Для создателей рекламных макетов, постеров и карточек товаров это особенно важно, потому что надписи остаются одним из самых сложных элементов для генераторов изображений.
Microsoft также заявляет о более качественных портретах и 3D-сценах, а ещё о более аккуратных коммерческих и фотореалистичных результатах. Модель должна лучше справляться с продуктовыми визуалами, брендингом и кинематографичными кадрами — то есть с задачами, где важны не только идея, но и финальная полировка изображения.
Где попробовать модель
MAI-Image-2.6 уже доступна для генерации по тексту в Arena. Позже на этой неделе Microsoft обещает добавить её в MAI Playground, а затем развернуть в Microsoft Foundry и других продуктах компании.
В анонсе также упомянуты работа с несколькими референсами, более глубокое понимание контекста и расширенный контроль над рассуждением, форматом и разрешением. Подробности этих функций Microsoft пока не раскрыла и обещает рассказать о них отдельно.
Почему это важно для креаторов
Высокая позиция в Arena показывает, что собственная линейка Microsoft быстро догоняет лидеров рынка. Но рейтинг не заменяет тест на реальных задачах: авторам и маркетологам стоит отдельно проверить точность надписей, сохранение стиля между сериями изображений и качество лиц, упаковки и мелких деталей.
* Meta Platforms Inc. признана экстремистской организацией и запрещена на территории РФ.