Подразделение Microsoft AI представило генеративную модель MAI-Image-2.6, которая заняла вторую строчку в рейтинге генерации изображений LMArena. Обновление принесло прирост в +79 пунктов рейтинга Elo по сравнению с версией 2.5, позволив корпорации обойти конкурирующие решения от Meta, Google (Imagen) и xAI. Хотя сокращение отставания от лидеров рынка все еще требует серьезных усилий, прогресс в бенчмарках демонстрирует реальное улучшение архитектуры, а не поверхностную настройку.
Главный технический прорыв зафиксирован в рендеринге текста внутри изображений, где модель прибавила сразу +91 пункт Elo. Исторически неразборчивость надписей оставалась главным слабым местом диффузионных систем; преодоление этого барьера открывает прямые возможности для брендинга фотореалистичных продуктов, создания макетов интерфейсов и типографики в 3D-дизайне. Microsoft AI также отчиталась о стабильном росте показателей во всех подкатегориях LMArena, включая сложные портреты и работу с пространственным освещением.
Помимо борьбы за позиции в бенчмарках, данный релиз знаменует важный стратегический поворот для Редмонда. Развивая собственные базовые мультимодальные модели под брендом MAI, Microsoft последовательно снижает операционную зависимость от внешних партнеров вроде OpenAI. Корпорация делает ставку на корпоративный сегмент визуального контента, стремясь полностью контролировать собственный стек инференса, а не просто выступать каналом дистрибуции чужих весов.
Модель MAI-Image-2.6 уже доступна для публичного тестирования на платформе LMArena. На этой неделе начнется ее развертывание в MAI Playground, после чего последует интеграция в Microsoft Foundry и коммерческие сервисы компании.