Взрывной спрос на вычислительные мощности со стороны корпоративных сетей — подстегиваемый большими языковыми моделями, автономными агентами и масштабными облачными нагрузками — вынуждает гиперскейлеров пересматривать баланс расходов на инфраструктуру. Microsoft готовится представить свой ИИ-ускоритель следующего поколения Maia 300 уже в сентябре. Этот шаг означает решительную эскалацию стратегии Редмонда по снижению зависимости от Nvidia, которая сжигает маржинальность облачного бизнеса. По данным источников в отрасли, Microsoft ведет активные переговоры с TSMC, чтобы зарезервировать производственные мощности для выпуска более 300 000 процессоров Maia 300 к 2027 году.
Запланированные объемы говорят о резком ускорении темпов по сравнению с предыдущими итерациями. Первое поколение ускорителей Maia компания представила в 2023 году, а в январе 2026 года выпустила Maia 200, чей тираж ограничился десятками тысяч единиц. И хотя руководство Microsoft публично заявляет о планах со временем преодолеть планку в миллион чипов, именно промежуточная цель в 300 000 процессоров обеспечивает неоспоримый экономический эффект для отчетности Azure.
Технический базис и экономика инференса
Хотя точные размеры кристалла, техпроцесс и коммерческие цены на Maia 300 держатся в секрете, чип Maia 200 дает представление об архитектурных ориентирах. Созданный по 3-нанометровому техпроцессу, Maia 200 получил 216 ГБ памяти HBM3e с пропускной способностью 7 ТБ/с и 272 МБ встроенной памяти SRAM, поддерживая объединение до 6 144 ускорителей в единую кластерную фабрику.
«По заявлениям Microsoft, производительность Maia 200 превышает 10 петафлопс при вычислениях в формате FP4 и более 5 петафлопс в формате FP8».
На практике Microsoft заявляет о сокращении затрат на токен на 30% по сравнению с универсальными графическими процессорами в своем парке серверов. Для руководителей инфраструктурных подразделений математика предельно ясна: снижение совокупной стоимости владения (TCO) инференс-инфраструктурой критически важно для защиты валовой маржи подписок на Copilot и удержания конкурентных цен на API для корпоративных клиентов, работающих с моделями OpenAI.
Рыночные реалии и защитный ров Nvidia
При этом собственное железо редко позволяет полностью отказаться от других поставщиков. Развертывание проприетарных чипов не способно подорвать позиции Nvidia на широком рынке — во многом из-за того, что экосистема CUDA и специализированные библиотеки вычислений намертво встроены в корпоративные процессы разработки. Microsoft действует прагматично: компания переводит на Maia внутренние сервисы и детерминированные циклы инференса, освобождая дефицитные кластеры Nvidia для устаревших стеков и клиентов, требующих нативного инструментария CUDA.
Для корпоративных заказчиков аппаратная экспансия Редмонда ускоряет фрагментацию рынка облачной инфраструктуры. Если Microsoft удастся масштабировать Maia 300 до сотен тысяч активных узлов, компания получит достаточный запас маржинальности, чтобы развязать агрессивную ценовую войну за стоимость обращений к размещенным моделям. Это поставит конкурентов без собственной микроэлектроники в уязвимое положение: им придется бороться за квоты на чипы и мириться с падающей маржой программных сервисов.