Власть Nvidia на рынке искусственного интеллекта никогда не держалась исключительно на кремнии — ее фундаментом служит армия примерно из четырех миллионов разработчиков, запертых в теплых объятиях программной экосистемы CUDA. Но монополии, построенные на проприетарном софте, неизбежно провоцируют агрессивные обходные маневры. Согласно официальному заявлению в WeChat-канале DeepSeek, китайский разработчик систем искусственного интеллекта объединил усилия с Huawei для выпуска открытого программного инструментария, созданного специально под чипы Huawei Ascend.
Главной жемчужиной этого релиза стал TileLang — язык программирования с открытым исходным кодом, изначально разработанный исследователями из Пекинского университета и прошедший боевое крещение в собственной инфраструктуре DeepSeek на протяжении примерно года. Как отмечается в описании релиза, TileLang предлагает более чистую модель программирования, чем CUDA, одновременно выжимая максимум производительности из ускорителей не от Nvidia. Это не очередное пустое обещание экосистемы — это рабочий код, созданный для того, чтобы кремний от Huawei стал жизнеспособным без необходимости переписывать софт.
Аппаратные кластеры и экспортное давление
Сам по себе софт не обучает большие модели, поэтому DeepSeek и Huawei также спроектировали суперкластер узлов на базе 128 чипов Ascend 950. Этот аппаратный рывок происходит на фоне собственных анонсов процессоров от Huawei, где компания ясно дала понять, что именно эти системы станут основой для внутренних запусков обучения в следующем году.
"Ссылаясь на экспортный контроль США, действующий председатель правления Huawei Эрик Сюй заявил, что компания не может смириться с будущим, зависящим от того, захочет ли кто-то еще продавать чипы в Китай."
Поскольку внутренний спрос значительно превосходит предложение, Huawei оставляет чипы дома, делая ставку на полную поддержку стека программного обеспечения, чтобы заставить местное железо работать.
Смена динамики в инференсе и поддержке моделей
Трещины в проприетарных программных бастионах появляются и в других местах. Проведя тесты кастомного чипа инференса Jalapeño от OpenAI, аналитики из SemiAnalysis объявили монополию CUDA потенциально мертвой, учитывая то, с какой скоростью OpenAI портирует новые модели на проприетарный кремний. В ходе их тестирования Jalapeño превзошел чипы Blackwell от Nvidia по показателю производительности на ватт почти во всех бенчмарках, доказав, что оптимизация проприетарного железа побеждает привязку к универсальному софту везде, где важна скорость выполнения.
Проверьте свои действующие конвейеры развертывания инференса на этой неделе, чтобы убедиться: ваш инструментарий не опирается строго на примитивы, привязанные к CUDA, и способен работать с независимыми языковыми компиляторами вроде TileLang, пока ваш поставщик инфраструктуры не начал диктовать вам уровень маржинальности.