ByteDance больше не намерена ограничиваться репутацией поставщика самых аддиктивных алгоритмов в мире. По данным Financial Times, материнская компания TikTok в настоящее время ведет предварительное обучение ИИ-гиганта, насчитывающего 10 триллионов параметров. Для сравнения: это в три раза превышает размер Kimi K3 от Moonshot AI — нынешнего тяжеловеса на внутреннем рынке Китая. Нацелившись на такой масштаб, ByteDance фактически бросает вызов мировым лидерам, сопоставляясь или даже превосходя слухи о потолке в 8 триллионов параметров у модели Mythos 5 от Anthropic.

Главное

Масштаб: Модель втрое больше самых мощных текущих китайских аналогов. Стратегия: Полный отказ от дистилляции в пользу собственных разработок. Команда: Проектом занимается подразделение Seed численностью 2000 человек. Сроки: Окно предварительного обучения составляет от трех до шести месяцев.

Стратегический контекст

Что делает этот шаг чем-то большим, чем просто демонстрация ресурсов, так это концептуальный сдвиг в разработке. Сообщается, что уже более года ByteDance не использует дистилляцию — вежливый отраслевой термин для обучения модели на результатах работы чужих систем. Отказ от этого короткого пути указывает на уверенность основателя Чжан Имина в проприетарных наборах данных и внутренних конвейерах обучения. Команда Seed не просто догоняет конкурентов; они пытаются выстроить оригинальную архитектуру с нуля, свободную от ограничений подержанного интеллекта.

Эра восприятия китайского ИИ как серии сложных «оболочек» или дистиллированных клонов, скорее всего, подходит к концу.

Логистический подвиг в данном случае — пожалуй, самая интригующая часть истории. Создание модели на 10 триллионов параметров требует колоссальной концентрации вычислительных мощностей, что остается серьезным вызовом в условиях ужесточающихся экспортных ограничений на чипы. В то время как xAI Илона Маска стремится к аналогичным порогам с кластером Colossus 2, ByteDance доказывает, что способна мобилизовать достаточно оборудования, чтобы оставаться в гонке. Это не спекулятивный научно-исследовательский проект; перед нами система, призванная перевернуть текущую иерархию больших языковых моделей в ближайшие несколько кварталов.

Итог

Этот сдвиг знаменует новую фазу в гонке вооружений ИИ, где законы масштабирования сталкиваются с геополитическим трением. Если ByteDance успешно развернет модель такой величины без опоры на западные разработки, это докажет, что огромные массивы данных и инженерная стойкость могут компенсировать дефицит полупроводников.

Большие языковые моделиИскусственный интеллектAI-чипыAnthropicByteDance