Пока индустрия продолжает закидывать проблемы дефицитными чипами NVIDIA, стартап LiquidAI решил пойти против течения и доказать, что архитектурное изящество важнее грубой силы. Компания представила энкодеры LFM2.5 (версии на 230M и 350M параметров), которые элегантно обходят родовое проклятие трансформеров — квадратичную сложность при работе с длинным контекстом. Там, где классические модели начинают «задыхаться» от объема данных, LiquidAI сохраняет завидную бодрость.

Техническое превосходство и независимость от GPU

Технические характеристики выглядят как приговор для старых архитектур:

На дистанции в 8 тысяч токенов эти энкодеры работают в 3,7 раза быстрее, чем ModernBERT-base. Результат достигается на стандартных CPU, которые годами простаивали в серверных стойках. Использование двунаправленного внимания и механизма коротких сверток (non-causal short convolutions) позволяет вычислительным затратам расти линейно, а не экспоненциально.

Новые возможности для бизнеса

Для CTO и владельцев продуктов это сигнал к пересмотру бюджетов на облака. Теперь такие задачи, как автоматический аудит политик, детектирование персональных данных (PII) и классификация тяжелых документов, можно перенести с перегретого рынка GPU на собственную инфраструктуру.

Это не просто экономия, а возможность развернуть полноценный NLP-стек здесь и сейчас, не дожидаясь квот на видеокарты.

При этом малый размер моделей не должен вводить в заблуждение: в тестах GLUE и SuperGLUE компактный LFM2.5-Encoder-350M обходит куда более массивных конкурентов.

Итоги: эффективность важнее хайпа

На наш взгляд, этот релиз закрывает вопрос о том, что размер параметров является единственным мерилом качества. LiquidAI фактически превращает CPU в полноправных участников AI-стека, избавляя компании от унизительной зависимости от поставок «железа». Вы получаете фильтры безопасности и классификаторы промышленного уровня, которые работают на том, что у вас уже есть под рукой. В мире, где эффективность важнее хайпа, побеждают те, кто умеет считать деньги и оптимизировать код, а не просто сжигать тераватты в погоне за лишним миллиардом параметров.

ПроизводительностьСнижение затратЛокальный ИИМашинное обучениеLiquidAI