Эпоха, когда криптографические примитивы годами мариновались в экспертных рецензиях, подходит к логическому финалу. В Anthropic раскрыли карты: их невыпущенная модель Claude Mythos Preview вскрыла фундаментальные математические дефекты в алгоритмах шифрования, которые человеческий глаз упорно игнорировал. Важно понимать масштаб: это не поиск забытой точки с запятой или утечки памяти в коде. Модель обнаружила теоретические лазейки в самой «математике» — фундаменте, на котором держится всё, от банковских транзакций до обновлений критического софта. Результаты двух свежих работ Anthropic намекают: стандарты безопасности, которые мы считали незыблемыми, полны скрытых дверей, нанести которые на карту способна только нечеловеческая логика.
Кейс HAWK и пределы человеческой верификации
В первом исследовании Жигимантас Стразницкас и Стивен А. Вайс натравили Claude Mythos Preview на HAWK — прототип метода защиты от атак будущих квантовых компьютеров. Мировое сообщество криптографов два года изучало этот алгоритм под микроскопом и вынесло вердикт: «безопасно». Однако ИИ за считаные итерации нашел скрытый математический путь, который радикально снижает сложность взлома системы. По сути, модель вскрыла вектор атаки, который исследователи просмотрели за весь цикл верификации. Переход от поиска багов в софте к выявлению изъянов в математических доказательствах — это новая реальность безопасности.
Большая часть математических открытий в этой работе была сделана при помощи ИИ. Вклад авторов-людей заключался в основном в руководстве, организации процесса и проверке результатов.
Как отмечают Стразницкас и Вайс, ИИ взял на себя всю тяжелую «механику» открытия, превратив человека в высокоуровневого дирижера. В данном случае модель работала как инструмент, требующий надзора для упаковки выводов в связное доказательство. Очевидно, что для оценки сложных постквантовых кандидатов традиционного метода «человек читает статью» уже недостаточно — он не дает гарантий против изощренных логических эксплойтов.
Автономное изобретение: Мёбиус-бридж и анализ AES
Если в кейсе с HAWK ИИ нуждался в направляющей руке, то во втором исследовании Милада Насра и Николаса Карлини Claude Mythos Preview продемонстрировала пугающую автономность. Модели поручили проанализировать упрощенные версии AES (Advanced Encryption Standard) — глобального стандарта интернет-коммуникаций. Методы тестирования этих версий не менялись с 2013 года. Работая самостоятельно, ИИ изобрел новый математический прием, названный «Мёбиус-бридж» (Möbius Bridge). Эта инновация позволяет обходить фазы проб и ошибок, в которых обычно вязнут люди, ускоряя процесс аудита в 200–800 раз. Теперь проверку сложнейших структур можно проводить на скоростях, недоступных человеческому мозгу.
Произошедшее не означает, что завтра AES превратится в тыкву, но запас прочности существующих стандартов явно оказался меньше, чем мы привыкли думать. Для тех, кто принимает решения в R&D, вывод один: автоматизированная формальная верификация с помощью ИИ становится обязательным этапом разработки любой защищенной системы. Автономное создание концепции «Мёбиус-бридж» доказывает, что ИИ способен не только подражать, но и генерировать собственные аналитические фреймворки. Мы входим в мир, где единственным способом проверить безопасность системы будет использование другого ИИ, сопоставимого по мощности. На данном этапе человеку остается роль контролера: ИИ указывает на лазейку, и, как признают авторы исследования, после этой «наводки» аудит становится тривиальной задачей.