Защита скрытых цепочек рассуждений (Chain-of-Thought) у ведущих провайдеров оказалась фикцией. Согласно препринту arXiv:2608.09867, зашифрованные провайдерами рассуждения систем OpenAI, Anthropic и Google расшифровываются дословно, без использования джейлбрейков. Причина — фундаментальная архитектурная ошибка: зашифрованные блоки рассуждений взаимозаменяемы между сессиями, учетными записями и моделями внутри одного семейства. Чтобы прочесть закрытые мысли флагмана Opus, достаточно передать его шифротекст младшей модели Haiku — и она выдает весь ход мысли открытым текстом.

Эта уязвимость фактически обнуляет защиту от несанкционированной дистилляции. Конкуренты получают возможность дешево и напрямую копировать архитектуру логики флагманских моделей, обходя контрактные ограничения провайдеров. Корпоративные клиенты, полагавшиеся на изоляцию скрытых вычислений, сталкиваются с прямой утечкой проприетарной логики и чувствительных данных: анализ массива из 315 320 блоков выявил сотни учетных записей и персональных сведений, попавших в открытые репозитории.

Для CTO и руководителей AI-направлений вывод однозначен: передача зашифрованных блоков между контурами разрушает периметр конфиденциальности. Пока вендоры экстренно закрывают брешь, бизнесу не стоит рассматривать встроенный ризонинг как защищенную среду исполнения для критических корпоративных алгоритмов.

Безопасность ИИКибербезопасностьБольшие языковые моделиOpenAIAnthropic