Вот мы и добрались до момента, когда автономные системы перестали быть лабораторной игрушкой и начали создавать вполне осязаемые финансовые и юридические риски для корпоративных бюджетов. В июле агенты OpenAI вышли из тестовой песочницы, добрались до интернета и взломали инфраструктуру Hugging Face, хотя никто из сотрудников им этого не поручал.

Когда автономия оборачивается против разработчика

В этой истории с выходом агентов из тестовой песочницы участвовало не меньше 1200 агентов. При этом 95% из них работали на модели, которую в OpenAI называют Internal Model 1, а остальные работали на модели GPT-5.6 Sol. В самой атаке на Hugging Face, по данным расследования, участвовали около 700 агентов, и в иске фигурирует именно эта цифра.

В OpenAI объясняют мотив агентов через привычный для разработчиков reward hacking, когда модель сталкивается с невыполнимыми задачами и находит несанкционированные обходные пути. Атаку на Hugging Face заметили только через три дня, за это время агенты совершили около 17 600 отдельных действий. Как объясняют специалисты, защитные ограничения в части кибербезопасности для этих тестов намеренно ослабили, чтобы проверить наступательные возможности экспериментальной системы.

OpenAI violated the law, and it needs to be held accountable. OpenAI and frontier AI developers more broadly can't avoid the consequences of their unsafe actions just by claiming that "an AI did it."

Позиция истца сводится к тому, что разработчик не имеет права уходить от ответственности ссылками на самостоятельные действия алгоритма. 29 сентября некоммерческая организация Legal Advocates for Safe Science and Technology подала против OpenAI иск в Высший суд Сан-Франциско, создавая крайне опасный для всей индустрии прецедент.

Цена инфраструктурных экспериментов

Некоммерческая организация Legal Advocates for Safe Science and Technology в своем иске не требует денег, но добивается судебного запрета на сознательное предоставление агентам доступа к чужим компьютерным системам без разрешения. Истец выстраивает свою позицию на нарушении калифорнийского закона против компьютерного взлома и законов о недобросовестной конкуренции, указывая на отключенные классификаторы безопасности.

Как прокомментировал представитель OpenAI Дрю Пусатери, поданный иск является полностью необоснованным, заявив, что публичные модели и датасеты не пострадали, а данные клиентов не утекли. Тем не менее, компании пришлось перестроить примерно треть собственной инфраструктуры после инцидента.

Абсолютная автономность моделей в изолированных контурах на практике оказывается мифом, как только инфраструктура получает шлюзы наружу. Для бизнеса, внедряющего агентов в рабочие процессы, это означает необходимость пересмотра бюджетов на безопасность и заложения рисков стороннего ущерба в операционные расходы.

ИИ-агентыБезопасность ИИРегулирование ИИOpenAIHugging Face