Anthropic почти целый год — с мая 2025 по апрель 2026 года — эксплуатировала свои передовые модели без активных классификаторов биологических и химических угроз. Об этом компания сообщила в свежем отчете по безопасности. Защитные барьеры, разработанные специально для предотвращения генерации практических инструкций по созданию оружия массового поражения (химического, биологического, радиологического и ядерного — CBRN), были полностью отключены для всего входящего трафика от внешних подрядчиков по разметке данных.
Инфраструктурная уязвимость затронула около 50 000 сторонних специалистов, которые провели порядка 133 миллионов диалоговых сессий без контроля критически важных фильтров безопасности. В Anthropic признали, что проверка этих подрядчиков возлагалась исключительно на сторонние агентства, чьи протоколы верификации оказались недостаточными. Хотя лаборатория утверждает, что последующий аудит не выявил попыток создания оружия, инцидент вскрывает серьезные проблемы в базовом управлении инфраструктурой безопасности.
Это признание резко контрастирует с жесткой публичной риторикой генерального директора Дарио Амодеи, который регулярно называет распространение биооружия с помощью ИИ цивилизационной угрозой, превосходящей по масштабам кибервойны. Предупреждения о катастрофических биорисках на слушаниях в Вашингтоне на фоне незакрытых исключений в боевой маршрутизации трафика обнажают глубокий разрыв между маркетингом безопасности и реальной инженерной дисциплиной.