Anthropic выпустила API для проверки цифровых водяных знаков, позволяющий одобренным организациям определять, был ли произвольный текст сгенерирован моделью Claude. Релиз напрямую обусловлен требованиями закона ЕС об искусственном интеллекте (EU AI Act) о прозрачности синтетического контента, вступившими в силу в августе 2025 года. Этот шаг превращает атрибуцию моделей из абстрактных исследований в области безопасности в реальный инструмент корпоративного аудита. На текущем этапе доступ открыт только для регуляторов, исследователей, медиа и корпоративных служб комплаенса, а более широкое развертывание запланировано на следующие фазы.

С технической точки зрения система адаптирует фреймворк SynthID от Google, точечно корректируя вероятности выбора токенов при генерации для внедрения статистически верифицируемой сигнатуры. В Anthropic утверждают, что этот скрытый след устойчив к умеренному перефразированию, не содержит метаданных пользователей и не снижает семантическое качество текста — хотя независимые практики по-прежнему скептически оценивают, действительно ли ограничения при выборе токенов позволяют избежать едва заметной деградации ответов.

Для руководителей бизнеса этот API создает прямые операционные риски в автоматизированных процессах подготовки документации и контента. Юридические эксперты подчеркивают, что надежная проверка водяных знаков осложняет биллинг клиентских часов и вскрывает нарушения в контрактах, прямо запрещающих использование генеративного ИИ. Проверка соответствия больше не зависит от ненадежных эвристических детекторов: корпоративные рабочие процессы столкнулись с детерминированным отслеживанием происхождения данных независимо от того, готовы они к этому или нет.

AnthropicРегулирование ИИГенеративный ИИБезопасность ИИИИ в бизнесе