Anthropic согласилась на рекордную выплату в $1,5 млрд, чтобы закрыть коллективный иск от авторов книг. Это крупнейшее в истории мировое соглашение по вопросам авторского права, одобренное федеральным судом Сан-Франциско, фактически легализует сомнительное прошлое стартапа. Суть претензий сводилась к тому, что в 2021–2022 годах компания без зазрения совести скачивала базы LibGen и PiLiMi для обучения своих моделей. Из почти полумиллиона произведений авторы смогли подтвердить права на 91,3%, что вылилось в «ценник» около $3000 за одну книгу. Для Дарио Амодеи и инвесторов это не поражение, а вполне прагматичная покупка входного билета в высшую лигу.
Юридические тонкости и прецедент «отмывания» данных
Дьявол здесь кроется в юридических нюансах. Судья Алсуп ранее четко обозначил позицию: обучение ИИ на законно полученных данных — это «впечатляющая трансформация» и добросовестное использование (fair use). Выплачивая эти полтора миллиарда, Anthropic закрывает вопрос именно незаконного приобретения контента, то есть банального пиратства, а не самой технологии обучения.
На наш взгляд, это создает опасный прецедент «отмывания» данных: гиганты индустрии теперь могут просто заложить штрафы в совокупную стоимость владения (TCO) технологией. Для малых игроков, не способных выписать чек на миллиард, вход в сектор становится практически невозможным.
Будущее Claude и фильтрация вывода
Несмотря на финансовое перемирие, авторы оставили за собой право на новые иски, если Claude начнет дословно цитировать их произведения в ответах. Это заставляет Anthropic сместить фокус с очистки обучающей выборки на жесткую фильтрацию вывода.
Вместо того чтобы менять стратегию сбора данных, компания будет латать дыры в безопасности, чтобы модель не «проболталась» лишним. По сути, мы наблюдаем, как крупные AI-лаборатории превращают судебные издержки в инструмент монополизации рынка под прикрытием заботы об авторском праве.