Правовое поле вокруг обучения передовых моделей стремительно сужается. Издания The Seattle Times и Newsday подали совместный иск против OpenAI и Microsoft в федеральный суд, обвинив обоих технологических гигантов в систематическом несанкционированном сборе материалов региональной журналистики для обучения больших языковых моделей, таких как ChatGPT и Copilot. В иске не стесняются в выражениях, описывая генеративный ИИ как «змею, пожирающую собственный хвост»: система поглощает авторские репортажи лишь для того, чтобы выдавать вторичные копии, которые каннибализируют оригинальные издания.

Момент для иска создает неловкую ситуацию в Редмонде. Ранее Microsoft и OpenAI финансировали отдельные стипендиальные программы The Seattle Times и местные инициативы, однако эти символические пожертвования явно не помогли купить иммунитет от претензий. Представитель Microsoft заявил изданию GeekWire, что компания удивлена иском, но остается открытой к диалогу — стандартная формулировка, за которой скрывается стремительно растущий объем юридических обязательств.

Переход от конфликтов с национальными медиагигантами, такими как продолжающийся с 2023 года процесс The New York Times, к искам от региональных издателей сигнализирует об опасном масштабировании проблемы для разработчиков ИИ: формировании прецедента коллективных исков. То, что начиналось как локальная борьба с элитными СМИ, превращается в масштабную осаду всей экосистемы локальной прессы за нарушение авторских прав. Для создателей ИИ эпоха отношения к общедоступным веб-данным как к бесконечному бесплатному шведскому столу официально завершена.

Для руководителей корпоративного сектора этот юридический сдвиг напрямую меняет экономику внедрения ИИ. Поскольку разработчики моделей вынуждены заключать лицензионные соглашения на контент во избежание разрушительных компенсаций по закону, базовая стоимость обучения передовых систем вырастет. Что еще важнее, B2B-клиенты, использующие коммерческие API, сталкиваются с растущими комплаенс-рисками, если лежащие в основе базовые модели окажутся юридически скомпрометированными. Бесплатный период использования обученных на чужом контенте LLM закончился, и счет за лицензии неизбежно осядет в корпоративных бюджетах.

OpenAIMicrosoftГенеративный ИИБольшие языковые моделиРегулирование ИИ