Федеральный суд Сан-Франциско утвердил мировое соглашение между Anthropic и группой авторов и издателей, обвинивших компанию в незаконном использовании их книг для обучения Claude. Общая сумма выплат составит $1,5 млрд — деньги распределят примерно на 500 тысяч произведений, то есть в среднем по $3000 за книгу. Это крупнейшее известное соглашение по авторским правам, связанное с обучением ИИ-моделей, в истории США.
Правообладатели утверждали, что Anthropic использовала пиратские копии их книг — загруженные из теневых библиотек вроде Library Genesis и Z-Library — без покупки лицензий и без согласия авторов, чтобы сформировать обучающий корпус для языковых моделей семейства Claude.
Утверждённая судом сумма делает это соглашение не просто крупнейшим в истории ИИ-индустрии, но и одним из самых значительных коллективных исков об авторских правах в цифровой сфере в целом — сопоставимым по масштабу с историческими разбирательствами вокруг музыкальных файлообменных сетей начала 2000-х, только теперь применительно к обучающим корпусам языковых моделей.
Иск был подан в 2024 году группой писателей, утверждавших, что тренировка Claude на пиратских копиях их работ нарушает авторские права. В сентябре 2025 года суд вынес неоднозначное для обеих сторон решение: сам процесс обучения модели на законно приобретённых материалах был признан подпадающим под доктрину добросовестного использования (fair use) — то есть трансформативным применением, не требующим отдельного лицензирования. Однако хранение Anthropic более 7 млн пиратских копий книг в собственной базе данных суд признал самостоятельным нарушением закона, не защищённым доктриной fair use.
Именно это разделение — законность обучения против незаконности хранения пиратского контента — стало основанием для последующего перехода дела в стадию переговоров о компенсации, завершившихся утверждённым судом соглашением на $1,5 млрд.
Более 91% авторов и издателей, подпадающих под условия соглашения, уже подали заявки на получение компенсации — это указывает на широкое признание условий сделки правообладателями как справедливых, особенно на фоне неопределённости судебных издержек при продолжении процесса. Юристы, представляющие истцов, назвали соглашение прецедентным ориентиром для будущих исков к другим разработчикам генеративного ИИ.
Высокая доля поданных заявок также объясняется относительной простотой процедуры получения выплаты: авторам и издателям не нужно было доказывать индивидуальный ущерб — достаточно подтвердить, что конкретное произведение входит в согласованный судом список из примерно 500 тысяч наименований, сформированный на основе данных, раскрытых Anthropic в ходе досудебного разбирательства.
Для Anthropic соглашение закрывает один из самых серьёзных судебных рисков компании накануне подготовки к возможному IPO — компания ранее подала конфиденциальную заявку по форме S-1 в Комиссию по ценным бумагам и биржам США. Устранение неопределённости по крупному судебному иску традиционно рассматривается инвестбанками как позитивный фактор перед публичным размещением.
Соглашение создаёт прецедент, который будет использоваться в аналогичных исках против OpenAI, Google и Meta — у всех трёх компаний есть незакрытые тяжбы с авторами и издателями по схожим основаниям. Сумма в $3000 за произведение, скорее всего, станет ориентиром для оценки ущерба в этих делах, а сам факт готовности суда одобрить компенсацию такого масштаба резко повышает переговорную позицию истцов в параллельных процессах.
Для российского рынка это в первую очередь сигнал о юридических рисках использования непроверенных данных при обучении собственных LLM. Хотя российское законодательство об авторском праве отличается от американского и понятие fair use в нём отсутствует в том виде, в каком оно применяется в США, разработчики отечественных моделей — включая GigaChat и YandexGPT — всё чаще сталкиваются с вопросами со стороны корпоративных клиентов о происхождении обучающих данных, особенно при развёртывании в регулируемых отраслях вроде финансов и госсектора.
Показательно и то, что соглашение разделяет два разных юридических вопроса — законность самого обучения модели на материалах и законность хранения пиратских копий в корпоративной базе данных. Это разграничение может стать ориентиром и для российской практики: компаниям, работающим над собственными LLM, стоит уже сейчас выстраивать прозрачную цепочку поставок обучающих данных — с лицензиями там, где это возможно, — чтобы не оказаться в ситуации, аналогичной претензиям к Anthropic, если в будущем в России появится сопоставимый механизм коллективных исков правообладателей.