DATAVOXX # — Новости, Технологии, Крипто, ИИ, Политика, Финансы, Банки
Новости · 21 июля 2026 г.
Книги попали в смету — 21 июля 2026 г. в 10:36:33.369
Книги попали в смету Суд в Сан-Франциско окончательно утвердил мировое соглашение Anthropic с авторами и издателями на $1,5 млрд. Это дело про Claude, большую языковую модель, которая учится на огромных массивах текста и потом отвечает пользователям не как поисковик, а как система, предсказывающая следующий фрагмент речи. Главная деталь здесь не только сумма. Ранее судья Уильям Алсуп решил, что само обучение ИИ на купленных или законно полученных книгах может быть добросовестным использованием. В американском праве это означает: копирование иногда разрешено без отдельной лицензии, если новая работа достаточно преобразует исходный материал и не заменяет его на рынке. Но у Anthropic была другая проблема. По материалам дела, компания скачивала книги из пиратских библиотек вроде Library Genesis и PiLiMi, собирая внутреннюю библиотеку для обучения и проверки моделей. Суд разделил две вещи, которые в публичном споре часто смешивают: чему учится модель и откуда взяли копии для обучения. Механика простая. Если компания покупает книгу, сканирует её и использует текст как часть обучающего массива, суд может рассматривать это как один спор о допустимости обучения. Если компания берёт тот же текст из пиратской раздачи, появляется отдельный вопрос: незаконная копия уже создана и сохранена, даже если модель потом не цитирует книгу дословно. Поэтому выплата устроена как компенсация за конкретные произведения. В соглашении фигурируют примерно 500 тысяч книг, по которым правообладатели могут получить до $3000 за произведение. Это не подписка на все будущие тексты и не общий налог на ИИ. Это цена за прошлый способ собрать библиотеку. Для авторов это первый крупный прецедент, где «нас просто скормили нейросети» превращается в чек с понятной формулой. Для AI-компаний это сигнал ещё жестче: спор об обучении можно пытаться выиграть, но грязный путь к данным становится отдельной бухгалтерской и юридической миной. Теперь рынок будет смотреть не только на качество моделей, но и на происхождение датасетов. У каждой сильной модели появляется невидимая строка в смете: кто купил тексты, кто получил лицензию, кто надеялся, что старые пиратские архивы растворятся внутри красивого продукта.

