Обчислювальний потенціал системи Nvidia Vera
Мільярдний компроміс Anthropic та правовласників

Індустрія штучного інтелекту довгий час вибудовувала свою стратегію навколо концепції Fair Use — добросовісного використання даних, стверджуючи, що навчання нейромереж не є копіюванням, а є процесом вилучення статистичних закономірностей. Однак справа Anthropic та розробників моделі Claude продемонструвала, що грань між технологічним прогресом і банальним піратством може бути надзвичайно тонкою. Окружний суд Північного округу Каліфорнії затвердив угоду про виплату 1,5 мільярда доларів на користь книжкових видавництв та авторів, фактично встановивши ринкову вартість «права на навчання».
Конфлікт розгорівся навколо методів збору даних. У центрі уваги опинилися повідомлення про те, що для навчання Claude компанія масово закуповувала, сканувала і згодом знищувала мільйони паперових книг. Попри спроби захисту довести, що сам процес навчання ШІ відповідає законодавству про авторське право, суд виявив критичну вразливість у позиції Anthropic. Проблема полягала не стільки в самому навчанні, скільки у створенні «центральної бібліотеки», де зберігалося понад 7 мільйонів піратських копій творів. Наявність такого архіву, який не був безпосередньо пов'язаний із процесом навчання, перевела справу з площини технологічних інновацій у площину прямого порушення закону.
Фінансова сторона питання викликала неоднозначну реакцію. Сума в 1,5 мільярда доларів розподіляється таким чином, що правовласники отримують близько 3 тисяч доларів за кожен використаний твір. Для багатьох авторів ця цифра здалася нікчемною порівняно з потенційними збитками, які могли б сягнути сотень мільярдів доларів у разі повноцінного судового розгляду. Крім того, значна частина коштів пішла на оплату послуг юристів: суд присудив їм понад 101 мільйон доларів, що стало приводом для протестів частини позивачів.
Проте суд відхилив заперечення проти угоди, зазначивши, що претензії до розміру виплат не спираються на реалістичну оцінку ризиків. У юридичній практиці США мирова угода часто є більш прагматичним шляхом, ніж багаторічні тяжби з невизначеним результатом. Для Anthropic цей крок став способом уникнути катастрофічних збитків і очистити репутацію перед подальшим масштабуванням продукту.
Цей кейс — лише перша цеглина у фундаменті нової правової реальності. Паралельно з цим розгортаються аналогічні процеси проти інших технологічних гігантів. Так, група найбільших видавництв, включаючи Hachette Book Group та Elsevier, вже подала позов до Google за незаконне використання мільйонів творів для навчання моделі Gemini.
Ринок рухається до епохи легальних датасетів. Якщо раніше розробники LLM могли дозволити собі «дикий» збір даних із відкритого інтернету та тіньових бібліотек, то тепер індустрія переходить до моделі ліцензування. Прецедент з Anthropic підтверджує: дані більше не є безкоштовним паливом для ШІ; вони перетворюються на дороговартісний актив, за який доведеться платити або через прямі контракти, або через багатомільярдні судові виплати.

