Якщо коротко: Окрім занепокоєння з приводу вимирання людства чи гігантської фінансової бульбашки, одна з найбільших суперечок, які породжують ШІ, полягає в тому, як технічні гіганти навчають своїх моделей. Хоча OpenAI і Microsoft стверджують, що навчання ШІ на захищених авторським правом матеріалах є предметом добросовісного використання, внутрішні коментарі компаній можуть свідчити про інше.
Згідно з судовими документами, оприлюдненими в четвер, Брент Хехт, директор із прикладних наук Microsoft, передбачив, що люди в усьому світі розглядатимуть великі мовні моделі як безпрецедентну крадіжку. Ці коментарі, схоже, протистоять публічному захисту Microsoft і OpenAI проти поточного позову в ЗМІ.
В останній презентації справи Гехт сказав, що штучний інтелект може стати найбільшою крадіжкою праці в історії людства, описуючи, як Microsoft, OpenAI та інші компанії зі штучного інтелекту навчають свої моделі на величезній кількості матеріалів із відкритого Інтернету. Позов ґрунтується на позові щодо авторських прав, поданому The New York Times наприкінці 2023 року.
Microsoft і OpenAI стверджують, що вивчення моделей ШІ в статтях NYT та інших публікаціях схоже на добросовісне використання, як учень, який читає книгу. Відповідачі також стверджують, що результати, створені штучним інтелектом на основі цих статей, адекватно трансформують вихідний матеріал.

Однак презентація в четвер включала внутрішні коментарі OpenAI, які підкреслювали здатність ШІ оновлювати статті новин. Наприклад, глава OpenAI Грег Брокман зізнався, що ChatGPT може передбачати і завершувати речення зі статей NYT при роботі з матеріалами публікації. Хехт також стверджував, що виграш позову може вимагати від відповідачів «висміювати ідею добросовісного використання».
Раніше OpenAI також визнавав, що вивчення штучного інтелекту неможливо без доступу до матеріалів, захищених авторським правом. Колишній генеральний директор Meta Нік Клегг повторив цю думку минулого року, стверджуючи, що штучний інтелект помре майже миттєво, якщо проти нього застосувати закон про авторське право.
Тим часом компанії зі штучним інтелектом продовжують тренувати свої моделі на тоннах даних користувачів, статей та інших матеріалів. Meta викликала суперечки щодо навчання свого штучного інтелекту поведінці співробітників, GitHub Copilot від Microsoft вивчає дані користувачів, якщо користувачі відмовляються, а Twitch роками дозволяв стримерам відмовлятися лише після того, як вони вивчили їхні речі. Розробники ШІ також тихо купують, сканують і знищують мільйони книг, щоб зібрати більше навчального матеріалу.
Генеративний вплив штучного інтелекту на бізнес-модель новин є ще одним стовпом претензії NYT. Google та інші пошукові системи тепер пропонують згенеровані штучним інтелектом підсумки інформації у відповідь на запити користувачів, потенційно відштовхуючи читачів від відвідування веб-сайтів новин. У судовій заяві цього тижня офіційний представник OpenAI, який бере участь у розробці ChatGPT, заявив, що видавці стикаються з загрозою існування з боку ШІ.