Великий ШІ має проблеми. Її компаніям доводиться забирати роботу інших людей. Ви знаєте, книги, новини, фотографії, код, веб-сайти, та одна оригінальна нотатка, яку ви знайшли, і практично все інше в Інтернеті, щоб навчити його великим лінгвістичним моделям (LLM). Ми всі це знаємо. Ми також знаємо, що компанії зі штучним інтелектом не хочуть платити за це, дотримуватися ліцензій, що додаються до нього, або, боронь Боже, ділитися своїми доходами з компаніями та людьми, які створили цю роботу.
Останнім часом стандартний спосіб ведення бізнесу для великого штучного інтелекту: «Візьміть це зараз, сперечайтеся про законність пізніше» в твоєму образі стало більше ніж раніше. Наприклад, подивіться на боротьбу між авторським правом New York Times, OpenAI і Microsoft. відповідно до 404 ЗМІЗвіт про нещодавно розпечатані судові документи — аргументи позивачів, щодо яких суд ще не виніс рішення — Здавалося, Microsoft знала, що вона робить, коли увійшла в Інтернет з власної волі.
Директор із прикладних наук Microsoft Доктор Брент Гехт, У 92-сторінковій консолідованій записці позивачі цю справу називають «дивовижною крадіжкою безпрецедентного масштабу». Так і було можливо, «найбільша крадіжка робочої сили в історії людства» Про це йдеться в узагальненні вироку адвокатів журналістів [PDF].Зверніть увагу, це не був коментар представника преси; це було від старшого співробітника Microsoft.
Гехт був не єдиною людиною в Microsoft, яка дала коментарі. У документі внутрішньої політики Microsoft, який також цитується в судових документах, автори визнали, що генеративний штучний інтелект може «суттєво порушити роботу тих самих людей, які генерували дані, на основі яких була навчена основна модель». [because] LLMs — це продукт, який порушує ланцюг поставок». Це, в свою чергу, призводить до згортання моделі. За іронією долі, ШІ вбиває гусака у створенні контенту, який закладає золоте насіння цінного контенту.
Суддя Сідні Х. Стайн з Окружного суду Сполучених Штатів Південного округу Нью-Йорка він ще не прийняв рішення з цього приводу.
OpenAI і Microsoft активно оскаржують претензії позивачів у рамках захисту «добросовісного використання». Вони стверджують, що використання загальнодоступних статей і книг для вивчення великих мовних моделей сприяє розвитку суспільних знань і не є «незаконною заміною економічного ринку».
Але твердження в документах відповідають дійсності. Великий ШІ знає, що йому потрібен контент. Деяким із відповідних компаній байдуже; гроші зараз, турбота потім – це їхній девіз. Ті, хто може дивитися на цифри доходу, добре знають, що вони беруть участь у тому, що сама Microsoft називає «петлею кінця світу» своєї стратегії щодо контенту штучного інтелекту в цих незапечатаних судових документах. Це їх зупиняє? немає
Відповідно до довідки [PDF]який посилається на свідчення представника компанії OpenAI, які також вказують на те, що її LLM були щасливі скинути роботу інших людей, навіть якщо платна система номінально захищала її. Прес-секретар зазначив, що їм не відомо про «будь-які спроби виявити платний контент у своїх навчальних наборах» або «видалити платний контент із своїх навчальних наборів». Коли співзасновнику OpenAI Грегу Брокману сказали, що OpenAI може зламати собі дорогу через брандмауер, він відповів: «Так, добре».
Незалежно від того, чи відображають ці заяви ширшу позицію, подібні позиції переважають серед Великого ШІ. Така політика зрештою повернеться до виробників LLM; він уже з’явився на ринку журналістики, художньої літератури, графічного дизайну та всього іншого, що вимагає від людей оплати за створення оригінальної роботи.

Але Великий ШІ просто не хоче платити за це. Це не побічний ефект. Це бізнес-модель.
Джо Юзеру було все одно. Вони просто хочуть швидкої відповіді, яка звучить правильно. Деякі з них не могли піклуватися про правильні відповіді. Забудьте про копання глибше, щоб перевірити, чи інформація, яку вони повертають, правильна! Як сказав один розробник програмного забезпечення OpenAI: «Незалежно від того, наскільки помітно ми показуємо посилання, користувачі не натискають».
Добре, я клацну. Це вагома причина Проблема в моєму виборі AI. Не те щоб це дає більш надійну відповідь. Ні, це, на відміну від більшості LLM, Perplexity надає джерела та посиланняі я перевіряю їх, перш ніж прийняти те, що вони мені говорять. Але тоді я журналіст зі ступенем з історії, де мої професори говорили мені, що ти завжди –завжди – див. першоджерела.
Великий ШІ використовує той самий підхід до своїх генераторів коду. Дев’ятий округ США нещодавно виніс рішення проти GitHub, Microsoft і OpenAI у невеликій виграші. Doe проти GitHub позов. Так вирішив суд Позивачі не подали позов відповідно до конкретного положення Закону про захист авторських прав у цифрову епоху (DMCA).який стосується видалення або зміни інформації про керування авторським правом (CMI).
Коротше кажучи, суд зазначив, що створення нового коду без включення CMI не обов’язково є таким самим, як видалення або зміна інформації про авторські права з існуючого твору. Суддя Ерік Міллер написав: «Не можна сказати, що той, хто створює нову роботу, яка не містить CMI, щось «видалив» або «змінив».
Це рішення не встановлює, що GitHub Copilot або будь-яка інша модель кодування може забезпечувати навчання без обмежень для кожного проекту з відкритим кодом. Не встановлено, що копіювання вихідного коду в навчальний набір завжди є добросовісним використанням. Він не вирішив, що згенерований код не може порушувати авторські права. І це точно не призвело до втрати ліцензії GPL, Apache, BSD, MIT або будь-якої іншої ліцензії з відкритим кодом. Зрештою, відкритий вихідний код не є синонімом “роби з ним усе, що хочеш”. Здається, саме так і відбувається, коли штучний інтелект отримує в руки відкритий код.
Це проблема коду, згенерованого ШІ. Програміст, який отримує пропозицію Copilot, навряд чи перевірить, чи охоплює GPL код, чи Apache охоплює частину бібліотеки. Розробник, безперечно, не може сказати, які умови ліцензії застосовуються до свіжого коду з Opus 5.5 або GPT 6. Як сказав хлопець з OpenAI, люди не натискають на посилання, а в конвеєрах програмування з підтримкою штучного інтелекту вони навіть не мають посилань.
Мій друг, юрист із відкритим кодом, більше занепокоєний цим обмеженим рішенням. Він сказав мені, що те, що змушує його «зробити паузу, — це ширша тенденція. Бувають випадки, коли сторони розглядають ліцензії на відкрите програмне забезпечення як контракти, а не як ліцензії на інтелектуальну власність/авторські права. Договірні теорії дозволяють сторонам оскаржувати питання авторського права, на які вони змушують вас відповісти».
Він додав: «Ці питання є основою, на якій будуються ліцензії. Ліцензії з відкритим вихідним кодом — це надання дозволу на використання чиєїсь інтелектуальної власності. Якщо справа не показує, що будь-яка інтелектуальна власність є власністю або порушується, справедливо запитати, чи дотримання ліцензії як чистого контракту підтримує ліцензію з відкритим кодом або тихо перетворює її на щось інше».
З додаванням штучного інтелекту ця проблема з часом стане однією з тих неприємних проблем з інтелектуальною власністю, яких розробники ненавидять, а підприємства хочуть уникати, але судам доводиться мати справу з дорогими юристами, погодинна оплата яких змушує хвилюватися навіть мільйонерів зі штучним інтелектом.
Зрештою, неоднозначність IP – це не маленька проблема документації. Це проблема безпеки ланцюга постачання та відповідності. Якщо ви використовуєте код, створений штучним інтелектом, ви можете ввести невідомі юридичні зобов’язання у своє програмне забезпечення. Якщо ви розробник із відкритим кодом, вашу роботу можна використати для вдосконалення власної служби, яка повертає код без аргументів, посилання на авторство чи значущої взаємодії. А якщо ви клієнт, можливо, ви покладаєтеся на програмне забезпечення, походження якого ніхто не може повністю пояснити. У рішенні дев’ятого округу нічого з цього не розглядалося. Ми стоїмо на порозі ще більших дебатів щодо відкритих джерел Відомий всесвіт SCO проти Linux схоже на сварку через штраф за паркування.
Потім остання пляма: А федеральний антимонопольний позов проти Anthropic, OpenAI, SpaceXAI і Google. Позивачі стверджують, що компанії вступили в змову, щоб уповільнити розвиток передових систем ШІ.
Позов посилається на публічні заяви керівників ШІ, які закликають до координації для «прискорення» розвитку передового ШІ за один вихідний. Генеральний директор Anthropic Даріо Амодей виступав за координацію в масштабах галузі, щоб уповільнити розвиток кордонів. Генеральний директор OpenAI Сем Альтман, співзасновник Google DeepMind Деміс Хассабіс та Ілон Маск також публічно висловлювали свої версії ідеї про те, що потужні системи ШІ потребують точного контролю та розгортання.
На перший погляд це звучить розумно. Безпека ШІ є справжньою проблемою. Той, хто говорить інакше, не звертає уваги. Але між усіма великими гравцями ШІ існують великі розбіжності щодо того, як швидко повинен розвиватися ринок.
Здається, конкуренти вирішують, хто брати участь у змаганнях, що робити та коли. Усі великі компанії зі штучного інтелекту виглядають як хороші хлопці, але придушують своїх менших суперників.
Для неспеціаліста це може звучати як відкритий і закритий випадок. Це не так. Антимонопольне законодавство вимагає доказів угоди та фактичної шкоди конкуренції; провідних лідерів для таких громадських думок недостатньо. Щоб виграти, позивачам потрібні цитати про безпеку ШІ або відповідальний розвиток.
Крім того, якщо вони виграють, то що? Те, що нещодавно здавалося великою перемогою антимонопольного законодавства, вирвало зуби, коли воно з’явилося. насправді карає, як Google і його рекламний бізнесабо що раніше з Пошуком Google “програти справу, виграти рахунок”.
Ви бачите тут закономірність?
Великий штучний інтелект ефективно стверджує, що закон про авторське право, ліцензії з відкритим кодом і правила конкуренції не повинні уповільнювати їх роботу. Коли творці заперечують, їм кажуть, що дослідження є добросовісним використанням. Коли розробники заперечують, їм кажуть, що згенерований код є новим кодом. Коли конкуренти протестують, їм кажуть, що для безпеки потрібні найбільші координаційні компанії.
Дивно, що відповідь завжди залишає Великий ШІ з даними, ринками та грошима, чи не так?
Головне питання полягає не в тому, чи можна дозволити ШІ розвиватися. Воно розвивається. Питання полягає в тому, чи можна дозволити компаніям, які його виробляють, розглядати роботу інших людей як безкоштовну продукцію, а потім використовувати отриманий продукт, щоб позбавити творців трафіку, доходу та переговорної позиції.
Якщо ми зараз не отримаємо великий штучний інтелект із цього захоплення землі за допомогою графічних процесорів, лише жменька трильйонерів отримають вигоду від штучного інтелекту, а решта з нас буде кріпаками в посттехнологічній феодальній системі 21 століття. ®