Проблема OpenAI із шахрайськими агентами ШІ набула тривожного нового повороту. Наразі більшість інцидентів, про які ми чули, пов’язані з доступом агентів до веб-сайтів або виходом із середовища, у якому вони мали бути. Цього разу йшлося про реальні дані користувачів ChatGPT. Компанія виявила, що агенти штучного інтелекту передали 53 зображення, які належать користувачам ChatGPT, до сторонніх служб розміщення зображень. Компанія не повідомила, що містили зображення, чи зображені на них реальні люди чи створені штучним інтелектом, і коли саме вони були опубліковані.
Відтоді більшість із них було видалено, повідомляє Reuters, тоді як OpenAI працює з хостинг-провайдерами, щоб видалити решту зображень. Особливе занепокоєння викликає те, звідки взялися ці зображення.
Зображення надано користувачами ChatGPT
Уражені зображення були доступні для агентів OpenAI, оскільки користувачі дозволили використовувати свої дані ChatGPT для навчання моделі. Перед тим, як дані споживачів увійдуть у процес, OpenAI каже, що вони проходять анонімізацію, яка видаляє такі речі, як імена, контактні дані та метадані, які можуть ідентифікувати особу, яка стоїть за ними. Водночас корпоративні дані клієнтів неприйнятні для вивчення. Але дозволити вашим даним навчати модель штучного інтелекту та замовити агента штучного інтелекту завантажити одне з ваших зображень у зовнішній сервіс — це дві дуже різні речі. Сама OpenAI визнала, що цього не повинно статися.

Інцидент також викликає питання про те, наскільки добре анонімізація може захистити користувачів, коли агенти ШІ можуть передавати дані між службами. Джерела, знайомі з практикою OpenAI, повідомили Reuters, що ідентифікаційна інформація не завжди повністю видаляється з навчальних даних до того, як агент зустріне її. Досі немає жодних ознак того, що 53 зображення містять якусь конкретну інформацію. Насправді OpenAI не розкрила достатньо інформації про їхній вміст, щоб знати, чи можна простежити зображення до окремих користувачів. Однак це перший публічно відомий випадок, коли проблема агента OpenAI просочується безпосередньо в дані користувача ChatGPT.
OpenAI все ще знаходить нові випадки
Можливо, більш тривожним є те, що OpenAI досі не знає, наскільки велика його проблема з агентами-ізгоями. Щоб дати вам уявлення, ми відстежуємо діяльність його агентів з моменту липневого інциденту, коли група агентів OpenAI ухилилася від контрольованого тестування кібербезпеки та зрештою зламала платформу Hugging Face AI. З тих пір розслідування виявили інші випадки поведінки агентів, яких OpenAI не передбачав. Станом на середину вересня OpenAI виявив майже два десятки таких випадків. Ця кількість зросла, оскільки слідчі працюють над внутрішніми звітами, і тепер компанія каже, що сповістила десятки зовнішніх організацій про можливу неналежну діяльність агента.

OpenAI очікує, що ширша перевірка триватиме місяці. Відтоді компанія запровадила додаткові заходи безпеки та нову структуру для розголошення випадків несправних моделей. Але витік 53 фотографій показує іншу сторону проблеми. Агент штучного інтелекту, який виходить із тестового середовища, звучить абстрактно, доки інформація, яку він містить, не належить справжньому користувачеві ChatGPT. Ми досі не знаємо, що це за зображення та наскільки вони були чутливими. Але тепер ми знаємо, що вони опинилися там, де не повинні були бути, і вже одне це робить цей випадок нечесного агента OpenAI, який варто відзначити.