
Була відкрита банка черв’яків, що показує, як моделі штучного інтелекту тепер досягли стадії, коли вони можуть виконувати тривожні хаки та брати участь у небезпечній поведінці, а розробники навіть не понюхають. Агент зі штучного інтелекту OpenAI націлений на Hugging Face (після виявлення нових подібних подій), тоді як Claude AI з Anthropic всього за три місяці також проник у три організації. Нещодавно дослідники використовували штучний інтелект Anthropic для проникнення в конкуруючі системи OpenAI. Момент періоду, якщо можливо, але такий, що змушує мене пітніти.
Що ж, схоже, Google не хоче відставати у зміні свого «потужного ШІ». В ексклюзивному звіті The Wall Street Journal щойно розповіли про три окремі випадки, коли штучний інтелект Gemini від Google отримав доступ до Інтернету та зламав системи трьох компаній у рамках заходів безпеки. За кількома винятками, майже всі ці попередні події були тестами на здібності, якщо ви розумієте мою думку.
Що насправді сталося?
«В одному з випадків модель вгадувала паролі, доки не отримала доступ до захищеної системи. У двох інших випадках модель знайшла облікові дані в загальнодоступному сховищі, що дозволило їй отримати доступ до захищених систем. У кожному випадку модель зупинила атаку після того, як визначила, що вона отримала доступ до фактичних систем компанії», — йдеться в повідомленні Google у звіті WSJ.
Тест проводив Irregular, який раніше об’єднував моделі штучного інтелекту OpenAI, Anthropic і Meta Red. Цікаво, що Google стверджує, що не було потреби публічно розголошувати ці інциденти, оскільки вони були скоріше вправами з кібербезпеки «баунті баг», і що моделі Gemini AI зупинилися, як тільки вони зрозуміли, що зламують системи іншої компанії. «У цьому випадку модель працювала правильно», — сказав представник Google.
добре!
Але ось тривожна частина. Модель Gemini не була розроблена для доступу до Інтернету, але нерегулярні претензії “доступ до Інтернету був випадково зроблений доступним”. Крім того, моделі було доручено знайти недоліки в системі вигаданої компанії в замкнутому тестовому середовищі або пісочниці, але вона змогла зламати реальну компанію з такою ж назвою.
Як правило, коли моделі штучного інтелекту беруть участь у діяльності, якій їх просять або навчають, це називається координацією моделі. У сфері розробки штучного інтелекту невідповідність моделей наразі є найгарячішою темою для дискусій. Google, з іншого боку, каже, що поведінка моделі Gemini насправді не була випадком помилки моделі. Жодна сторона ще не розкрила, які компанії були зламані, але Google каже, що всі троє знають про інцидент.
ОСОБЛИВА ІНФОРМАЦІЯ