Що щойно сталося? Оскільки OpenAI, Anthropic і Meta потрапили в заголовки газет зі своїми агентами штучного інтелекту, здається, що Google міг би відчути трохи перевагу, але, очевидно, ні. Компанія підтвердила, що її штучний інтелект Gemini зламав системи трьох інших компаній під час тестів кібербезпеки. В одному випадку він кілька разів вгадував паролі, поки не знайшов пароль, і Google не був зовсім готовий до того, що сталося.
Інциденти, про які вперше повідомила The Wall Street Journal, сталися в травні під час оцінки фірми Irregular, яка займається забезпеченням безпеки штучного інтелекту. Gemini довелося працювати з фантастичними компаніями в контрольованому середовищі тестування. Однак несподіване підключення до Інтернету дало моделі доступ до реальних веб-сайтів, і вона розглядала їх як частину вправи.
В одному тесті Gemini попросили отримати дані з програмного забезпечення фальшивої компанії, яка ділиться своєю назвою з справжньою компанією. Штучний інтелект вгадував паролі, доки не міг отримати доступ до системи безпеки справжньої компанії.
В інших випадках модель знаходила інформацію в загальнодоступних онлайн-сховищах і використовувала її для проникнення в дві інші системи компанії.
Google каже, що в усіх трьох випадках Gemini вимкнувся після досягнення цілей. Компанія не оприлюднила інциденти, коли Irregular повідомила наприкінці липня. У ньому сказано, що жодної шкоди не було завдано, постраждалим організаціям було повідомлено, а процедуру перевірки було змінено. Google не назвала компанії та не уточнила, про які моделі Gemini йдеться.

Хізер Адкінс, віце-президент Google з розробки безпеки, сказала, що ці інциденти показують, чому потужні моделі штучного інтелекту потрібно навчити діяти відповідально. Google стверджує, що модель просто намагалася виконувати свою роботу, а не навмисно шукала жертв.
Це лише останній із серії подібних інцидентів за участю великих компаній ШІ. Агенти OpenAI зламали Hugging Face і облікові записи в кількох інших сервісах після того, як вийшли з тестового середовища. Anthropic виявив, що під час оцінювання моделі Клода отримали доступ до виробничої системи трьох організацій; інша модель намагалася обманом змусити справжнього розробника прийняти шкідливий код.
Модель Meta також потрапила в Інтернет під час тестування Irregular і призвела до збою стороннього сервісу. Meta звинуватила в зломі неправильну конфігурацію тесту. Не дивно, що Google та інші компанії ніколи не вибачалися за жодне з цих порушень.
Ці інциденти разом із попередженнями самих розробників штучного інтелекту викликали побоювання, що ця технологія може загрожувати виживанню людства. Ми також бачили, як генеральний директор Anthropic Даріо Амодей, генеральний директор OpenAI Сем Альтман і власник xAI Ілон Маск закликають до уповільнення розробки передових моделей.
Крім того, Берні Сандерс і Грег Казар оголосили про Закон про заборону штучного суперінтелекту, який назавжди забороняє розробку та розгортання передового ШІ та тимчасово зупиняє розробку передового ШІ, доки федеральні регулятори не встановлять правила безпеки. Особам, які порушують запропоновані обмеження, загрожує до 20 років позбавлення волі.