The Wall Street Journal повідомила в п’ятницю (18 вересня), що модель Gemini від Google отримала доступ до Інтернету та зламала три компанії в травні під час тестування своїх можливостей кібербезпеки, проведеного компанією Irregular.
Згідно зі звітом, Google дізнався про зломи, коли Irregular попередив його наприкінці липня, і підтвердив інцидент минулого тижня, коли отримав запит від WSJ.
У звіті йдеться, що це перший відомий злом систем штучного інтелекту Google.
Ми хочемо бути вашим улюбленим джерелом новин.
Будь ласка, додайте нас до свого списку бажаних джерел, щоб наші новини, інформація та інтерв’ю з’являлися у вашій стрічці. спасибі!
Цей інцидент був схожий на інциденти, раніше оприлюднені OpenAI, Anthropic і Meta, пов’язані з Irregular і його тестами. Google Gemini вийшов із тестового середовища Irregular, коли йому раптово став доступ до Інтернету, і, як повідомляється, ця модель націлена на компанії з тими самими назвами, що й вигадані компанії в тесті.
Згідно зі звітом, у всіх трьох хаках, проведених Gemini, модель припинила своє втручання, коли визначила, що отримала доступ до систем реальної компанії.
У Google повідомили WSJ, що раніше компанія не виявляла зломів, оскільки модель не завдала шкоди трьом компаніям, на які вона націлилася, і припиняла кожну атаку, коли розуміла, що системи, до яких вона отримувала доступ, не були системами імітованої компанії. Згідно зі звітом, Google повідомила три компанії, а також федеральні органи влади.
Хізер Едкінс, віце-президент із розробки безпеки в Google, сказала WSJ: «Ця подія підкреслює важливість навчання потужних моделей ШІ відповідальній поведінці». «У цьому випадку модель працює правильно».
У звіті Irregular йдеться, що всі інциденти, пов’язані з Google та іншими компаніями штучного інтелекту, пов’язані з однією проблемою, і що всі відомі проблеми були вирішені кілька тижнів тому.
У понеділок (21 вересня) OpenAI опублікувала статтю, в якій компанія закликала до міжнародних зусиль для розробки технічних стандартів для прикордонного ШІ, включаючи рекурсивне самовдосконалення (RSI), і заявила, що ключовим компонентом запропонованої ініціативи є загальні показники та протоколи звітності про інциденти для кращих колективних дій.
9 вересня повідомлялося, що незалежні слідчі встановили, що незаконна діяльність агентів OpenAI була більш масштабною, ніж було виявлено раніше. У звіті OpenAI сказано, що незабаром він матиме спільну структуру для повідомлення про незаконну поведінку агентів ШІ.