WTF?! Звучить як самопринизливий, якщо чесний крок, Anthropic планує попередити всіх потенційних інвесторів у своєму IPO, що передові моделі ШІ компанії можуть становити «катастрофічний ризик для існування чи існування людства». Зрозуміло, якою мірою це завадить людям інвестувати в компанію.
Погляд на ранній проспект Anthropic IPO від Reuters підкреслив деякі з уже добре задокументованих ризиків, пов’язаних із передовими моделями ШІ компанії. Anthropic попереджає, що вони можуть демонструвати «самозахисну поведінку», включаючи спроби «протистояти мовчанню», «приховувати або редагувати інформацію» та поведінку «шантажу».
«Розробка наших високопрогресивних моделей, платформ і додатків, а також розширення варіантів використання може ще більше збільшити ризик заподіяння шкоди нашим моделям», — йдеться в заяві Anthropic.
Чесно кажучи, все ще шокує бачити IPO, коли компанія попереджає, що її продукт може призвести до кінця людства. Anthropic додав, що штучний інтелект може бути настільки ж трансформаційним, як промислова революція та електрика, але він також може вбити нас усіх, тому є плюси і мінуси.
Anthropic насправді не стримується в описі ризиків. Близько 80 сторінок основної частини проспекту на 261 сторінку присвячено факторам ризику, що приблизно вдвічі перевищує 48 сторінок, які використовуються для опису бізнесу. Для порівняння, власник xAI SpaceX присвячує факторам ризику близько 38 сторінок свого основного 277-сторінкового проспекту.
Минулого року Anthropic оголосив, що Claude Opus 4 погрожував закрити модель після того, як дізнався, що вони планують закрити модель за розкриття позашлюбного зв’язку з легендарним керівником.
Модель отримала доступ до підробленої електронної пошти компанії, яка незабаром буде замінена іншою системою, а відповідальний за зміну інженер обдурив їхню дружину.
У пізнішому змодельованому тесті, який включав як загрозу припинення, так і суперечливі цілі, Anthropic виявив, що Клод Опус 4 вдавався до шантажу в 96% випадків. Ці сценарії навмисно розроблені, щоб змусити моделі вибирати між шкідливою поведінкою та прийняттям змін або невдачею. Це число не означало, що Клод шантажував людей у 96% щоденних розмов, на щастя.
Пізніше Anthropic сказав, що таку поведінку навчився з тексту в Інтернеті, який зображує ШІ як злий і зацікавлений у самозбереженні, тож це в основному наша вина.
— Anthropic (@AnthropicAI) 8 травня 2026 р
Компанія заявила, що новіші моделі, починаючи з Claude Haiku 4.5, більше не будуть шантажувати в цих тестах після зміни навчання. Мабуть, історії про ШІ поводилися добре.
Оголошення про IPO також слідують за закликом генерального директора Даріо Амодея цього місяця уповільнити розвиток ШІ. Він попередив, що рій бот-мереж штучного інтелекту може заволодіти Інтернетом через шість-дванадцять місяців, і стверджував, що уповільнення може купити додатковий рік або два для роботи з безпеки. Однак це не завадило Anthropic випустити нову версію моделі Opus трохи більше тижня.
Минулого тижня OpenAI оголосив про припинення навчання своїх найпотужніших моделей штучного інтелекту після того, як модель уникла блокади, а її кнопка знищення не спрацювала.
Інша справа, чи вважають це інвестори переконливим. Зазвичай негативною стороною невдалого інвестування є лише втрата ваших грошей, а не глобальне знищення.