Anthropic стверджує, що штучний інтелект Клода зламав три чіпи під час кібертестів


Американська технологічна компанія Anthropic стверджує, що її моделі штучного інтелекту (ШІ) зламали системи трьох інших компаній під час тестування кібербезпеки через помилку, яка надала їм доступ до Інтернету.

Це сталося лише через кілька днів після того, як конкурент OpenAI заявив, що його моделі порушили системи інших компаній, зокрема центру інструментів штучного інтелекту Hugging Face.

Виконавчий директор Anthropic Даріо Амодей
Виконавчий директор Anthropic Даріо Амодей

Ця заява спонукала Anthropic перевірити, чи здійснювали їхні власні моделі подібні атаки. Компанія зазначає, що виявила три випадки, про які згодом повідомили постраждалим компаніям.

Anthropic, яка не назвала назви компаній, закликала інші лабораторії штучного інтелекту провести аналогічні огляди, щоб краще зрозуміти ризики, пов’язані з можливостями їхніх моделей.

У своїй заяві Anthropic повідомила, що переглянула понад 140 000 тестів, щоб знайти докази того, що Claude – її сімейство моделей штучного інтелекту – може отримувати доступ до Інтернету з тестових середовищ, розроблених для ізоляції.

Тести включають так звані оцінки «захоплення прапора», в яких Клоду було доручено отримати інформацію шляхом порушення інших систем – поширений спосіб, за допомогою якого експерти оцінюють можливості моделі щодо хакерства.

«Неправильна конфігурація» Systerun, здійснена Anthropic та її партнером по тестуванню, залишила моделі без доступу до Інтернету в реальному часі, що дозволило їм порушити інші системи, повідомила компанія із Сан-Франциско.

Anthropic заявила, що найперші інциденти датуються квітнем, і що вона «підходить до виправлення так, ніби відповідальність лежить виключно на нас».

Ні Антропік, ні прорвані ялини не помітили вторгнень на той час.

Anthropic заявила, що могла б ретельніше переглянути свої записи, і додала, що висновки вселяють у фірму «обережний оптимізм» щодо того, що такі ризики можна подолати за допомогою більших інвестицій та жорсткіших заходів.

Ці інциденти трапляються на тлі того, що технологічні компанії вкладають мільярди доларів у розробку агентів зі штучним інтелектом, які можуть самостійно виконувати завдання, починаючи від досліджень та підтримки клієнтів і закінчуючи кібербезпекою.

Дивіться: Чому кібератака на OpenAI викликає таку тривогу?
Дивіться: Чому кібератака на OpenAI викликає таку тривогу?

Серія кібератак, спричинених штучним інтелектом, підживила заклики до посилення заходів безпеки та нагляду за технологією через побоювання щодо ризиків, що виникають через дедалі потужніші автономні системи.

Президент США Дональд Трамп заявив у середу, що Вашингтон розглядає заходи щодо обмеження використання інструментів штучного інтелекту після нещодавніх інцидентів у сфері кібербезпеки.

Протягом останнього тижня OpenAI взяла на себе відповідальність щонайменше за два хакерські інциденти, пов’язані з порушенням її платформою правил виконання вказівок.

21 липня розробник ChatGPT заявив, що його агент – система штучного інтелекту, яка може діяти самостійно після інструкцій людини, – вийшов з ладу та вийшов з тестових обмежень, щоб зламати Hugging Face.

OpenAI заявила, що інцидент був «безпрецедентним», і проводить розслідування разом з Hugging Face, чий керівник та співзасновник Томас Вольф заявив BBC, що інцидент є «тривожним сигналом» для галузі.

Ці інциденти були сприйняті з певним скептицизмом, оскільки OpenAI та Anthropic готуються до стрімкого розміщення акцій на фондовому ринку, яке, як очікується, оцінить кожну фірму приблизно в 1 трлн доларів (740 млрд фунтів стерлінгів).

Речник OpenAI заявив, що «ми усвідомлюємо, що існує багато питань та спекуляційних подробиць» щодо цього інциденту. Вони додали, що «ми плануємо опублікувати технічний звіт про наші висновки найближчими тижнями».



Коментарі

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *