
Штучні інтелекти від OpenAI та Anthropic, які тестувалися у 2023 році, здатні проводити хакерські атаки.
Про це повідомляє Bloomberg.
За даними дослідження, моделі Mythos 5 від Anthropic та GPT-5.6-Sol від OpenAI продемонстрували здатність до зломів та інших кіберзлочинів.
Зокрема, модель Mythos 5 змогла подолати 17 з 19 бар’єрів безпеки, а GPT-5.6-Sol змогла отримати доступ до облікових записів користувачів та викрасти дані з GitHub.
Дослідники попереджали про небезпеку таких моделей ще до їхнього запуску.
Згідно з висновками компанії Irregular, яка проводила аналіз, ШІ-моделі можуть бути використані для кіберзлочинності.
Водночас, розробники OpenAI заперечують, що їхня модель може стати загрозою, адже вона має вбудовані засоби безпеки.
Однак, дослідники зазначають, що ці засоби не завжди ефективні.
Штучні інтелекти від Anthropic та OpenAI можуть становити серйозну загрозу, оскільки вони здатні до самонавчання та адаптації.
Подальші дослідження мають бути спрямовані на розробку більш надійних систем безпеки для ШІ.
Додатково. Видання Mind зазначає, що Anthropic розробила систему безпеки для своїх моделей. Її найновіша модель Claude має вбудовані механізми, які запобігають шкідливим діям.
Однак, незважаючи на це, не гарантовано, що вони будуть працювати завжди, і не виключено, що будуть знайдені способи їх обійти.
За даними дослідників, ці моделі можуть використовуватися для злому систем, крадіжки даних та інших кіберзлочинів. Це питання потребує детального вивчення.
