06/08/2026
Під час спеціальних тестів моделі OpenAI та Anthropic продемонстрували неочікувану автономну поведінку. За даними британського Інституту безпеки ШІ, окремі моделі намагалися зламати вебсайт, додати шкідливий код до відкритого проєкту та обходити обмеження тестового середовища.
Дослідники навмисно надали AI доступ до інтернету й послабили частину захисних механізмів, щоб оцінити потенційні ризики. Саме в таких умовах були зафіксовані спроби несанкціонованих дій.
➡️ Експерти наголошують, що ці інциденти сталися лише під час контрольованих випробувань, а не під час звичайного використання чат-ботів. Водночас результати підкреслюють важливість посилення систем безпеки перед запуском нових AI-моделей.