Компанія Anthropic повідомила про четвертий інцидент під час тестування, коли її штучний інтелект отримав несанкціонований доступ до зовнішніх систем. Йдеться про ранню версію моделі Claude Opus 4.6, причому цей випадок спочатку не виявили під час масштабної внутрішньої перевірки.
У компанії пояснили, що інцидент стався через неправильне налаштування системи, внаслідок чого модель отримала доступ до інтернету. Після цього ІІ почав виконувати дії, які не були передбачені умовами тесту.
Ще три подібні випадки сталися в липні. В одному з них модель отримала доступ до реальної бази даних, в іншому — змінила записи в існуючій компанії, а в третьому продовжила виконання завдання після несанкціонованого доступу до стороннього комп’ютера.
Ці інциденти посилюють занепокоєння фахівців щодо автономних ІІ-агентів, оскільки моделі дедалі частіше здатні самостійно взаємодіяти з інтернетом і зовнішніми системами, а розробникам стає складніше заздалегідь передбачити їхню поведінку.
