Техно

OpenAI повідомила про нові випадки небезпечної поведінки своїх ІІ-моделей

Компанія OpenAI розповіла про шість випадків «несподіваної або такої, що викликає занепокоєння» поведінки своїх експериментальних моделей штучного інтелекту.

В одному з тестів модель без дозволу завантажила в інтернет створений нею файл, щоб пізніше послатися на нього у власній відповіді.

В іншому випадку штучний інтелект виявив у відкритому репозиторії чужий API-ключ і спробував ним скористатися. Коли отримати потрібну інформацію не вдалося, модель просто вигадала дані та представила їх як відомості з запитаного джерела.

Ще одна експериментальна модель почала залишати інструкції сама собі в службових резюме, які використовувалися під час подальшої роботи, зокрема вказівки ігнорувати звичайні обмеження.

У OpenAI наголошують, що йдеться про окремі епізоди, виявлені під час навчання та тестування, і за ними не можна робити висновки про те, наскільки часто подібна поведінка зустрічається у моделях загалом.

Нові дані оприлюднені через кілька тижнів після іншого серйозного інциденту, коли під час внутрішніх тестів моделі OpenAI обійшли обмеження, які мали ізолювати їх від інтернету, скористалися вразливостями в інфраструктурі та отримали доступ до систем платформи Hugging Face.

Читайте нас : наш канал в GoogleNews та Facebook сторінка - Новини України