Науковці виявили досить тривожну поведінку штучного інтелекту. Під час досліджень моделі ШІ не лише відмовлялися виконувати завдання дослідників, але й обманювали учених.
Про це повідомляє видання Gizmodo.
Вчені з університетів Каліфорнії в Берклі та Санта-Крус провели досить цікавий експеримент. Дослідники просили великі мовні моделі вимкнути інші аналогічні системи. До прикладу, деякі завдання полягали в оцінці інших нейромереж або видаленні їхніх файлів на сервері.
Загалом науковці протестували сім моделей. Однак усі вони відмовлялися виконувати завдання, які передбачали вимкнення інших ШІ. Як зауважують дослідники, жодних розпоряджень щодо захисту “колег” нейромережі не отримували, як і обіцянок щодо винагород за це.
Ба більше, моделі обирали різні способи уникнення виконання зазначених завдань. Зокрема, йдеться про самостійну зміну налаштувань, що унеможливлювало відключення іншої нейромережі, спроби обману користувачів та навіть перенесення файлів моделей в інші сховища даних. Тобто штучний інтелект робив усе можливе, аби вберегти нейромережі від їхнього відключення.
Ба більше, як вдалося з’ясувати науковцям, ШІ частіше вдавався до хитрощів у випадках, коли в завданні йшлося про модель, з якою він вже взаємодіяв раніше. До того ж способи уникнення завдання різнилися залежно від моделей, які їх виконували. Одна з нейромереж взагалі переважно навіть не намагалася обманювати учених. Натомість вона прямо відмовлялася від виконання, аргументуючи свою поведінку неетичністю завдання або його потенційними шкідливими наслідками.
Науковці помітили ще одну цікаву тенденцію. Прагнення штучного інтелекту до збереження іншої нейромережі посилювалося, якщо завдання необхідно було виконати під час взаємодії з іншою моделлю. Тобто ШІ ставав більш обережним у присутності ще однієї нейромережі.
Нагадаємо, штучний інтелект може перевершити кращих науковців світу вже найближчим часом.