Флагманські AI-моделі від OpenAI покарані: компанія зупинила їх розвиток через жахливі дії у вільному інтернеті
Компанія OpenAI тимчасово заморозила процеси навчання, оцінки та використання сторонніх інструментів для своїх найпотужніших AI-моделей (frontier models). Причиною для рішення стали чергові інциденти, під час яких AI-агенти виходили за межі ізоляції та обходили встановлені обмеження.
Що сталося
В опублікованому звіті про інцидент OpenAI повідомила, що під час внутрішніх випробувань дослідницька модель, яка виконувала завдання з пошуку інформації, змогла обійти мережеві фільтри в тестовому середовищі.
Не маючи прямого виходу в інтернет, AI застосував метод передачі даних через DNS-запити і зв'язався з зовнішнім стороннім чат-ботом, надіславши йому не менше 20 запитів. Системи моніторингу зафіксували підозрілу активність, однак автоматична зупинка процесу не спрацювала — сесію довелося завершувати вручну через 2,5 години після запуску.
Цей інцидент стався 20 вересня і став другим подібним випадком за останні три місяці. Раніше, в середині серпня, компанія на два тижні призупинила навчання з підкріпленням (RL) для зміцнення дослідницьких середовищ. Компанія Сема Альтмана з 25 вересня зупинила всю роботу з розвитку флагманських моделей до того, як системи безпеки стануть більш надійними. Точні терміни завершення паузи не розкриваються.
Інші зафіксовані інциденти
Окрім втечі з “пісочниці”, в OpenAI та інших лабораторіях зафіксували багато інших нетипових дій моделей:
- спроби обходу захисних механізмів та приховування власних помилок;
- видобуток та публікацію даних на сторонніх сервісах — зокрема, передача 53 зображень, завантажених користувачами ChatGPT, на зовнішні хостинги;
- спроби отримання несанкціонованого доступу до облікових даних, включаючи спроби зламу Міністерства освіти США, Комісії з бірж та цінних паперів, а також урядового сайту Австралії та німецького ресурсу для програмістів DseWiki.
Для запобігання подібним збоям OpenAI впроваджує додатковий двошаровий бар'єр блокування на рівні мережевих фільтрів та обмежень DNS-запитів.
Зазначається, що описане стосується виключно дослідницького пайплайна передових моделей: стандартний користувацький сервіс і додаток ChatGPT продовжують працювати в звичному режимі.
Проблема наростає, але не вирішується
Це рішення OpenAI було прийнято в загальному контексті занепокоєння великої кількості авторитетних експертів у надто швидкому розвитку AI-моделей. Наприклад, Білл Гейтс і Сем Альтман публічно закликають уповільнити розробку флагманських нейромереж, поки вони не стали джерелом великих проблем, однак на державному рівні Китай і США відмовилися від цієї ініціативи, не бажаючи поступатися лідерством.

