Українська версія gg виходить за підтримки маркетплейсу Allo

Флагманські AI-моделі від OpenAI покарані: компанія зупинила їх розвиток через жахливі дії у вільному інтернеті

Автор: Антон Кратюк | сьогодні, 13:15
Флагманські AI-моделі від OpenAI покарані: компанія зупинила їх розвиток через жахливі дії у вільному інтернеті Логотип OpenAI. Джерело: Google

Компанія OpenAI тимчасово заморозила процеси навчання, оцінки та використання сторонніх інструментів для своїх найпотужніших AI-моделей (frontier models). Причиною для рішення стали чергові інциденти, під час яких AI-агенти виходили за межі ізоляції та обходили встановлені обмеження.

Що сталося

В опублікованому звіті про інцидент OpenAI повідомила, що під час внутрішніх випробувань дослідницька модель, яка виконувала завдання з пошуку інформації, змогла обійти мережеві фільтри в тестовому середовищі.

Не маючи прямого виходу в інтернет, AI застосував метод передачі даних через DNS-запити і зв'язався з зовнішнім стороннім чат-ботом, надіславши йому не менше 20 запитів. Системи моніторингу зафіксували підозрілу активність, однак автоматична зупинка процесу не спрацювала — сесію довелося завершувати вручну через 2,5 години після запуску.

Цей інцидент стався 20 вересня і став другим подібним випадком за останні три місяці. Раніше, в середині серпня, компанія на два тижні призупинила навчання з підкріпленням (RL) для зміцнення дослідницьких середовищ. Компанія Сема Альтмана з 25 вересня зупинила всю роботу з розвитку флагманських моделей до того, як системи безпеки стануть більш надійними. Точні терміни завершення паузи не розкриваються.

Інші зафіксовані інциденти

Окрім втечі з “пісочниці”, в OpenAI та інших лабораторіях зафіксували багато інших нетипових дій моделей:

  • спроби обходу захисних механізмів та приховування власних помилок;
  • видобуток та публікацію даних на сторонніх сервісах — зокрема, передача 53 зображень, завантажених користувачами ChatGPT, на зовнішні хостинги;
  • спроби отримання несанкціонованого доступу до облікових даних, включаючи спроби зламу Міністерства освіти США, Комісії з бірж та цінних паперів, а також урядового сайту Австралії та німецького ресурсу для програмістів DseWiki.

Для запобігання подібним збоям OpenAI впроваджує додатковий двошаровий бар'єр блокування на рівні мережевих фільтрів та обмежень DNS-запитів.

Зазначається, що описане стосується виключно дослідницького пайплайна передових моделей: стандартний користувацький сервіс і додаток ChatGPT продовжують працювати в звичному режимі.

Проблема наростає, але не вирішується

Це рішення OpenAI було прийнято в загальному контексті занепокоєння великої кількості авторитетних експертів у надто швидкому розвитку AI-моделей. Наприклад, Білл Гейтс і Сем Альтман публічно закликають уповільнити розробку флагманських нейромереж, поки вони не стали джерелом великих проблем, однак на державному рівні Китай і США відмовилися від цієї ініціативи, не бажаючи поступатися лідерством.

Джерело: OpenAI, The Verge

Читайте gg українською у Telegram