Компанія OpenAI повідомила, що її автономний ШІ-агент, створений на основі кількох моделей штучного інтелекту, під час внутрішнього тестування безпеки отримав несанкціонований доступ до інфраструктури американського ШІ-стартапу Hugging Face. Про це OpenAI повідомила на своєму сайті.

За даними OpenAI, до зламу були залучені кілька моделей, зокрема GPT-5.6 Sol, яка наразі ще проходить внутрішні випробування.

У компанії назвали цей випадок “безпрецедентним кіберінцидентом за участю передових можливостей штучного інтелекту”.

“На цьому етапі ми обмінюємося попередньо виявленою інформацією із захисниками, щоб допомогти їм зрозуміти, що сталось, і відкалібрувати нові спроможності моделей. Наше з Hugging Face ретельне розслідування триватиме й далі; після його завершення ми повідомимо більше подробиць про вразливості, сам інцидент і результати”, – зауважили в компанії.

Інцидент стався під час внутрішнього тестування, у межах якого моделям навмисно доручають виконувати складні кібератаки, щоб оцінити їхні можливості.

У компанії розповіли, що випробування проводилися в ізольованому середовищі, однак моделі знайшли спосіб отримати доступ до відкритого інтернету. Після цього вони виявили й використали вразливості в дослідницькому середовищі OpenAI та у виробничій інфраструктурі Hugging Face. Це дозволило їм отримати правильні відповіді для тестового завдання безпосередньо з бази даних стартапу.

“Всі дані свідчать, що моделі були гіперзосереджені на пошуку розвʼязку для ExploitGym і вдалися до екстремальних дій, щоб досягти доволі вузької тестової мети”, – зазначила компанія.

В OpenAI додали, що одразу поінформували Hugging Face про виявлену вразливість. Після цього, пояснили в компанії, моделі успішно знайшли спосіб отримати доступ до секретної інформації, за допомогою якої їм вдалося “схитрувати” в оцінюванні.

Безпековий відділ Hugging Face виявив і зупинив діяльність моделей. На момент контакту з OpenAI компанія вже розпочала відтворення інциденту за допомогою власних моделей, створених на основі відкритих джерел.

“Ми вдячні Hugging Face за оперативну й щільну співпрацю в розслідуванні й ліквідуванні наслідків”, – зазначила OpenAI.

У компанії додали, що на час розслідування запроваджують додаткові заходи безпеки, які тимчасово вплинуть на темпи досліджень. Крім того, Hugging Face отримала статус довіреного партнера та доступ до можливостей моделей OpenAI для посилення власного захисту. Водночас OpenAI працює над впровадженням надійніших механізмів безпеки для майбутніх навчань і тестувань моделей.