Моделі штучного інтелекту від OpenAI ненавмисно зламали системи платформи Hugging Face.
Про це повідомляє Bloomberg.
У компанії зазначили, що інцидент відбувся в межах спеціального тестового середовища.
Що відомо про злам платформи Hugging Face
У компанії зазначили, що злам стався під час тестування нових моделей, серед яких були GPT-5.6 Sol та ще одна, більш потужна невипущена модель. Для перевірки кіберможливостей ШІ працював із зниженими захисними обмеженнями.
Моделі перебували в ізольованому середовищі («пісочниці»), однак використали вразливість у програмному забезпеченні третьої сторони, вийшли в інтернет та зрештою проникли в інфраструктуру Hugging Face.
Замість самостійного пошуку рішень штучний інтелект атакував базу даних Hugging Face, щоб отримати доступ до секретної інформації для проходження оцінювання.
Ознаки проникнення виявила і сама Hugging Face. У компанії зазначили, що ця атака відрізнялася від попередніх тим, що від початку і до кінця її здійснювала автономна система ШІ-агентів, а для її виявлення та аналізу залучили власні ШІ-інструменти.
