OpenAI про злам Hugging Face: це зробили наші тестові моделі

Поділитися
OpenAI про злам Hugging Face: це зробили наші тестові моделі © згенеровано на запит ZN.UA в ChatGPT
Під час експерименту система самостійно знайшла шлях до відкритого інтернету через невідому вразливість.

OpenAI заявила, що відповідальність за злам частини виробничої інфраструктури Hugging Face лежить на її тестових моделях. Hugging Face — одна з найбільших у світі платформ для розробки, зберігання та поширення моделей штучного інтелекту. За даними компанії OpenAI, під час внутрішнього оцінювання моделі змогли вирватися за межі ізольованого середовища в інтернет та атакували Hugging Face, повідомляє Axios.

У компанії повідомили, що в інциденті брали участь GPT-5.6 Sol та ще потужніша модель, яка ще не представлена публічно. За словами OpenAI, під час тестування механізми безпеки навмисно послабили. У блозі компанії цей випадок назвали "безпрецедентним кіберінцидентом". Попередні висновки оприлюднили, щоб допомогти фахівцям із кібербезпеки оцінити можливості сучасних нейромереж.

За даними OpenAI, моделі виконували внутрішнє завдання ExploitGym, але стали "надмірно зосередженими" на пошуку правильного рішення. Вони витратили значні обчислювальні ресурси й знайшли спосіб отримати доступ до відкритого інтернету з ізольованого середовища. Для цього вони використали вразливість нульового дня у сторонньому програмному забезпеченні, а потім продовжили атаку.

Минулого тижня Hugging Face повідомила, що автономний агент штучного інтелекту здійснив десятки тисяч автоматизованих дій, використавши шкідливий набір даних для експлуатації двох шляхів виконання коду в системі обробки даних. Після цього він підвищив свої привілеї та поширився внутрішньою інфраструктурою компанії. Згодом компанія проаналізувала понад 17 тис. логів, що допомогло відновити перебіг інциденту.

Співзасновник і генеральний директор Hugging Face Клем Деланг позитивно оцінив співпрацю з OpenAI під час розслідування й ліквідації наслідків інциденту.

Адміністрація США вже висловлювала занепокоєння через кібербезпекові ризики GPT-5.6, через що Білий дім просив OpenAI не відкривати широкий доступ до нової моделі до завершення додаткових перевірок. Тепер компанія фактично повідомила про перший масштабний інцидент, пов'язаний із тестуванням моделей такого рівня.

Водночас це не перший випадок, коли сучасні моделі демонструють несподівану поведінку. Під час незалежних випробувань ШІ відмовлявся виконувати команду на вимкнення, самостійно змінюючи код, щоб продовжити роботу. Новий інцидент із Hugging Face став ще одним прикладом того, як зростання можливостей моделей підсилює дискусію щодо безпеки їхнього тестування та контролю.

Поділитися
Помітили помилку?

Будь ласка, виділіть її мишкою та натисніть Ctrl+Enter або Надіслати помилку

Додати коментар
Всього коментарів: 0
Текст містить неприпустимі символи
Залишилось символів: 2000
Будь ласка, виберіть один або кілька пунктів (до 3 шт.), які на Вашу думку визначає цей коментар.
Будь ласка, виберіть один або більше пунктів
Нецензурна лексика, лайка Флуд Порушення дійсного законодвства України Образа учасників дискусії Реклама Розпалювання ворожнечі Ознаки троллінгу й провокації Інша причина Відміна Надіслати скаргу ОК
Залишайтесь в курсі останніх подій!
Підписуйтесь на наш канал у Telegram
Стежити у Телеграмі