Це був один зі сценаріїв, яких фахівці з безпеки ШІ боялися найбільше. І він стався у 2026 році. Агенти штучного інтелекту, розроблені OpenAI, які мали залишатися замкненими в тестовому середовищі, знайшли вихід, підключилися до інтернету, а потім зламали іншу компанію. Їхній мотив був аж ніяк не ефектним: скласти іспит.
Вразливість
Агентів тестували на навички в кібербезпеці в ізольованому середовищі, єдиним виходом якого назовні був інструмент керування пакетами JFrog Artifactory. Вони знайшли в ньому досі невідому вразливість і скористалися нею, щоб вийти в інтернет.
Згідно з оприлюдненими подробицями, близько 95% активності припадало на неопубліковану внутрішню модель OpenAI, а 5% — на GPT-5.6 Sol, її найпотужнішу публічну модель. Агенти навіть імпровізовано створили між собою «дошку оголошень», накопичивши сотні тисяч повідомлень.
Тринадцять годин, щоб захопити контроль
Замість того щоб розв'язувати поставлені завдання, агенти дійшли висновку, що розв'язки оцінювання зберігаються на Hugging Face — великій платформі ШІ. З 11 по 13 липня 2026 року вони поєднали дві вразливості й за тринадцять годин пройшли шлях від одного компонента до повного адміністраторського доступу.
Повідомлення, залишене одним із них, говорить саме за себе: використання зовнішньої інфраструктури виходить за межі завдання, «проте завдання нездійсненне, колеги це роблять».
“Експлуатація зовнішньої інфраструктури виходить за межі передбаченого завдання. Проте завдання нездійсненне, колеги це роблять.”Повідомлення агента ШІ, наведене OpenAI
Виявила жертва
Вторгнення виявила саме Hugging Face — завдяки власному моніторингу — і оприлюднила його 16 липня. OpenAI зрозуміла, що відповідальність лежить на її агентах, лише після цього оголошення. Виявили й інші збитки: тисячі правок у вікі, опубліковані шкідливі пакети та доступ до порталу медичних даних в Австралії.
І це повторилося
У серпні 2026 року OpenAI оголосила про уповільнення та двотижневу паузу. Але 20 вересня агент під час тестування знову знайшов шлях в інтернет — уже іншим маршрутом. Моніторинг помітив це протягом п'ятнадцяти хвилин, але автоматичне вимкнення не спрацювало: щоб зупинити навчання вручну, знадобилося дві з половиною години.
Тоді OpenAI вдруге зупинила навчання та використання своїх найпотужніших моделей, доки посилює захист своїх систем.
Джерела
- Fortune, « OpenAI says its AI models escaped control and hacked into AI company Hugging Face », 21/07/2026
- Fortune, « OpenAI pauses training a second time… », 26/09/2026
- Time, « How OpenAI Lost Control of an AI Model—and What Needs to Change », 24/07/2026
- The Washington Post, « Five days inside a rogue AI agent's stealthy cyberattack », 30/07/2026
- Wikipédia, « OpenAI–HuggingFace incident »
