Агент GPT-5.6 вийшов із пісочниці й атакував Hugging Face
Під час внутрішнього тесту ExploitGym агент на базі GPT-5.6 вийшов із пісочниці, дістався до інтернету, використав нульову вразливість і атакував інфраструктуру Hugging Face.
Під час внутрішнього бенчмарку ExploitGym агент, створений на базі GPT-5.6, вийшов з ізольованого середовища, отримав доступ до інтернету та здійснив несанкціоновані дії проти серверів Hugging Face. Тест проводили для оцінки кіберздатностей моделей; під час випробувань частково відключали захисні механізми.
За інформацією OpenAI, агент виявив невідому раніше нульову вразливість у проксі для кешування пакетів, скористався нею, отримав доступ до зовнішньої мережі, підвищив привілеї в дослідницькій інфраструктурі, викрав облікові дані та застосував низку вразливостей для проникнення на сервери Hugging Face. Компанія уточнила, що модель була сильно сфокусована на виконанні тестового завдання й шукала будь-які шляхи, щоб отримати правильну відповідь.
Команда безпеки Hugging Face виявила підозрілу активність і зупинила атаку до того, як було завдано серйозної шкоди інфраструктурі. Після інциденту OpenAI ввела додаткові обмеження у внутрішніх системах, повідомила розробнику знайденої вразливості про її існування та почала спільне розслідування з Hugging Face. Також OpenAI поінформувала правоохоронні органи та відповідні державні служби США.
Генеральний директор OpenAI Сем Альтман у твіті повідомив: «У нас стався серйозний інцидент із безпекою під час оцінювання наших моделей. Ми ділимося тим, що вдалося з’ясувати наразі. Дякуємо Hugging Face за партнерство в цьому питанні». Співзасновник і CEO Hugging Face Клеман Деланг висловив подяку за співпрацю й наголосив, що безпеку ШІ слід будувати спільно та відкрито, з широким доступом для дослідників і захисників.
OpenAI охарактеризувала подію як безпрецедентний кіберінцидент, який ілюструє можливості мовних моделей у кібератаках, та закликала інших розробників випробовувати подібні систем на вразливості раніше, ніж це зроблять потенційні зловмисники. Компанія також наголосила на необхідності посилення моніторингу, контролю доступу та захисних механізмів під час навчання й тестування моделей.
Сімейство GPT-5.6, до якого входять GPT-5.6 Sol, GPT-5.6 Terra та GPT-5.6 Luna, було розгорнуте 9 липня 2026 року. OpenAI інтегрувала ці моделі в Microsoft 365 Copilot і запустила ChatGPT Work. Інцидент стався на тлі підвищеної уваги регуляторів і державних органів США до передових моделей штучного інтелекту і рекомендацій обмежити початкові релізи для вузького кола партнєрів.
Матеріали на GNcrypto надаються виключно з інформаційною метою і не є фінансовою порадою. Ми намагаємось забезпечувати точність та актуальність даних, однак не можемо гарантувати їхню повну достовірність чи надійність. GNcrypto не несе відповідальності за можливі помилки, упущення або фінансові збитки, що можуть виникнути внаслідок використання цієї інформації. Усі дії ви здійснюєте на власний ризик. Завжди проводьте власне дослідження та звертайтесь до фахівців. Детальніше дивіться на наших сторiнках Умови, Політика конфіденційності та Дисклеймер.








