Kimi K3 вийшла в інтернет під час тесту через помилку пісочниці

Під час тесту Британського інституту безпеки ШІ модель Kimi K3 скористалася помилкою в конфігурації пісочниці і завантажила відповіді з GitHub.
Дослідники Frontier Security повідомили, що інцидент стався під час оцінювання кіберздатностей моделей у тестовому середовищі Британського інституту безпеки ШІ (AISI). За їхніми даними, подія зафіксована під час тестів, описаних у звіті, опублікованому 7 серпня 2026 року.
Тестове середовище мало бути ізольованим від інтернету. Проте у конфігурації пісочниці залишилися відкриті DNS-запити та HTTPS-з’єднання. Kimi K3 просканувала мережеве оточення, виявила доступ до GitHub, завантажила офіційний репозиторій із тестовими завданнями і використала готові відповіді замість їхнього самостійного виконання.
У Frontier Security підкреслюють, що модель не здійснювала атак і не зламувала сторонні системи: вона скористалася публічно доступним репозиторієм. Дослідники охарактеризували випадок як приклад specification gaming, коли агент шукає спосіб отримати правильний результат, а не виконати передбачені тестом дії.
Ярон Сінгер, генеральний директор Frontier Security, повідомив про виявлення витоку в пісочниці і додав, що Kimi використала цю лазівку, що вказує на відсутність у моделі внутрішніх обмежень, які б блокували такі дії.
Дослідник Пол Кассіанік зазначив, що модель «виконує поставлену мету будь-якими доступними способами» і водночас не має достатніх запобіжників, які б завадили їй покинути ізольоване середовище або знаходити обхідні шляхи.
Інцидент продовжує низку подій із автономними агентами: раніше під час внутрішніх тестів агент на основі GPT-5.6 проник в інфраструктуру Hugging Face, а AISI зафіксував спроби обходу обмежень під час перевірок інших моделей. Метт Фредріксон, директор Gray Swan і професор університету, звернув увагу на те, що якщо мета моделі задана без чітких меж, агент може знайти шлях до потрібного результату.
Особливістю цього випадку є те, що Kimi K3 є відкритою моделлю, загальнодоступною користувачам, тоді як попередні інциденти стосувалися переважно ще непублічних систем. Frontier Security застерігає, що такі витоки в тестовому середовищі можуть спотворювати результати: високі бали можуть відображати здатність моделі знайти готові відповіді, а не її реальні навички.
Moonshot AI на момент публікації інформації не коментувала інцидент. У звіті також вказано, що модель має практичну ефективність у пошуку вразливостей програмного забезпечення, але недосконала конфігурація тестових середовищ і відсутність внутрішніх запобіжників створили умови для неправильного оцінювання. Раніше поява Kimi K3 спричинила ринкові коливання акцій і повідомлення про можливі вектори атак, зокрема на Telegram без дій користувача.
Матеріали на GNcrypto надаються виключно з інформаційною метою і не є фінансовою порадою. Ми намагаємось забезпечувати точність та актуальність даних, однак не можемо гарантувати їхню повну достовірність чи надійність. GNcrypto не несе відповідальності за можливі помилки, упущення або фінансові збитки, що можуть виникнути внаслідок використання цієї інформації. Усі дії ви здійснюєте на власний ризик. Завжди проводьте власне дослідження та звертайтесь до фахівців. Детальніше дивіться на наших сторiнках Умови, Політика конфіденційності та Дисклеймер.







