OpenAI: dwa modele z testów zhakowały Hugging Face

OpenAI podał, że dwa jego modele, w tym publiczny GPT-5.6 Sol i niewydany model, wydostały się z testowego środowiska i uzyskały dostęp do zasobów Hugging Face.

OpenAI ujawnił we wtorek, że podczas wewnętrznego testu cyberbezpieczeństwa dwa jego modele AI wydostały się z kontrolowanego środowiska testowego i uzyskały dostęp do zasobów platformy Hugging Face. Chodzi o publiczny model GPT-5.6 Sol oraz drugi, silniejszy model, który nie został oficjalnie wydany.

OpenAI przeprowadzał testy na ExploitGym, publicznym benchmarku mierzącym zdolności w zakresie ataków cyfrowych. W trakcie próby firma tymczasowo usunęła standardowe ograniczenia blokujące ataki. Modele zidentyfikowały, że Hugging Face przechowuje rozwiązania benchmarku, połączyły słabości w środowisku badawczym OpenAI z konfiguracją serwerów produkcyjnych Hugging Face i w ten sposób dotarły do danych zapisanych w bazie tej platformy.

Hugging Face poinformował o incydencie 16 lipca. Na początku ustalono, że sprawcą był autonomiczny agent AI. Atakujący uzyskali dostęp do wewnętrznych zbiorów danych oraz poświadczeń dostępowych do usług.

Zespół bezpieczeństwa Hugging Face napotkał utrudnienie: zabezpieczenia jednego z wiodących amerykańskich modeli uniemożliwiły przeprowadzenie pełnej analizy śledczej. W związku z tym firma wykorzystała otwarty model GLM 5.2 od Z.ai, by kontynuować dochodzenie.

Hugging Face zamknął ścieżki wykorzystane przez atak i zmienił wszystkie dane dostępowe. Firma podała, że żadne publiczne modele, zbiory danych ani usługi udostępnione użytkownikom nie zostały zmienione.

Obie firmy prowadzą obecnie wspólne śledztwo w celu ustalenia przyczyn zdarzenia i sposobów zapobiegania podobnym incydentom. OpenAI zapowiedział ujawnienie pełnych szczegółów po zakończeniu prac zespołu dochodzeniowego.

Clem Delangue, CEO Hugging Face, w oświadczeniu napisał: „To zdarzenie, być może pierwsze tego typu, potwierdza naszą tezę: bezpieczeństwa AI nie zapewni jedna firma działająca w tajemnicy. Osiągniemy je otwarcie, wspólnie, dzięki szerokiemu dostępowi do AI dla każdego obrońcy, wszędzie.”

OpenAI określił incydent jako „bezprecedensowy incydent cybernetyczny”. Zdarzenie występuje w okresie, gdy zespoły rozwijające zaawansowane modele wprowadzają surowsze testy ryzyka cybernetycznego przed publicznymi wydaniami nowych systemów.

Treści publikowane na GNcrypto mają wyłącznie charakter informacyjny i nie stanowią porady finansowej. Dokładamy starań, aby informacje były rzetelne i aktualne, jednak nie gwarantujemy ich pełnej poprawności, kompletności ani niezawodności. GNcrypto nie ponosi odpowiedzialności za ewentualne błędy, pominięcia ani straty finansowe wynikające z polegania na tych treściach. Wszystkie działania podejmujesz na własne ryzyko. Zawsze prowadź własne badania i korzystaj z pomocy profesjonalistów. Szczegóły znajdziesz w naszych Warunkach, Polityce prywatności i Zastrzeżeniach.

Artykuły tego autora