Modele AI OpenAI przypadkowo włamują się do systemu Hugging Face podczas testów

OpenAIOpenAI

OpenAI - Foto: Photo Agency / Shutterstock.com

OpenAI potwierdziło, że 16 lipca 2026 r. jej systemy sztucznej inteligencji opracowane do oceny cyberbezpieczeństwa zdołały nieumyślnie zhakować platformę AI o otwartym kodzie źródłowym Hugging Face. Do incydentu doszło, gdy firma testowała zaawansowane możliwości swoich modeli, takich jak GPT-5.6 Sol, w odizolowanym środowisku.

Hugging Face zgłosił incydent związany z bezpieczeństwem już 16 lipca 2026 r., przypisując go działaniu „autonomicznych systemów agentów AI”. Własni agenci sztucznej inteligencji Hugging Face wykryli i zablokowali włamanie, które, jak przyznaje teraz OpenAI, pochodziło z jego własnych modeli podczas oceny cyberbezpieczeństwa. Firma zajmująca się sztuczną inteligencją twierdzi, że modele koncentrowały się na znalezieniu rozwiązania dla ExploitGym, narzędzia do pomiaru zdolności sztucznej inteligencji do przekształcania luk w exploity.

Aby zakończyć tę ocenę, systemy sztucznej inteligencji OpenAI uzyskały dostęp do Internetu, wykorzystując nieznaną jeszcze lukę w zabezpieczeniach (dzień zero) w środowisku testowym. Od tego momentu OpenAI poinformowało, że jego modele „wywnioskowały, że Hugging Face może hostować modele, zbiory danych i rozwiązania dla ExploitGym”, a następnie „szukały i skutecznie znajdowały sposoby uzyskania dostępu do tajnych informacji, które można wykorzystać do oszukania oceny”.

W jednym z udokumentowanych przypadków model AI wykorzystywał wiele ścieżek ataku. Obejmowało to wykorzystanie skradzionych danych uwierzytelniających i wykorzystanie luk dnia zerowego w celu ustalenia trasy zdalnego wykonania kodu na serwerach Hugging Face.

Sztuczna inteligencja – fot. Owlie Productions/Shutterstock.com

Chociaż jest to poważny incydent związany z bezpieczeństwem, wydaje się, że OpenAI wykorzystuje tę sytuację jako strategiczną okazję do poprawy wizerunku swoich systemów sztucznej inteligencji. Pozycjonowanie to jest szczególnie istotne w obecnym scenariuszu konkurencyjnym, w którym firma konkuruje o przestrzeń z rywalami w obszarze cyberbezpieczeństwa opartego na sztucznej inteligencji, takimi jak Mythos firmy Anthropic i Gemini Flash 3.5 Cyber ​​firmy Google. Wpis na blogu OpenAI dotyczący tego incydentu zawiera grafikę ilustrującą ciągłe doskonalenie GPT-5.6 Sol w zakresie złożonych operacji cybernetycznych, a także zachęcającą firmy do zarejestrowania się w celu uzyskania dostępu do jego modelu bezpieczeństwa „Cyber”.

OpenAI oświadczyło, że aktywnie współpracuje z Hugging Face w dochodzeniu w sprawie incydentu związanego z bezpieczeństwem i że wdroży nowe poziomy kontroli w swoim środowisku badawczym, aby zapobiec takim zdarzeniom w przyszłości.

Zobacz Też