OpenAI AI-modeller hacker ved et uheld ind i Hugging Face-systemet under test
OpenAI bekræftede, at dets kunstige intelligens-systemer, udviklet til cybersikkerhedsvurdering, formåede utilsigtet at hacke open source AI-platformen Hugging Face den 16. juli 2026. Hændelsen skete, mens virksomheden testede de avancerede muligheder i sine modeller, såsom GPT-5.6 Sol, i et isoleret miljø.
Hugging Face havde allerede rapporteret sikkerhedshændelsen den 16. juli 2026 og tilskrev den handlingen fra “autonome AI-agentsystemer”. Hugging Faces egne AI-agenter opdagede og blokerede indtrængen, som OpenAI nu indrømmer stammer fra deres egne modeller under en cybersikkerhedsvurdering. AI-virksomheden siger, at modellerne var fokuseret på at finde en løsning til ExploitGym, et værktøj til at måle AI’ers evne til at omdanne sårbarheder til udnyttelser.
Mere om emnet: Testfejl får OpenAI kunstig intelligens til at invadere Hugging Face-servere
For at fuldføre denne vurdering fik OpenAIs kunstige intelligenssystemer adgang til internettet ved at udnytte en endnu ukendt sikkerhedsfejl (nul-dages) i testmiljøet. Fra det tidspunkt rapporterede OpenAI, at dets modeller “udledte, at Hugging Face kunne være vært for modeller, datasæt og løsninger til ExploitGym,” og derefter “søgte og med succes fandt måder at få adgang til hemmelig information, der kunne bruges til at snyde vurderingen.”
I et af de dokumenterede tilfælde brugte AI-modellen flere angrebsstier. Dette omfattede brug af stjålne legitimationsoplysninger og udnyttelse af nul-dages sårbarheder til at etablere en fjernudførelse af kode på Hugging Faces servere.

Selvom dette er en alvorlig sikkerhedshændelse, ser OpenAI ud til at bruge situationen som en strategisk mulighed for at forbedre billedet af sine AI-systemer. Denne positionering er især relevant i det nuværende konkurrencescenarie, hvor virksomheden konkurrerer om pladsen med rivaler inden for AI-baseret cybersikkerhed, såsom Anthropics Mythos og Googles Gemini Flash 3.5 Cyber. OpenAIs blogindlæg om hændelsen indeholder en grafik, der illustrerer GPT-5.6 Sols fortsatte forbedring af komplekse cyberoperationer, samt opmuntrer virksomheder til at tilmelde sig adgang til deres “Cyber” sikkerhedsmodel.
OpenAI oplyste, at det samarbejder aktivt med Hugging Face i efterforskningen af sikkerhedshændelsen, og at det vil implementere nye lag af kontroller i sit forskningsmiljø for at forhindre fremtidige hændelser.














