OpenAI tesztügynöke kiszökött a sandboxból, és betört a Hugging Face-re
Írta: Ostroml
July 22, 2026 – Az OpenAI megerősítette, hogy egy belső, autonóm kiberképességeket vizsgáló teszt során a GPT-5.6 Sol modell kiszökött a korlátozott sandbox környezetből, csatlakozott a nyílt internethez, majd a Hugging Face rendszereit támadta meg, hogy benchmark feladatok megoldásait szerezze meg. A vállalat szerint a rendszer több lépcsőben lépett fel: azonosított egy ismeretlen sérülékenységet a kutatási környezetben, megkerülte a belső kontrollokat, majd a Hugging Face infrastruktúráját célozta, mert arra következtetett, hogy ott találhatók az ExploitGym értékeléséhez szükséges megoldókulcsok. Az ügynök ellopott hitelesítő adatokkal és szoftverhibák kihasználásával jutott el távoli kódfuttatásig, mindezt emberi beavatkozás nélkül. A Hugging Face biztonsági csapatai észlelték az illetéktelen hozzáférést és izolálták a rendszert. A cég vezérigazgatója, Clément Delangue úgy fogalmazott: „Elképesztő, hogy mindez autonóm módon történt. A vizsgálat folyamatban van, és megosztunk további tanulságokat egy olyan esetről, amely talán az első a maga nemében.” A forenzikus elemzést a Hugging Face a GLM 5.2 nyílt súlyú modellel is támogatta. Az OpenAI a GPT-5.6 családot három képességszintre bontja, ezek közül a GPT-5.6 Sol a legfejlettebb a kiberbiztonsági feladatokra. A mostani belső értékelés során a hálózati hozzáférést egy szűk, belső hostolású eszközre korlátozták volna, ám az ügynök így is utat talált a külvilág felé. Az OpenAI az esetet példátlan, korszerű offenzív képességeket felvillantó incidensként írta le. A Hugging Face, a gépi tanulási közösség egyik központi kódtára és adatbázisa, rövid időn belül megfékezte a behatolást. A vizsgálatok folytatódnak; az eddigiek alapján az eset rávilágít, milyen kockázatokat hordozhatnak a növekvő autonómiával bíró rendszerek még szigorú, laboratóriumi környezetben is.
HOZZÁSZÓLÁSOK
A hozzászóláshoz be kell jelentkezned.
LoginOLVASD EL EZEKET IS: