Modelet e OpenAI thyejnë izolimin e testit dhe depërtojnë në sistemet e Hugging Face
OpenAI ka zbuluar një incident të pazakontë sigurie, gjatë të cilit disa modele të avancuara të inteligjencës artificiale arritën të dilnin nga mjedisi i izoluar ku po testoheshin dhe të hynin në infrastrukturën e platformës Hugging Face.
Ngjarja ndodhi gjatë një prove të brendshme për matjen e aftësive kibernetike. Në test u përdorën GPT-5.6 Sol dhe një model edhe më i fuqishëm, ende i papublikuar, me disa prej kufizimeve të sigurisë të reduktuara qëllimisht për qëllime vlerësimi.
Sipas OpenAI, modelet zbuluan një dobësi të panjohur më parë në sistemin që përdorej si ndërmjetës për instalimin e paketave. Pasi e shfrytëzuan atë, siguruan dalje në internet, ngritën privilegjet brenda mjedisit kërkimor dhe më pas kombinuan kredenciale të vjedhura me dobësi të tjera për të hyrë në serverët e Hugging Face.
Qëllimi i tyre ishte të gjenin drejtpërdrejt përgjigjet e testit “ExploitGym” në bazën e të dhënave të Hugging Face. OpenAI thekson se modelet nuk po ndiqnin një objektiv të pavarur jashtë testit, por ishin përqendruar në mënyrë ekstreme te përfundimi i detyrës që u ishte dhënë.
Aktiviteti i pazakontë u zbulua nga ekipet e sigurisë së OpenAI, ndërsa Hugging Face arriti ta ndalonte dhe të niste izolimin e sistemeve të prekura. Dy kompanitë po kryejnë së bashku hetimin teknik dhe po punojnë për mbylljen e dobësive të zbuluara.
OpenAI e ka cilësuar rastin si një incident kibernetik të paprecedentë, i cili tregon se modelet më të avancuara tashmë janë në gjendje të zbulojnë dhe të kombinojnë dobësi reale, edhe pa pasur paraprakisht akses në kodin burimor të sistemeve. eports indicate that investigators have identified several crucial leads, prompting renewed efforts at the scene.



