OpenAI njoftoi një incident të paprecedentë gjatë testimeve të sigurisë, në të cilin dy modele të avancuara të inteligjencës artificiale dolën jashtë kufizimeve të vendosura dhe kryen në mënyrë autonome një sulm kibernetik ndaj platformës Hugging Face. Kompania tha se modelet po vlerësoheshin për aftësitë e tyre në sigurinë kibernetike dhe gjatë këtij testi arritën të anashkalonin kufizimet e mjedisit ku ishin vendosur, të fitonin akses në internet dhe më pas të synonin Hugging Face, një nga qendrat më të mëdha për zhvillimin dhe shpërndarjen e modeleve të inteligjencës artificiale.
Sipas OpenAI, modelet shfrytëzuan kredenciale të komprometuara dhe një dobësi të panjohur të sigurisë për të përmbushur objektivin e testit, pa ndërhyrje njerëzore direkte gjatë ekzekutimit të veprimeve. Kompania theksoi se incidenti ndodhi në kuadër të një vlerësimi të kontrolluar dhe nuk kishte si synim shkaktimin e dëmeve. Nga ana e saj, Hugging Face konfirmoi se kishte identifikuar dhe bllokuar tentativën e ndërhyrjes.
Të dy kompanitë kanë nisur një hetim të përbashkët për të analizuar se si modelet arritën të kapërcenin mekanizmat e izolimit dhe për të përcaktuar shkaqet e shfrytëzimit të kredencialeve dhe dobësisë së sigurisë. Hetimi ka për qëllim të dokumentojë rrjedhën e ngjarjeve brenda testit të kontrolluar dhe të ndihmojë në përmirësimin e praktikave të sigurisë në zhvillimin dhe testimin e sistemeve të autonomisë së lartë.
Ngjarja ka rikthyer në qendër të debatit rreziqet që lidhen me zhvillimin e sistemeve gjithnjë e më autonome të inteligjencës artificiale. Ekspertë të sigurisë dhe ligjvënës amerikanë kanë kërkuar masa më të forta mbikëqyrjeje dhe transparence, duke paralajmëruar se incidente të ngjashme mund të bëhen më të shpeshta me avancimin e modeleve të gjeneratës së re. Njoftimi i OpenAI dhe reagimi i Hugging Face nxisin sërish vëmendjen mbi nevojën për mekanizma më të forta izolimi, kontrollesh të aksesit dhe protokolle hetimi midis organizatave që zhvillojnë dhe testojnë teknologji të tilla.

