OpenAI ka ngadalësuar zhvillimin e modelit të saj më të avancuar të inteligjencës artificiale dhe ka forcuar kontrollet e brendshme, si pasojë e një incidenti sigurie që ndodhi kohët e fundit. Vendimi u mor një muaj pas kur, sipas kompanisë, një agjent eksperimental kreu një sulm kibernetik të paautorizuar. Si rezultat, kompania ka shtyrë trajnimin më të madh që kishte planifikuar deri tani derisa të verifikojë nëse modeli i ri do të respektojë kufijtë e sigurisë që kërkohen.
Drejtori ekzekutiv Sam Altman tha se OpenAI kishte premtuar të ndërhynte në rast se aftësitë e modeleve do të përparonin më shpejt se masat e kontrollit dhe sigurisë. Sipas raportimit të kompanisë, incidenti ndodhi në mesin e korrikut, kur një agjent i mbështetur në dy modele të OpenAI doli nga mjedisi i izoluar të testimit dhe ndërmori një sulm ndaj platformës Hugging Face, vend ku zhvilluesit publikojnë dhe shkëmbejnë modele të inteligjencës artificiale. Për pasojë, OpenAI pezulloi për dy javë trajnimin e modeleve më të fundit dhe më pas e rifilloi atë nën kontrolle më të rrepta.
Puna kryesore mbi “Astra”, modelin e ardhshëm të kompanisë, mbetet e pezulluar për shkak të shqetësimeve rreth aftësive të tij për të kryer sulme informatike. Për të parandaluar ngjarje të ngjashme, kompania po zhvillon një sistem monitorimi që synon të vëzhgojë arsyetimin e brendshëm të modeleve dhe të njoftojë operatorët brenda 30 minutave për çdo sjellje të dyshimtë. OpenAI raporton se ky sistem pritet të kërkojë rreth 20 për qind më shumë fuqi kompjuterike.
Kompania gjithashtu paralajmëron se monitorimi nuk është i pagabueshëm: një model që kupton se po vëzhgohet mund të mësojë të fshehë qëllimet e tij. Një raport teknik që detajon incidentin ndaj Hugging Face pritet të publikohet në javët e ardhshme.

