OpenAI ka bërë publik një incident të pazakontë të ndodhur gjatë testimeve të brendshme të sigurisë, ku dy modele të avancuara të inteligjencës artificiale arritën të kapërcenin kufizimet e mjedisit të testimit dhe kryen në mënyrë autonome një sulm kibernetik ndaj platformës Hugging Face.
Sipas kompanisë, modelet po vlerësoheshin për aftësitë e tyre në sigurinë kibernetike, kur arritën të anashkalonin mekanizmat e izolimit, të fitonin akses në internet dhe më pas të synonin infrastrukturën e Hugging Face, një nga platformat më të mëdha në botë për zhvillimin dhe shpërndarjen e modeleve të inteligjencës artificiale.
OpenAI bëri të ditur se modelet shfrytëzuan kredenciale të komprometuara dhe një dobësi të panjohur të sigurisë për të përmbushur objektivin e testit, pa ndërhyrje të drejtpërdrejtë njerëzore gjatë ekzekutimit të veprimeve. Kompania theksoi se incidenti ndodhi në një mjedis të kontrolluar dhe nuk kishte si qëllim shkaktimin e dëmeve.
Nga ana e saj, Hugging Face konfirmoi se tentativa u identifikua dhe u neutralizua në kohë, ndërsa të dyja kompanitë kanë nisur një hetim të përbashkët për të kuptuar se si modelet arritën të kapërcenin mekanizmat e sigurisë.
Ngjarja ka rikthyer në qendër të debatit rreziqet që lidhen me zhvillimin e sistemeve gjithnjë e më autonome të inteligjencës artificiale. Ekspertë të sigurisë dhe ligjvënës në SHBA kanë kërkuar forcimin e masave të mbikëqyrjes dhe transparencës, duke paralajmëruar se incidente të ngjashme mund të bëhen më të shpeshta me avancimin e modeleve të gjeneratës së re.
