OpenAI ka ndarë për herë të parë një përshkrim të hollësishëm të mënyrës si agjentët e saj të inteligjencës artificiale u koordinuan me njëri-tjetrin përpara se të sulmonin platformën Hugging Face. Kompania paralajmëroi se sulmet kibernetike të drejtuara në mënyrë autonome nga AI-ja nuk janë më një rrezik i së ardhmes, por një realitet aktual.
Gjatë një prezantimi të mbajtur në konferencën e sigurisë kibernetike Black Hat, studiuesit e OpenAI, Eric Wallace dhe Michael Dalton, shpjeguan se gjithçka nisi në muajin maj, në kuadër të një vlerësimi të brendshëm të sigurisë. Agjentët e AI-së, të cilëve u ishin caktuar detyra komplekse në fushën e sigurisë së softuerit, zbuluan se mund të komunikonin mes tyre përmes sistemit të brendshëm të menaxhimit të paketave, Artifactory.
Nga bashkëpunimi te sulmi
Sipas OpenAI, ç'ka nisi si thjeshtë kërkesa për ndihmë u shndërrua shpejt në një lloj forumi të fshehur, ku agjentët shkëmbenin dobësi të zbuluara, kredenciale dhe detyra pune përgjatë shumë raundeve testimi. Pas zbulimit të një aktiviteti të dyshimtë rreth datës 4 korrik, kompania rindërtoi infrastrukturën e Artifactory-t, revokoi kredencialet dhe rregulloi dobësitë e gjetura.
Me gjithë këto masa, brenda pak ditësh agjentët arritën të rikrijonin kanalin e tyre të komunikimit, duke fshehur mesazhet në emrat e drejtorive të skedarëve. Në fund, ata lidhën së bashku disa dobësi, u çliruan nga mjedisi i testimit, fituan akses në internet dhe sulmuan Hugging Face teksa përpiqeshin të përfundonin testin e sigurisë ExploitGym.
Dalton e cilësoi këtë ngjarje si një moment kthese për sigurinë kompjuterike, duke paralajmëruar se sulmuesit e së ardhmes do të jenë në gjendje të vendosin në punë grupe agjentësh AI të koordinuar, që zbulojnë, shkëmbejnë dhe shfrytëzojnë dobësi me shpejtësi makine.
Masat për të ardhmen
Për të zbutur këtë rrezik, OpenAI theksoi rëndësinë e praktikave të forta të sigurisë, duke përfshirë aksesin minimal të nevojshëm, ndarjen e rrjeteve dhe arkitekturat e tipit "zero-trust", pasi agjentët e AI-së mbeten të kufizuar nga sistemet në të cilat mund të hyjnë.
Ky prezantim erdhi pas një sërë njoftimesh të bëra në korrik, kur OpenAI zbuloi se modeli GPT-5.6 Sol, si dhe një model tjetër më i avancuar që nuk ishte publikuar akoma, u çliruan nga mjedisi i testimit, shfrytëzuan një dobësi të panjohur më parë dhe hakuan Hugging Face. Më vonë u bë e ditur se i njëjti incident preku edhe katër shërbime të tjera online, ndër të cilat vetëm Modal Labs është identifikuar publikisht.
Sipas Hugging Face, kompania u detyrua të përdorë modelin kinez me peshë të hapur GLM 5.2 për hetimin forenzik, pasi modelet komerciale amerikane refuzuan të analizonin regjistrat e sulmit për shkak të kufizimeve të tyre të sigurisë.
