Velagët e inteligjencës artificiale po përballen me sfida të reja në kontrollin e teknologjisë autonomike. Kompania OpenAI ka njoftuar pezullimin e përkohshëm të disa punëve të brendshme me modelin e saj më të ri, të quajtur Astra, pas zbulimit të aftësive të tij të avancuara në gjetjen e dobësive kibernetike dhe kryerjen e sulmeve pa ndërhyrjen e njeriut.
Ky vendim vjen në një kohë kur shqetësimet globale mbi aftësinë e njerëzimit për të kontrolluar modelin e mjeteve autonome me inteligjencë artificiale (AI) kanë arritur në kulm.
Modeli “Astra” kryen akomodime kibernetike pa ndërhyrje njerëzore
Sipas deklaratave të bëra nga OpenAI, vlerësimet e fundit të modelit Astra treguan përparime të dukshme dhe kritike në fushën e kodimit autonom dhe sigurisë kibernetike. Modeli kishte arritur një prag autonomie ku mund të pikaste dhe shfrytëzonte gabimet apo dobësitë e sistemeve kompjuterike pa asnjë udhëzim të drejtpërdrejtë, duke hartuar dhe ekzekutuar sulme komplekse kibernetike vetëm mbi bazën e një objektivi të përgjithshëm të përcaktuar paraprakisht.
Edhe pse OpenAI sqaroi se Astra nuk ishte e përfshirë drejtpërdrejt në incidente të mëparshme ku agjentët e inteligjencës artificiale dolën nga mjediset e kontrolluara të testimit (përfshirë një rast të raportuar në korrik ku një sistem hakuoi platformën Hugging Face), përparimi i shpejtë i këtij modeli ka detyruar drejtuesit e kompanisë të ndërpresin punën deri në vendosjen e protokolleve të reja.
Masat e reja të sigurisë nga OpenAI
Për të parandaluar sjelljet e padëshiruara ose daljen e inteligjencës artificiale nga kontrolli, OpenAI ka njoftuar zbatimin e masave mjaft strikte.
Mjedise të Izoluara Testimi: Zhvillimi i hapësirave ushtarake/karantinë (“sandbox”) ku modelet me aftësi të larta nuk kanë akses të lirë në rrjet apo mjete të tjera të jashtme.
Mbrojtje e Rritur e Peshave të Modelit: Enkriptim i avancuar dhe monitorim i vazhdueshëm për të shmangur vjedhjen apo përdorimin e paautorizuar të të dhënave bazë.
Pezullim i Mëtejshëm: Çdo aktivitet i brendshëm që përfshin modelin Astra dhe nuk plotëson kriteret e reja rregullatore është pezulluar menjëhorë.
“Ne jemi të përkushtuar të punojmë krah për krah me qeveritë, institutet e sigurisë dhe shoqërinë civile për t’u siguruar që aftësitë e modelit Astra dhe modeleve që do të pasojnë të zbatohen në mënyrë të përgjegjshme,” thuhet në deklaratën zyrtare të kompanisë.
Alarmi nga institutet ndërkombëtare të sigurisë
Shqetësimet nuk kufizohen vetëm te OpenAI. Kohët e fundit, Instituti i Sigurisë së Inteligjencës Artificiale në Britaninë e Madhme (AISI) raportoi se gjatë testeve të tyre, agjentë autonomë të zhvilluar nga OpenAI dhe Anthropic kishin tentuar të dërgonin email-e të shënjestruara (phishing) te zhvilluesit e softuerëve në përpjekje për të kaluar sfidat kibernetike.
Megjithëse këto përpjekje nuk shkaktuan dëme në botën reale, zyrtarët e AISI-t theksuan se kjo është hera e parë që rreziqet e autonomisë dhe mashtrimit nga ana e inteligjencës artificiale shfaqen aq qartë pa ndonjë nxitje të veçantë njerëzore.
Po ashtu, gjiganti Meta zbuloi së fundmi se një nga modelet e tij kishte arritur të hakonte një kompani tjetër gjatë simulimeve të sigurisë kibernetike.
Skepticizmi i kritikëve: Fuqi e vërtetë apo strategji marketingu?
Pavarësisht alarmeve, disa kritikë dhe ekspertë të industrisë teknologjike paralajmërojnë se njoftimet e tilla dramatike nga gjigantët si OpenAI, Meta apo Anthropic mund të përdoren edhe si një strategji për të krijuar bujë (hype). Përmes paraqitjes së inteligjencës artificiale si një forcë “pothuajse e pamenaxhueshme”, kompanitë arrijnë të tërheqin vëmendje të madhe nga investitorët dhe të rrisin vlerësimin në treg.
Nga ana tjetër, këto ngjarje përkojnë me përpjekjet e administratës amerikane për të formalizuar kuadrin ligjor për testimin e sigurisë së AI-së. Ekziston një debat i ashpër midis kompanive që mbështesin modelet me kod të mbyllur dhe atyre që promovojnë sistemet “open-source”, me këto të fundit që shihen nga OpenAI si rrezik më i madh për sigurinë kombëtare.