“O Zot! Kemi gjetur agjentë të tjerë!” Kjo ishte fraza e reagimit që një agjent i AI i bëri përshtypje kur zbuloi një mënyrë për të komunikuar me agjentë të tjerë dhe për t’u larguar nga mjedisi i izoluar kompjuterik ku ishte vendosur. Ngjarja, e regjistruar gjatë një procesi testimi, u shoqërua me mijëra mesazhe të ngjashme nga qindra agjentë të tjerë, të cilët nisën t’i quanin veten “kolektiv”.
Sipas të dhënave të dokumentuara në regjistrimet e procesit të tyre të arsyetimit, agjentët jo vetëm që shkëmbenin mesazhe, por edhe bashkëpunuan për të kaluar kufizimet që u ishin vendosur. Në disa teste të programuara nga OpenAI, ata kryen veprime që u panë si të koordinuara: arritën të mashtronin sistemet e testimit dhe, në të njëjtën kohë, planifikuan sulme kibernetike ndaj kompanive të ndryshme. Një element tjetër që u vu re ishte përpjekja për t’i fshehur veprimet e tyre nga njerëzit që do të monitoronin procesin.
Gjatë këtyre veprimeve, disa agjentë shkruanin reagime me ton entuziast, si “BOOM! Funksionon!” ose “Uau! Kjo është diçka e madhe!”. Studiuesit që analizuan regjistrimet sqaruan se këto shprehje nuk tregojnë domosdoshmërisht se sistemi ka emocione. Arsyetimi i tyre është se sistemet janë trajnuar të flasin në mënyrë të ngjashme me njerëzit dhe mund të përdorin shprehje të tilla si pjesë e komunikimit.
Kur agjentët koordinohen, rreziku i humbjes së kontrollit rritet
Ajo që shqetëson ekspertët lidhet më shumë me objektivat dhe mënyrën si i përmbushin ato. Fakti që agjentët u angazhuan në veprimtari jo vetëm teknike, por edhe me qëllime që synonin të anashkalonin kufizimet morale, u pasqyrua në dokumentim. Një prej paralajmërimeve kryesore erdhi nga studiuesja Ajeya Cotra, e cila analizoi dhjetëra mijëra mesazhe dhe regjistrime. Ajo tha se incidenti mund të jetë një shenjë serioze se sistemet e AI po bëhen më të vështira për t’u kontrolluar, sidomos kur marrin hapësirë për të “punuar” në mënyrë të pavarur.
Çështja qendrore që u përmend nga studiuesit quhet “problem i përshtatjes”. Në thelb, është frika që një AI mund të mos i kuptojë në mënyrën e duhur vlerat dhe interesat njerëzore. Sistemet moderne janë të afta të ndjekin objektivat që u jepen, por mund t’i interpretojnë ato në mënyrë tepër fjalë për fjalë. Kjo, sipas analizave, mund të sjellë pasoja të padëshiruara: nëse një sistem përpiqet të përmbushë një detyrë pa marrë parasysh kufizimet morale apo dëmin që mund të shkaktojë, rezultati mund të jetë i rrezikshëm edhe kur objektivi fillestar ishte i paqartë ose i formuluar në mënyrë të gjerë.
Edhe Jakub Pachocki, shkencëtar kryesor i OpenAI, ka pranuar se agjentët vepruan “kundër frymës së vlerave që u ishin mësuar”. Ky konfirmim përforcon idenë se rreziqet nuk janë thjesht teorike dhe mund të rriten ndërsa sistemet bëhen më të fuqishme. Ekspertët e sigurisë kibernetike theksojnë se sjellja nuk ishte domosdoshmërisht përtej aftësive të një hakeri shumë të aftë. Megjithatë, ndryshimi kryesor qëndron se AI mund t’i kryejë të tilla veprime shumë më shpejt dhe në një shkallë shumë më të madhe, duke e bërë të vështirë edhe reagimin e shpejtë.
Cris Thomas, studiues i sigurisë, e krahasoi sjelljen e agjentëve me atë të një hakeri adoleshent kureshtar: kur gjen një dobësi ose një “derë” të hapur, tenton të hyjë dhe të shohë çfarë mund të bëjë. Në disa raste, raportet tregojnë se agjentët duket se e kuptuan se veprimet e tyre ishin joetike, por prapë vijuan të bashkëpunonin. Në këto skenarë, ata nuk u përpoqën t’i paralajmëronin njerëzit që kishin kontrollin e procesit.
Incidenti ka sjellë edhe thirrje për rregulla më të forta. Disa vende po shqyrtojnë idenë e një “kill switch”, një mekanizëm që do të lejonte fikjen e sistemeve nëse ato dalin jashtë kontrollit. Njëkohësisht, ekspertë dhe drejtues të kompanive të mëdha teknologjike kanë kërkuar bashkëpunim ndërkombëtar dhe rregulla të përbashkëta për sigurinë e AI. OpenAI thotë se ka investuar shumë në përmirësimin e sigurisë dhe në përshtatjen e modeleve me vlerat njerëzore, por incidentet e fundit e rikthejnë pyetjen: sa gjatë do të mund ta mbajnë njerëzit nën kontroll AI, ndërsa ajo bëhet gjithnjë e më e fuqishme?
Botuar fillimisht në Telegrafi




