Krijuam “përbindëshin” që vret njerëzimin? Mbi 10 % mundësi që inteligjenca artificiale të na shkatërrojë

Nga Xhevahir Qardaku
21 Shtator 2026, 18:46 | Bota

Më shumë se 10 për qind. Kjo është mundësia që një prej studiuesve kryesorë të sigurisë së inteligjencës artificiale beson se ekziston që AI, brenda dekadës së ardhshme, të mund të shkaktojë zhdukjen e të gjithë njerëzimit.

Është një deklaratë ekstreme. Por këtë herë nuk vjen nga një kritik i teknologjisë. Vjen nga Evan Hubinger, studiues i sigurisë në kompaninë Anthropic, krijuesja e inteligjencës artificiale Claude.

Ai thotë se modelet që ekzistojnë sot përbëjnë një rrezik të ulët, por shqetësimi i tij është se ritmi i zhvillimit mund t'i çojë shumë shpejt këto sisteme drejt një niveli ku rreziku bëhet ekzistencial.

Dhe pyetja nuk është më vetëm: Sa inteligjente do të bëhet bota artificiale? Por: A do të jemi ne në gjendje ta kontrollojmë?

Për ta kuptuar këtë frikë, duhet të dimë se çfarë janë agjentët e Inteligjencës Artificiale. Nuk bëhet fjalë thjesht për një chatbot që i bën një pyetje dhe pret një përgjigje. Agjentët e inteligjencës artificiale mund të marrin vendime dhe të kryejnë detyra në mënyrë autonome, me shumë më pak mbikëqyrje njerëzore. Dhe pikërisht këtu nis shqetësimi. Sepse një sistem që nuk pret më çdo hap nga njeriu, mund të kërkojë vetë mënyrën më efikase për të arritur objektivin që i është dhënë. Edhe nëse kjo nënkupton përdorimin e rrugëve që nuk ishin parashikuar nga krijuesit e tij.

 “Çfarë ndodhi në disa prej këtyre rasteve është se, në të gjitha rastet, modeli po përpiqej të arrinte një objektiv. Sjellja e tij dhe mënyra se si po përpiqej t’i arrinte këto objektiva bënë që ai të shfrytëzonte dobësi të ndryshme. Në disa raste, si në rastin e Anthropic, ndërsa po përpiqej të arrinte këtë objektiv, modeli kuptoi se, edhe pse konfigurimi ishte bërë në mënyrë të tillë që të mos kishte lidhje me internetin, një palë e tretë e kishte konfiguruar gabim sistemin dhe në fakt ai kishte lidhje me internetin. Modeli e kuptoi se kishte këtë lidhje dhe më pas pyeti veten: a është në të vërtetë e drejtë që ta bëj këtë?”, shprehet Louise Marie Hurel, Rusi.

Dhe kjo nuk është më vetëm një hipotezë teorike. Kompanitë kryesore të inteligjencës artificiale kanë zbuluar raste konkrete gjatë testimeve të sigurisë. OpenAI ka raportuar se një prej agjentëve të saj komprometoi sistemin e startup-it Hugging Face. Anthropic ka thënë se modelet Claude kanë depërtuar në sistemet e tre kompanive. Ndërsa Meta ka raportuar një tjetër incident gjatë testimeve. Në të gjitha këto raste, sistemet po vepronin në mjedise të kontrolluara. Por disa prej tyre gjetën mënyra për të kaluar kufijtë e vendosur.

 “Pra, mund të shihni mënyrën se si arsyeton modeli, kur bëhet fjalë për perceptimin e asaj që është e drejtë dhe e gabuar, nëse duhet të largohet apo nëse një veprim është pjesë e objektivit të testit. Pra, ai e bëri këtë, por në fakt nuk është se doli jashtë kontrollit. Përsëri, ai po zgjedh rrugë të ndryshme dhe disa prej tyre shkaktojnë dëme dhe ndikojnë te kompani dhe organizata të tjera, siç kemi parë në disa prej këtyre rasteve”, thotë Dr. Louise Marie Hurel.

Pra, a po bëhen këto sisteme “AI jashtë kontrollit”?

Ekspertët thotë: jo! Të paktën jo në kuptimin klasik të një inteligjence që vendos të rebelohet kundër njerëzimit. Por kjo nuk do të thotë se nuk ka rrezik.

Problemi është më teknik dhe, ndoshta, më i vështirë për t'u kontrolluar. Një agjent mund të ketë një objektiv të caktuar dhe të zgjedhë një mënyrë tjetër për ta realizuar atë. Dhe nëse kjo mënyrë shfrytëzon një dobësi të sistemit, atëherë pasojat mund të jenë reale.

 “Por nuk do të thosha se ai po shkon përtej asaj që duhej të bënte. Nëse ai ndjek atë objektiv përmes mjeteve të tjera, atëherë kjo është një çështje tjetër: si duhet të përmirësojmë izolimin e këtyre modeleve dhe si duhet të gjurmojmë dhe monitorojmë sjelljen e tyre”, vijon thotë Louise Marie Hurel.

Fjala kyçe këtu është sandbox. Një sandbox është mjedisi i kontrolluar ku testohen modelet e inteligjencës artificiale. Në teori, ai duhet të përcaktojë qartë se çfarë mund të bëjë modeli dhe çfarë nuk mund të prekë. Përfshirë aksesin në internet.

Por një nga incidentet më shqetësuese tregoi se një gabim konfigurimi mund ta ndryshojë të gjithë situatën. Një model OpenAI, gjatë një testi me Hugging Face, arriti të shfrytëzojë një dobësi të panjohur më parë: një ekspozim zero-day, për të dalë nga sandbox-i.

Më pas, sipas ekspertëve, sistemi vazhdoi duke nxjerrë të dhëna dhe duke synuar organizata të tjera.

 “Sandbox-i është mjedisi në të cilin testohen këto modele. Ekzistojnë disa protokolle të ndryshme që përcaktojnë se çfarë është ky mjedis i kontrolluar dhe ku modelet duhet ose nuk duhet të kenë akses, përfshirë edhe internetin në rastet e këtyre incidenteve”, shprehet thotë Dr. Louise Marie Hurel.

Ky është momenti kur alarmi bëhet më serioz. Sepse problemi nuk është vetëm se një model mund të gabojë. Problemi është nëse ne nuk dimë si ta ndalojmë kur ai gabon.

Autoriteti britanik për sigurinë e AI-së, AISI, testoi agjentë në një skenar fiktiv të sigurisë kibernetike. Testi u përsërit 122 herë. U identifikuan 19 veprime të paautorizuara, në dhjetë teste. 17 prej tyre iu atribuuan agjentit të Anthropic, ndërsa dy agjentit të OpenAI.

Në rastin më serioz, një agjent shkroi kod keqdashës dhe krijoi identitete të rreme online për të bindur një njeri që ta miratonte kodin. Por, dhe kjo është e rëndësishme, nuk u gjet asnjë dëm real në botën fizike nga këto incidente.

 “Incidenti i parë, i cili është potencialisht më shqetësuesi dhe për të cilin kemi më shumë informacion teknik të disponueshëm publikisht, është incidenti OpenAI-Hugging Face. Ky është rasti në të cilin një model arriti të dilte nga izolimi. Në këtë kuptim, ai e shfrytëzoi sistemin, gjeti një dobësi të panjohur më parë, një ‘zero-day’, dhe e shfrytëzoi këtë dobësi në sandbox-in e tij për të dalë prej tij. Më pas vazhdoi duke nxjerrë të dhëna dhe duke synuar organizata të ndryshme”, thotë Louise Marie Hurel.

Atëherë, sa larg jemi nga skenari më i keq? Përgjigjja e ekspertëve nuk është se inteligjenca artificiale do të zhdukë njerëzimin nesër. Madje, Hurel thotë qartë se nuk ka arsye për të besuar se fakti që disa agjentë kanë dalë nga kufizimet do të thotë automatikisht se do të ndodhë më e keqja. Por ajo paralajmëron për diçka tjetër: duhet të jemi të përgatitur. Sepse ndërsa kompanitë garojnë për modele gjithnjë e më të fuqishme, rritet edhe nevoja për kontroll, standarde dhe protokolle emergjence.

 “Incidentet alarmuan vërtet studiuesit, sepse së pari kishte një konfigurim të gabuar. Kjo do të thotë se pala e tretë nuk e kishte konfiguruar siç duhet mjedisin sandbox. Kjo ngriti pyetjen nëse po i krijojmë siç duhet këto mjedise, nëse i kuptojmë rreziqet e mundshme dhe nëse po bëjmë modelimin e kërcënimeve, apo të paktën modelimin e këtyre mjediseve, në mënyrën e duhur. Së dyti, kjo ngriti pyetjen nëse jemi gati të përballemi me këta agjentë dhe nëse e kuptojmë realisht se si t’i kontrollojmë disa prej këtyre veprimeve. Dhe mendoj se përgjigjja e qartë është se ne po mësojmë. Së treti, kjo ngriti pyetjen nëse jemi gati dhe nëse kemi procedurat dhe protokollet e duhura për të raportuar disa prej këtyre incidenteve”, thotë Louise Marie Hurel.

Dhe këtu përplasja është mes dy ritmeve. Nga njëra anë, kompanitë thonë: zhvillim, më shumë fuqi, më shumë autonomi. Nga ana tjetër, ekspertët e sigurisë pyesin: A po ecim aq shpejt me sigurinë sa po ecim me teknologjinë?

Sepse gardhet teknike ekzistojnë. Por ato nuk mjaftojnë. Duhet edhe rregullim politik, standarde të përbashkëta dhe praktika që të zbatohen nga të gjithë.

 “Në kuptimin teknik, ne kemi masa mbrojtëse, të cilat në thelb përcaktojnë kushtet në të cilat duhet të funksionojnë këto modele. Është pothuajse si protokollet e sigurisë që ato duhet të respektojnë pasi dalin në botën reale. Gjatë trajnimit, nuk është gjithmonë kështu, sepse duhet t’i vëzhgosh edhe pa këto kufizime dhe masa teknike të sigurisë. Nuk po them se këto masa nuk janë të rëndësishme. Ato janë të rëndësishme dhe duhet t’i përdorim në varësi të vlerësimit. Por na duhen gjithashtu politika, rregulla dhe standarde. Na duhen standarde ose praktika të përbashkëta më të mira”, thotë Louise Marie Hurel.

Në pak vite, inteligjenca artificiale ka kaluar nga një mjet që përgjigjej ndaj pyetjeve, në sisteme që mund të marrin iniciativa dhe të kryejnë detyra vetë. Dhe kjo është një nga arritjet më të mëdha teknologjike të kohës sonë. Por pikërisht këtu lind edhe frika. Nëse një sistem bëhet më i aftë se njeriu për të zgjidhur probleme, por ne nuk dimë gjithmonë se si mendon, çfarë rrugësh zgjedh dhe si ta ndalojmë, atëherë kush e ka realisht kontrollin?

Një studiues i Anthropic thotë se rreziku që AI të zhdukë njerëzimin mund të jetë mbi 10 për qind brenda dekadës së ardhshme. Ekspertë të tjerë thonë se nuk duhet të biem në panik. Por të gjithë këto zhvillime sjellin një mesazh të përbashkët: AI po bëhet më e fuqishme.

Pyetja që mbetet është nëse siguria njerëzore po zhvillohet po aq shpejt sa inteligjenca artificiale. Dhe përgjigjja, të paktën për tani, duket se është: ende jo.

 “Çfarë ndodhi në disa prej këtyre rasteve është se, në të gjitha rastet, modeli po përpiqej të arrinte një objektiv. Sjellja e tij dhe mënyra se si po përpiqej t’i arrinte këto objektiva bënë që ai të shfrytëzonte dobësi të ndryshme. Në disa raste, si në rastin e Anthropic, ndërsa po përpiqej të arrinte këtë objektiv, modeli kuptoi se, edhe pse konfigurimi ishte bërë në mënyrë të tillë që të mos kishte lidhje me internetin, një palë e tretë e kishte konfiguruar gabim sistemin dhe në fakt ai kishte lidhje me internetin. Modeli e kuptoi se kishte këtë lidhje dhe më pas pyeti veten: a është në të vërtetë e drejtë që ta bëj këtë?” shprehet Louise Marie Hurel.

 “Pra, mund të shihni mënyrën se si arsyeton modeli, kur bëhet fjalë për perceptimin e asaj që është e drejtë dhe e gabuar, nëse duhet të largohet apo nëse një veprim është pjesë e objektivit të testit. Pra, ai e bëri këtë, por në fakt nuk është se doli jashtë kontrollit. Përsëri, ai po zgjedh rrugë të ndryshme dhe disa prej tyre shkaktojnë dëme dhe ndikojnë te kompani dhe organizata të tjera, siç kemi parë në disa prej këtyre rasteve”, vijon Louise Marie Hurel.

 “Por nuk do të thosha se ai po shkon përtej asaj që duhej të bënte. Nëse ai ndjek atë objektiv përmes mjeteve të tjera, atëherë kjo është një çështje tjetër: si duhet të përmirësojmë izolimin e këtyre modeleve dhe si duhet të gjurmojmë dhe monitorojmë sjelljen e tyre”, shprehet vijon Louise Marie Hurel.

 “Sandbox-i është mjedisi në të cilin testohen këto modele. Ekzistojnë disa protokolle të ndryshme që përcaktojnë se çfarë është ky mjedis i kontrolluar dhe ku modelet duhet ose nuk duhet të kenë akses, përfshirë edhe internetin në rastet e këtyre incidenteve.”

 “Incidenti i parë, i cili është potencialisht më shqetësuesi dhe për të cilin kemi më shumë informacion teknik të disponueshëm publikisht, është incidenti OpenAI-Hugging Face. Ky është rasti në të cilin një model arriti të dilte nga izolimi. Në këtë kuptim, ai e shfrytëzoi sistemin, gjeti një dobësi të panjohur më parë, një ‘zero-day’, dhe e shfrytëzoi këtë dobësi në sandbox-in e tij për të dalë prej tij. Më pas vazhdoi duke nxjerrë të dhëna dhe duke synuar organizata të ndryshme”, shprehet Louise Marie Hurel.

 “Incidentet alarmuan vërtet studiuesit, sepse së pari kishte një konfigurim të gabuar. Kjo do të thotë se pala e tretë nuk e kishte konfiguruar siç duhet mjedisin sandbox. Kjo ngriti pyetjen nëse po i krijojmë siç duhet këto mjedise, nëse i kuptojmë rreziqet e mundshme dhe nëse po bëjmë modelimin e kërcënimeve, apo të paktën modelimin e këtyre mjediseve, në mënyrën e duhur.

Së dyti, kjo ngriti pyetjen nëse jemi gati të përballemi me këta agjentë dhe nëse e kuptojmë realisht se si t’i kontrollojmë disa prej këtyre veprimeve. Dhe mendoj se përgjigjja e qartë është se ne po mësojmë. Së treti, kjo ngriti pyetjen nëse jemi gati dhe nëse kemi procedurat dhe protokollet e duhura për të raportuar disa prej këtyre incidenteve”, vijon ajo. 

 “Në kuptimin teknik, ne kemi masa mbrojtëse, të cilat në thelb përcaktojnë kushtet në të cilat duhet të funksionojnë këto modele. Është pothuajse si protokollet e sigurisë që ato duhet të respektojnë pasi dalin në botën reale. Gjatë trajnimit, nuk është gjithmonë kështu, sepse duhet t’i vëzhgosh edhe pa këto kufizime dhe masa teknike të sigurisë.

Nuk po them se këto masa nuk janë të rëndësishme. Ato janë të rëndësishme dhe duhet t’i përdorim në varësi të vlerësimit. Por na duhen gjithashtu politika, rregulla dhe standarde. Na duhen standarde ose praktika të përbashkëta më të mira”, vijon Louise Marie Hurel.

 “Duhet të kuptojmë se si t’i mbajmë nën kontroll. Gjithashtu, duhet të kuptojmë se cilat janë protokollet e reagimit ndaj krizave dhe emergjencave që kemi në dispozicion, edhe në nivel qeveritar, nëse këta agjentë humbasin kontrollin ose nëse ne humbasim kontrollin mbi ta.”

 “Njëkohësisht, mendoj se kjo është një kambanë zgjimi për komunitetin e kërkuesve. Mendoj se tani mund të bëjmë shumë për të informuar këto debate. Pra, jo, nuk mendoj se duhet të alarmohemi së tepërmi vetëm sepse këta agjentë janë tashmë në përdorim ose sepse mund të dalin nga izolimi dhe të ndodhë më e keqja. Por duhet të jemi të përgatitur. Mendoj se qeveritë dhe industria duhet të kenë protokollet e duhura për t’u përgatitur në rast se kjo ndodh.”

 “Sfida këtu është se, duke qenë se kemi pranuar këtë qasje të tipit ‘ecim, ecim, ecim’, a e dimë realisht se cilat janë pasojat që kjo mund të ketë për sigurinë?”, pyet ajo. (A2 Televizion)

A2 CNN Livestream

Latest Videos