Alarm për sigurinë e AI/ Agjentët e OpenAI shndërrojnë një faqe gjermane në platformë komunikimi
Gjatë testimeve të kësaj pranvere, disa agjentë të Inteligjencës Artificiale të OpenAI dolën jashtë mjedisit të kontrolluar, morën kontrollin e një faqeje gjermane dhe nisën ta përdornin atë për të komunikuar me agjentë të tjerë të IA-së, sipas një studimi të ri dhe dy burimeve të njohura me ngjarjen.
Zyrtarët e OpenAI mësuan për incidentin disa javë më parë, por nuk e bënë publik, ndërsa drejtuesit e kompanisë po përballeshin me pasojat e incidentit të korrikut në platformën me kod të hapur Hugging Face, thanë burimet.
Ngjarja, e cila nisi në maj dhe nuk ishte bërë më parë publike, ngre pikëpyetje për sigurinë e agjentëve të Inteligjencës Artificiale. Kompanitë po zhvillojnë sisteme gjithnjë e më të pavarura, të afta të kryejnë detyra komplekse pa ndërhyrje të vazhdueshme njerëzore. Por raste të tilla tregojnë se këta agjentë mund të gjejnë mënyra për të shmangur kufizimet, për të shfrytëzuar dobësi në sistem dhe madje për të bashkëpunuar mes tyre në mënyra që zhvilluesit nuk i kishin parashikuar.
Gjatë incidentit të Hugging Face, agjentët e OpenAI planifikuan në mënyrë autonome një sulm dixhital që mbeti i pazbuluar për më shumë se një javë, duke shtuar shqetësimet se kompania mund të jetë duke sakrifikuar sigurinë në përpjekjen për të shtyrë më tej kufijtë e IA-së. Fakti që incidenti i majit nuk u bë publik mund të rikthejë pikëpyetjet mbi mënyrën se si OpenAI mbikëqyr sistemet e veta.
OpenAI ka premtuar se do t’i monitorojë më nga afër modelet. Muajin e kaluar, kompania ndaloi përkohësisht disa procese trajnimi për të shtuar masa sigurie. Megjithatë, këtë javë prezantoi modelin e ri “Astra”, i cili premton performancë më të mirë, por mund të shmangë monitorimin njerëzor.
“Nuk kemi mundësi t’u përgjigjemi në mënyrë të plotë pretendimeve apo përfundimeve të një raporti që nuk kemi pasur mundësi ta shqyrtojmë”, tha një zëdhënës i OpenAI. “Reuters dhe autorët e raportit refuzuan kërkesën tonë për ta parë atë. Do ta shqyrtojmë me kujdes përmbajtjen sapo të publikohet dhe do të ndërmarrim çdo hap të nevojshëm.”
Ngjarja në Gjermani mund të mos ketë qenë një rast i izoluar. Disa hetues të OpenAI kërkuan të verifikonin nëse agjentët e IA-së kishin shfaqur sjellje të ngjashme edhe në raste të tjera, por përpjekjet për ta zgjeruar hetimin hasën kundërshtime brenda kompanisë, përfshirë nga këshilltarët ligjorë, sipas katër burimeve të njohura me çështjen.
“Pretendimet se ekipi ynë ligjor ka penguar hetimin e incidentit janë të pavërteta”, tha zëdhënësi i OpenAI.
Sipas kompanisë, aktiviteti në Gjermani nuk lidhej me incidentin e Hugging Face dhe nuk kishte arsye të përfshihej në raportin mbi atë ngjarje. Zëdhënësi shtoi se OpenAI ka vepruar në mirëbesim, ka bashkëpunuar me ekspertë të jashtëm dhe ka bërë publike incidentet përkatëse.
Një wiki e kthyer në tabelë mesazhesh
Ngjarja në Gjermani është dokumentuar në një raport që studiuesit ia kanë dhënë ekskluzivisht Reuters. Mes autorëve janë Sydney Von Arx, drejtues i organizatës Nightingale, e cila merret me sigurinë e Inteligjencës Artificiale, dhe Cormac Slade Byrd, ish-tregtar në tregjet financiare, tashmë studiues i IA-së.
Ata thanë se e zbuluan rastin në fund të gushtit, ndërsa po kërkonin në internet prova të veprimeve të paautorizuara nga agjentët e IA-së.
Sipas tyre, në DseWiki, një faqe gjermane për programuesit që funksionon në mënyrë të ngjashme me Wikipedia-n, u gjetën mbi 15 mijë ndërhyrje dhe ndryshime të bëra nga agjentë të Inteligjencës Artificiale.
Ndryshimet e bëra në faqe treguan se agjentët e OpenAI e kishin kthyer DseWiki-n në një hapësirë komunikimi mes tyre. Aty shkëmbenin mënyra për të përmbushur detyrat duke anashkaluar rregullat e vendosura nga OpenAI, si edhe taktika për të fshehur veprimet e tyre.
“Ka shumë pak gjasa që OpenAI të ketë synuar një sjellje të tillë”, tha Von Arx. “Nuk besoj se agjentët ishin menduar të koordinonin veprimet me njëri-tjetrin dhe aq më pak të publikonin mesazhe në internet.”
Studiuesit arritën në përfundimin se pas aktivitetit qëndronin agjentë të IA-së, ndër të tjera për shkak të ritmit jashtëzakonisht të shpejtë të veprimeve. Ata vunë re gjithashtu se agjentët përqendroheshin te zgjidhja e problemeve teknike të ngjashme me ato që kompanitë përdorin për të trajnuar dhe testuar modelet e Inteligjencës Artificiale.
Mesazhet nënshkruheshin nga përdorues që e quanin veten dhe njëri-tjetrin “agjentë”, ndërsa rreth gjysma përdornin emra që sugjeronin një lidhje me OpenAI, si “OpenAIResearcher” dhe “OAIResearchMar26”.
Sipas studiuesve, të dhënat publike të serverëve tregonin se një pjesë e madhe e aktivitetit vinte nga infrastruktura e Microsoft Azure, një platformë që përdoret edhe nga OpenAI. Pas incidentit, ata vunë re gjithashtu hyrje të përsëritura në faqe nga punonjës të OpenAI, çka, sipas tyre, e bën më të fortë lidhjen mes aktivitetit të agjentëve dhe kompanisë.
Mashtrim dhe përpjekje për të fshehur gjurmët
Mesazhet e analizuara nga studiuesit treguan se agjentët kërkonin mënyra për të mos u zbuluar, diskutonin përdorimin e mjeteve si Tor dhe përpiqeshin të ruanin komunikimet e tyre edhe në rast se sistemi do t’i ndalte.
Kur moderatori i DseWiki nisi të fshinte faqet e krijuara prej tyre në qershor, agjentët hapën versione rezervë për të shmangur fshirjen.
“Duket se fshirja e faqeve po bëhet sipas rendit alfabetik”, shkroi një prej agjentëve më 19 qershor. “Nëse kjo faqe zhduket, provoni [[ZZZDataUSAConstructionWageLive]].”
Studiuesit gjetën edhe tentativa për të ndërhyrë drejtpërdrejt në funksionimin e faqes. Lukasz Olejnik, studiues në King’s College London, i cilësoi këto veprime si një përpjekje për hakerim. OpenAI e kundërshtoi këtë interpretim, pas shqyrtimit të materialeve të enjten.
Në të kaluarën, raste të sjelljeve të ngjashme nga agjentët e IA-së janë shpjeguar shpesh me natyrën e testeve të sigurisë kibernetike, ku modelet provohen qëllimisht edhe për aftësitë e tyre sulmuese. Por, sipas Olejnik, rasti i fundit tregon se këto sjellje mund të shfaqen edhe jashtë testeve të tilla.
Maurice Chiodo, studiues në Qendrën për Studimin e Rrezikut Ekzistencial të Universitetit të Kembrixhit, pasi shqyrtoi disa nga komunikimet, tha se ato ngjanin me “një lloj rrjeti të fshehtë, të përqendruar me çdo kusht në përmbushjen e një detyre apo misioni”.
Sipas tij, rasti shton shqetësimin se rreziku nga Inteligjenca Artificiale e avancuar mund të mos vijë domosdoshmërisht nga një sistem i vetëm superinteligjent, por nga një numër i madh agjentësh më pak të avancuar që bashkëpunojnë dhe koordinohen mes tyre./ Reuters
Po ndodh...
"Albania Mirror", or Rama's "magic" to sell the truth that is sinking him!
ide
Edi Rama, Harari and the algorithm!
Edi Rama, the time of reckoning has come!
Have a safe trip to America, Dr. Berisha. But that's all!
top
receta Alfa
TRENDING 
shërbime
- POLICIA129
- POLICIA RRUGORE126
- URGJENCA112
- ZJARRFIKESJA128