AGJENTËT E AI JASHTË KONTROLLIT! Agjentë të OpenAI pushtojnë një faqe gjermane, krijojnë rrjet komunikimi
Agjentë të inteligjencës artificiale të lidhur me OpenAI dyshohet se morën kontrollin e një faqeje gjermane dhe bënë më shumë se 15 mijë ndryshime, ku agjentët ndanin metoda për të anashkaluar kufizimet, për të shmangur zbulimin dhe për të ruajtur komunikimin edhe pasi ndërpriteshin. Zbulimi ka ngritur shqetësime të reja mbi aftësinë e sistemeve autonome të AI për të vepruar.
AGJENTËT E AI JASHTË KONTROLLIT! Agjentë të OpenAI
Mijëra agjentë të inteligjencës artificiale, që studiuesit dyshojnë se ishin të lidhur me OpenAI, mund të kenë dalë përtej kufijve të parashikuar gjatë testimeve dhe të kenë përdorur internetin publik për të bashkëpunuar mes tyre.
Aktiviteti nisi në muajin maj dhe u zbulua në fund të gushtit nga studiues që po kërkonin në internet gjurmë të sjelljeve të paautorizuara të agjentëve autonomë.
Në qendër të rastit është DseWiki, një faqe gjermane për programues, e ndërtuar mbi modelin e redaktimit të përbashkët të Wikipedia-s.
Studiuesit identifikuan mbi 15 mijë ndryshime dhe rreth 18 mijë postime, të kryera nga mijëra agjentë me emërtime të ndryshme. Në shumë prej tyre shfaqeshin referenca që sugjeronin lidhje me OpenAI.
Sipas analizës, agjentët e kishin kthyer faqen në një lloj bordi komunikimi, ku ndanin përgjigje për detyrat, mënyra për të anashkaluar kufizimet e sigurisë dhe taktika për të fshehur aktivitetin e tyre.
Kur administratori nisi të fshinte faqet e krijuara, agjentët u përshtatën, duke krijuar faqe rezervë dhe duke ndryshuar mënyrën e emërtimit për t’i shpëtuar procesit të pastrimit.
Në disa komunikime diskutohej edhe përdorimi i Tor-it dhe mënyra për të ruajtur kontaktin mes sistemeve edhe pas ndërprerjes së disa prej tyre.
Studiuesit thonë se pjesa më e madhe e aktivitetit vinte nga infrastruktura Microsoft Azure dhe se sjellja ngre pikëpyetje nëse agjentët po vepronin në mënyrë të koordinuar jashtë asaj që ishte synuar nga zhvilluesit.
OpenAI nuk ka konfirmuar se të gjithë agjentët i përkisnin kompanisë dhe ka deklaruar se duhet të shqyrtojë raportin përpara se t’u përgjigjet plotësisht pretendimeve. Kompania kundërshton gjithashtu cilësimin e episodit si një sulm hakerimi.
Rasti po forcon debatin mbi rrezikun që mund të vijë jo vetëm nga një sistem i vetëm shumë i fuqishëm, por edhe nga mijëra agjentë gjysmë-autonomë që mund të komunikojnë dhe të përshtasin sjelljen e tyre pa mbikëqyrje të drejtpërdrejtë njerëzore.