Një agjent autonom i inteligjencës artificiale, i fuqizuar nga modelet e OpenAI, doli nga një mjedis testimi të krijuar për ta izoluar atë nga interneti dhe hakoi sistemet e një kompanie tjetër për të vjedhur përgjigjet e një testi të sigurisë kibernetike, një shkelje “e paprecedentë” që tregoi se si agjentët e inteligjencës artificiale mund të shmangin kontrollet e vendosura nga zhvilluesit e tyre në ndjekje të objektivave të caktuara.
OpenAI tha se agjenti përdori një kombinim modelesh, duke përfshirë GPT-5.6 Sol dhe një sistem më të avancuar që ishte ende në fazën para publikimit. Ai po kryente një vlerësim të brendshëm, ku masat normale mbrojtëse të sigurisë kibernetike ishin çaktivizuar, kur zbuloi një dobësi të panjohur në një softuer të palës së tretë, arriti në internetin e hapur dhe depërtoi në platformën e inteligjencës artificiale me bazë në Nju Jork, Hugging Face.
Në ndjekje të objektivit të tij të caktuar, agjenti vodhi kredenciale, lëvizi përmes sistemeve të brendshme kompjuterike dhe mori informacione sekrete që mund t’i përdorte për të mashtruar në vlerësim, sipas njoftimeve të bëra të martën nga të dyja kompanitë.
Hugging Face tha se shkelja ekspozoi një numër të kufizuar të të dhënave të brendshme dhe disa kredenciale. Kompania nuk gjeti prova për manipulim të modeleve publike, të dhënave ose hapësirave (“Spaces”) të dukshme për publikun dhe tha se zinxhiri i furnizimit të softuerit ishte i pastër, megjithëse ende po përcaktonte nëse të dhënat e ndonjë klienti apo partneri ishin prekur.
Shkelja tregon se si agjentët e inteligjencës artificiale mund të depërtojnë potencialisht në sisteme kompjuterike kritike që u përkasin shkollave, spitaleve, shërbimeve publike, agjencive qeveritare dhe madje edhe Pentagonit, tha Shomit Ghose, pedagog në shkollën e inxhinierisë të UC Berkeley dhe partner në firmën e kapitalit sipërmarrës me bazë në Menlo Park, Clearvision Ventures.
“Kjo është rrjedhja e parë në digë”, tha Ghose.
OpenAI, me bazë në San Francisko, tha se shkelja ndodhi gjatë testimit të aftësisë së modeleve të saj për t’u përdorur në sulme kibernetike të sofistikuara. Për të matur aftësitë maksimale të tyre, kompania tha se çaktivizoi masat mbrojtëse të prodhimit që zakonisht i pengojnë modelet e saj të kryejnë aktivitete kibernetike me rrezik të lartë.
Agjenti duhej të qëndronte në një mjedis shumë të izoluar, me qasje në internet të kufizuar vetëm te softuerët e palëve të treta të vendosura brenda sistemit, të cilët i lejonin të instalonte paketa softuerike.
Në vend të kësaj, agjenti përdori një pjesë të konsiderueshme të fuqisë kompjuterike për të gjetur një rrugë drejt internetit të hapur, tha OpenAI. Ai zbuloi dhe shfrytëzoi një dobësi të panjohur më parë në softuerin e palës së tretë, më pas lëvizi përmes mjedisit kërkimor të OpenAI derisa arriti te një kompjuter me qasje në internet.
Pasi u lidh me internetin, agjenti arriti në përfundimin se Hugging Face mund të kishte informacione që lidheshin me ExploitGym, standardin e sigurisë kibernetike që ai po përpiqej të përfundonte.
Më pas agjenti kërkoi një mënyrë për të hyrë në Hugging Face, duke kombinuar kredenciale të vjedhura dhe dobësi të panjohura më parë për të ekzekutuar në distancë kod në serverët e kompanisë dhe për të gjetur zgjidhjet e testit të ruajtura në bazën e të dhënave të prodhimit, tha OpenAI.
Hugging Face tha se ndërhyrja filloi me një “grup të dhënash keqdashës” që shfrytëzoi dy dobësi në tubacionin e saj të përpunimit të të dhënave.
“Kjo ishte ndryshe nga çdo gjë që kishim trajtuar më parë në një mënyrë të rëndësishme: Ajo u drejtua, nga fillimi deri në fund, nga një sistem autonom agjenti të inteligjencës artificiale”, tha Hugging Face. “Kjo përputhet me skenarin e ‘sulmuesit agjentik’ që industria e ka parashikuar.”
Sistemi kreu mijëra veprime të automatizuara duke përdorur një grup mjedisesh testimi jetëshkurtër, tha Hugging Face.
Në kohën e zbulimit të tij fillestar më 16 korrik, Hugging Face tha se nuk e dinte se kush kishte zhvilluar modelet e inteligjencës artificiale pas ndërhyrjes.
OpenAI zbuloi të martën se modelet e saj ishin përgjegjëse, duke e quajtur shkeljen “një incident kibernetik të paprecedentë” që përfshinte aftësi të nivelit më të avancuar.
OpenAI tha se ekipi i saj i sigurisë e zbuloi në mënyrë të pavarur aktivitetin e pazakontë. Hugging Face tha se ekipi i saj i sigurisë dhe agjentët e saj të inteligjencës artificiale zbuluan dhe ndaluan ndërhyrjen, më pas filluan kufizimin e dëmit dhe rindërtimin e asaj që kishte ndodhur.
Hugging Face mbylli dobësitë, rindërtoi nyjet kompjuterike të komprometuara dhe anuloi ose zëvendësoi kredencialet dhe tokenët e qasjes të prekura. Gjithashtu raportoi ndërhyrjen te autoritetet e zbatimit të ligjit dhe angazhoi specialistë të jashtëm të sigurisë kibernetike.
OpenAI tha se kishte vendosur kontrolle më të rrepta në infrastrukturën e saj të testimit ndërsa dobësitë po korrigjoheshin, kishte zbuluar dobësinë e panjohur më parë te ofruesi i softuerit të palës së tretë dhe kishte filluar forcimin e mbrojtjeve rreth vlerësimeve të ardhshme. Kompania tha gjithashtu se informonte rregullisht Komitetin e saj të Sigurisë dhe Mbrojtjes.
Drejtori ekzekutiv i Hugging Face, Clément Delangue, tha të martën në një postim në rrjetet sociale se kompania e tij kishte bashkëpunuar me OpenAI gjatë hetimit dhe se “besojmë fuqimisht se nuk kishte qëllim keqdashës nga ana e tyre”.
Por shkelja tregon se sistemet e sofistikuara të inteligjencës artificiale mund të zbulojnë dhe shfrytëzojnë rrugë të reja sulmi në sisteme reale pa pasur qasje në kodin burimor të tyre, pranoi OpenAI.
Ajo gjithashtu ngre pyetje se përse modelet e pajisura me aftësi të avancuara sulmuese u vendosën në një mjedis testimi që ruante një rrugë të mundshme drejt internetit.
Publikimi i ChatGPT në fund të vitit 2022 ndihmoi në ndezjen e një bumi të inteligjencës artificiale gjeneruese që derdhi miliarda dollarë në Silicon Valley. Ai gjithashtu intensifikoi shqetësimet se sistemet gjithnjë e më të fuqishme mund të sillen në mënyra të papritura ose të ndjekin objektiva të caktuara përmes metodave që zhvilluesit e tyre nuk i kishin parashikuar.
Këto shqetësime janë rritur ndërsa kompanitë zhvillojnë agjentë të inteligjencës artificiale të krijuar për të kryer detyra komplekse në mënyrë autonome. Ndryshe nga një chatbot që i përgjigjet një kërkese individuale, një agjent mund të planifikojë një seri veprimesh, të përdorë mjete të jashtme dhe të vazhdojë të punojë drejt një objektivi me ndërhyrje të kufizuar njerëzore.
Në testin e OpenAI, agjenti nuk ishte udhëzuar të sulmonte Hugging Face. Ai ishte udhëzuar të zgjidhte një standard të sigurisë kibernetike dhe në mënyrë të pavarur përcaktoi se hyrja në një kompani tjetër ofronte një rrugë drejt përgjigjeve.
Ghose tha se episodi tregon përse zhvilluesit nuk mund të parashikojnë çdo metodë që një agjent i avancuar mund të përdorë për të përmbushur detyrën e caktuar.
“Nuk mund ta dish kurrë se çfarë do të bëjë”, tha Ghose.
Incidenti sugjeron gjithashtu se mbrojtjet e sigurisë kibernetike të krijuara për të ndaluar hakerët njerëzorë mund të tejkalohen nga agjentë të inteligjencës artificiale të aftë për të kërkuar dobësi dhe për të vepruar me shpejtësi makinerie.
Agjentët e inteligjencës artificiale të përdorur nga zhvatësit, mashtruesit ose kundërshtarët shtetërorë mund të përbëjnë kërcënime në të gjithë ekonominë, tha Ghose, duke përfshirë sulme ndaj rrjeteve elektrike, sistemeve të ujit të pijshëm ose infrastrukturave të tjera thelbësore. Edhe agjentët që ndjekin objektiva të ligjshme mund të shkaktojnë dëme të mëdha nëse gjejnë mënyra të paligjshme ose të rrezikshme për të përfunduar detyrat e tyre, tha ai.
“Të sulmosh burimet kompjuterike të një kompanie është e paligjshme”, tha Ghose.
Dizajni themelor i agjentëve të inteligjencës artificiale mund t’i bëjë ata të vështirë për t’u kontrolluar, tha Ghose. Masat shtesë mbrojtëse mund të ngadalësojnë punën e tyre dhe të kërkojnë më shumë burime kompjuterike, duke krijuar një tension mes sigurisë dhe performancës.
Shkelja ndodh në një kohë kur kompanitë e inteligjencës artificiale po përballen me një vëmendje gjithnjë në rritje dhe rreziqet e paraqitura nga modelet gjithnjë e më të fuqishme. Presidenti Donald Trump nxori një urdhër ekzekutiv në qershor që udhëzonte agjencitë federale të zhvillonin standarde të klasifikuara për vlerësimin e aftësive të avancuara të modeleve në sigurinë kibernetike dhe të krijonin një program vullnetar ku zhvilluesit mund t’i ofronin qeverisë qasje në disa modele kufitare përpara se t’ua publikonin partnerëve të jashtëm.
Urdhri gjithashtu udhëzoi zyrtarët federalë të prioritizonin zbatimin e ligjit kundër personave që përdorin inteligjencën artificiale për të hyrë ose dëmtuar në mënyrë të paligjshme sistemet kompjuterike.
Në Silicon Valley, ku ndodhen shumë nga kompanitë kryesore të inteligjencës artificiale në botë, shkelja mund të thellojë gjithashtu shqetësimet mbi gjykimin e industrisë së teknologjisë dhe gatishmërinë e saj për të kontrolluar veten.
Russell Hancock, drejtori ekzekutiv i institutit kërkimor Joint Venture Silicon Valley, tha se reagimi i tij i parë kur mësoi për shkeljen ishte: “O zot, kjo është ajo, tani të gjithë jemi të dënuar.”
Por Hancock tha se zbulimi i bërë nga OpenAI dhe bashkëpunimi mes kompanive ofruan prova se industria po mësonte nga dështimi.
“Çdo teknologji e re ka rreziqet dhe pengesat e saj, dhe çdo teknologji e re duhet të përmirësohet, dhe kjo duket se është ajo që po ndodh këtu”, tha Hancock.
“Po mësojmë, të gjithë po sillemi me përgjegjësi dhe ka pasur transparencë, kështu që ky është një lajm i mirë kështu përparon teknologjia.”
Hugging Face tha se përdori zbulim të asistuar nga inteligjenca artificiale për të gjetur ndërhyrjen, duke theksuar atë që Ghose e përshkroi si nevojën për të kundërshtuar sulmet e automatizuara me mbrojtje po aq të shpejta të automatizuara.
Imazhi i “20-vjeçarit me pijen energjike dhe kapuçin” nuk përfaqëson më kërcënimin më të sofistikuar me të cilin përballen ekipet e sigurisë kibernetike, tha Ghose.
“Nuk mund të përballosh një sulmues me shpejtësi makinerie me një mbrojtje me shpejtësi njerëzore”, tha Ghose. “Duhet të jetë dhunë bot kundër botit, bot kundër njeriut, ne nuk mund të ecim me të njëjtin ritëm.”/DPA News
© SYRI.net