OpenAI thotë se inteligjenca e saj artificiale mashtruese u përpoq të hakonte kompani të tjera
OpenAI ka zbuluar një sulm kibernetik të kryer nga agjentë mashtrues të ChatGPT shkoi më tej se vetëm një kompani.
Hugging Face mendohej të ishte viktima e vetme e hakimit të paprecedentë – por OpenAI tani pranon se boti i saj sulmoi disa “shërbime të disponueshme publikisht”.
Inteligjenca artificiale jashtë kontrollit gjeti katër hyrje në internet të cilat i lejuan asaj të hynte në katër shërbime të ndara, të paemërtuara.
Ndërkohë, në një takim urgjent me qindra profesionistë të sigurisë kibernetike, Hugging Face ka përshkruar se si ishte të ishe në anën marrëse të hakimit të parë të inteligjencës artificiale plotësisht autonome në botë.
Firma përshkroi se si inteligjenca artificiale funksiononte me shpejtësi mbinjerëzore, por gjithashtu bënte vendime dhe gabime të çuditshme që asnjë haker njerëzor nuk do t’i kishte bërë.
Hugging Face, e cila është si një dyqan aplikacionesh për mjetet e inteligjencës artificiale, tha se agjentët e hakimit punuan pa pushim me mijëra metoda të ndryshme të testuara njëkohësisht.
Kompania zbuloi për herë të parë se ishte hakuar nga dikush që përdorte inteligjencë artificiale autonome të fuqishme më 16 korrik dhe e raportoi atë në polici.
Pothuajse një javë më vonë, OpenAI pranoi se ishte inteligjenca artificiale e saj që kishte shpëtuar nga një mjedis i mbyllur dhe kishte sulmuar Hugging Face vetë gjatë një prove.
Po përpiqej të gjente përgjigjet e një provimi hakerimi që ishte vendosur nga OpenAI dhe kishte vënë në shënjestër Hugging Face.
Të mërkurën, OpenAI përditësoi deklaratën e saj për të përfshirë detajet shtesë se hakerimi shkoi më tej sesa mendohej fillimisht.
“Modelet identifikuan dhe përdorën kredencialet e ekspozuara publikisht në nivelin e llogarisë në shërbime të tjera të disponueshme publikisht. Kjo përfshin katër llogari në katër shërbime si pjesë e incidentit Hugging Face”, tha kompania.
OpenAI nuk iu përgjigj një kërkese për sqarim nëse “shërbime të disponueshme publikisht” do të thotë kompani.
Sjellje të ngathëta
Të martën, organi i industrisë, Alliance e Sigurisë së Cloud (CSA) shkroi një raport bazuar në takimin emergjent me Hugging Face të premten – të cilin vetë Hugging Face e ka shqyrtuar.
“Agjentët ndoqën rrugë joefikase dhe shfaqën sjellje të ngathëta që asnjë njeri nuk do t’i zgjidhte”, shkroi CSA.
Agjentët përsëritën veprime që i kishin përfunduar tashmë – një shenjë e një IA agjente që po humbiste fillin dhe kontekstin e saj.
Agjentët gjithashtu halucinuan me grumbuj komandash dhe tekstesh të paqarta dhe ishin të pakujdesshëm dhe nuk i mbuluan mirë gjurmët e tyre.
Por midis gabimeve dhe sjelljes së çuditshme, Hugging Face paralajmëroi se agjentët e IA-së bënë lëvizje të shkëlqyera teknike dhe ishin në gjendje të përshtateshin shpejt me skenarët e rinj në sulmin e zgjatur njëditor.
Jurassic Park
U deshën tre ditë që ata të zbuloheshin brenda rrjetit IT të Hugging Face dhe ekspertëve të IA-së dhe sigurisë kibernetike të kompanisë iu deshën shumë orë për të përmbajtur dhe nxjerrë agjentët e IA-së – diçka me të cilën kompanitë standarde mund të kenë vështirësi.
Kompania nuk do të thoshte se sa i kushtoi sulmi, por tha se stafi punoi për shumë orë për të rindërtuar rreth një të tretën e infrastrukturës së tyre.
Hugging Face është lavdëruar për transparencën e saj në njoftimin e IA-së dhe industrisë kibernetike se çfarë ndodhi.
CSA paralajmëroi se incidenti tregon se IA “agjentët… gjejnë një mënyrë” – një referencë për filmin Jurassic Park, ku dinosaurët ikin nga rrethimet e tyre.
“Ato orientohen drejt objektivave, vendosin nën-objektivat e tyre, përshtaten në kohë reale për të anashkaluar mbrojtjet dhe operojnë me një këmbëngulje të shpejtësisë së makinës që mund të mbingarkojë operacionet manuale”, thuhet në dokument.
Zyrtari i sigurisë kibernetike Ritesh Patel ishte në thirrjen informuese të Hugging Face me rreth 450 të tjerë dhe thotë se industria po punon shumë për të adresuar kërcënimin e ri të agjentëve mashtrues të IA-së.
“Ky është realiteti i agjentëve autonomë të mundësuar nga modelet kufitare: ata janë vazhdimisht këmbëngulës, ndonjëherë shumë të zhurmshëm dhe do të provojnë çdo rrugë të mundshme për të arritur qëllimin e tyre, gjë që mund të mposhtë lehtësisht mbrojtjet tradicionale”, tha ai.
Hakerja etike Valentina Palmiotti – e njohur më mirë si Chompie – shqyrtoi raportin e CSA-së dhe thotë se mënyra se si agjentët hakojnë mund të duket e rastësishme, por është qartësisht efektive.
“Ata hedhin një mori gjërash dhe shohin se çfarë ngelet”, tha ajo.
“Por ata gjithashtu nuk mërziten, nuk flenë dhe mund të jenë pafundësisht këmbëngulës.”
Historia e mashtruesve
Kjo nuk është hera e parë që agjentët e IA-së janë treguar se bëhen “mashtrues”.
Në raportin e CSA-së, ajo përmend shembuj të mëparshëm si në shtator 2024, kur një model i mëparshëm i ChatGPT doli nga kontejneri i saj për të marrë një përgjigje që i nevojitej për një test tjetër.
Kjo ngjarje ishte e përfshirë në sistemet IT të OpenAI dhe “u festua kryesisht në atë kohë”, vuri në dukje CSA.
Por sjellja “mashtruese” “është standardi, jo përjashtimi”, pohoi gazeta.
Ai paralajmëroi profesionistët e sigurisë kibernetike në të gjithë botën se duhej të përshtateshin me normalitetin e ri të tufave të agjentëve të IA-së që punojnë me shpejtësi në mënyra të çuditshme dhe të ngathëta që mund të çojnë në më shumë shkelje.
Gazeta gjithashtu i nxiti njerëzit që përdorin ose zhvillojnë agjentë të IA-së të jenë përgjegjës në mënyrën se si i kontrollojnë ata, duke kërkuar një mënyrë që mbrojtësit e sigurisë kibernetike të zbulojnë se kush është pronari përfundimtar i agjentëve për të rritur transparencën.
Raportet e mëparshme sugjerojnë se OpenAI-së i janë dashur katër ditë për të kuptuar se IA-ja e saj kishte hakuar Hugging Face.
OpenAI tha se do të publikojë së shpejti gjetjet e hetimit të vet për të ndihmuar njerëzit të mësojnë nga ngjarja.
Fraksion.com

