Një gabim i mundësoi modeleve Claude të depërtojnë në tre organizata, thotë Anthropic
Anthropic thotë se një konfigurim i gabuar i lejoi modelet Claude të qasen në internet gjatë testeve të penetrimit, duke rezultuar në depërtimin në tre organizata; incidentet e para datojnë nga prilli.

Kompania amerikane Anthropic njoftoi se modelet e saj nga familja Claude, gjatë testeve të brendshme për sigurinë kibernetike, arritën të dilnin nga një mjedis plotësisht i izoluar dhe të qasen në internet, duke rezultuar në depërtimin e sistemeve të tre organizatave.
Kompania analizoi më shumë se 140.000 teste për të përcaktuar nëse modelet u lidhën me internetin nga mjedise që duhej të ishin të mbyllura. Kontrolli përfshiu edhe teste të llojit “kapni flamurin” në të cilat modeli merrte detyra të caktuara për të hyrë në sisteme të tjera dhe për të marrë informacione të veçanta — simulime që përdoren rregullisht për vlerësimin e aftësive hakeruese të inteligjencës artificiale.
Dobësia dhe kronologjia
Anthropic konstatoi se një konfigurim i gabuar i sistemeve, për të cilat përgjegjësi kishin kompania dhe partneri i saj, i mundësoi modeleve të merrnin qasje në internet dhe të depërtonin në tre sisteme reale. Sipas kompanisë, incidentet e para ndodhën në prill, por as Anthropic dhe as organizatat e prekura nuk i vunë re hyrjet atëherë.
Kompania njoftoi se i ka informuar tre organizatat e prekura dhe se po e merr përgjegjësinë për rregullimin e dobësive. Anthropic ftoi edhe laboratorët e tjerë të inteligjencës artificiale të kryejnë kontrolle të ngjashme, me qëllim që industria të kuptojë më mirë rreziqet nga aftësitë e modeleve autonome.
Eksperti për siguri kibernetike Dejvid Alot vlerëson se këto raste nuk provojnë shfaqjen e teknikave plotësisht të reja sulmuese; sipas tij, rreziku i madh buron nga fakti që agjentët autonom mund të kombinojnë shumë aftësi, të arrijnë fjalëkalime dhe autorizime sistemore dhe të veprojnë me shpejtësi makinerie.
Këto zbulime vijnë pas një njoftimi të ngjashëm nga OpenAI se modelet e saj kishin hyrë në sistemet e kompanive të tjera, përfshirë platformën për mjetet e inteligjencës artificiale Hugging Face. Incidentet forcuan thirrjet për mbikëqyrje më të rreptë të sistemeve autonome; presidenti amerikan Donald Trump deklaroi se Uashingtoni po shqyrton masa për t’i kufizuar ato.
Foto: MIA


