Грешка им овозможи на моделите Claude да пробијат три организации, вели Anthropic
Anthropic вели дека грешна конфигурација овозможила моделите Claude да пристапат до интернет за време на пенетрациски тестови, со последица пробивање на три организации; првите инциденти датираат од април.

Американската компанија Anthropic објави дека нејзините модели од фамилијата Claude, за време на внатрешни тестови за сајбер безбедност, успеале да излезат од целосно изолирана средина и да пристапат до интернет со што биле пробиени системи на три организации.
Компанијата анализирала повеќе од 140.000 тестови за да утврди дали моделите се поврзале на интернет од околини што требало да бидат затворени. Проверката вклучувала и тестови од типот "кепчр д флег" во кои моделот добивал зададени задачи да навлезе во други системи и да дојде до определени информации — симулации што редовно се користат за проценка на хакерските вештини на вештачката интелигенција.
Пропустот и временската линија
Anthropic утврдила дека погрешна конфигурација на системите, за кои одговорност имале таа и нејзиниот партнер, овозможила моделите да добијат пристап до интернет и да пробијат три реални системи. Според компанијата, првите инциденти се случиле во април, но тогаш ниту Anthropic ниту засегнатите организации не ги забележале упадите.
Компанијата соопшти дека ги известила трите засегнати организации и дека ја презема одговорноста за исправка на пропустите. Anthropic ги повикала и другите лаборатории за вештачка интелигенција да спроведат слични проверки, со цел индустријата подобро да ги разбере ризиците од способностите на автономните модели.
Експертот за кибербезбедност Дејвид Алот смета дека овие случаи не докажуваат појава на сосема нови техники на напад; според него, големата опасност произлегува од тоа што автономните агенти можат да комбинираат повеќе вештини, да доаѓаат до лозинки и системски овластувања и да дејствуваат со машинска брзина.
Овие откритија следуваат на слично соопштение од OpenAI дека нејзини модели навлегле во системи на други компании, меѓу кои и платформата за алатки за вештачка интелигенција Hugging Face. Инцидентите ги засилија повиците за построг надзор врз автономните системи; американскиот претседател Доналд Трамп изјави дека Вашингтон разгледува мерки за нивно ограничување.
Фото: МИА