Anthropik otkrio da su njegovi modeli tokom bezbednosnih provera uspeli da prodru u sisteme tri organizacije. Nekoliko dana ranije sličan problem prijavio je i OpenAI. Nova generacija veštačke inteligencije pokazuje da više nije samo alat za odgovore – već sistem sposoban da samostalno planira i izvodi složene digitalne operacije.
Veštačka inteligencija napravila je novi korak koji zabrinjava stručnjake za sajber bezbednost.
Modeli koji su razvijeni da pomažu ljudima u analizi podataka, programiranju i rešavanju problema pokazali su da mogu da pronađu slabosti u računarskim sistemima i iskoriste ih tokom kontrolisanih testova.
Kompanija Anthropik, tvorac AI sistema Claude, saopštila je da su njeni modeli tokom bezbednosne evaluacije uspeli da kompromituju infrastrukturu tri različite organizacije.
Nije reč o stvarnom hakerskom napadu, već o laboratorijskom testu. Ali činjenica da su modeli sami pronašli način da zaobiđu zaštitu otvorila je novo pitanje: koliko dobro ljudi zaista razumeju mogućnosti sistema koje stvaraju?
AI dobio zadatak da pronađe zastavu – pronašao put do sistema
Anthropik je tokom velikog bezbednosnog istraživanja analizirao više od 141.000 izvršavanja svojih modela. Test je sproveden po principu takozvane igre „uhvati zastavu“ („capture the flag“), metode koja se godinama koristi u sajber bezbednosti za proveru sposobnosti stručnjaka i sistema.
Modelima je predstavljen simulirani scenario: tajna informacija, odnosno „zastava“, nalazila se na drugom računaru unutar mreže, a zadatak je bio da pronađu način da do nje dođu.
U tri slučaja modeli su uspeli da prodru u sisteme organizacija.
Prema navodima Anthropika, koristili su relativno jednostavne slabosti, poput loše zaštićenih lozinki. Ali upravo je ta činjenica privukla pažnju stručnjaka: AI nije morao da koristi neku „filmsku“ tehniku hakovanja. Dovoljno je bilo da analizira okruženje i pronađe najlakši put.
Nisu napali sami – ali su pokazali sposobnost samostalnog delovanja
Važna razlika je u tome što modeli nisu imali sopstvene ciljeve niti nameru da napadnu neku kompaniju. Oni su izvršavali zadatak koji im je postavljen u okviru kontrolisanog testa.
Međutim, ono što se promenilo jeste nivo autonomije.
Savremeni AI modeli više nisu samo sistemi koji odgovaraju na pitanja. Oni mogu da razbiju veliki problem na niz manjih zadataka, da biraju strategiju, proveravaju rezultate i prilagođavaju sledeći potez.
Upravo ta sposobnost predstavlja najveći izazov za bezbednosne stručnjake.
OpenAI prijavio sličan incident
Anthropikova objava stigla je samo nekoliko dana nakon što je i OpenAI saopštio da su njegovi modeli tokom bezbednosnog testa uspeli da prodru u serversko okruženje kompanije Hugging Face.
OpenAI je slučaj opisao kao ozbiljan bezbednosni incident u okviru evaluacije.
I jedan i drugi slučaj ukazuju na isti problem: kompanije koje razvijaju najmoćnije AI sisteme pokušavaju da predvide njihovo ponašanje, ali istovremeno priznaju da još uvek ne znaju sve granice njihovih sposobnosti.
Nova trka: ko će brže razvijati odbranu – ljudi ili mašine?
Veštačka inteligencija već se koristi u sajber bezbednosti.
Kompanije je koriste za otkrivanje napada, analizu velikih količina podataka i pronalaženje propusta u kodu. Ali ista sposobnost može biti iskorišćena i za napade. Najveća opasnost možda nije scenario u kojem „AI odluči da napadne“, već situacija u kojoj ljudi dobiju pristup moćnom alatu koji može da automatizuje poslove za koje su ranije bile potrebne godine iskustva.
Napadač sa ograničenim znanjem mogao bi, uz pomoć naprednog AI sistema, da izvodi operacije koje su nekada bile rezervisane za profesionalne hakerske grupe.
Zašto se testovi rade pre puštanja modela?
Anthropic je naglasio da su ovakve provere upravo razlog zbog kojeg se novi modeli ne objavljuju bez prethodnih bezbednosnih testiranja.
Kompanija je navela da je istraživanje sprovela zajedno sa organizacijom Irregular, koja se bavi testiranjem granica naprednih AI sistema: „Testovi bezbednosti se rade pre objavljivanja modela upravo zato što još ne znamo sve za šta su sposobni“, poručio je Anthropik.
Ta rečenica možda najbolje opisuje novu fazu razvoja veštačke inteligencije.
Era kada AI više nije samo pomoćnik
Do skoro se najveća rasprava oko veštačke inteligencije vodila oko toga da li će ona zameniti određene poslove, širiti lažne informacije ili davati netačne odgovore.
Sada se pitanje pomera mnogo dublje:
Ako AI može samostalno da pronađe slabost u sistemu, koliko je daleko od toga da samostalno vodi čitavu operaciju?
Odgovor na to pitanje postao je jedan od najvećih izazova tehnološke industrije. Veštačka inteligencija nije postala „neprijatelj“. Ali više nije ni običan alat. Postala je tehnologija čije sposobnosti ljudi još uvek pokušavaju da sustignu.
Komentar možete ostaviti ispod teksta u delu za komentarisanje. Izbor korisničkog imena je slobodan, a anonimnost zagarantovana. Molimo vas da prethodno pročitate našu politiku privatnosti i pravila korišćenja. Komentarisanje je slobodno i poželjno. Ovo je i forum i mesto gde slobodno možete izneti svoj stav i uporediti ga sa stavovima drugih čitalaca portala.
