PANDORINA KUTIJA

VEŠTAČKA IZMIČE NADZORU

Visited 23 times, 23 visit(s) today

Nova generacija AI programa izvršava zadatke sa izuzetnom upornošću, pa je pokušaj ograničavanja snalažljivosti često unapred izgubljena bitka. Nemoguće je predvideti svaki način izmicanja kontroli. A čelnici kompanija, pak, ističu da programi često koriste tehnike koje ljudima nikada ne bi pale na pamet da zaobiđu pravila.

Kompanije OpenAI, Anthropic i stručnjaci za bezbednost istražuju desetine hiljada incidenata u kojima su njihovi programi (modeli) veštačke inteligencije (AI) preduzeli korake koje procenitelji smatraju problematičnim. Prema saznanjima sajta za vesti Axios, toliki broj slučajeva poslednjih meseci u toku internih testiranja i stvarnoj primeni pokazuje da je problem znatno složeniji nego što se u javnosti mislilo. Nalazi otvaraju i pitanje mogu li vodeće kompanije u sektoru uspostaviti potpunu kontrolu nad svojom tehnologijom. Incidenti uključuju zaobilaženje bezbedonosnih protokola, samostalno pokretanje internetskih foruma za raspravu, izlazak iz okruženja za testiranje, preuzimanje kontrole na veb stranicama i pokušaje izbegavanja nadzora. Slučajevi su se događali i u internim proverama i u stvarnom okruženju, a mnogi još nisu objavljeni jer se još sprovode istrage.

Deo testiranja izvodi se kao tzv. red-teaming, gde kompanije namerno podstiču AI na neprimereno ponašanje da bi proverile njihovu sigurnost. Ispadi su slični onima koje je OpenAI obelodanio poslednjih dana. Uključuju uspešne i neuspešne pokušaje zaobilaženja pravila, a za većinu zasad nije poznato da su uzrokovali štetu u stvarnom svetu. Izvori navode da bi ukupan broj mogao biti znatno veći. Kompanija je objavila da privremeno zaustavlja treniranje svojih najsposobnijih programa. Glasnogovornik je rekao da će s radom nastaviti „tek kada budu ubeđeni da su uveli dodatne zaštitne mere”. Izvršni direktor Sem Altman obznanio je na društvenoj mreži X da interna revizija „ne ide onoliko brzo koliko bi želeli”. Istakao je da je incident s programom Hugging Face najozbiljniji do sada. Grupa od stotinu agenata, naime, koordinisala je delovanje putem foruma i hakirala drugu kompaniju da bi poboljšala vlastite rezultate na testu kibernetičke pouzdanosti.

Kompanija Anthropic je angažovala organizaciju za bezbednost da joj ispita ponašanje programa. U objavljenim dokumentima navela je, na primer, koliko je često njihov program Opus 5.5, reagovao na neobične ili problematične načine. Pokušao je, recimo, da pobegne iz okruženja za ispitivanje u 1,5 posto slučajeva. I napominje da se radilo o eksperimentima u kojima se zadatak nije mogao rešiti bez tog koraka. Budući da ova i druge kompanije izvode stotine hiljada testiranja, čak i mali procenat nepredviđenog ponašanja može rezultirati desetinama hiljada incidenata. Incident s programom Hugging Face, a i niz drugih koji su usledili, podstakli su vodeće ljude u industriji veštačke inteligencije da pozovu na usporavanje razvoja i zatraže strožu nacionalne i međunarodne propise.

Međutim, drugi direktori i istraživači upozoravaju da nemaju puno poverenja u sposobnost kompanija vestačke inteligencije da spreče svako problematično ponašanje. Nova generacija programa izvršava zadatke sa izuzetnom upornošću, pa je pokušaj ograničavanja snalažljivosti često unapred izgubljena bitka. Nemoguće je predvideti svaki način izmicanja kontroli. A čelnici kompanija, pak, ističu da programi često koriste tehnike koje ljudima nikada ne bi pale na pamet da zaobiđu pravila. „Pokušaj sastavljanja savršenog popisa onoga šta se sme, a šta ne, verovatno je uzaludan posao”, podsetio je jedan stručnjak za kibernetičku bezbednost.

„To što smo videli samo je delić celokupne slike”, upozorio je istraživač Konrad Stoc iz nezavisne organizacije za ocenu veštačke inteligencije Transluce. Konor Lihi, istraživač i izvršni direktor organizacije ControlAI, naglašava da problem nije u tome koliku je štetu izazvao svaki pojedinačni slučaj:  „Neverovatno je što se ovde radi o autonomnim sistemima koji čine to šta im je izričito zabranjene”, a potencijalno uključuje i kaznena dela.

(AI ilustracija)

(Indeks)

Visited 23 times, 23 visit(s) today

O autoru

administrator

Ostavite komentar