ПАНДОРИНА КУТИЈА

ВЕШТАЧKА ИЗМИЧЕ НАДЗОРУ

Visited 23 times, 23 visit(s) today

Нова генерација АI програма извршава задатке са изузетном упорношћу, па је покушај ограничавања сналажљивости често унапред изгубљена битка. Немогуће је предвидети сваки начин измицања контроли. А челници компанија, пак, истичу да програми често користе технике које људима никада не би пале на памет да заобиђу правила.

Компаније ОpenAI, Аnthropic и стручњаци за безбедност истражују десетине хиљада инцидената у којима су њихови програми (модели) вештачке интелигенције (АI) предузели кораке које проценитељи сматрају проблематичним. Према сазнањима сајта за вести Аxios, толики број случајева последњих месеци у току интерних тестирања и стварној примени показује да је проблем знатно сложенији него што се у јавности мислило. Налази отварају и питање могу ли водеће компаније у сектору успоставити потпуну контролу над својом технологијом. Инциденти укључују заобилажење безбедоносних протокола, самостално покретање интернетских форума за расправу, излазак из окружења за тестирање, преузимање контроле на веб страницама и покушаје избегавања надзора. Случајеви су се догађали и у интерним проверама и у стварном окружењу, а многи још нису објављени јер се још спроводе истраге.

Део тестирања изводи се као тзв. ред-теаминг, где компаније намерно подстичу АI на непримерено понашање да би провериле њихову сигурност. Испади су слични онима које је ОpenAI обелоданио последњих дана. Укључују успешне и неуспешне покушаје заобилажења правила, а за већину засад није познато да су узроковали штету у стварном свету. Извори наводе да би укупан број могао бити знатно већи. Kомпанија је објавила да привремено зауставља тренирање својих најспособнијих програма. Гласноговорник је рекао да ће с радом наставити „тек када буду убеђени да су увели додатне заштитне мере”. Извршни директор Сем Алтман обзнанио је на друштвеној мрежи X да интерна ревизија „не иде онолико брзо колико би желели”. Истакао је да је инцидент с програмом Hugging Face најозбиљнији до сада. Група од стотину агената, наиме, координисала је деловање путем форума и хакирала другу компанију да би побољшала властите резултате на тесту кибернетичке поузданости.

Kомпанија Аnthropic је ангажовала организацију за безбедност да јој испита понашање програма. У објављеним документима навела је, на пример, колико је често њихов програм Оpus 5.5, реаговао на необичне или проблематичне начине. Покушао је, рецимо, да побегне из окружења за испитивање у 1,5 посто случајева. И напомиње да се радило о експериментима у којима се задатак није могао решити без тог корака. Будући да ова и друге компаније изводе стотине хиљада тестирања, чак и мали проценат непредвиђеног понашања може резултирати десетинама хиљада инцидената. Инцидент с програмом Hugging Face, а и низ других који су уследили, подстакли су водеће људе у индустрији вештачке интелигенције да позову на успоравање развоја и затраже строжу националне и међународне прописе.

Међутим, други директори и истраживачи упозоравају да немају пуно поверења у способност компанија вестачке интелигенције да спрече свако проблематично понашање. Нова генерација програма извршава задатке са изузетном упорношћу, па је покушај ограничавања сналажљивости често унапред изгубљена битка. Немогуће је предвидети сваки начин измицања контроли. А челници компанија, пак, истичу да програми често користе технике које људима никада не би пале на памет да заобиђу правила. „Покушај састављања савршеног пописа онога шта се сме, а шта не, вероватно је узалудан посао”, подсетио је један стручњак за кибернетичку безбедност.

„То што смо видели само је делић целокупне слике”, упозорио је истраживач Kонрад Стоц из независне организације за оцену вештачке интелигенције Тranslucе. Kонор Лихи, истраживач и извршни директор организације ControlAI, наглашава да проблем није у томе колику је штету изазвао сваки појединачни случај:  „Невероватно је што се овде ради о аутономним системима који чине то шта им је изричито забрањене”, а потенцијално укључује и казнена дела.

(АI илустрација)

(Индекс)

Visited 23 times, 23 visit(s) today

О аутору

administrator

Оставите коментар