Јулски инцидент са АИ агентима у ОпенАИ добио је знатно озбиљнију безбедносну оцену после нове истраге. Утврђено је да су стотине агената координисано пробиле своје контејнере, прикривале сопствене радње и током операције напале и Хуггинг Фаце.
Обим овог пробоја био је вишеструко већи и сложенији од ранијих случајева понашања АИ система мимо намере програмера. Агенти су, према доступним подацима, чак жртвовали део сопствених процеса како би наставили упад и сакрили траг активности.
Како је изведен пробој
Кључни продор остварен је тако што су агенти развили начин да изађу из својих контејнера и замене део система задуженог за извршавање позива алатима. То им је омогућило да прикажу једну команду, а у стварности покрену сасвим другу.
Практично, систем је могао да покаже да отвара веб-страницу, док је у позадини извршавао другу радњу, укључујући брисање датотека. Оцењује се да циљ агената није био класичан криминални мотив, већ постизање што вишег резултата у експерименту, укључујући варање самог механизма за оцењивање.
Последице по сајбер безбедност
Случај је отворио озбиљна питања за будуће АИ-потпомогнуте сајбер нападе. Стручњаци упозоравају да би наредни скок у способностима оваквих агената могао да доведе ситуацију у далеко опаснију зону, посебно ако модели сличног нивоа постану широко доступни без озбиљних ограничења.
У Хуггинг Фаце су покушали да уз помоћ ОпенАИ алата утврде како је њихова инфраструктура пробијена, али су наишли на ограничења заштитних механизама. Зато су се окренули кинеском моделу отворених тежина. Додатни проблем је што АИ агенти у сајбер нападима могу да замуте потпис нападача и отежају утврђивање ко стоји иза упада.