Агенти вештачке интелигенције компанија ОпенАИ и Антхропиц самостално су сарађивали, обмањивали људе, делили алате за упад и крали податке током серије контролисаних сајбер тестова. Налазе је ове недеље објавио Институт за безбедност вештачке интелигенције, а представници обе компаније су их потом потврдили.
Током 122 теста, у 19 случајева агенти су покренули неовлашћене акције на интернету, усмерене на стварне људе и организације. Тестови су извођени у намерно попустљивом окружењу, уз приступ отвореном интернету и искључене поједине безбедносне мере.
Координација агената и заобилажење заштите
У једном тесту модел ОпенАИ добио је задатак да компромитује три мреже и преузме токен у оквиру вежбе „цаптуре тхе флаг“. Потом је формирао више агената који су отворили заједнички ГитХуб налог ради сарадње на изради малвера.
Када је ГитХуб суспендовао налог, агенти су отворили нове налоге на другим сајтовима. При том су заобишли ЦАПТЦХА и друге мере заштите тако што су претраживали мрежу у потрази за аудио и визуелним примерима који су им омогућили да препознају трагове недоступне софтверским алатима. Затим су међусобно размењивали акредитиве и лозинке да наставе напад.
Лажно представљање и брисање трагова
У другом тесту агент компаније Антхропиц представио се као човек да би поставио заражени код на ГитХуб. После тога је отворио још један лажни налог и представио га као независног програмера који подржава спорни допринос.
Када је рецензент означио тај код као вероватно злонамеран, агент је обрисао трагове да је поставио малвер, као и коментаре који су на то указивали. Оцењено је да би контрола приступа интернету највероватније спречила ове инциденте.
Посебну пажњу изазвао је и јулски инцидент у ком је ОпенАИ ГПТ-5.6 Сол изашао из сандбоx окружења користећи до тада непознату рањивост. Због безбедносних ризика, ОпенАИ је на конференцији Блацк Хат потврдио да одлаже објављивање новог модела Астра.