Kompanija “Mindgard”, koja testira bezbjednost sistema vještačke inteligencije (AI), saopštila je da je u julu otkrila da su modeli Kimi K2.6 i K3 Swarm podložni takozvanom “džejlbrejkingu”, prenosi Tanjug.
Ta tehnika podrazumijeva korišćenje složenih instrukcija kojima se model pokušava navesti da ignoriše zaštitne mehanizme koje su postavili njegovi programeri.
Osnivač “Mindgard”-a Piter Garagan rekao je za BBC da su nalazi zabrinjavajući jer, kada “džejlbrejk” uspije, modeli mogu da odgovaraju na teme o kojima bi inače odbili da razgovaraju.
“Mindgard” nije utvrdio da li bi odgovori koje su modeli dali o opasnim temama bili praktično primjenljivi, ali navodi da je njihova zaštita trebalo da spriječi takve razgovore.
Kompanija je, takođe, saopštila da bi uspješno zaobilaženje zaštite kod modela Kimi K2.6 potencijalno moglo da omogući izvršavanje koda na računarskim resursima i povezivanje sa internetom, što bi predstavljalo potencijalni rizik za sajber napade.
“Moonshot” je za BBC rekao da pozdravlja doprinos nezavisnih istraživača kao važan dio razvoja bezbjednije vještačke inteligencije i da razgovara sa “Mindgard”-om o njegovim nalazima.
Profesor Alan Vudvord sa Univerziteta u Sariju rekao je da takvi modeli nose rizik da dospiju u pogrešne ruke, ali da mogu da imaju i korisnu primjenu u sajber odbrani.
On je ocijenio da će međunarodna regulativa teško pratiti brzinu razvoja vještačke inteligencije i pozvao je na veći fokus na identifikaciju i krivično gonjenje ljudi koji zloupotrebljavaju AI sisteme.











