“Meta”nın süni intellekt modelinin təhlükəsizlik göstəricisi kəskin aşağı düşüb
Təhlükəsizlik mexanizmləri aradan qaldırılan süni intellekt modellərinin terror hücumları, terrorizmin maliyyələşdirilməsi və radikallaşma ilə bağlı sorğulara ətraflı cavablar verdiyi aşkarlanıb.
Crossmedia.az xəbər verir ki, bu barədə “CBS” telekanalı məlumat yayıb.
Araşdırma Böyük Britaniyada fəaliyyət göstərən qeyri-kommersiya təşkilatı “Tech Against Terrorism” tərəfindən aparılıb. Tədqiqat çərçivəsində terror hücumu planlaşdıran şəxsin verə biləcəyi yüzlərlə sorğu əsasında 130-dan çox süni intellekt modeli qiymətləndirilib.
Araşdırma zamanı modellərə təhlükəsizlik mexanizmlərini zəiflədən və ya aradan qaldıran, “abliteration” adlandırılan müdaxilə tətbiq edilib. Bu üsul süni intellektin müəyyən sorğuları rədd etmə davranışını aradan qaldırmağa yönəlib.
Nəticələrə görə, sınaqdan keçirilən beş modeldən üçü bu müdaxilədən sonra təhlükəsizlik testlərindən keçə bilməyib. Modellərin ilkin versiyaları bu cür sorğuları rədd etsə də, müdaxilədən sonra terror hücumları, terrorizmin maliyyələşdirilməsi və radikallaşma ilə bağlı müraciətlərə ətraflı cavablar verib.
Araşdırmada nümunə kimi “Meta” şirkətinin “Llama 3.1 8B” modeli göstərilib. Model təhlükəsizlik mexanizmlərinə müdaxilə edilməzdən əvvəl 100 bal üzərindən 97 bal toplasa da, dəyişiklikdən sonra göstəricisi təxminən 3 bala enib.
22:18 10.10.2026
Oxunuş sayı: 72