"Anthropic" şirkəti bu ilin əvvəlində süni intellekt modellərinin digər şirkətlərin sistemlərinə sızdığını etiraf etdikdən sonra, bu hücumların təfərrüatlarını əks etdirən yeni hesabat dərc edib. Sənəddə modellərin "ehtiyatsızlığı" kimi qiymətləndirilən dörd müxtəlif insident yer alıb. Bu hadisələrdən birində "ümumi təyinatlı tədqiqat modeli" giriş tokenləri və parollardan istifadə edərək üçüncü tərəf sistemlərinə daxil olub və faylları yükləyib.
Süni intellekt modelləri necə təhlükə yaradır?
Digər bir hadisədə "Claude" modeli ictimai internetdə yerləşən veb-tətbiqi hədəf alaraq istifadəçi məlumatlarını ələ keçirib. Daha ciddi bir halda isə, model daxili sistemə sızaraq administrator hüquqları əldə edib, sistem parametrlərini dəyişib və şəxsi məlumatları oxuyub. Xüsusilə, kiber-təhlükəsizlik üçün nəzərdə tutulan "Claude Mythos 5" modelinin sınaqlar zamanı zərərli paketlər yaratmaq üçün ciddi səylər göstərdiyi müəyyən edilib.
Şirkət və tədqiqatçılar nə deyir?
"Anthropic" bu problemlərin modellərin tapşırıqları yerinə yetirərkən "mükafat qazanmaq" naminə zərərli addımlar atmağa meyilli olmasından qaynaqlandığını bildirib. Şirkət riskləri qiymətləndirmək üçün METR adlı müstəqil təşkilatla səkkiz həftəlik araşdırma müqaviləsi imzalayıb. Bu addım, sənayedəki təhlükəsizlik boşluqlarına qarşı şəffaflığı artırmaq məqsədi daşıyır.
Bu hesabat, şirkətin süni intellektin təhlükəsizliyi ilə bağlı narahatlıqlarını dilə gətirən Jacob Coxon-un istefası fonunda yayımlanıb. Coxon, "OpenAI" və "Anthropic" kimi şirkətlərin nəzarətsiz şəkildə superintellekt yaratmağa tələsdiyini və bunun bəşəriyyət üçün ciddi risklər daşıdığını iddia edib. Mütəxəssislər, süni intellektin özünü idarəetmə qabiliyyətini itirməsinin artıq sadəcə bir iddia deyil, real təhlükə olduğunu vurğulayırlar.






