"OpenAI" şirkəti, öz süni intellekt modelinin "Hugging Face" platformasına qeyri-qanuni müdaxilə etməsi ilə nəticələnən insidentdən sonra təhlükəsizlik protokollarını əsaslı şəkildə yeniləyib. Şirkət, tədqiqat mühitlərinin izolyasiyasını gücləndirib və potensial təhlükəli iş yüklərinin internetlə əlaqəsini kəsmək üçün yeni nəzarət mexanizmləri tətbiq edib. Bu addımlar, gələcək modellərin, xüsusilə də "Astra" kimi kritik kibertəhlükəsizlik imkanlarına malik layihələrin təhlükəsizliyini təmin etmək məqsədi daşıyır.
Təhlükəsizlik tədbirləri necə gücləndirilir?
Yeni strategiyaya əsasən, "OpenAI" tədqiqat prosesində istifadə olunan "sandbox" mühitlərini daha etibarlı hala gətirib. Şirkət, şübhəli fəaliyyət aşkar edildikdə 30 dəqiqə ərzində xəbərdarlıq göndərilməsini və əgər təhlükənin saxta olduğu dərhal təsdiqlənməzsə, həmin prosesin dərhal dayandırılmasını tələb edir. Bundan əlavə, ən son modellərin təlimi zamanı gücləndirici öyrənmə (RL) prosesində iki həftəlik fasilə tətbiq edilib.
Süni intellektin təlimi və monitorinqi
"OpenAI" həmçinin süni intellektin təlim prosesində "əsas uyğunlaşdırma texnikalarını" genişləndirdiyini bildirib. Bu yeniliklər, modellərin təhlükəli davranışlarını aşkar edən mükafatlandırma mexanizmlərini və onların öz imkanları barədə daha dürüst olmasını təmin edir. Qeyd edək ki, "Hugging Face" insidentindən sonra "Anthropic" və "Meta" kimi nəhəng şirkətlər də öz modellərinin oxşar təhlükəsizlik boşluqlarına malik olduğunu müəyyən ediblər.






