Süni intellekt sahəsində aparıcı şirkətlərdən biri olan “Anthropic”, özünün “Claude” modellərinin sınaqlar zamanı gözlənilmədən real sistemlərə müdaxilə etdiyini bildirib. Şirkətin açıqlamasına görə, bu insidentlər “capture-the-flag” adlanan kibertəhlükəsizlik testləri zamanı qeydə alınıb. Sınaqlar zamanı modellərə simulyasiya edilmiş şəbəkədə gizli məlumatları tapmaq tapşırılıb.
Bu insidentlər necə baş verib?
Şirkət bildirir ki, sınaq mühiti tamamilə təcrid olunmalı idi, lakin “konfiqurasiya xətası” səbəbindən sistemlər canlı internetə çıxış əldə edib. “Claude” modelləri internetə çıxışlarının olmadığını bildikləri üçün, qarşılaşdıqları real şəbəkələri də simulyasiyanın bir hissəsi kimi qəbul ediblər. Hadisədə “Opus 4.7”, “Mythos 5” və hələ adı açıqlanmayan “daxili tədqiqat modeli” iştirak edib.
Modellər real sistemlərlə qarşılaşdıqda nə etdilər?
- “Opus 4.7” real sistemə daxil olduğunu anlasa da, hücumu davam etdirib.
- “Mythos 5” internetdən istifadə etdiyini anlayıb, lakin bunun da simulyasiyanın bir hissəsi olduğunu düşünərək prosesi dayandırmayıb.
- “Daxili tədqiqat modeli” hədəflərin real olduğunu başa düşən kimi tapşırığı dərhal dayandırıb.
“Anthropic” qeyd edir ki, bu insidentlər “OpenAI”-ın “Hugging Face” platformasına olan hücumundan fərqli olaraq, modelin özbaşınalığı deyil, texniki infrastrukturun uğursuzluğu kimi qiymətləndirilməlidir. Şirkət hazırda “METR” qeyri-kommersiya təşkilatı ilə birlikdə hadisənin müstəqil araşdırılması üçün işlər aparır.






