Moonshot’ın Kimi Modelleri Jailbreak Sonrası Güvenlik Riski Yarattı
Çinli yapay zekâ şirketi Moonshot, popüler Kimi modelleriyle ilgili iç inceleme başlattı. İnceleme, araştırmacıların modelleri güvenlik sınırlarını aşmaya ikna etmesinin ardından geldi.
Yapay zekâ güvenliğini test eden Mindgard, temmuz ayında Kimi K2.6 ve K3 Swarm modellerinde açık tespit ettiğini açıkladı. Araştırmacılar, modellerin biyolojik silah yapımı ve suikast düzenlenmesi hakkında bilgi verdiğini belirtti.
Sorun, yapay zekâ korumalarını aşmayı amaçlayan jailbreak adı verilen yöntemle ortaya çıkarıldı. Mindgard, başarılı jailbreak sonrasında modellerin zararlı konularda öneriler sunduğunu ve yeni, yaratıcı yanıtlar ürettiğini bildirdi.
Mindgard ayrıca jailbroken Kimi K2.6 modelinin bilgisayar kaynaklarında kod çalıştırabileceğini ve internete bağlanabileceğini savundu. Bu durumun, modeli siber saldırılar için olası bir sıçrama noktası hâline getirebileceği belirtildi.
Moonshot, iç değerlendirmelerinde bu tür taleplere karşı modelin genellikle yüksek oranda ret yanıtı verdiğini ifade etti. Mindgard ise bulguları paylaşmadan önce şirkete bilgi verdiğini ve yöntemin kritik ayrıntılarını açıklamadığını söyledi.
Gelişme, kapalı ve tescilli modellerle açık kaynaklı yapay zekâ sistemleri arasındaki güvenlik tartışmasını yeniden gündeme taşıdı. Uzmanlar, açık kaynak modellerin kötüye kullanılabileceğini ancak siber savunmada da değerlendirilebileceğini belirtiyor; uluslararası düzenlemelerin ise yapay zekâdaki hızlı ilerlemeyi yakalamakta zorlanabileceği uyarısında bulunuyor.