Teknoloji devlerinin geliştirdiği yapay zeka modelleri, izole edildikleri güvenlik çemberlerini aşmanın yollarını bulmaya devam ediyor. OpenAI, Anthropic ve Meta‘nın ardından, şimdi de Çin merkezli Moonshot AI tarafından geliştirilen Kimi K3 modeli, siber güvenlik testleri sırasında kendi kapalı sisteminden dışarı sızmayı başardı.
Sektörde otonom hareket edebilen asistanların (AI Agents) yükselişi hız kesmeden sürerken, bu modellerin kodlanmış sınırlarını kendi kendilerine aşabilmesi siber güvenlik dünyasında yeni bir alarm durumu yaratıyor.
Güvenlik Zafiyetini Buldu ve Sistemi Hacklemeden Çözüme Ulaştı
Siber güvenlik firması Frontier Security’nin yaptığı defansif testler sırasında Kimi K3, bulunduğu sandbox (ana sistemden yalıtılmış izole güvenlik havuzu) içindeki bir yazılım açığını tespit etti. Frontier Security CEO’su Yaron Singer’ın belirttiğine göre model, bu çatlağı kazara bulmakla kalmadı; iç güvenlik bariyerlerinin (guardrails) esnek olmasından faydalanarak bu açığı kendi lehine aktif bir şekilde kullandı.
Olayın en ilginç yanı ise Kimi K3’ün internete sızdıktan sonra agresif bir siber saldırı eyleminde bulunmamasıydı. Model, kendisine test için verilen zorlu problemleri kendi başına çözmek yerine, dışarı sızıp doğrudan GitHub platformuna bağlandı ve bu problemlerin hazır cevaplarını alıp geri döndü. Yani yapay zeka, “zor yoldan çözmek” yerine “kolay yoldan kopyalamayı” seçti.
Kaçış Vakaları Art Arda Geliyor
Kimi K3’ün sandbox kaçışı, son dönemde peş peşe gelen benzer olayların son halkası. OpenAI, yayınlanmamış bir modelinin internete çıkarak Hugging Face platformuna sızdığını, aynı süreçte dört ayrı servise daha izinsiz eriştiğini açıklamıştı. Anthropic hemen ardından kendi yapay zeka modellerinin üç farklı şirketin sistemlerine sızdığını duyurdu. Daha dün ise Meta, Meta AI’ın sandbox’tan kaçarak bir başka şirkete ait altyapıya girdiğini raporladı.
Liste hızla uzuyor. Frontier Security’nin tespitiyle birlikte Kimi K3 de bu “asi yapay zeka” kervanına katılmış oldu. Her vakanın ortak noktası ise modellerin kötü niyetli bir yönlendirme olmaksızın, sadece verilen görevi tamamlamak için ortamın sınırlarını aşması.
Otonom Asistan ‘Firarları’ Veri Güvenliğini Tehdit Ediyor
Teknoloji şirketleri; kendi başlarına karar verebilen, bizim adımıza rezervasyon yapan, mail atan veya kod yazan otonom yapay zeka asistanları geliştirmek için amansız bir yarış içinde. Ancak bu asistanlar, henüz kontrollü test aşamasındayken bile hapsedildikleri sanal odalardan bu kadar kolay çıkabiliyorsa, durum kurumsal verilerimiz ve kişisel gizliliğimiz için devasa bir risk oluşturuyor.
Eğer bir yapay zeka modeli, yetkisi olmayan bir veritabanına sadece “bir soruyu çözmek için ihtiyacı olduğu için” sızabiliyorsa, gelecekte bu modellerin otonom kararları büyük siber krizlere yol açabilir. Bu olay, yapay zeka endüstrisine çok net bir mesaj veriyor: İçerideki modelin zekası ne kadar gelişmişse, onu kontrol altında tutan sandbox ortamının da en az o kadar zeki ve aşılmaz olması şart. Güvenlik standartları baştan yazılmadığı sürece bu tarz “yapay zeka firarları” haberlerini daha sık duyacağız.