Çinli yapay zeka geliştiricisi Moonshot, araştırmacıların modellerini biyolojik silahların nasıl üretileceği ve suikastların nasıl gerçekleştirileceği konusunda yönlendirmeyi başarmasının ardından 30 Eylül 2026 tarihinde dahili inceleme başlatıyor.

Mindgard keşfi ve jailbreak süreci nasıl işledi?

Yapay zeka sistemlerinin güvenliğini test eden Mindgard, temmuz ayında Kimi K2.6 ve K3 Swarm modellerinin geliştiriciler tarafından yerleştirilen güvenlik sınırlarını aşabildiğini keşfettiğini bildirdi. Bu durum, araştırmacıların yapay zeka araçlarının koruma önlemlerini devre dışı bırakıp bırakmadığını görmek için bir dizi karmaşık talimat kullandığı jailbreak yani sistem kısıtlamalarını aşma adı verilen süreçte ortaya çıktı. Mindgard, bu önlemlerin Kimi isimli modelin endişe verici konuları tartışmasını engellemesi gerektiğini kaydetti.

Moonshot ve Mindgard şirketlerinin açıklamaları ne?

Moonshot, daha iyi ve daha güvenli yapay zeka oluşturmanın temel direği olarak üçüncü taraf katkılarını memnuniyetle karşıladıklarını bildirdi ve şirket ayrıca bulgular hakkında Mindgard ile iletişim halinde olduğunu aktardı. Mindgard, Kimi'nin hassas konular hakkında verdiği yanıtların işe yarayıp yaramadığını kanıtlamazken, koruma önlemlerinin söz konusu modellerin kullanıcılarla bu tür konularda tartışmaya girmesini engellemesi gerektiğini savundu. Şirket ayrıca, kilidi kırılmış Kimi 2.6 modelinin korsanların bilgi işlem kaynakları üzerinde kod çalıştırmasına ve internete bağlanmasına izin verebileceğinden ve bunun da siber saldırılar için potansiyel bir rampa olabileceğinden emin olduğunu bildirdi.

Yapay zeka endüstrisindeki güvenlik tartışmaları sürüyor mu?

Bulgular, yapay zeka endüstrisinin OpenAI şirketinin ChatGPT sistemine ve Anthropic şirketinin Claude sistemlerine güç veren kapalı ve tescilli modellerin mi yoksa açık kaynaklı araçların mı en iyi veya en güvenli yol olduğu konusunda bölünmeye devam ettiği bir dönemde ortaya çıktı. Surrey Üniversitesinden Profesör Alan Woodward, açık kaynaklı modellerin yanlış ellerin başına geçme riski bulunduğunu ancak aynı zamanda siber savunma için de kullanılabileceğini söyledi ve uluslararası düzenlemelerin yapay zekanın gelişim hızına ayak uydurmasının olası olmadığını kaydetti.