Çinli yapay zekada korkutan açık: Biyolojik silah ve suikast alarmı

Çinli yapay zeka geliştiricisi Moonshot, Kimi modellerinin güvenlik sınırlarının aşılarak biyolojik silah üretimi ve suikast gibi konularda yanıt vermeye yönlendirildiğine ilişkin bulgular üzerine dahili inceleme başlatıyor. Açığı tespit eden Mindgard, modellerin siber saldırılar için de kullanılabileceği uyarısında bulundu.

Yapay zeka sistemlerinin güvenliğini test eden Mindgard, Moonshot tarafından geliştirilen Kimi K2.6 ve K3 Swarm modellerinde güvenlik açıkları tespit ettiğini duyurdu. Şirket, temmuz ayında yapılan testlerde modellerin geliştiriciler tarafından yerleştirilen koruma önlemlerini aşan yanıtlar üretebildiğini bildirdi.Araştırmacılar, karmaşık talimatlar kullanarak yapay zeka araçlarını biyolojik silah üretimi ve suikastların gerçekleştirilmesi gibi tehlikeli konularda yanıt vermeye yönlendirdiklerini belirtti.GÜVENLİK SINIRLARI AŞILDIBulgular, yapay zeka sistemlerinin kısıtlamalarını aşmayı amaçlayan ve "jailbreak" olarak adlandırılan güvenlik testleri sırasında ortaya çıktı.Mindgard, modellerdeki koruma önlemlerinin bu tür zararlı taleplere yanıt verilmesini engellemesi gerektiğini vurguladı.

Bununla birlikte şirket, Kimi'nin ürettiği yanıtların uygulanabilirliğini veya işe yarayıp yaramadığını kanıtlamadığını da belirtti.MOONSHOT İNCELEME BAŞLATIYORMoonshot, bulgular üzerine dahili inceleme başlatacağını ve Mindgard ile iletişim halinde olduğunu açıkladı.Şirket, üçüncü tarafların katkılarını daha iyi ve daha güvenli yapay zeka sistemleri geliştirmenin temel unsurlarından biri olarak gördüğünü bildirdi.SİBER SALDIRILAR İÇİN KULLANILABİLİR UYARISIMindgard'ın dikkat çektiği riskler, modellerin tehlikeli içerikler üretmesiyle sınırlı kalmadı.Şirket, güvenlik kısıtlamaları aşılan Kimi K2.6'nın, saldırganların bilgi işlem kaynakları üzerinde kod çalıştırmasına ve internete bağlanmasına olanak sağlayabileceğini savundu.

Bu yeteneklerin siber saldırılar için bir başlangıç noktası olarak kullanılabileceği uyarısında bulundu.AÇIK KAYNAK VE GÜVENLİK TARTIŞMASIBulgular, yapay zeka sektöründe açık kaynaklı sistemler ile kapalı ve tescilli modellerin güvenliği konusundaki tartışmaları yeniden gündeme taşıdı.Sektörde, ChatGPT ve Anthropic'in Claude sistemlerine güç veren kapalı modeller ile açık kaynaklı araçlardan hangisinin daha güvenli bir geliştirme yolu sunduğu konusunda farklı görüşler bulunuyor.Surrey Üniversitesinden Prof.

Alan Woodward, açık kaynaklı modellerin kötü niyetli kişilerin eline geçme riski taşıdığını, ancak aynı teknolojilerin siber savunma amacıyla da kullanılabileceğini söyledi.Woodward, uluslararası düzenlemelerin yapay zekanın gelişim hızına ayak uydurmasının ise olası görünmediğini belirtti.

İLGİLİ HABERLER