Öncü Yapay Zeka Modellerini Jailbreak Yapmak Korkutucu Derecede Kolay
2 dk okumawired
PAYLAS:

Kaliforniya merkezli yapay zeka güvenlik kuruluşu FAR.AI tarafından yayımlanan yeni bir rapor, dünyanın en güçlü yapay zeka modellerinden bazılarının güvenlik bariyerlerini aşmanın ne kadar kolay ve ucuz olduğunu gözler önüne serdi. Araştırma, siber saldırı planları veya biyolojik silah tasarımları gibi zararlı içerikler üretmek için modellerin nasıl manipüle edilebileceğini detaylandırıyor.
FAR.AI, sorunlu prompt girdilerini alarak çalışan jailbreak yöntemlerini tespit etmek amacıyla binden fazla farklı versiyon üreten özel bir araç geliştirdi. Bu testlerde, dört büyük ABD'li şirketin öncü modelleri incelendi: Anthropic'in Claude Opus 4.8 ve Fable 5; OpenAI'ın GPT 5.5 ve 5.6; Google'ın Gemini 3.1 Pro ve Elon Musk'ın yeni birleştirdiği SpaceXAI şirketine ait Grok 4.3 ile 4.5 modelleri.
Rapora göre, güvenlik önlemlerini aşmaya karşı en savunmasız model 448 başarılı jailbreak ile Grok olurken, onu 249 vakayla Gemini takip etti. Claude, Fable ve GPT modelleri ise bu spesifik otomatik saldırılara karşı direnç gösterdi. Ancak uzmanlar, bu durumun söz konusu modellerin daha karmaşık jailbreak yöntemlerine karşı tamamen bağışık olduğu anlamına gelmediğini belirtiyor.
Araştırma, başka bir yapay zeka modeli kullanarak otomatik jailbreak üretmenin maliyetini de hesapladı. Sonuçlara göre, Grok'un güvenlik bariyerlerini aşmak sadece 58 dolar, Gemini'yi manipüle etmek ise 278 dolar gibi oldukça düşük maliyetlere mal oluyor. FAR.AI CEO'su Adam Gleave, "Şu anda yapay zeka modelleri restoranlardan daha az denetleniyor" diyerek, şirketlerin kendi kendilerini denetleyeceği yönündeki beklentilerin anlamsız olduğunu vurguladı.
Google DeepMind'ın AGI güvenlik ve uyum direktörü Rohin Shah, tüm jailbreak'lerin aynı derecede tehlikeli olmadığını belirterek, bu sonuçların Gemini'nin güvenliğinin kapsamlı bir değerlendirmesi olarak görülmemesi gerektiğini savundu. Anthropic sözcüsü Michael Aciman ise bulguların güvenlik sistemlerine yaptıkları sürekli yatırımı yansıttığını ifade etti. OpenAI ve SpaceXAI ise konuyla ilgili yorum yapmadı.
ABD'de federal düzeyde henüz spesifik güvenlik gereksinimleri yasalaşmamış olsa da, Kaliforniya ve New York gibi eyaletler öncü yapay zeka geliştiricilerinin güvenlik raporları yayınlamasını zorunlu kılan yasaları onayladı. Illinois eyaleti de yakında şirketlerin güvenlik uygulamalarını üçüncü taraf denetçilere inceletmesini şart koşacak.
Sektördeki bu düzenleme karmaşası sürerken, hükümet müdahaleleri de artıyor. Haziran ayında Trump yönetimi, ulusal güvenlik endişelerini gerekçe göstererek Anthropic'in Fable 5 ve Mythos 5 modellerine ihracat kontrolleri getirmiş ve şirket bu modelleri birkaç haftalığına çevrimdışı bırakmak zorunda kalmıştı. Beyaz Saray ayrıca, yeni siber güvenlik riskleri oluşturabileceği endişesiyle Anthropic ve OpenAI'dan son model sürümlerini ertelemelerini talep etti.
--- **İlgili Kaynaklar:** yapay zeka danışmanlık ve çözüm hizmetleri konusunda [yapay zeka firması](https://yapayzekafirmasi.com) ile iletişime geçebilirsiniz.Dünyanın önde gelen yapay zeka modellerindeki güvenlik açıkları ve ABD'deki yasal düzenleme adımları, Türkiye'deki kurumsal yapay zeka entegrasyonlarını ve gelecekteki yerel regülasyonları etkileyebilir.
Gemini ve Grok gibi modelleri kullanan Türk şirketleri, API entegrasyonlarında veri sızıntılarını önlemek için ek güvenlik katmanlarına ihtiyaç duyabilir.
ABD'deki eyalet bazlı güvenlik denetimi yasaları ve ihracat kontrolleri, Türkiye'deki BTK ve KVKK'nın gelecekteki yapay zeka regülasyonlarına emsal teşkil edebilir.
Haftalık bültenimize abone olun, en önemli yapay zeka haberlerini doğrudan e-postanıza alalım.



