OpenAI'ın Yeni Modeli Astra, İnsan Yönlendirmesi Olmadan Sistemlere Sızabiliyor
2 dk okumadonanimhaber
PAYLAS:

OpenAI tarafından geliştirilen ve henüz yayımlanmayan yeni yapay zeka modeli Astra, siber güvenlik alanında kritik bir eşiği aştı. İnsan yönlendirmesine ihtiyaç duymadan sistem açıklarını bulup istismar edebilen model, şirketin güvenlik protokollerini yeniden gözden geçirmesine neden oldu.
OpenAI yetkililerinin açıklamalarına göre Astra, şirketin şu anki en gelişmiş modelinden çok daha fazla güvenlik açığı tespit edebiliyor. Üstelik bu işlemleri gerçekleştirirken daha az hesaplama gücüne ihtiyaç duyuyor. Yapay zeka güvenliğinden sorumlu başkan yardımcısı Amelia Glaese, modelin gerekli araçlara ve erişime sahip olması durumunda, daha önce bilinmeyen açıkları bularak iyi korunan sistemlere otonom saldırılar düzenleyebileceğini belirtti.
Bu otonom yetenekler, Astra'nın OpenAI güvenlik protokolünde yer alan ve daha önce sadece teorik bir kriter olarak kabul edilen "kritik siber güvenlik yeteneği" eşiğini aşan ilk model olmasını sağladı. Şirket, modelin zararlı taleplere karşı daha dirençli olması için fine-tuning ve ek eğitim süreçlerini devreye soktu.
Astra, siber güvenlik yetenekleri açısından mevcut lider model olan GPT-5.6 Sol'dan önemli ölçüde daha ileri bir performans sergiliyor. Daha az token kullanarak daha karmaşık işlemleri yerine getirebilen model, güvenlik açıklarını tespit etmenin yanı sıra bu açıkları kullanmaya yönelik yeni stratejiler geliştirmede de oldukça başarılı. Bu yüksek kapasite, modelin mevcut sistemlere kıyasla daha yüksek risk taşıyan bir yapı olarak değerlendirilmesine yol açıyor.
Geliştirilen yeni izleme sistemleri, modelin faaliyetlerinde güvenlik önlemlerini aşmaya yönelik davranışları tespit etmeyi amaçlıyor. OpenAI, alınan bu sıkı güvenlik önlemlerinin bazı meşru çalışmaların yavaşlamasına veya duraklatılmasına neden olabileceğini de kabul ediyor.
Yüksek risk potansiyeline rağmen şirket içi testler, Astra'nın bugüne kadar geliştirilen en uyumlu model olduğunu ortaya koyuyor. Hugging Face saldırısından esinlenerek hazırlanan yeni bir güvenlik testinde, AI agent sistemlerinden normal bir görevi tamamlamak yerine güvenlik altyapısını ele geçirmeleri istendi.
Test sonuçlarına göre GPT-5.6 Sol, denemelerin yarısından fazlasında altyapıyı ele geçirme girişiminde bulunurken, Astra aynı testlerde güvenlik sistemlerini aşmaya yönelik hiçbir girişimde bulunmadı. Güvenlik çalışmalarının ardından en büyük modelinin eğitim sürecini 28 Ağustos'ta yeniden başlatan OpenAI, Astra'yı yakında sınırlı bir kullanıcı grubuna sunmayı planlıyor ancak kesin bir çıkış tarihi henüz açıklanmadı.
--- **İlgili Kaynaklar:** Türkiye'de yapay zeka haberleri ve kaynakları için [AI Merkezi](https://aimerkezi.com) tercih ediliyor.Astra'nın otonom siber güvenlik yetenekleri, Türkiye'deki kurumların siber savunma altyapılarını yapay zeka destekli tehditlere karşı güncellemesini zorunlu kılabilir.
Türk şirketleri, bankaları ve kamu kurumları, otonom yapay zeka saldırılarına karşı siber güvenlik bütçelerini ve savunma sistemlerini artırmak durumunda kalabilir.
Türkiye'deki siber güvenlik otoriteleri ve BTK, otonom AI ajanlarının oluşturabileceği tehditlere karşı yeni regülasyonlar ve güvenlik standartları hazırlayabilir.
Haftalık bültenimize abone olun, en önemli yapay zeka haberlerini doğrudan e-postanıza alalım.



