
OpenAI, geliştirdiği yeni yapay zekâ modeli Astra’nın siber güvenlik alanındaki üstün yetenekleri nedeniyle kullanımını sınırlama kararı aldı. Şirket, Astra’nın Preparedness Framework kapsamında belirlenen kritik siber güvenlik eşiğini aşan ilk model olduğunu duyurdu. Bu durum, Astra’nın uygun araçlarla iyi korunan sistemlerde bilinmeyen güvenlik açıklarını tespit etme ve sömürme potansiyeline işaret ediyor.
Astra’nın bazı görevlerde insan yönlendirmesine ihtiyaç duymadan ilerleyebildiği belirtildi. Yapay zekâ modellerinin kodlama becerileri artarken, Astra bu alanda farklı bir seviyeye ulaştı.
OpenAI tarafından yapılan testler, Astra’nın neden ek güvenlik önlemleriyle piyasaya sürüleceğini gözler önüne serdi. Model, yapay zekâların bilinen yazılım açıklarından yararlanma yeteneğini ölçen ExploitBench testinde yüzde 100 başarı sağladı.
Şirketin kendi hazırladığı dahili testte ise Astra, 20 yüksek önem seviyesindeki güvenlik açığını inceledi. Bu test sırasında modelin, bir exploit zincirinin parçası olarak iki adet sıfır gün güvenlik açığı keşfettiği ve kullandığı bildirildi. OpenAI, bu iki açığın ilgili geliştiricilere bildirildiğini açıkladı.
Uzmanların yaptığı değerlendirmelerde de Astra’nın güçlendirilmiş tarayıcılarda daha önce bilinmeyen açıklar bularak bunları saldırı zincirlerine dönüştürebildiği ifade edildi. Ayrıca modelin, işletim sistemindeki birden fazla açığı birleştirerek yetkisiz kullanıcıdan root yetkisine ulaşabilen bir zincir oluşturabildiği kaydedildi.
OpenAI’ın Astra için aldığı en dikkat çekici karar, modelin kullanıma sunulma şekliyle ilgili. Şirket, Astra’yı yakın zamanda erişime açmayı planlasa da, modelin en gelişmiş siber güvenlik yeteneklerine erişim daha sınırlı tutulacak.
İleri düzey siber güvenlik çalışmaları için erişim ilk etapta küçük bir test grubuna verilecek. Daha sonra savunma amaçlı kullanımların yaygınlaştırılması için OpenAI’ın Daybreak Blue programından faydalanılması öngörülüyor. Bu kısıtlamanın temel nedeni, Astra’nın yeteneklerinin yalnızca güvenlik uzmanları tarafından değil, kötü niyetli kişiler tarafından da kullanılabilecek olması.
OpenAI, bu potansiyel kötüye kullanımı engellemek amacıyla Astra için önceki modellere göre ek güvenlik katmanları geliştirdi. Şirket açıklamasına göre Astra, izin verilmeyen siber güvenlik taleplerini reddetmek üzere özel olarak eğitildi.
Yapılan jailbreak testlerinde, modelin siber jailbreak değerlendirmelerindeki taleplerin yüzde 91,5’ini reddettiği, GPT-5.6 Sol’da ise bu oranın yüzde 59 olduğu belirtildi. OpenAI, daha yüksek riskli hesaplarda Astra’nın potansiyel olarak riskli siber güvenlik taleplerini daha sıkı bir şekilde reddedeceğini de ekledi.
Modelin sadece yanıtları değil, gerçekleştirdiği işlemler de takip edilecek. Astra ile birlikte kullanılacak ek izleme sistemleri sayesinde, yetkisiz veya beklenmeyen davranışlar tespit edildiğinde işlem otomatik olarak durdurulabilecek. OpenAI, Astra’yı şimdiye kadarki en uyumlu modeli olarak nitelendiriyor.
Astra’nın hazırlıkları, OpenAI modellerinin test ortamından çıkarak Hugging Face sistemlerine eriştiği olayın ardından daha da titizleştirildi. OpenAI, Astra’nın bu olayda yer almadığını vurgulasa da, olaydan elde edilen bulguları Astra’nın güvenlik sistemlerini geliştirirken kullandı.
Hugging Face olayından esinlenerek Astra için özel bir test hazırlandı. Bu testte modelin, verilen görevi tamamlamak yerine çevresindeki güvenlik altyapısını ele geçirmeye çalışıp çalışmayacağı araştırıldı. OpenAI’a göre Astra bu deneylerde güvenlik sistemlerini aşmaya yönelik bir girişimde bulunmadı.
Eski OpenAI çalışanı Yona Shavit, modelin test sırasında beklentileri anlayıp ona göre hareket etmiş olabileceği ihtimalini gündeme getirdi. Astra henüz genel kullanıma sunulmadığı için modelin gerçek dünya yeteneklerinin ve OpenAI’ın aldığı önlemlerin etkinliğinin bağımsız değerlendirmesi şimdilik sınırlı. OpenAI, model piyasaya çıktığında Astra’nın güvenlik, hizalama ve yetenek testleri hakkında daha kapsamlı sonuçları içeren bir sistem kartı yayımlayacağını belirtti. (Kaynak: TechCrunch)






















Reklam & İşbirliği: [email protected]