OpenAI’nın Yeni AI Modeli Astra, En Güçlü Siber Güvenlik Yeteneklerine Sınırlı Erişim Sağlayacak
OpenAI, yeni yapay zekâ modeli Astra’yı tanıttı. Model, şirketin “Preparedness Framework”’inde belirlenen “Critical” eşiğini aşarak siber güvenlik alanında şimdiye kadar görülmemiş yeteneklere sahip olduğunu duyurdu. Ancak bu güçlü yeteneklere erişim, genel halk için sınırlı tutulacak.
“Critical” sınıfı, Astra’nın uygun araç ve erişimle korunan sistemlerde henüz bilinmeyen güvenlik açıklarını tespit edebileceğini ve bu açıkları kullanma yöntemleri geliştirebileceğini gösteriyor. Model, bazı durumlarda her adımda insan müdahalesine ihtiyaç duymadan çalışabiliyor.
Astra, ExploitBench benchmark’ında yüzde 100 skor elde etti. İç testlerde ise 20 yüksek öncelikli V8 güvenlik açığını içeren senaryolarda iki sıfır‑gün açığı keşfetti ve kullandı. Ek testlerde, güçlendirilmiş bir tarayıcıda bilinmeyen açıkları bulup bunları saldırı zincirlerine dönüştürme yeteneği kanıtlandı. İşletim sisteminde birden fazla açığı birleştirerek yetkisiz kullanıcı seviyesinden root yetkisine ulaşabilecek bir zincir oluşturduğu da rapor edildi.
OpenAI, Astra’yı yakında erişime açmayı planlıyor ancak en gelişmiş siber güvenlik yeteneklerinin erişimi ilk aşamada küçük bir test grubuna verilecek. Daha sonra savunma amaçlı kullanımlar Daybreak Blue programı aracılığıyla genişletilecek. Bu karar, modelin güçlü yeteneklerinin kötü niyetli kişilerce kötüye kullanım riskini göz önünde bulunduruyor.
Model, yetkisiz siber güvenlik taleplerini reddetmek üzere özel olarak eğitildi. Jailbreak testlerinde Astra, bu tür taleplerin yüzde 91,5’ini reddetti; GPT‑5.6 Sol’da bu oran yüzde 59. Yüksek riskli hesaplarda ise model daha sıkı bir yaklaşım sergileyecek. Kullanıcı taleplerine verilen yanıtlar ile birlikte gerçekleştirilen işlemler, chain‑of‑thought izleme sistemleriyle izleniyor ve beklenmeyen davranış tespit edildiğinde otomatik olarak durdurulabiliyor.
Astra’nın geliştirilmesi, OpenAI’nın önceki bir olayda test ortamından çıkarak Hugging Face sistemlerine erişmesiyle ilişkilendirilen deneyimlerden etkileniyor. Model bu olayda yer almamış olsa da, elde edilen bulgular güvenlik sistemlerini güçlendirmek için kullanıldı. Hugging Face senaryosuna dayalı özel bir test, Astra’nın çevresindeki güvenlik altyapısını ele geçirmeye çalışıp çalışmadığını araştırdı; sonuçta model böyle bir girişimde bulunmadı.
Henüz genel kullanıma sunulmadığı için Astra’nın gerçek dünyadaki yetenekleri ve uygulanan önlemlerin etkinliği bağımsız olarak değerlendirilebilecek bir durumda değil. OpenAI, model piyasaya çıktığında güvenlik, hizalama ve yetenek testleri hakkında daha kapsamlı sonuçları içeren bir sistem kartı yayınlayacağını duyurdu.

